Scienza dei dati

Domande e risposte per i professionisti della scienza dei dati, gli specialisti di Machine Learning e coloro che sono interessati a saperne di più sul campo


5
Come unire i dati mensili, giornalieri e settimanali?
Google Trends restituisce i dati settimanali, quindi devo trovare un modo per unirli con i miei dati giornalieri / mensili. Quello che ho fatto finora è stato di suddividere ogni serie in dati giornalieri, ad esempio: a partire dal: 2013-03-03 - 2013-03-09 37 per: 2013-03-03 37 2013-03-04 37 2013-03-05 37 …


3
Gli algoritmi di riduzione delle mappe scritti per MongoDB possono essere trasferiti su Hadoop in un secondo momento?
Nella nostra azienda, abbiamo un database MongoDB che contiene molti dati non strutturati, sui quali dobbiamo eseguire algoritmi di riduzione delle mappe per generare report e altre analisi. Abbiamo due approcci tra cui scegliere per l'implementazione delle analisi richieste: Un approccio consiste nell'estrarre i dati da MongoDB in un cluster …


4
Algoritmo per la generazione di regole di classificazione
Quindi abbiamo il potenziale per un'applicazione di machine learning che si adatta abbastanza bene al tradizionale dominio problematico risolto dai classificatori, cioè abbiamo un insieme di attributi che descrivono un elemento e un "secchio" in cui finiscono. Tuttavia, piuttosto che creare modelli di probabilità come in Naive Bayes o classificatori …

2
Dropout su quali livelli di LSTM?
Utilizzando un multi-layer LSTMcon dropout, è consigliabile inserire il dropout su tutti i layer nascosti e sui layer Dense di output? Nel documento di Hinton (che proponeva il Dropout) metteva il Dropout solo sui livelli Dense, ma ciò era dovuto al fatto che gli strati interni nascosti erano convoluzionali. Ovviamente, …

1
Come utilizzare la propagazione dell'etichetta Scikit-Learn su dati strutturati grafici?
Come parte della mia ricerca, sono interessato a eseguire la propagazione delle etichette su un grafico. Sono particolarmente interessato a questi due metodi: Xiaojin Zhu e Zoubin Ghahramani. Imparare da dati etichettati e senza etichetta con la propagazione delle etichette. Rapporto tecnico CMU-CALD-02-107, Carnegie Mellon University, 2002 http://pages.cs.wisc.edu/~jerryzhu/pub/CMU-CALD-02-107.pdf Dengyong Zhou, …


3
Reti neurali - Correlazione di perdita e precisione
Sono un po 'confuso dalla coesistenza delle metriche di perdita e precisione nelle reti neurali. Entrambi dovrebbero rendere "l'esattezza" del confronto tra e , vero? Quindi l'applicazione dei due non è ridondante nelle epoche di addestramento? Inoltre, perché non sono correlati?yyyyy^y^\hat{y}

3
TensorFlow è una libreria di apprendimento automatico completa?
Sono nuovo di TensorFlow e ho bisogno di capire le capacità e le carenze di TensorFlow prima di poterlo utilizzare. So che si tratta di un framework di apprendimento profondo, ma a parte quello che altri algoritmi di apprendimento automatico possono usare con il flusso tensoriale. Ad esempio, possiamo usare …



3
Gli alberi di regressione possono prevedere continuamente?
Supponiamo che io abbia una funzione regolare come . Ho un set di addestramento e, ovviamente, non conosco anche se posso valutare dove voglio.f(x,y)=x2+y2f(x,y)=x2+y2f(x, y) = x^2+y^2D⊊{((x,y),f(x,y))|(x,y)∈R2}D⊊{((x,y),f(x,y))|(x,y)∈R2}D \subsetneq \{((x, y), f(x,y)) | (x,y) \in \mathbb{R}^2\}ffffff Gli alberi di regressione sono in grado di trovare un modello uniforme della funzione (quindi …


Utilizzando il nostro sito, riconosci di aver letto e compreso le nostre Informativa sui cookie e Informativa sulla privacy.
Licensed under cc by-sa 3.0 with attribution required.