Scienza dei dati

Domande e risposte per i professionisti della scienza dei dati, gli specialisti di Machine Learning e coloro che sono interessati a saperne di più sul campo





4
Le convoluzioni "appiattiscono le immagini"?
Sto cercando una buona spiegazione di come funzionano le convoluzioni nell'apprendimento profondo quando applicate a immagini multicanale. Ad esempio, supponiamo che io abbia un'immagine di 100 x 100 pixel con tre canali, RGB. Il tensore di input avrebbe quindi dimensioni 100 x 100 x 3. Se applico una convoluzione con …

2
Informazioni ottenute in R
Ho trovato i pacchetti utilizzati per calcolare "Guadagno delle informazioni" per selezionare gli attributi principali in Albero decisionale C4.5 e ho provato a usarli per calcolare "Guadagno delle informazioni". Ma i risultati del calcolo di ciascun pacchetto sono diversi come il codice seguente. > IG.CORElearn <- attrEval(In_Occu ~ In_Temp+In_Humi+In_CO2+In_Illu+In_LP+Out_Temp+Out_Humi, dataUSE1, …

3
Di quali conoscenze ho bisogno per scrivere un semplice programma AI per giocare?
Sono laureato B.Sc. Uno dei miei corsi è stato "Introduzione all'apprendimento automatico" e ho sempre voluto realizzare un progetto personale in questa materia. Di recente ho sentito parlare di diversi allenamenti di intelligenza artificiale per giocare a giochi come Mario, Go, ecc. Quali conoscenze devo acquisire per allenare un semplice …






2
Può verificarsi un overfitting negli algoritmi di ottimizzazione avanzata?
durante un corso online sull'apprendimento automatico di Andrew Ng in corso, mi sono imbattuto in un argomento chiamato overfitting . So che può verificarsi quando la discesa del gradiente viene utilizzata nella regressione lineare o logistica, ma può verificarsi quando vengono utilizzati algoritmi di ottimizzazione avanzata come "gradiente coniugato", "BFGS" …

3
Come valutare il clustering di testo?
Quali metriche possono essere utilizzate per valutare i modelli di clustering di testo? Ho usato tf-idf+ k-means, tf-idf+ hierarchical clustering, doc2vec+ k-means (metric is cosine similarity), doc2vec+ hierarchical clustering (metric is cosine similarity). Come decidere quale modello è il migliore?

2
Conteggio degli indici nei panda
Sento che questa è una domanda rudimentale, ma sono molto nuovo e non sono stato in grado di risolverlo / trovare la risposta. In definitiva, ciò che sto cercando di fare qui è contare valori univoci su una determinata colonna e quindi determinare quale di quei valori univoci ha più …

Utilizzando il nostro sito, riconosci di aver letto e compreso le nostre Informativa sui cookie e Informativa sulla privacy.
Licensed under cc by-sa 3.0 with attribution required.