Domande e risposte per i professionisti della scienza dei dati, gli specialisti di Machine Learning e coloro che sono interessati a saperne di più sul campo
Ho una semplice rete neurale (NN) per la classificazione MNIST. Include 2 livelli nascosti, ciascuno con 500 neuroni. Quindi le dimensioni del NN sono: 784-500-500-10. ReLU è usato in tutti i neuroni, softmax è usato all'uscita e l'entropia incrociata è la funzione di perdita. Ciò che mi confonde è perché …
Ho i seguenti dati per un piccolo progetto laterale. Viene da un accelerometro seduto sopra una lavatrice / asciugatrice e vorrei che mi dicesse quando la macchina è finita. x è i dati di input (movimento x / y / z come un valore), y è l'etichetta on / off …
Come usare Naive Bayes per la classificazione di testi multi-etichetta in R. Ho provato ad usare naiveBayes () dalla libreria e1071 ma sembra che durante l'allenamento non accetti la variabile di classe multi-etichetta. Ho creato TermDocumentMatrix usando il corpus del documento di testo e ho provato a creare il modello …
Sto lavorando a un set di dati con etichetta binaria altamente squilibrato, in cui il numero di etichette vere è solo il 7% dall'intero set di dati. Ma una combinazione di funzionalità potrebbe produrre un numero di unità superiore alla media in un sottoinsieme. Ad esempio, abbiamo il seguente set …
Sto cercando una buona spiegazione di come funzionano le convoluzioni nell'apprendimento profondo quando applicate a immagini multicanale. Ad esempio, supponiamo che io abbia un'immagine di 100 x 100 pixel con tre canali, RGB. Il tensore di input avrebbe quindi dimensioni 100 x 100 x 3. Se applico una convoluzione con …
Ho trovato i pacchetti utilizzati per calcolare "Guadagno delle informazioni" per selezionare gli attributi principali in Albero decisionale C4.5 e ho provato a usarli per calcolare "Guadagno delle informazioni". Ma i risultati del calcolo di ciascun pacchetto sono diversi come il codice seguente. > IG.CORElearn <- attrEval(In_Occu ~ In_Temp+In_Humi+In_CO2+In_Illu+In_LP+Out_Temp+Out_Humi, dataUSE1, …
Sono laureato B.Sc. Uno dei miei corsi è stato "Introduzione all'apprendimento automatico" e ho sempre voluto realizzare un progetto personale in questa materia. Di recente ho sentito parlare di diversi allenamenti di intelligenza artificiale per giocare a giochi come Mario, Go, ecc. Quali conoscenze devo acquisire per allenare un semplice …
Sono uno studente di machine learning e in questi giorni stavo cercando di imparare a usare la libreria TensorFlow. Ho passato vari tutorial, prove ed errori con tensorflow e ho pensato che il modo migliore per impararlo sul serio sarebbe usarlo in un piccolo progetto tutto mio. Ho deciso che …
In python sklearn, ci sono più algoritmi (ad es. Regressione, foresta casuale ... ecc.) Che hanno il parametro class_weight per gestire i dati sbilanciati. Tuttavia, non trovo tale parametro per gli algoritmi MLLib. Esiste un piano per implementare class_weight per alcuni algoritmi MLLib? O esiste un approccio in MLLib per …
Sto usando il pacchetto keras per addestrare un LSTM per una serie temporale univariata di tipo numerico (float). Eseguire una previsione anticipata di 1 passaggio è banale, ma non sono sicuro di come eseguire una previsione anticipata di 10 passaggi. Due domande: 1) Ho letto degli NN da sequenza a …
Di recente ho imparato come funzionerebbe una rete neurale vanilla, con un determinato numero di input, nodi nascosti e lo stesso numero di output degli input. Ho esaminato vari post ora correlati alla rete neurale ricorrente e capisco il concetto alla base, ma non riesco a capire alcune parti della …
Mi chiedo perché l'addestramento di RNN in genere non utilizzi il 100% della GPU. Ad esempio, se eseguo questo benchmark RNN su un Maxwell Titan X su Ubuntu 14.04.4 LTS x64, l'utilizzo della GPU è inferiore al 90%: Il benchmark è stato lanciato usando il comando: python rnn.py -n 'fastlstm' …
durante un corso online sull'apprendimento automatico di Andrew Ng in corso, mi sono imbattuto in un argomento chiamato overfitting . So che può verificarsi quando la discesa del gradiente viene utilizzata nella regressione lineare o logistica, ma può verificarsi quando vengono utilizzati algoritmi di ottimizzazione avanzata come "gradiente coniugato", "BFGS" …
Quali metriche possono essere utilizzate per valutare i modelli di clustering di testo? Ho usato tf-idf+ k-means, tf-idf+ hierarchical clustering, doc2vec+ k-means (metric is cosine similarity), doc2vec+ hierarchical clustering (metric is cosine similarity). Come decidere quale modello è il migliore?
Sento che questa è una domanda rudimentale, ma sono molto nuovo e non sono stato in grado di risolverlo / trovare la risposta. In definitiva, ciò che sto cercando di fare qui è contare valori univoci su una determinata colonna e quindi determinare quale di quei valori univoci ha più …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.