Domande e risposte per i professionisti della scienza dei dati, gli specialisti di Machine Learning e coloro che sono interessati a saperne di più sul campo
Ho un enorme set di dati da un database relazionale per il quale devo creare un modello di classificazione. Normalmente per questa situazione utilizzerei la Programmazione logica induttiva (ILP), ma a causa di circostanze speciali non posso farlo. L'altro modo per affrontare questo sarebbe solo quello di provare ad aggregare …
Un sistema di raccomandazioni tiene un registro di quali raccomandazioni sono state fatte a un determinato utente e se quell'utente accetta la raccomandazione. È come user_id item_id result 1 4 1 1 7 -1 5 19 1 5 80 1 dove 1 indica che l'utente ha accettato la raccomandazione mentre …
Quali set di dati disponibili gratuitamente posso usare per addestrare un classificatore di testo? Stiamo cercando di migliorare il coinvolgimento dei nostri utenti raccomandandogli il contenuto più correlato, quindi abbiamo pensato che se avessimo classificato i nostri contenuti in base a un sacco di parole predefinito, potremmo consigliargli di coinvolgere …
Sono nuovo di questa comunità e spero che la mia domanda si adatti bene qui. Come parte del mio corso di analisi dei dati universitari ho scelto di fare il progetto sul riconoscimento delle attività umane utilizzando set di dati per smartphone. Per quanto mi riguarda, questo argomento riguarda l'apprendimento …
Sono un dottorato in matematica. studente interessato ad andare nel settore come Data Scientist dopo la laurea. Darò brevemente alcuni retroscena della mia educazione prima di porre la mia domanda, in modo che sia meglio compreso: Corsi di matematica: Questo è stato principalmente in matematica pura: topologia, analisi funzionale, ecc., …
Sto sviluppando un modello di previsione utilizzando Java Weka api. Posso prevedere la classe per la nuova istanza utilizzando il seguente codice: double predictClass = classifer.classifyInstance(instance) Tuttavia, ho bisogno della probabilità della classe anziché del valore della classe. Grazie in anticipo per il tuo supporto.
Perché la misura F viene solitamente utilizzata per attività di classificazione (supervisionate), mentre la misura G (o indice di Fowlkes-Mallows) viene generalmente utilizzata per attività di clustering (senza supervisione)? La misura F è la media armonica della precisione e del richiamo . La misura G (o indice di Fowlkes-Mallows) è …
Nel documento Super-risoluzione singola immagine foto-realistica che utilizza una rete contraddittoria generativa di Christian Ledig et al., La distanza tra le immagini (utilizzate nella funzione di perdita) viene calcolata dalle mappe caratteristiche estratte dalla rete VGG19. I due usati nell'articolo sono (un po 'confusi) chiamati VGG22 e VGG54. Cosa sono …
Poiché il metodo interpolare e fillna fa lo stesso lavoro di riempimento di valori na. Qual è la differenza di base tra i due. Qual è il significato di avere questi due diversi metodi ?? Qualcuno può spiegarmi in termini laici. Ho già visitato la documentazione ufficiale e volevo sapere …
Supponiamo che io abbia una serie di segnali nel dominio del tempo senza assolutamente etichette . Voglio raggrupparli in 2 o 3 classi. I codificatori automatici sono reti senza supervisione che imparano a comprimere gli input. Quindi, dato un input , pesi e , distorsioni b_1 e b_2 e output …
Ho un set di dati con 19 colonne e circa 250k righe. Ho lavorato con set di dati più grandi, ma questa volta Pandas ha deciso di giocare con i miei nervi. Ho provato a dividere il set di dati originale in 3 sub-frame di dati basati su alcune semplici …
Ho dei dati di allenamento che sono etichettati con valori binari. Ho anche raccolto la fiducia di ciascuna di queste etichette, ovvero 0,8 di fiducia significherebbe che l'80% delle etichettatrici umane è d'accordo su tale etichetta. È possibile utilizzare questi dati di confidenza per migliorare l'accuratezza del mio classificatore? Il …
Gli esperti nel mio campo sono in grado di prevedere la probabilità che un evento (picco binario in giallo) 30 minuti prima che si verifichi . La frequenza qui è di 1 secondo, questa vista rappresenta alcune ore di dati, ho cerchiato in nero dove dovrebbe essere il modello "malizioso" …
Stavo leggendo il materiale relativo a XGBoost. Sembra che questo metodo non richieda alcun ridimensionamento variabile poiché si basa su alberi e questo può catturare interazioni complesse con schemi di non linearità. E può gestire variabili sia numeriche sia categoriche e sembra anche che le variabili ridondanti non influiscano troppo …
Ritengo che questa domanda sia collegata alla teoria alla base della convalida incrociata. Vi presento il mio empirica qui e ho scritto una domanda relativa alla teoria della convalida incrociata in là . Ho due modelli M1 e M2, utilizzo lo stesso set di dati per addestrarli ed eseguire la …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.