Scienza dei dati

Domande e risposte per i professionisti della scienza dei dati, gli specialisti di Machine Learning e coloro che sono interessati a saperne di più sul campo

2
Perché non usare sempre la tecnica di ottimizzazione ADAM?
Sembra che l' ottimizzatore Adaptive Moment Estimation (Adam) funzioni quasi sempre meglio (più velocemente e in modo più affidabile raggiungendo un minimo globale) quando si minimizza la funzione di costo nell'addestramento delle reti neurali. Perché non usare sempre Adam? Perché preoccuparsi di usare RMSProp o gli ottimizzatori del momento?



1
Allora, qual è il problema con LSTM?
Sto espandendo la mia conoscenza del pacchetto Keras e ho lavorato con alcuni dei modelli disponibili. Ho un problema di classificazione binaria NLP che sto cercando di risolvere e ho applicato diversi modelli. Dopo aver lavorato con alcuni risultati e aver letto sempre di più su LSTM, sembra che questo …


4
Rilevamento di anomalie con la rete neurale
Ho un grande set di dati multidimensionale che viene generato ogni giorno. Quale sarebbe un buon approccio per rilevare qualsiasi tipo di "anomalia" rispetto ai giorni precedenti? È un problema adatto che potrebbe essere affrontato con le reti neurali? Eventuali suggerimenti sono apprezzati. informazioni aggiuntive: non ci sono esempi, quindi …



3
Come usare RBM per la classificazione?
Al momento sto giocando con Restricted Boltzmann Machines e dato che ci sono, vorrei provare a classificare le cifre scritte a mano con esso. Il modello che ho creato ora è un modello generativo piuttosto elaborato ma non so come andare oltre. In questo articolo l'autore afferma che, dopo aver …


2
A quante dimensioni ridurre quando si fa PCA?
Come scegliere K per PCA? K è il numero di dimensioni su cui proiettare. L'unico requisito è non perdere troppe informazioni. Capisco che dipende dai dati, ma sto cercando di più una semplice panoramica generale su quali caratteristiche considerare quando si sceglie K.
12 pca 



1
MinHashing vs SimHashing
Supponiamo di avere cinque set che vorrei raggruppare. Comprendo che la tecnica di SimHashing descritta qui: https://moultano.wordpress.com/2010/01/21/simple-simhashing-3kbzhsxyg4467-6/ potrebbe produrre tre cluster ( {A}, {B,C,D}e {E}), per esempio, se i risultati sono stati: A -> h01 B -> h02 C -> h02 D -> h02 E -> h03 Allo stesso modo, …

7
Che cos'è un "vecchio nome" di data scientist?
Termini come "data science" e "data scientist" sono sempre più utilizzati in questi giorni. Molte aziende stanno assumendo "data scientist". Ma non credo sia un lavoro completamente nuovo. I dati esistevano dal passato e qualcuno doveva occuparsene. Immagino che il termine "data scientist" diventi più popolare perché suona più elegante …
12 bigdata 

Utilizzando il nostro sito, riconosci di aver letto e compreso le nostre Informativa sui cookie e Informativa sulla privacy.
Licensed under cc by-sa 3.0 with attribution required.