Scienza dei dati

Domande e risposte per i professionisti della scienza dei dati, gli specialisti di Machine Learning e coloro che sono interessati a saperne di più sul campo

2
Esistono API per la scansione dell'estratto di carta?
Se ho un elenco molto lungo di nomi di documenti, come posso ottenere abstract di questi documenti da Internet o da qualsiasi database? I nomi dei documenti sono come "Valutazione dell'utilità nel Web Mining per il dominio della sanità pubblica". Qualcuno conosce qualche API che può darmi una soluzione? Ho …

3
Dovrei usare GPU o CPU per deduzione?
Sto gestendo una rete neurale di apprendimento profondo che è stata addestrata da una GPU. Ora voglio distribuire questo a più host per deduzione. La domanda è: quali sono le condizioni per decidere se dovrei usare GPU o CPU per deduzione? Aggiunta di maggiori dettagli dai commenti qui sotto. Sono …

2
Come implementare la previsione della sequenza "uno-a-molti" e "molti a molti" in Keras?
Faccio fatica a interpretare la differenza di codifica di Keras per l'etichettatura della sequenza uno-a-molti (es. Classificazione di singole immagini) e molti-a-molti (ad es. Classificazione di sequenze di immagini). Vedo spesso due diversi tipi di codici: Tipo 1 è dove nessun TimeDistributed applicato in questo modo: model=Sequential() model.add(Convolution2D(nb_filters, kernel_size[0], kernel_size[1], …
13 keras  rnn  lstm  sequence 



2
È possibile modificare la metrica utilizzata dal callback di Early Stopping in Keras?
Quando si utilizza il callback con arresto anticipato in Keras, l'allenamento si interrompe quando alcune metriche (generalmente perdita di convalida) non aumentano. Esiste un modo per utilizzare un'altra metrica (come precisione, richiamo, misura f) anziché perdita di convalida? Tutti gli esempi che ho visto finora sono simili a questo: callbacks.EarlyStopping …




3
Query da linguaggio naturale a SQL
Ho lavorato allo sviluppo di un sistema "Conversione del linguaggio naturale in query SQL". Ho letto le risposte da domande simili, ma non sono riuscito a ottenere le informazioni che stavo cercando. Di seguito è riportato il diagramma di flusso per tale sistema che ho ottenuto da Un algoritmo per …

2
Come si applica SMOTE alla classificazione del testo?
Synthetic Minority Oversampling Technique (SMOTE) è una tecnica di sovracampionamento utilizzata in un problema con un set di dati sbilanciato. Finora ho un'idea di come applicarlo su dati generici e strutturati. Ma è possibile applicarlo sul problema della classificazione del testo? Quale parte dei dati è necessaria per sottocampionare? C'è …


5
Vantaggi del frame di dati Panda rispetto al normale database relazionale
In Science Data, molti sembrano essere utilizzando panda dataframes come il datastore. Quali sono le caratteristiche dei panda che lo rendono un archivio dati superiore rispetto ai normali database relazionali come MySQL , che vengono utilizzati per archiviare i dati in molti altri campi della programmazione? Mentre Panda fornisce alcune …
13 pandas  databases 


4
Dimensionalità e varietà
Una frase comunemente ascoltata nell'apprendimento automatico senza supervisione è Gli input ad alta dimensione in genere vivono su o vicino a una varietà a bassa dimensione Che cos'è una dimensione? Che cos'è una varietà? Qual è la differenza? Puoi fare un esempio per descrivere entrambi? Collettore da Wikipedia: In matematica, …

Utilizzando il nostro sito, riconosci di aver letto e compreso le nostre Informativa sui cookie e Informativa sulla privacy.
Licensed under cc by-sa 3.0 with attribution required.