Domande e risposte per i professionisti della scienza dei dati, gli specialisti di Machine Learning e coloro che sono interessati a saperne di più sul campo
C'è una domanda simile qui in CrossValidated e ho letto le risposte. La mia domanda è un po 'diversa. Non voglio semplicemente visualizzare i miei dati, e in effetti ciò che voglio visualizzare non è facile da visualizzare con nessuno dei due pacchetti. Ho due serie di punti ( coordinate …
Oggi, in una lezione, è stato affermato che la direzione dei bordi in una rete Bayes non ha molta importanza. Non devono rappresentare la causalità. È ovvio che non è possibile cambiare un singolo fronte in una rete Bayes. Ad esempio, lascia con ed . Se a , non sarebbe …
Ho cercato di comprendere i diversi algoritmi di clustering di k-means principalmente implementati nel statspacchetto del Rlinguaggio. Capisco l'algoritmo di Lloyd e l'algoritmo online di MacQueen. Il modo in cui li capisco è il seguente: Algoritmo di Lloyd: Inizialmente vengono scelte le osservazioni casuali "k" che serviranno da centroidi dei …
Uso spesso Nose, Tox o Unittest quando collaudo il mio codice Python, specialmente quando deve essere integrato con altri moduli o altri pezzi di codice. Tuttavia, ora che mi sono ritrovato a utilizzare R più di Python per la modellazione e lo sviluppo di ML. Mi sono reso conto che …
Mi è stato assegnato questo compito per analizzare i registri del server della nostra applicazione che contiene registri delle eccezioni, registri degli eventi dei registri del database, ecc. Sono nuovo di machine learning, usiamo Spark con ricerca elastica e Sparks MLlib (o PredictionIO). Un esempio del desiderato il risultato sarebbe …
Imparo meglio attraverso la sperimentazione e l'esempio. Sto imparando a conoscere le reti neurali e ho (quello che penso) una buona comprensione della classificazione e della regressione e anche un apprendimento supervisionato e senza supervisione, ma mi sono imbattuto in qualcosa che non riesco a capire; Se volessi allenare un'intelligenza …
Sto cercando di progettare un sistema che dato un paragrafo di testo sarà in grado di classificarlo e identificare il contesto: È addestrato con paragrafi di testo generati dall'utente (come commenti / domande / risposte) Ogni elemento nel set di allenamento verrà taggato con. Ad esempio ("categoria 1", "testo paragrafo") …
Ho appena letto il documento di Geoff Hinton sulla trasformazione dei codificatori automatici Hinton, Krizhevsky e Wang: Transforming Auto-encoder . In reti neurali artificiali e apprendimento automatico, 2011. e mi piacerebbe davvero giocare con qualcosa del genere. Ma dopo averlo letto non ho potuto ottenere abbastanza dettagli dall'articolo su come …
Ho già un'implementazione funzionante per un singolo agente che lavora su un problema di prezzi dinamico con l'obiettivo di massimizzare le entrate. Il problema con cui sto lavorando, tuttavia, coinvolge diversi prodotti che si sostituiscono a vicenda, quindi il prezzo dinamico di tutti con studenti indipendenti sembra errato, perché il …
Ho un frame di dati Panda (X11) come questo: In realtà ho 99 colonne fino a dx99 dx1 dx2 dx3 dx4 0 25041 40391 5856 0 1 25041 40391 25081 5856 2 25041 40391 42822 0 3 25061 40391 0 0 4 25041 40391 0 5856 5 40391 25002 5856 …
Sto cercando un sito Web o un libro in cui vengono forniti vari esempi pratici passo dopo passo, spiegando come scelgono le funzionalità pertinenti, la procedura di selezione del modello, ecc ...
Ho visto alcuni risultati impressionanti dai modelli LSTM che producevano testi simili a Shakespeare. Mi chiedevo se esiste un pacchetto LSTM per R. Ho cercato su Google per questo, ma ho trovato solo pacchetti per Python e Julia. (forse ci sono alcuni problemi di prestazioni che spiegano perché questi programmi …
Hanno un corpus di oltre milioni di documenti Per un dato documento vuoi trovare documenti simili usando il coseno come nel modello dello spazio vettoriale d1⋅ d2/ ( | | d1| | | | d2| | )d1⋅d2/(||d1||||d2||)d_1 \cdot d_2 / ( ||d_1|| ||d_2|| ) Tutti i tf sono stati normalizzati …
Ho un set di dati di grandi dimensioni che devo dividere in gruppi in base a parametri specifici. Voglio che il lavoro venga elaborato nel modo più efficiente possibile. Posso immaginare due modi per farlo Opzione 1 : creare una mappa dall'RDD originale e filtrare def customMapper(record): if passesSomeTest(record): return …
Ho un grande set di dati con oggetti JSON da 9m a ~ 300 byte ciascuno. Sono post da un aggregatore di link: sostanzialmente link (un URL, titolo e ID autore) e commenti (testo e ID autore) + metadati. Potrebbero benissimo essere record relazionali in una tabella, tranne per il …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.