Domande e risposte per i professionisti della scienza dei dati, gli specialisti di Machine Learning e coloro che sono interessati a saperne di più sul campo
Ho due tensori a:[batch_size, dim] b:[batch_size, dim]. Voglio fare un prodotto interno per ogni coppia nel lotto, generando c:[batch_size, 1], dove c[i,0]=a[i,:].T*b[i,:]. Come?
Usiamo .cache()su RDD per la memorizzazione nella cache persistente di un set di dati, la mia preoccupazione è quando questa cache sarà scaduta ?. dt = sc.parallelize([2, 3, 4, 5, 6]) dt.cache()
Chiuso . Questa domanda deve essere più focalizzata . Al momento non accetta risposte. Vuoi migliorare questa domanda? Aggiorna la domanda in modo che si concentri su un problema solo modificando questo post . Chiuso 4 anni fa . Sto lavorando a un progetto e ho difficoltà a decidere quale …
I miei dati includono risposte al sondaggio che sono binarie (numeriche) e nominali / categoriche. Tutte le risposte sono discrete e a livello individuale. I dati sono di forma (n = 7219, p = 105). Cose di coppia: Sto cercando di identificare una tecnica di clustering con una misura di …
Ho creato un classificatore Naive Bayes che utilizza la tecnica del bag-of-word per classificare i post di spam in una bacheca. Funziona, ma penso che potrei ottenere risultati molto migliori se i miei modelli considerassero gli ordinamenti e le frasi delle parole. (ad esempio, "ragazze" e "live" potrebbero non generare …
Sto cercando di trovare dati di borsa con cui esercitarmi, c'è una buona risorsa per questo? Ho trovato questo: ftp://emi.nasdaq.com/ITCH/ ma ha solo l'anno in corso. Ho già un modo per analizzare il protocollo, ma vorrei avere altri dati con cui confrontarli. Non deve essere nello stesso formato, purché abbia …
Ho un set di dati che contiene ~ 100.000 campioni di 50 classi. Ho usato SVM con un kernel RBF per addestrare e prevedere nuovi dati. Il problema però è che il set di dati è inclinato verso classi diverse. Ad esempio, Classe 1 - 30 (~ 3% ciascuno), Classe …
Questa domanda pone un algoritmo generativo vs. discriminativo, ma qualcuno può fornire un esempio della differenza tra questi moduli quando applicato all'elaborazione del linguaggio naturale? Come vengono utilizzati i modelli generativi e discriminatori nella PNL?
Sto cercando alcuni suggerimenti su come curare un elenco di parole d'ordine. Qualcuno sa / può consigliare un buon metodo per estrarre elenchi di parole d'ordine dal set di dati stesso per la preelaborazione e il filtro? I dati: un'enorme quantità di testo umano di lunghezza variabile (termini di ricerca …
Sto verificando la documentazione di XGBoost e si afferma che XGBoost è una libreria ottimizzata di incremento gradiente distribuito . Cosa si intende per distribuito? Buona giornata
Sto cercando di addestrare l' implementazione di Keras di Deeplabv3 + su Pascal VOC2012, usando il modello predefinito (che è stato anche addestrato su quel set di dati). Ho ottenuto strani risultati con l'accuratezza che converge rapidamente in 1.0: 5/5 [==============================] - 182s 36s/step - loss: 26864.4418 - acc: 0.7669 …
La normalizzazione in lotti e le ReLU sono entrambe soluzioni al problema del gradiente in via di estinzione. Se stiamo usando la normalizzazione in lotti, dovremmo quindi usare i sigmoidi? O ci sono caratteristiche delle ReLU che le rendono utili anche quando si utilizza batchnorm? Suppongo che la normalizzazione effettuata …
Il mio set di allenamento contiene circa 50.000 voci con le quali faccio un apprendimento iniziale. Su base settimanale, vengono aggiunte ~ 5k voci; ma la stessa quantità "scompare" (in quanto sono i dati dell'utente che devono essere eliminati dopo qualche tempo). Pertanto utilizzo l'apprendimento online perché non ho accesso …
Sto cercando di generare un modello intelligente in grado di scansionare un insieme di parole o stringhe e classificarle come nomi, numeri mobili, indirizzi, città, stati, paesi e altre entità usando l'apprendimento automatico o l'apprendimento profondo. Avevo cercato approcci, ma sfortunatamente non ho trovato alcun approccio da adottare. Avevo provato …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.