Sto usando il RandomForestpacchetto R e sono confuso su come interpretare i valori dell'asse Y nei loro grafici di dipendenza parziale. I documenti di aiuto affermano che la trama è una "rappresentazione grafica dell'effetto marginale di una variabile sulla probabilità della classe". Tuttavia, sono ancora confuso su ciò che rappresenta …
Ho un set di dati molto grande e mancano circa il 5% di valori casuali. Queste variabili sono correlate tra loro. Il seguente set di dati R è solo un esempio di giocattolo con dati correlati fittizi. set.seed(123) # matrix of X variable xmat <- matrix(sample(-1:1, 2000000, replace = TRUE), …
Sto cercando di capire come utilizzare l'apprendimento automatico per prevedere la serie finanziaria 1 o più passi nel futuro. Ho una serie di attività finanziarie con alcuni dati descrittivi e vorrei formare un modello e quindi utilizzare il modello per prevedere n-passi avanti. Quello che ho fatto finora è: getSymbols("GOOG") …
Una foresta casuale può essere addestrata per prevedere in modo appropriato i dati di conteggio? Come procederebbe? Ho una vasta gamma di valori, quindi la classificazione non ha davvero senso. Se usassi la regressione, troncerei semplicemente i risultati? Sono abbastanza perso qui. Qualche idea?
La mia comprensione è che la foresta casuale sceglie casualmente le variabili mtry per costruire ogni albero decisionale. Quindi, se mtry = ncol / 3, ogni variabile verrà utilizzata in media in 1/3 degli alberi. E 2/3 degli alberi non li useranno. Ma cosa succede se so che una singola …
Sto usando il pacchetto randomForest in R e usando i dati dell'iride, la foresta casuale generata è una classificazione ma quando uso un set di dati con circa 700 funzioni (le caratteristiche sono ogni pixel in un'immagine di 28x28 pixel) e la colonna etichetta viene denominata label, il randomForestgenerato è …
Per una recente competizione di Kaggle, ho definito (manualmente) 10 funzioni aggiuntive per il mio set di allenamento, che sarebbero state utilizzate per addestrare un classificatore di foreste casuale. Ho deciso di eseguire PCA sul set di dati con le nuove funzionalità, per vedere come si confrontavano tra loro. Ho …
Qual è la funzione di costo migliore per un albero forestale casuale: indice Gini o entropia? Sto cercando di implementare una foresta casuale a Clojure.
Sto cercando di risolvere un compito chiamato rilevamento dei pedoni e alleno il clasifer binario su due categorie di aspetti positivi: persone, aspetti negativi, sfondo. Ho un set di dati: numero di positivi = 3752 numero di negativi = 3800 Uso train \ test split 80 \ 20% e RandomForestClassifier …
Uso il pacchetto di cursore per allenare un oggetto randomForest con 10x10CV. library(caret) tc <- trainControl("repeatedcv", number=10, repeats=10, classProbs=TRUE, savePred=T) RFFit <- train(Defect ~., data=trainingSet, method="rf", trControl=tc, preProc=c("center", "scale")) Successivamente, testare randomForest su un testSet (nuovi dati) RF.testSet$Prediction <- predict(RFFit, newdata=testSet) La matrice di confusione mi mostra che il modello …
Sono nuovo di machine learning. Ho applicato la regressione logistica e la foresta casuale su uno stesso set di dati. Quindi ottengo un'importanza variabile (coefficiente assoluto per la regressione logistica e importanza variabile per la foresta casuale). Sto pensando di combinare i due per ottenere un'importanza variabile finale. Qualcuno può …
Ho dati con alcune migliaia di funzionalità e voglio fare la selezione ricorsiva delle funzionalità (RFE) per rimuovere quelle non informative. Lo faccio con il cursore e RFE. Tuttavia, ho iniziato a pensare, se voglio ottenere la migliore misura di regressione (foresta casuale, ad esempio), quando devo eseguire la regolazione …
Quindi, ho una matrice di circa 60 x 1000. Lo sto guardando come 60 oggetti con 1000 caratteristiche; i 60 oggetti sono raggruppati in 3 classi (a, b, c). 20 oggetti in ogni classe e conosciamo la vera classificazione. Mi piacerebbe fare un apprendimento supervisionato su questo set di 60 …
Penso che questa sia una domanda semplice, anche se il ragionamento alla base del perché o del perché potrebbe non esserlo. Il motivo per cui mi chiedo è che di recente ho scritto la mia implementazione di una RF e sebbene funzioni bene, non sta funzionando come mi aspettavo (basato …
Ho notato che quando si creano modelli di regressione della foresta casuali, almeno in R, il valore previsto non supera mai il valore massimo della variabile target visualizzata nei dati di allenamento. Ad esempio, vedi il codice qui sotto. Sto costruendo un modello di regressione da prevedere in mpgbase ai …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.