Durante l'addestramento dei modelli di apprendimento automatico, perché a volte è vantaggioso mantenere la dimensione del batch a una potenza di 2? Ho pensato che sarebbe meglio usare una dimensione che si adatta meglio alla tua memoria GPU / RAM. Questa risposta afferma che per alcuni pacchetti, una potenza di …
In quali casi è meglio usare un albero decisionale e altri casi un KNN? Perché usarne uno in alcuni casi? E l'altro in diversi casi? (Osservando la sua funzionalità, non l'algoritmo) Qualcuno ha qualche spiegazione o riferimenti a riguardo?
Sto usando Brain per addestrare una rete neurale su un set di funzionalità che include sia valori positivi che negativi. Ma Brain richiede valori di input compresi tra 0 e 1. Qual è il modo migliore per normalizzare i miei dati?
Attualmente sto usando XGBoost per la previsione del rischio, sembra che stia facendo un buon lavoro nel dipartimento di classificazione binaria, ma le uscite di probabilità sono molto lontane, cioè cambiare il valore di una caratteristica in un'osservazione di una quantità molto piccola può fare la probabilità salto in uscita …
Uso Python per eseguire un modello di foresta casuale sul mio set di dati non bilanciato (la variabile di destinazione era una classe binaria). Quando ho diviso il set di dati di training e testing, ho faticato a usare il campionamento stratificato (come il codice mostrato) oppure no. Finora, ho …
Sembra che sia diventato assiomatico che un insieme di discenti porti ai migliori risultati di modello possibili - e sta diventando molto più raro, ad esempio, per i singoli modelli vincere competizioni come Kaggle. C'è una spiegazione teorica del perché gli ensemble siano così dannatamente efficaci?
Ho un set di dati di utenti che acquistano prodotti da un sito Web. Gli attributi che ho sono ID utente, regione (stato) dell'utente, ID categorie di prodotto, ID parole chiave del prodotto, ID parole chiave del sito Web e importo delle vendite speso del prodotto. L'obiettivo è quello di …
Esistono librerie di apprendimento automatico per Ruby che sono relativamente complete (inclusa una vasta gamma di algoritmi per l'apprendimento supervisionato e non supervisionato), testate in modo solido e ben documentate? Adoro lo scikit-learning di Python per la sua incredibile documentazione, ma un cliente preferirebbe scrivere il codice in Ruby poiché …
Ho un set di dati con le seguenti specifiche: Set di dati di addestramento con 193.176 campioni con 2.821 positivi Set di dati di prova con 82.887 campioni con 673 positivi Ci sono 10 funzioni. Voglio eseguire una classificazione binaria (0 o 1). Il problema che sto affrontando è che …
Ho un set di dati binari altamente distorto: ho 1000 volte più esempi della classe negativa rispetto alla classe positiva. Vorrei addestrare un albero insieme (come alberi casuali extra o una foresta casuale) su questi dati, ma è difficile creare set di dati di addestramento che contengano abbastanza esempi della …
Sto cercando di capire come tutti i componenti dei "big data" giocano insieme in un caso d'uso reale, ad esempio hadoop, monogodb / nosql, storm, kafka, ... So che si tratta di una vasta gamma di strumenti utilizzati per tipi diversi, ma mi piacerebbe conoscere meglio la loro interazione con …
Sto addestrando una rete neurale convoluzionale per classificare le immagini in condizioni di nebbia (3 classi). Tuttavia, per ciascuna delle circa 150.000 immagini ho anche quattro variabili meteorologiche disponibili che potrebbero aiutare a prevedere le classi delle immagini. Mi chiedevo come avrei potuto aggiungere le variabili meteorologiche (ad es. Temperatura, …
Se guardo una delle molte fonti per le lezioni di Imagenet su Internet non riesco a trovare una sola classe legata agli esseri umani (e no, Harvestman non è qualcuno che raccoglie, ma è quello che sapevo come un papà longlegs, una specie di ragno :-). Come è possibile? Vorrei …
Sono un ingegnere informatico senza esperienza in statistica o matematica avanzata. Sto studiando il libro Python Machine Learning di Raschka e Mirjalili, ma quando ho cercato di capire la matematica del Machine Learning, non sono riuscito a capire il grande libro che un amico mi suggerisce Gli elementi dell'apprendimento statistico …
A causa di varie maledizioni di dimensionalità , l'accuratezza e la velocità di molte delle comuni tecniche predittive si riducono su dati ad alta dimensione. Quali sono alcune delle tecniche / trucchi / euristiche più utili che aiutano a gestire efficacemente i dati ad alta dimensione? Per esempio, Alcuni metodi …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.