Sto cercando di raggruppare insieme diversi set di dati utilizzando algoritmi non supervisionati (clustering). Il problema è che ho molte funzionalità (~ 500) e una piccola quantità di casi (200-300). Finora ero solito fare solo problemi di classificazione per i quali avevo sempre etichettato i dati come set di addestramento. …
Il mio obiettivo è analizzare i log di rete (ad es. Apache, syslog, audit di sicurezza di Active Directory e così via) utilizzando il rilevamento di clustering / anomalie ai fini del rilevamento delle intrusioni. Dai registri ho molti campi di testo come indirizzo IP, nome utente, nome host, porta …
Supponiamo di avere dati longitudinali della forma (ho più osservazioni, questa è solo la forma di una singola). Sono interessato a restrizioni su . Un senza restrizioni equivale a prendere con .Σ Σ Y j = α j + j - 1 ∑ ℓ = 1 ϕ ℓ j Y …
Supponiamo di avere un campione di frequenze di 4 possibili eventi: Event1 - 5 E2 - 1 E3 - 0 E4 - 12 e ho le probabilità attese dei miei eventi: p1 - 0.2 p2 - 0.1 p3 - 0.1 p4 - 0.6 Con la somma delle frequenze osservate dei …
Sono confuso sull'analisi delle permutazioni per la selezione delle caratteristiche in un contesto di regressione logistica. Potresti fornire una chiara spiegazione del test di permutazione casuale e come si applica alla selezione delle funzionalità? Forse con algoritmo esatto ed esempi. Infine, come si confronta con altri metodi di restringimento come …
Il mio set di dati comprende la mortalità totale o la sopravvivenza di un organismo in tre tipi di siti: costiera, midchannel e offshore. I numeri nella tabella seguente rappresentano il numero di siti. 100% Mortality 100% Survival Inshore 30 31 Midchannel 10 20 Offshore 1 10 Vorrei sapere se …
È possibile utilizzare l'analisi dei componenti principali del kernel (kPCA) per Latent Semantic Indexing (LSI) nello stesso modo in cui viene utilizzata la PCA? Eseguo LSI in R usando la prcompfunzione PCA ed estraggo le funzionalità con i caricamenti più alti dai primi componenti. Con ciò ottengo le caratteristiche che …
In un articolo che stavo leggendo di recente mi sono imbattuto nel seguente bit nella loro sezione di analisi dei dati: La tabella dei dati è stata quindi suddivisa in tessuti e linee cellulari e i due sottotitoli sono stati lucidati separatamente mediana (le righe e le colonne sono state …
Per la selezione dei predittori nella regressione lineare multivariata con predittori adatti , quali metodi sono disponibili per trovare un sottoinsieme "ottimale" dei predittori senza testare esplicitamente tutti i sottoinsiemi ? In "Applied Survival Analysis", Hosmer e Lemeshow fanno riferimento al metodo di Kuk, ma non riesco a trovare il …
Considera la regressione lineare multipla. Questa domanda potrebbe essere ingannevolmente semplice, ma sto cercando di capire intuitivamente perché, per esempio se ho predittori X1 e X2, allora le interazioni tra questi predittori possono essere adeguatamente catturate da X1 * X2. So che i termini di interazione sono modellati come prodotti, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.