Supponiamo che dipenda da α . A rigor di termini,
se e α sono entrambe variabili casuali, potremmo scrivere p ( X ∣ α ) ;
tuttavia, se è una variabile casuale e α è un parametro, dobbiamo scrivere p ( X ; α ) .
Ho notato più volte che la comunità dell'apprendimento automatico sembra ignorare le differenze e abusare dei termini.
Ad esempio, nel famoso modello LDA, dove è il parametro Dirichlet anziché una variabile casuale.

Non dovrebbe essere ? Vedo molte persone, inclusi gli autori originali del documento LDA, che lo scrivono come p ( θ ∣ α ) .