Come faccio a creare una matrice da un elenco di vettori in R?


102

Obiettivo: da un elenco di vettori di uguale lunghezza, creare una matrice in cui ogni vettore diventa una riga.

Esempio:

> a <- list()
> for (i in 1:10) a[[i]] <- c(i,1:5)
> a
[[1]]
[1] 1 1 2 3 4 5

[[2]]
[1] 2 1 2 3 4 5

[[3]]
[1] 3 1 2 3 4 5

[[4]]
[1] 4 1 2 3 4 5

[[5]]
[1] 5 1 2 3 4 5

[[6]]
[1] 6 1 2 3 4 5

[[7]]
[1] 7 1 2 3 4 5

[[8]]
[1] 8 1 2 3 4 5

[[9]]
[1] 9 1 2 3 4 5

[[10]]
[1] 10  1  2  3  4  5

Voglio:

      [,1] [,2] [,3] [,4] [,5] [,6]
 [1,]    1    1    2    3    4    5
 [2,]    2    1    2    3    4    5
 [3,]    3    1    2    3    4    5
 [4,]    4    1    2    3    4    5
 [5,]    5    1    2    3    4    5
 [6,]    6    1    2    3    4    5
 [7,]    7    1    2    3    4    5
 [8,]    8    1    2    3    4    5
 [9,]    9    1    2    3    4    5
[10,]   10    1    2    3    4    5 

Risposte:


124

Un'opzione è usare do.call():

 > do.call(rbind, a)
      [,1] [,2] [,3] [,4] [,5] [,6]
 [1,]    1    1    2    3    4    5
 [2,]    2    1    2    3    4    5
 [3,]    3    1    2    3    4    5
 [4,]    4    1    2    3    4    5
 [5,]    5    1    2    3    4    5
 [6,]    6    1    2    3    4    5
 [7,]    7    1    2    3    4    5
 [8,]    8    1    2    3    4    5
 [9,]    9    1    2    3    4    5
[10,]   10    1    2    3    4    5

5
Quindi la differenza tra this e lo standard rbind () è che do.call () passa ogni elemento della lista come un argomento separato - è vero? do.call (rbind, a) è equivalente a rbind (a [[1]], a [[2]] ... a [[10]])?
Matt Parker

5
do.call () è ottimo per questo scopo, vorrei che fosse "documentato" meglio nei materiali introduttivi.
andrewj

16

simplify2arrayè una funzione di base abbastanza intuitiva. Tuttavia, poiché l'impostazione predefinita di R è di riempire prima i dati per colonne, sarà necessario trasporre l'output. ( sapplyutilizza simplify2array, come documentato in help(sapply).)

> t(simplify2array(a))
      [,1] [,2] [,3] [,4] [,5] [,6]
 [1,]    1    1    2    3    4    5
 [2,]    2    1    2    3    4    5
 [3,]    3    1    2    3    4    5
 [4,]    4    1    2    3    4    5
 [5,]    5    1    2    3    4    5
 [6,]    6    1    2    3    4    5
 [7,]    7    1    2    3    4    5
 [8,]    8    1    2    3    4    5
 [9,]    9    1    2    3    4    5
[10,]   10    1    2    3    4    5

12

Non è semplice, ma funziona:

> t(sapply(a, unlist))
      [,1] [,2] [,3] [,4] [,5] [,6]
 [1,]    1    1    2    3    4    5
 [2,]    2    1    2    3    4    5
 [3,]    3    1    2    3    4    5
 [4,]    4    1    2    3    4    5
 [5,]    5    1    2    3    4    5
 [6,]    6    1    2    3    4    5
 [7,]    7    1    2    3    4    5
 [8,]    8    1    2    3    4    5
 [9,]    9    1    2    3    4    5
[10,]   10    1    2    3    4    5

1
Con rjsonrisultati, colMeansfunziona solo per questo metodo! Grazie!
mpyw

10

La matrixfunzione incorporata ha la bella opzione per inserire i dati byrow. Combinalo con un unlistnella tua lista delle fonti ti darà una matrice. È inoltre necessario specificare il numero di righe in modo che possa suddividere i dati non elencati. Questo è:

> matrix(unlist(a), byrow=TRUE, nrow=length(a) )
      [,1] [,2] [,3] [,4] [,5] [,6]
 [1,]    1    1    2    3    4    5
 [2,]    2    1    2    3    4    5
 [3,]    3    1    2    3    4    5
 [4,]    4    1    2    3    4    5
 [5,]    5    1    2    3    4    5
 [6,]    6    1    2    3    4    5
 [7,]    7    1    2    3    4    5
 [8,]    8    1    2    3    4    5
 [9,]    9    1    2    3    4    5
[10,]   10    1    2    3    4    5

Oppure compila una matrice da colonne e poi trasporre: t( matrix( unlist(a), ncol=length(a) ) ).
Kalin

8
t(sapply(a, '[', 1:max(sapply(a, length))))

dove "a" è un elenco. Funzionerebbe per dimensioni di riga diverse


3
> library(plyr)
> as.matrix(ldply(a))
      V1 V2 V3 V4 V5 V6
 [1,]  1  1  2  3  4  5
 [2,]  2  1  2  3  4  5
 [3,]  3  1  2  3  4  5
 [4,]  4  1  2  3  4  5
 [5,]  5  1  2  3  4  5
 [6,]  6  1  2  3  4  5
 [7,]  7  1  2  3  4  5
 [8,]  8  1  2  3  4  5
 [9,]  9  1  2  3  4  5
[10,] 10  1  2  3  4  5

1
Questo semplicemente non funzionerà se le righe non hanno la stessa lunghezza, mentre do.call (rbind, ...) funziona ancora.
Primo

qualche indizio su come farlo funzionare per dimensioni di riga disuguali con NA per i dati di riga mancanti?
Arihant

1
@rwst In realtà, do.call (rbind, ...) non funziona per vettori di lunghezza diversa, a meno che non si intenda davvero riutilizzare il vettore quando si riempie la riga alla fine. Vedi la risposta di Arihant per un modo che si riempia invece di NAvalori alla fine.
Kalin
Utilizzando il nostro sito, riconosci di aver letto e compreso le nostre Informativa sui cookie e Informativa sulla privacy.
Licensed under cc by-sa 3.0 with attribution required.