Ho questo requisito unico che può essere spiegato da questo codice. Questo è un codice funzionante ma non efficiente in termini di memoria.
data = [[
"A 5408599",
"B 8126880",
"A 2003529",
],
[
"C 9925336",
"C 3705674",
"A 823678571",
"C 3205170186",
],
[
"C 9772980",
"B 8960327",
"C 4185139021",
"D 1226285245",
"C 2523866271",
"D 2940954504",
"D 5083193",
]]
temp_dict = {
item: index for index, sublist in enumerate(data)
for item in sublist
}
print(data[temp_dict["A 2003529"]])
out: ['A 5408599', 'B 8126880', 'A 2003529']
In breve, desidero che ogni elemento dell'elenco secondario sia indicizzabile e che debba restituire l'elenco secondario.
Il metodo sopra funziona ma richiede molta memoria quando i dati sono grandi. Esiste un modo migliore per la memoria e la CPU? I dati sono archiviati come file JSON.
Modifica Ho provato le risposte per lo scenario di utilizzo più ampio possibile (1000 elenchi secondari, 100 elementi in ciascun elenco secondario, 1 milione di query) e qui sono riportati i risultati (media di 10 esecuzioni):
Method, Time (seconds), Extra Memory used
my, 0.637 40 Mb
deceze, 0.63 40 Mb
James, 0.78 200 kb
Pant, > 300 0 kb
mcsoini, forever 0 kb
{item: sublist for sublist in data for item in sublist}potrebbe essere leggermente più efficiente e diretto ... ?!