このコードで説明できるこの固有の要件があります。これは機能するコードですが、メモリ効率は良くありません。
data = [[
"A 5408599",
"B 8126880",
"A 2003529",
],
[
"C 9925336",
"C 3705674",
"A 823678571",
"C 3205170186",
],
[
"C 9772980",
"B 8960327",
"C 4185139021",
"D 1226285245",
"C 2523866271",
"D 2940954504",
"D 5083193",
]]
temp_dict = {
item: index for index, sublist in enumerate(data)
for item in sublist
}
print(data[temp_dict["A 2003529"]])
out: ['A 5408599', 'B 8126880', 'A 2003529']
簡単に言うと、サブリストの各項目をインデックス可能にして、サブリストを返す必要があります。
上記の方法は機能しますが、データが大きい場合、大量のメモリを消費します。メモリとCPUに優しい方法はありますか?データはJSONファイルとして保存されます。
編集 私は可能な最大のユースケースシナリオ(1000サブリスト、各サブリストに100アイテム、100万クエリ)の回答を試しましたが、結果は次のとおりです(10回の実行の平均)。
Method, Time (seconds), Extra Memory used
my, 0.637 40 Mb
deceze, 0.63 40 Mb
James, 0.78 200 kb
Pant, > 300 0 kb
mcsoini, forever 0 kb
{item: sublist for sublist in data for item in sublist}少し効率的で直接的かもしれません…?!