1998年以降の1000株の1分間のデータのデータセットがあり、その合計(2012-1998)*(365*24*60)*1000 = 7.3 Billionは行の周りにあります。
ほとんど(99.9%)は、読み取り要求のみを実行します。
このデータをデータベースに保存するための最良の方法は何ですか?
- 7.3B行の1つの大きなテーブル?
- 1000テーブル(銘柄記号ごとに1つ)、それぞれ730万行?
- データベースエンジンの推奨事項はありますか?(Amazon RDSのMySQLを使用する予定です)
私はこれほど大きなデータセットを扱うことに慣れていないので、これは私が学ぶ絶好の機会です。私はあなたの助けとアドバイスに感謝します。
編集:
これはサンプル行です:
「XX」、20041208、938、43.7444、43.7541、43.735、43.7444、35116.7、1、0、0
列1は銘柄記号、列2は日付、列3は分、残りは始値-高値-安値-終値、出来高、および3つの整数列です。
ほとんどのクエリは、「2012年4月12日12:15から2012年4月13日12:52までのAAPLの価格を教えてください」のようになります。
ハードウェアについて:Amazon RDSを使用する予定なので、柔軟に対応できます。

