128GB革命 #4 2千ドル・4千ドル・7千ドルの地図
128GB革命 #4 2千ドル・4千ドル・7千ドルの地図
家電量販店の陳列棚を思い浮かべてほしい。同じ冷蔵庫でも、扉が一枚の小さいもの、野菜室が独立した真ん中のもの、右開き左開きまで選べる大きいもの、と段階が並んでいるよね。値札もほぼ階段状についていて、買い物客は自分の家族の人数と生活と財布を、その階段に照らし合わせて決める。迷いはするけど、基準は明確だ。ところがローカルLLM、つまりAIの模型を自宅のマシンで動かす世界では、長いことこの陳列棚がなかったんだよね。グラフィックボードの話、メモリの話、電源の話がバラバラに転がっていて、初心者はどれを買えばいいのか分からない。そこに一枚の見取り図を置いた人がいる。XのJun Song氏、ハンドルネームは@jun_songだ。2千ドルならこれ、4千ドルならこれ、7千ドルならこれ、という三段階のハードウェアガイド。冒頭に結論を言ってしまえば、頂点の7千ドル段がM5 Max 128GB、まさに本連載の主戦場なんだよね。前回はRedisの作者antirez氏が、自宅のMacで284Bの模型を動かすためにds4という道具を鍛える話をした。今回はその道具を載せる台そのもの、机と財布の選び方の話をする。
三段の階段と、そこに立つ機械
ガイドの中身を一段ずつ紹介しよう。一段目は約2千ドル。ゲーミングデスクトップにRTX 3090という一世代以上前の旗艦グラフィックボードを差して、Qwen3.8-27Bという27Bサイズの模型を動かす構成だ。ここには発想の転換がある。最新のミドルレンジを定価で買うより、一時代前の旗艦を中古で漁るほうが、同じ金額で太い道路と広い作業場が手に入る。車でも新しい軽自動車より古い高級車のほうが走りが良い、という理屈に似ているよね。プロの世界では当然の考え方なんだけど、PCパーツの世界に降りてくると見落とされがちで、それを最初の段に据えたのがこのガイドの眼力なんだ。
一段目の中身をもう少し覗いておこう。Qwen3.8-27Bというのは、2千ドル段の担当として妙に丈夫な選択だ。この連載の調査でも、M5 Max側で29tok/s前後という数字がllmcheckに(推定)扱いで記録されていて、27B級としては素直な速さが出る。RTX 3090側でも24GBのビデオメモリに収まるサイズで、中古旗艦との相性が良い。冒頭の2千ドルで実用の模型が回り始める、というのはローカルLLMの世界の意外なほど低い参入障壁なんだよね。
二段目は約4千ドル。NVIDIAのDGX Sparkという、手のひらに載るサイズのAI専用機を薦めている。128GBのメモリを搭載していて、DeepSeek V4 Flashの2.5bit量子化版を載せる想定だ。三段目が約7千ドルのM5 Max 128GB。Appleのノートの最上級構成で、この連載で何度も見てきた128GBのユニファイドメモリを持つ。2、4、7という数字が綺麗に倍々になっていないのが、かえって信頼できるんだよね。机上で作った階段ではなく、それぞれの価格帯で実際に何が一番良いかを突き詰めた結果、こういう歪な間隔になったはずだから。
日本円でも眺めてみよう。@trevorwood222氏が日本市場での価格比較を投稿している。DGX Sparkが約62万円、M5 Max 128GBの2TBストレージ版が約74万円。ドル建ての2倍近い開きが、日本では12万円ほどに縮まれて見えるのは、為替と流通の都合なんだよね。数値は毎月揺れるけど、三段の階段という地形そのものは国境を越えて通用する。だからこのガイドは翻訳なしで世界中で読まれている。
この三段は、値段の階段であると同時に人数の階段でもある。2千ドルの段は趣味の個人。4千ドルのDGX Sparkはプロトタイピングや実験、複数の処理を同時にさばく用途向き。7千ドルのM5 Maxは、機密データを外に出せない一人の専門家、というのがこの連載で見てきた使い方だ。同じ128GB機が二段目と三段目に隣り合って並んでいるのが面白いところで、ここには設計思想の違いが横たわっている。メモリの帯域幅、つまりメモリと演算装置の間の道路の太さは、M5 Maxが約614GB/sに対してDGX Sparkは約273GB/s。単純計算で2.25倍の差だ。一方、消費電力はM5 Maxが最大約270Wなのに対してDGX Sparkは約1000W。ノート1台と、ドライヤー数台ぶんの差になる。道路の太さを取るか、CUDAという巨大な工具箱とFP4演算を取るか。この対決の詳細な判定は第12回と第13回に譲る。今日は、2千ドルの中古旗艦、4千ドルの専用機、7千ドルのノート、という三段構えの地形だけを掴んでほしいんだよね。
第一報の瞬間
@jun_song氏の仕事はガイドだけではない。もう一つ、速報の速さでコミュニティを支えている。2026年7月31日、DeepSeek V4 FlashのGA版、つまり正式公開版のDQ量子化版が128GBのMacに載る、という情報を第一報として出したんだよね。前回見たとおり、DeepSeek V4 Flashは284Bパラメータの巨大模型で、IQ2XXSという2bit級の荒い量子化で約81GBまで縮めれば128GB機に載る。ただし、公式に配布される量子化には複数のバリエーションがあって、全部が128GBに収まるとは限らない。載る載らないの瀬戸際の情報を、公開の瞬間に出してくれる人がいるかいないか。これは地味だけど、実際に機械を買おうとする人にとっては喉から手が出るほど有り難いんだ。
同じ人物の速報にもう一つ、面白いものがある。Qwen3.8-27Bを実際に1時間ほど使い込んだ上で、その出来をClaude Opus 4.6から4.8の間に相当する、と評した一件だ。ベンチマークの点数ではなく、1時間の作業レビュー。数字職人の多いこの界隈で、使った感触を横並びの大型モデルと比較して言い切る評論スタイルは、逆に鮮度があるんだよね。さらに128GBから256GB向けの最上位模型としてSuperDeepseek-V4-Flashを紹介するなど、階層ガイドの上のほうまで視野が続いている。速報、レビュー、展望。一人の投稿者の役割がこう連なっていると、もう個人メディアの体裁なんだよね。発表を待ってから書く記者ではなく、自分でも機械を回しながら、動いた瞬間に種明かしをする同時通訳のような立ち位置だ。
なぜ一報ごとの速報がこれほど要るのか。仕組みから見るとこうだ。コミュニティベンチのoMLXには、前回も見た38万行を超える実測が蓄積されている。あれは動かした人たちの事後の記録であり、地図として完璧に近い。けれど機械を買おうとしている人間が知りたいのは、もっと前の段階のことだ。この模型はこの机に載るのか。載るとしたらどの量子化なら載るのか。事前の断片情報と事後の大記録、この二つが揃ってはじめて人は財布を切れる。第一報は地図の縁を少しずつ広げる作業なんだよね。
そして第一報は単独で終わらない。@trevorwood222氏がDGX Sparkの日本での価格が約62万円、M5 Max 128GBの2TBストレージ版が約74万円という比較を投稿し、@bridgemindai氏が5,399ドルのM5 Max 128GBで実測動画を公開する。火種となる速報が出て、周囲の実測が薪をくべる。この連載で見てきた情報の燃え方の、また別の見本なんだよね。
地図の寿命
ここで少し立ち止まって、この種のガイドがなぜ貴重なのかを考えたい。ハードウェアの性能は毎年変わる。来年にはM6 Maxが出て、7千ドル段の答えも書き変わるだろう。変わらないのは判断の枠組みのほうだ。予算を三段に区切る。各段でその予算で買える一番良い道具を一つ挙げる。人数と用途を軸に選ばせる。この型は部品の名前が全部入れ替わっても崩れない。だからこそ@jun_song氏のガイドは、投稿されてから何ヶ月も経ったいまでも引用され続けていて、コミュニティの調査でも事実上の基準として記録された。流行の寿命が短いSNSの投稿としては異例の長寿なんだよね。
正直に限界も書いておこう。調査チーム自身が明かしているように、Xの投稿は検索の断片と第三者への引用で再構成されていて、@jun_song氏の全投稿を網羅した記録が手元にあるわけではない。三段の金額も為替と中古相場で常に揺れる概算だ。それでもこの地図が価値を持ち続けるのは、載っている値札そのものより、値札の貼り方のほうが長持ちするからだと思う。
地図の使い方にも、読む側の上達があると思う。最初は値段だけで段を選ぶ。次に人数で選ぶようになる。そして最後には、自分の作業の中身、つまり機密を扱うのか、処理を並べるのか、持ち運ぶのかで段を選べるようになる。冷蔵庫選びと同じで、家族の生活が見えてくると、説明を聞かなくても棚の前に立って決められるようになるんだよね。
読者が今日からできることは三つある。ひとつめ、機械を見る前に自分の予算を決め、三段のどの段に立つかを先に決めること。機械を見てから予算を考えると、必ず一段上を見てしまうんだよね。ふたつめ、2千ドル段の中古旗艦という発想を真剣に検討すること。古い頂点を漁る考え方は、グラフィックボード以外の道具選びにも応用が利く。みっつめ、@jun_song氏と@trevorwood222氏をフォローしておくこと。模型のリリース直後の載る載らないの情報は、彼らのタイムラインに最初に流れてくる。
次回は、@bridgemindai氏の実測映像。数字ではなく、動いている画面そのものが持つ説得力の話をする。