【LLLMパワーレポート #006】ランタイム戦国、v0.4.0 vs v0.34.0
9月4日と5日、1日違いで上がった2つのバージョン
2026年9月、ローカルLLMを支える「土台」の世界で、興味深い出来事が起きました。llama.cppのv0.4.0が9月4日に、ollamaのv0.34.0が9月5日にリリースされたのです。GitHubの実測日付によれば、その差はわずか1日です。
両プロジェクトはどちらもローカルで大規模言語モデルを動かすためのランタイムであり、多くの利用者が同じ土台の上でモデルを選び、比較しながら使っています。その両者が立て続けにメジャーアップデートを公開したというのは、偶然とは言い切れないタイミングです。数字で見ると、llama.cppのv0.4.0は「0.4.0」、ollamaは「0.34.0」と、バージョンの付け方は異なりますが、いずれも長い開発の積み重ねを経た到達点と受け止められます。
一方で、この1日違いのリリースが互いを意識したものなのか、それとも単なる偶然なのかについては、資料からは読み取れません。ここは推測を挟まず、事実として「1日違いで2つの新版が上がった」ことだけを確認しておきます。とはいえ、ローカルLLMの利用者からすれば、選択肢の土台が同時期に更新されるのは歓迎すべき状況です。次節以降では、それぞれのバージョンが何を届けてくれたのかを見ていきます。

挿絵の説明
llama.cpp v0.4.0、労せずして定番であり続ける故障の少ない仕組みの底力
llama.cppの最新リリースは、ggml-org/llama.cppのv0.4.0で、GitHubの実測では2026年9月4日にリリースされています。翌9月5日のollama v0.34.0と1日違いという、本号のテーマを形作る日付です。ローカルLLM推論の土台ともいえるプロジェクトであり、こうした定番ツールが着実にバージョンを重ねているという事実そのものが、エコシステム全体の安定性を示す材料になると考えられます。
ただし、今回の資料に含まれているのは、リポジトリ名・バージョン番号・リリース日の実測値のみです。変更点の内容や性能面の変化については記録がなく、したがって「故障の少ない仕組み」としての具体的な改良点に触れることは、現時点では控えるのが誠実な扱いといえます。とはいえ、リリース日の事実だけからでも、基盤側の更新が途切れることなく続いていることは読み取れます。同じ時期にllama.cppとollamaという二大ランタイムが相次いで新版を出したことは、ローカルLLMを支える土台の競争が今も続いていることの傍証になるでしょう。また、編集部によるローカル推論の実測は本号では実施していないため、動作面の評価も今回の対象外です。v0.4.0の中身に迫るには、公開されているリリースノートの精読という作業が、次の一段として必要になるでしょう。

挿絵の説明
ollama v0.34.0、動けばすぐ試せる手軽さで攻める
ollamaのv0.34.0がリリースされたのは、llama.cpp v0.4.0の翌日、2026年9月5日です(GitHub実測)。1日違いの発売は、読者に「競っているのだ」と実感させる十分なタイミングです。llama.cppが緻密な仕組みの堅さで存在感を示すのに対し、ollamaの持ち味は、動けばすぐ試せる手軽さにあると本稿は捉えています。
ollamaはモデルの取得から対話の開始までを滑らかにつなぐ使い勝手が評価されてきたランタイムであり、新規にローカルLLMに触れる層の入口としての役割が大きいといえます。バージョンが1日違いで上がったという事実は、土台となる推論エンジンをめぐる開発が今も活発で、互いに歩調を合わせるように、あるいは意識し合うように更新が続いていることを示しています。
もっとも、本号では編集部によるローカル推論の実測を行っていないため、v0.34.0そのものの動作速度や品質についての評価はここでは述べません。リリース日から読み取れるのは、llama.cppが9月4日、ollamaが9月5日と、ほぼ同時期に新版を用意したという事実のみです。手軽さを武器に利用者を迎える陣営と、堅牢さで定番を守る陣営が、同じ週に揃って動きました。この1日差は偶然かもしれませんが、両プロジェクトが互いを強く意識している構図を感じさせると編集部は見ています。
mlx-lm v0.31.3、4月から動きのない静かなワークベンチ
llama.cppとollamaが9月4日と5日という近さで新版を投入する一方、Apple Silicon系のmlx-lmは静かな時間を過ごしています。GitHub実測によれば、mlx-lmの最新リリースはv0.31.3、日付は2026年4月22日です。あれから約5か月、新版の公開は確認できません。
ただし、静かさの意味は一通りではありません。基盤であるml-explore/mlx本体は2026年8月25日にv0.32.2をリリースしており、プロジェクト全体が停止しているわけではなさそうです。パッケージとしてのmlx-lmの更新が止まる一方で、土台側は動きを続けています。
面白いのはその外側の生態です。HuggingFaceのMLXモデル最新12件はすべて2026年9月11日付の更新で、モデルのほうは毎日のように新規投入が続いています。とはいえ、12件のいずれもダウンロード数・いいね数が0という、まだ誰の目にも触れていない状態でした。llama.cppやollamaでは人気モデルが数百万〜千万単位のダウンロードを集めていることと並べると、配布の熱量と受け手の規模との温度差が見えてきます。
mlx-lmだけ更新が途絶えた理由は、資料からは分かりません。静かなワークベンチが次に動くのかどうかも、現時点では推測の域を出ません。
人気モデルの数字から見る、土台の上で何が起きているか
人気モデルのダウンロード数を眺めると、ランタイムの「土台」とモデル需要の関係がうかびあがります。全体トレンド上位10にはQwen/Qwen3.8-27Bが732万2476ダウンロードでランクインし、派生でもunslothのQwen3.8-27B-GGUFが1112万7203、ISTA-DASLabのQwen3.8-27B-GSQ-RCO-GGUFが61万4850と、GGUF形式のモデルが目立つ数字を記録しています。GGUFはllama.cpp系のエコシステムで広く使われる形式であり、上位にGGUF版が複数並ぶことは、llama.cpp v0.4.0という土台の更新とモデル需要の流れが重なる構図を示唆します。ただし、これはダウンロード数の傾向からの推測です。
一方、MLX形式の動きも示唆的です。HuggingFaceのMLXモデル最新更新12件は、すべてダウンロード数0・いいね0という実測結果でした。MLXモデルが全く使われていないと断定することはできませんが、直近の更新分に限れば数字がまったく動いておらず、mlx-lmのリリースが4月22日のv0.31.3で止まっている状況と並べて見ると、静けさが数字にも表れていると読めます。なお、今号では編集部によるローカル推論の実測は行っていないため、ここで述べるのはすべて公開データ上の数字に基づく観察です。土台の更新頻度とモデル形式の需要の間にどの程度の連動があるのかは、今後の数字の推移を見守るのがよさそうです。
特別付録:別冊付録:2026ランタイム更新カレンダー(4プロジェクト比較)
本特集の締めくくりとして、4プロジェクトの更新日付を一つの年表に並べ、2026年の「土台」の歩みを俯瞰しておきたいと思います。まずllama.cppです。GitHub実測ではv0.4.0が2026年9月4日にリリースされており、特集の前半で見たとおり、秋の更新合戦の口火を切るタイミングでした。続くollamaは、そのわずか1日後の9月5日にv0.34.0を投入しています。この日付の近さは、両プロジェクトが互いの動向を意識せざるを得ない関係にあることを、数字以上に雄弁に物語っていると感じられます。Apple製ハードウェア向けのml-explore/mlxは、2026年8月25日のv0.32.2が最新で、夏の終わりまで地道な更新を続けています。一方、その上で動くml-explore/mlx-lmは、2026年4月22日のv0.31.3を最後に更新が確認できておらず、前半で触れた静かなワークベンチの状況がここでも数字で裏づけられます。年表として並べると、春に動きを止めた一方と、秋の1日違いで競り合う両者、そして夏に細々と歩む mlxという、4つの異なるリズムがはっきりと浮かび上がります。なお、ここで示したのは編集部が実測取得した時点での日付です。今後の更新状況はそれぞれのリポジトリをご確認ください。
今号の文章はクラウドモデルで生成し、編集部によるローカル推論の実測は行っていません。