【LLLMパワーレポート #003】397Bの巨鳥、Macに舞い降りた
同日投入で9Bから397Bまで—Ornith-1.5ファミリーの全体像
Ornith-1.5というモデルファミリーのMLX移植版が、2026年9月7日時点のHuggingFaceで相次いで更新されているのを本日の索敵で確認しました。同じ日に並んだのは3つのサイズ帯です。まず小型の9Bとして、adityak74氏の「Ornith-1.5-9B-MLX-distil-oQ4」。次に中堅の35B級として、newtechstudio氏の「Ornith-1.5-35B-A3B-oQ3.5e-mtp」。そして最大峰の397Bとして、AutomatosX氏の「AX-Ornith-1.5-397B-MLX-AXQ-6bit-MTP」と「AX-Ornith-1.5-397B-MLX-AXQ-MXFP4-MTP」の2本です。
名前から読み取れるのは、oQ系の量子化やMTP(マルチトークン予測)系の工夫がファミリー全体の共通言語になりつつあるように見える点です。ただしこれはリポジトリ名からの推察で、内部構成の詳細までは確認できていません。
注目したいのは、これら4リポジトリがいずれもダウンロード数0・いいね数0で、更新日が同一日であることです。つまり登場したばかりの、まだ誰も評価を示していない状態のモデル群が一斉に並んだ形です。9Bから397Bまでという幅は、同一ファミリーの量子化移植を一気に届けようという勢いを感じさせます。なお、今号では編集部によるローカル推論の実測は行っておらず、本節は公開情報の観察にとどまります。

挿絵の説明
巨鳥を担ぐ2つの量子化—AXQ 6bitとMXFP4-MTPの役割分担
Ornith-1.5-397BのMLX移植は、AutomatosX名義で2つの量子化バリエーションが同時に公開されている点が特徴です。ひとつは「AX-Ornith-1.5-397B-MLX-AXQ-6bit-MTP」、もうひとつは「AX-Ornith-1.5-397B-MLX-AXQ-MXFP4-MTP」で、いずれも2026年9月7日時点で更新が確認できました。6bitという比較的高いビット幅のAXQ版と、MXFP4を採用した版の2本立ては、精度とメモリ容量のトレードオフに対して選択肢を二つ用意する構えだと読めます。
名前の末尾に付いた「MTP」は、両リポジトリ共通のキーワードです。ただし編集部は今号でローカル推論の実測を行っていないため、MTPの実際の挙動や、両量子化で生成速度や品質がどう変わるかについては、まだ確認できていません。
ダウンロード数とライク数は執筆時点でいずれも0と表示されており、公開直後の鮮度が高い状態です。397Bという規模を扱う以上、どちらの版がどの程度のメモリで動くのかは次節以降で検討すべき論点になりますが、まずは「同じモデルに2つの量子化が同日投入された」こと自体が、MLX向け超大規模モデルの供給が一分野として立ってきた現れだと受け止めています。

挿絵の説明
397BはMacの統一メモリでどこまで運べるか—必要容量と現実的な搭載構成を考える
Ornith-1.5-397BをMacで動かす場合、最初の関門は搭載メモリ量です。パラメータ数397Bという規模から、量子化あたりの概算容量は単純計算で見積もれます。AXQ 6bitでは1パラメータあたり6ビット強となるため、本体だけでおおむね300GB前後に達する見込みです。一方、MXFP4では4ビット換算となるため、200GB弱程度に収まる計算です。ただしこれは重みのみの理論値で、KVキャッシュやランタイム側のオーバーヘッドが別途乗る点は押さえておく必要があります。
この概算から導ける現実的な搭載構成は、提案として次のように整理できます。MXFP4版は、大容量統一メモリを備えたMac Studioクラスの最上位構成が現実的な下限となり、 余裕を持って動かすにはさらに上の構成が望ましいと考えられます。AXQ 6bit版は本体だけで300GB級となるため、市販のMacの枠を超える可能性が高く、現時点の統一メモリ搭載機では手が届きにくいのが実情です。
なお、今号では編集部によるローカル推論の実測は行っていないため、上記の容量はあくまで量子化ビット数からの概算であり、実際の動作可否や速度を保証するものではありません。それでも、MXFP4という選択肢があることで、397Bという規模のモデルがMacの統一メモリの射程内に入りつつあること自体が、本号の注目点といえます。
MLX v0.32.2とllama.cpp v0.4.0—ランタイム側の追いかけ方
Ornith-1.5のMLX版を動かすには、ランタイム側の対応状況の確認が欠かせません。GitHubで実測した最新リリースを見ると、Appleの機械学習フレームワーク「MLX」本体はml-explore/mlxがv0.32.2(2026年8月25日リリース)、その上で動くmlx-lmはv0.31.3(2026年4月22日リリース)です。MLX系モデルをMacで動かす場合は、この2層構造を意識してバージョンを揃えるのが確実です。一方、GGUF系で広く使われるllama.cppはggml-org/llama.cppがv0.4.0(2026年9月4日)に到達しており、Ornith-1.5のMLX移植公開と同じ時期に新版が出たことになります。なおollamaもv0.33.3(2026年9月2日)が最新でした。AXQ 6bitやMXFP4-MTPといった量子化形式は、新しいほどランタイムの対応可否が動作の分かれ目になります。そのため、モデルを入手したらまず自分のランタイムのバージョンと、モデルが要求する量子化形式・MTP対応の有無を突き合わせて確認するのが賢明です。申し添えますと、今号では編集部によるローカル推論の実測は行っておらず、「確実に動く」といった検証結果はまだ示せません。動作報告は今後の実測に譲り、まずはリリースノートで対応形式を確認してからモデルを入手する手順を提案します。
特別付録:MLX量子化早見表ポスター
本号の特別付録として、MLXで配布されているモデルに実際に使われている量子化形式を一望できる「早見表ポスター」を用意しました。表の材料は、本日の索敵で確認できたHuggingFace上のMLXモデル群です。具体的には、8Bit版としてN0at/DeepSeek-R1-Distill-Qwen-32B-Uncensored-mlx-8BitやMcG-221/Split-31B-mlx-8Bit、4bit版としてpgmharikrishnan/grug-35b-v2-MLX-4bit、2BitのMXFP4系としてmetalman3289/Qwen3-4B-Instruct-2507-gabliterated-mxfp4-mlx-2Bit、そしてOrnith-1.5系のoQ4、oQ3.5e、AXQ 6bit、AXQ-MXFP4といった形式が並びます。
ポスターは、量子化の種類ごとにビット幅と対応モデル名を整理し、Wallに貼って眺められるようレイアウトしたものです。なお、編集部では本号のローカル推論の実測を行っていないため、表は配布情報の確認結果の整理であり、品質や速度の評価を含むものではありません。各形式の役割の詳細については、本特集の該当節と併せてご覧いただくと見通しが立ちやすくなります。
今号の工房から
今号の取材は、2026年9月7日16時17分JST時点での実測取得を基に組み立てました。同日という一日のうちに、9Bから397BまでのOrnith-1.5系MLXモデルが並んで更新されていたことは、ハブを眺めているだけでは見落としそうな変化でした。編集部としては、まずモデル名の「並び」そのものに驚き、その後で各モデルの量子化形式や規模といった内容を掘り下げていく順番で調査を進めています。
なお、今号では編集部によるローカル推論の実測は実施していません。そのため、本編で推論速度や動作の感触に関する記述は扱っていません。代わりに、リリースノートやモデルカードといった一次情報の読み取りを中心に構成した号となっています。実測による検証が済んでいない部分については、その旨を記事内で明示する方針をとりました。実測値と一次情報を区別して読んでいただくことが、本号の信頼性を支える前提だと考えています。
大規模モデルをMacで運用する領域は、量子化方式とメモリ容量という二つの条件の組み合わせ次第で、成否が分かれやすい世界です。だからこそ、資料に並んだ数値を整理して並べてみるだけでも、自分の環境で採りうる選択肢の輪郭が少しずつ見えてきます。読者の皆さんの環境に思いを巡らせながら、本編をご覧いただければ幸いです。
今号の文章はクラウドモデルで生成し、編集部によるローカル推論の実測は行っていません。