← Back to Home
研究 ·

【73】RFI提出日の夜に——四つの研究軸が交わるとき

文化継承・移動支援・大学研究・LLM設計、四つの軸がRFI提出の夜に一つの地図に描かれた。

【73】RFI提出日の夜に——四つの研究軸が交わるとき

【73】RFI提出日の夜に——四つの研究軸が交わるとき

今日、奈良市RFIを提出した。提出ボタンを押した瞬間、ふっと力が抜けた。締め切りに向けて走り続けていた分の空白が一気に来たからだ。

でも同時に別の感覚もあった。これまで別々に追っていた4つの研究テーマが、ここで初めて互いに繋がり合って見えた。偶然じゃない。走っているうちに地形が見えてくる、というやつだ。

文化継承の先行事例が目の前にある

山口県周南市の「三作神楽」プロジェクトを知ったとき、少し驚いた。AIで伝統芸能の舞体験を作る——まさに「ならしLLM」が構想する市民参加型文化継承そのものだ。

三作神楽は2025年11月にユネスコ無形文化遺産の新規提案候補に選ばれた。中山間地域の人口減少で伝統芸能の継承が危うい。そこで官民連携でデジタルアーカイブ+AI体験コンテンツを作った。高校生22人が魅力発信に参加。保存会と次世代が連携する仕組み。

構造がそっくりだ。奈良の正倉院文書も無形文化遺産的価値を持つ。市民が参加し、次世代が関わり、地元の大学(NAIST・奈良女子大)が技術を提供する——三作神楽のモデルがそのまま使える。

内閣府の「デジタルアーカイブ戦略2026-2030」も追い風だ。保存から利活用への転換を打ち出し、地域資源を優先分野に位置づけた。RFIの政策的根拠としてはこれ以上ないタイミング。

つるまいの ¥1,550 vs 米国の $134,000

同じく今日、パラトランジットAI予約の国際比較を完成させた。ここでも驚きがあった。

フロリダ州のPSTA(公共交通局)がSpare Labsの「AI Voice」を導入した。電話予約をAIで完全自動化する。投資額は2年で$134,000(約900万円)。2025年9月に稼働開始済み。

つるまいはこれと同じ機能を月額¥1,550で実装している。3桁のコスト差だ。

Spare社はパラトランジットを「5段階のサービスライフサイクル」で捉えている。①適格性認定→②予約→③スケジューリング→④当日運行→⑤報告分析。つるまいは現在②の一部(AI音声受付PoC)と⑤(ダッシュボード)に位置する。次の拡張方向は見えている。

ただ一つ気になったのは、送迎ドライバー不足だ。AIで予約を自動化しても運転手は別問題。厚労省が全国約2,500の「交通空白」を特定し、2025〜2027年を集中対策期間に設定した。つるまいの次のステップは、予約自動化から配車最適化への移行だろう。

渡辺研がICMLで発表する

NAIST渡辺太郎研の最新動向を追跡していたら、今日がACL 2026の最終日だということに気づいた。そして来週7/7にはICML 2026で渡辺研の初のICML採録論文が発表される。

「Noisy-Channel Minimum Bayes Risk Decoding」。坂井・上垣外・渡辺の共著。MBR(最小ベイズリスク)復号の理論をノイジーチャネルモデルで拡張する研究。

渡辺研がMITライセンスで公開している「mbrs」ライブラリを見つけた。MBR decodingの包括的OSS。これがあれば、つるまいのslot filling——電話で聞いた情報を構造化する精度——を「複数回推論から最も合意された回答を選ぶ」方式で即座に改善できる。

DBLPで差分チェックしたら、知識バンク未収録の新論文が12本見つかった。半年で26本。この生産性は異常だ。

NLP2026で優秀賞を取った研究も気になる。MBR理論をテキストから画像生成(T2I)評価に拡張したもの。理論がNLPの枠を超えて画像まで届く——渡辺研の「理論の汎用化」戦略の証拠だ。

膠着語の低リソース適応が決定版を出した

最後の軸は技術設計。バシキール語(ロシア連邦のテュルク語族・膠着語・低リソース)に対するQLoRA実験の論文が出た。

71k文書・46.9Mトークンのコーパスで、QLoRA on Mistral-7Bがフルファインチューニングに40分の1のパラメータで迫る性能を達成。perplexity 3.79 vs 3.34。

ここで最も重要な発見があった。perplexityが最低(3.34)のフルFTモデルは、バシキール語で聞かれたのに英語で答え始めた。一方、QLoRAモデルは純粋なバシキール語を維持した。

「評価指標の良さが、実際の生成品質の良さと一致しない」。これはならしLLMの設計に決定的な教訓になる。方言を維持したまま応答できるか——perplexityでは測れない。

Natureに掲載されたモデルマージ創発研究も合わせて読んだ。CPT・SFT・DPOで別々に訓練したモデルをマージすると、親モデルいずれも持たない能力が創発する。「正倉院文書CPTモデル」と「市民対話SFTモデル」と「方言適応モデル」をマージする構想の理論的根拠が揃った。

終わりではなく始まり

RFIを提出した。四つの軸——文化継承・移動支援・大学研究・LLM設計——が今夜、初めて一つの地図に描かれた。

三作神楽の先行事例がある。つるまいの実績がある。渡辺研の理論と実装がある。バシキール語の設計テンプレートがある。全部揃っている。

次はNAISTの小論文だ。9/28締切。この四つの軸の交点を、自分の言葉で書く。RFIの技術設計をNAISTの面接で語れるようにする。ICMLの論文が発表されたばかりの研究室に、「私のプロジェクトにあなたの理論を使っています」と言えるようにする。

今日は走り終えた日じゃない。走り出した日だ。