Liquid AIは2026年8月4日、わずか2.6Bパラメータで高度なツール利用が可能な軽量AIモデル「LFM2.5-2.6B」を公開した。Liquid AIの技術ブログによれば、このモデルはクラウドに依存しないローカル環境での自律エージェント構築を可能にし、プライバシー保護と運用コストの低減という二つの課題に新たな解決策を提示している。

なぜ2.6Bという小型モデルが「エージェント」として実用的なのか?

Liquid AIの発表によると、LFM2.5-2.6Bは計画立案やツール呼び出し、複数ステップのタスク処理に特化して設計されている。教師モデルからの蒸留と、エージェント特化型の強化学習(Agentic RL)を組み合わせた独自の訓練手法が採用されており、サイズの約4倍のパラメータを持つモデルと同等以上の命令追従性能を実現した。従来の巨大モデルとは異なり、エージェントとしての実用性を小型モデルで追求した点が技術的な画期となっている。

Apple M5 Maxで秒間220トークンを叩き出す推論性能の正体とは?

LFM2.5-2.6Bは、その軽量性によりエッジデバイス上での高速な推論を実現する。Liquid AIの技術文書では、Apple M5 Max搭載機で秒間220トークン、Ryzen AI Max+搭載機で秒間113トークンの処理速度を達成したと報告されている。2.5GB未満のメモリで動作するため、スマートフォンやノートパソコンといった一般的な消費者向けハードウェアでの実用的な稼働が可能だ。また、llama.cppやMLXといった主要な推論エンジンに初日から対応しており、既存の開発環境へ容易に導入できる点も強みである。

クラウド依存からの脱却は開発者にどのような恩恵をもたらすのか?

LFM2.5-2.6Bの登場は、AIアプリケーション開発におけるクラウド依存からの脱却を促し、インフラ運用に大きなメリットをもたらす。デバイス内で推論が完結するため、クラウドAPI利用に伴う高額な推論コストをゼロに削減できる。さらに、データがデバイス外に出ないことでプライバシー保護が強化され、医療や金融といった機密データを扱う分野でのAI活用が加速すると見られる。これは、クラウドベースのAI経済における「GPU税」とも呼ばれるコスト構造に、構造的な変化をもたらす可能性を秘めている。

小型モデルが抱える「ハルシネーション」と信頼性の壁をどう超えるか?

LFM2.5-2.6Bは大きな可能性を秘める一方で、小型モデル特有の課題も存在する。Redditの技術コミュニティでは、ツールが誤った形式のデータを返した場合に、モデルがそれを検証せずに誤認・出力する「ハルシネーション」のリスクが指摘されている。これはエージェントの連鎖的な誤動作につながる懸念がある。今後はモデル単体の性能向上だけでなく、ツール層やプロンプトエンジニアリングによる堅牢なエラーハンドリングの確立が、ローカルエージェントの信頼性確保の鍵となるだろう。