Liquid AIが発表した「LFM2.5-2.6B」は、わずか2.6Bパラメータという軽量モデルでありながら、クラウド型AIに匹敵するエージェント機能を備えている。この画期的な技術は、AIの利用形態をクラウド依存からエッジ完結へと大きく転換させる可能性を秘めている。

なぜ2.6Bモデルが「4倍の規模」に匹敵するエージェント性能を発揮できるのか?

LFM2.5-2.6Bが軽量でありながら高性能を発揮する背景には、独自の学習プロセスがある。Liquid AIの技術ブログによれば、同社は「Agentic Reinforcement Learning(エージェント強化学習)」を採用した。これは単なる知識の詰め込みではなく、モデルが実際のツールや環境と対話しながら学習するパイプラインを構築する手法である。これにより、モデルはエージェントとしての振る舞いを最適化し、IFBenchやToolSandboxといったベンチマークにおいて、4倍以上の規模を持つGemma-4やQwen3.5といったモデルと互角、あるいはそれ以上の性能を記録している。

Apple M5 Maxで220トークン/秒、ローカル環境での実用性能はどれほどか?

LFM2.5-2.6Bは、コンシューマー向けハードウェア上での高速な推論を実現している。Liquid AIの公式発表によれば、Apple M5 Max搭載デバイスで220トークン/秒、Ryzen AI Max+搭載デバイスで113トークン/秒という実用的な速度を達成した。これは、約34兆トークンで事前学習されたモデルが、128Kのコンテキストウィンドウを持つハイブリッドアーキテクチャを採用しているためである。また、llama.cppやMLXといった主要な推論エコシステムを初日からサポートしており、開発者は追加の複雑な設定なしに、すぐにローカル環境でモデルをデプロイできる。

インフラコストの無効化がもたらす開発者への恩恵とは?

この軽量モデルの登場は、AIエージェントの導入を検討する開発者にとって、インフラコストの概念を大きく変える可能性がある。高価なH100のようなGPUを占有することなく、既存のコンシューマー向けハードウェアで実用的な速度を実現できるため、クラウドのAPI料金や専用インフラの維持コストを大幅に削減できる。特にデータプライバシーが重視される環境や、低遅延が求められるアプリケーションにおいて、デバイス内でAI処理を完結させることは大きなメリットとなる。これにより、これまでエンタープライズの特権であった高度なAIエージェントの活用が、個人の開発者や小規模なアプリケーションへと民主化されると見られる。

コーディング能力の限界と自律型エージェントの制御リスクをどう乗り越えるか?

LFM2.5-2.6Bはエージェント機能に特化しているものの、コーディング能力や知識集約型タスクにおいては、依然として大規模モデルに一日の長があることがベンチマーク結果で示されている。また、エージェントとしての自律性が高まるほど、予期せぬ挙動への制御やセキュリティリスクの管理がより困難になることは避けられない課題である。今後は、この軽量モデルが実際の商用環境でどの程度の安定性を維持できるか、また、より高度な推論を必要とするタスクに対して、どのように外部ツールと連携し限界を補完していくのかが普及の鍵となるだろう。