フランス発のAIスタートアップ・Mistral AIが、最大規模モデル「Mistral Large 4」のプレビュー版を公開した。開発チームが愛称として付けた**「Le Chonk」(でかいやつ)というニックネームが示す通り、総パラメータ数は1兆500億**という圧倒的なスケールを誇る。
Mistral Large 4の主な特徴
- アーキテクチャ: MoE(Mixture of Experts)型を採用。全パラメータを常に動かすのではなく、推論ごとに必要な「専門家」モジュールだけを活性化するため、実効コストを抑えながら大規模なモデル能力を引き出せる。
- マルチモーダル対応: テキストだけでなく画像認識にも対応。さらに推論モードと指示応答モードを動的に切り替えられる設計になっており、タスクに応じた柔軟な使い方が可能だ。
- セキュリティ性能: サイバーセキュリティとコーディングの評価で特に高いスコアを記録。脆弱性再現テストでは全モデル中最高を達成したとされており、セキュリティ専門家やペネトレーションテスターにとっても注目の存在になりそうだ。
- オープンウェイト公開予定: モデルの重みは10月末にオープンウェイト形式で公開予定。商用・研究問わず幅広い用途での活用が期待される。
なぜこれが重要なのか
GPT-4oやGemini Ultraといったクローズドモデルが高性能AI市場を席巻するなか、Mistralはオープンウェイトという旗を降ろさずに規模を拡大し続けている点が際立っている。1兆パラメータ級のモデルをオープンで公開するという判断は、コミュニティへの強いコミットメントであり、同時に「大きなモデルはクローズドでなければ成り立たない」という業界の常識への挑戦でもある。
MoEアーキテクチャの採用も賢明な選択だ。単純に密なモデルを1兆パラメータに膨らませれば推論コストは天文学的になるが、MoEであれば実際に動くパラメータ数を絞れる。セルフホストや微調整を検討している組織にとっても、現実的な選択肢になり得る。
個人的な所感
Le Chonkというニックネームのセンスに思わず笑ってしまったが、中身は笑えないレベルの本気度だ。サイバーセキュリティ評価でトップを取ったというのは、単なるベンチマーク競争とは違う実用的な強みを示している。月末の正式公開後、コミュニティがどんなファインチューンや用途を生み出すか、今から楽しみでならない。
参照元: Mistral Large 4 – Mistral AI 公式ブログ
日本語解説: ITmedia NEWS