Mistral Large 4:実践的なモデル概要

ワークフローを選択する前に、アーキテクチャ、コンテキストウィンドウ、画像入力、リリース境界を理解してください。

選択的に接続されたエキスパートモジュール、長いドキュメント、画像入力を持つ概念的なモデルアーキテクチャ。
このページの内容

モデルカードが示すもの

Mistral Large 4は6,年2026.月にパブリックプレビューを開始しました。公式モデルカードには、きめ細かなmixture-of-expertsアーキテクチャ、合計1.05兆パラメータ、52億のアクティブパラメータ、1.6億パラメータのビジョンエンコーダーが記載されています。コンテキスト仕様は1Mトークンです。これらの数値はモデルを説明するものであり、特定のアプリケーションではより小さな許容量が適用される場合があります。

アクティブパラメータ数は、トークンに対してルーティングされる計算を表しています。デプロイが52億パラメータのみを保存することを意味するわけではありません。メモリ計画は、総チェックポイントとその実際のフォーマットから始め、キャッシュとサービングのオーバーヘッドを加えます。

検証できるタスクを選ぶ

有用な最初の評価は、既知のソースと確認可能な結果を持ちます。コーディングタスクには失敗するテストと期待される動作を与えます。ドキュメントタスクには番号付きの文章を与え、引用を求めます。画像タスクには検査できるラベルを与えます。流暢な回答だけを品質の唯一の尺度として使用することは避けてください。

タスク提供するもの確認するもの
コーディング関連する関数とエラー最小限のパッチがテストを通過
ドキュメント番号付きのソース文章証拠が各主張を裏付ける
画像スクリーンショットと質問ラベルが元と一致
抽出フィールドとソースJSONと事実が有効

サービス制限を分けて考える

プレイグラウンドは貼り付けたテキストと公開HTTPS画像URLを受け付けます。アプリケーションの許容量は24メッセージ、1メッセージあたり24,000文字、最大4,096出力トークンです。モデルカードの完全なコンテキストを自動的に提供するわけではありません。直接のPDF、音声、動画のアップロードは利用できません。チャットコントロールを使用して出力の長さと形式を選択し、重要な詳細はソースと照合して確認してください。

プロバイダー統合については、実際に呼び出すモデルとエンドポイントの制限を確認してください。APIガイドを使用し、評価記録にモデルバージョンを保持し、表示される出力だけでなく推論と再試行も予算に含めてください。

ホスト型アクセスとデプロイの選択

ホスト型推論はチェックポイントの運用を回避しますが、アプリケーションは認証、データ処理、ツール実行を引き続き所有します。リリース発表では、2026.年10月末に重みが予定されています。スケジュールをダウンロードとして扱うのではなく、実際のリリースとライセンスを確認してください。ハードウェアを選ぶ前に確認すべきことはデプロイガイドで説明しています。

小さな評価記録

日付、正確なモデルID、プロンプト、ソース、推論モード、出力予算を保存してください。回答がチェックを通過したか、合計時間、完了したタスクのコストを記録します。比較には失敗した試行も含めてください。本番トラフィックを変更する前に、難しい例を繰り返してください。コスト計算機はワークロードの見積もりに役立ちます。測定された請求額やパフォーマンス結果ではありません。

自分の作業からタスクを試す

ソース資料を持ってきて、結果を確認してください。

ワークスペースを開く