Mistral Large 4:实用模型解读
选择工作流前,理解模型架构、上下文、图片输入与发布边界。
本页目录
模型卡确定了什么
Mistral Large 4 于 2026 年 10 月 6 日进入公开预览。官方模型卡列出细粒度 MoE 架构、1.05T 总参数、52B 活跃参数和 1.6B 视觉编码器,上下文为 1M token。这些是模型规格,具体应用可以设置更小的额度。活跃参数描述每个 token 路由到的计算,不代表只需存储 52B 参数;部署内存要按实际检查点、格式、缓存与运行开销计算。
选择可以核查的任务
首次评估需要明确资料与检查标准。代码附失败测试和预期行为,文档按段落编号并要求原句,图片使用可以对照的标签。不要只看回答是否流畅。
| 任务 | 提供资料 | 核查标准 |
|---|---|---|
| 代码 | 函数与错误 | 最小补丁通过测试 |
| 文档 | 编号原文 | 证据支持每条结论 |
| 图片 | 截图与问题 | 标签匹配原图 |
| 提取 | 字段与资料 | JSON 与事实均有效 |
模型与应用限额分开
Playground 接受文字和公开 HTTPS 图片 URL,上限为 24 条消息,每条 24,000 字符,输出最多 4,096 token,不自动提供模型卡的全部上下文。直接 PDF、音频和视频上传未开放;线上模型尚待接通,本地回复为带标记样例。提供方接入应以实际端点为准,参照 API 教程,记录型号并把推理、重试计入预算。
托管还是本地部署
托管推理省去运行检查点的工作,鉴权、数据处理和工具执行仍由应用负责。公告计划在 2026 年 10 月底提供权重;正式发布后确认许可,不把计划当下载。购买硬件前读 部署指南。
保留评估记录
保存日期、准确模型 ID、提示词、资料、推理模式和输出预算,记录核查是否通过、总时间和完成任务成本,也记录失败尝试。切换生产流量前重测困难样例。计算器 估算业务量,不代表实测账单或性能。