Mistral AI
Mistral AI 是法国巴黎的 AI 公司(2023 年成立),专注开源大模型与推理优化。 是欧洲最强、全球第二的开源 LLM 提供者(仅次于 Meta 的 Llama)。
关键产品
| 模型 | 参数 | 类型 | 特点 |
|---|---|---|---|
| Mistral 7B | 7B | Dense | 早期开源标杆 |
| Mixtral 8x7B | 47B | MoE | 早期 MoE 标杆 |
| Mistral Small | 22B | Dense | 商用版主力 |
| Mistral Medium | ~70B | Dense | 商用版高配 |
| Mistral Large | ~123B | Dense | 商用版旗舰 |
| Codestral | 22B | Dense | 代码专用 |
| Mistral NeMo | 12B | Dense | NVIDIA 合作 |
关键技术亮点
- Sliding Window Attention(inference):每层只看最近 N 个 token 的 attention, KV cache 显存大幅下降。
- 早期 MoE 实践:Mixtral 8x7B 让业界看到 MoE 能训好。
- 极致推理优化:自研 vLLM、TensorRT-LLM 内核,跑得比 Llama 还快。
商用模式
- 开源 + 闭源双轨:基础模型开源(Apache 2.0),旗舰模型闭源(La Plateforme API)。
- 欧洲合规:GDPR / EU AI Act 友好,欧洲政府 / 金融客户首选。
- 价格优势:比 GPT-4 / Claude 便宜 5-10x,质量接近。
与 Llama 对比
- 生态:Llama >> Mistral(社区微调模型、HuggingFace 集成)。
- 多语种:Mistral 略好(法语母语 + 欧洲多语种训练数据)。
- 推理速度:Mistral 通常比同尺寸 Llama 快 10-20%。
- 文档 / 论文:Mistral 论文质量高(技术细节披露充分)。
适用
- 欧洲企业(合规要求)。
- 成本敏感的中小团队。
- 需要推理速度的实时应用。
限制
- 旗舰模型闭源,无法本地部署 Large 版本。
- 中文能力不如 Qwen / DeepSeek。
- 社区规模比 Llama 小一个数量级。