核心规格
- 模型系列
- Mixtral
- 厂商/维护方
- Mistral AI
- 许可证
- Apache 2.0
- 输入模态
- 文本
- 架构
- Mixture of Experts
- 总参数量
- 46.7B
- 最大上下文
- 32768 tokens
- 激活参数量
- 12.9B
- 仅权重显存估算
- BF16:93.4 GB;INT4:23.4 GB;INT8:46.7 GB
- 建议GPU显存
- BF16:120 GB;INT4:32 GB;INT8:64 GB
MODEL SELECTION PROFILE
暂无额外部署说明。
权重显存只是部署下限。真实服务还需要预留KV Cache、批处理、上下文、框架运行开销和安全余量;MoE模型的激活参数也不能代替完整权重容量。
结合模型、并发、硬件平台、预算和交付条件,进一步确认配置边界,或匹配可租算力资源。