MODEL SELECTION PROFILE

Mistral 7B Instruct v0.3

生态成熟的7B开放权重指令模型,适合英文应用、函数调用和资源有限的本地部署。
资料更新:2026-07-27官方资料来源 →

核心规格

模型系列
Mistral 7B
厂商/维护方
Mistral AI
许可证
Apache 2.0
输入模态
文本
架构
Dense Transformer
总参数量
7.3B
最大上下文
32768 tokens
仅权重显存估算
BF16:14.6 GB;INT4:3.7 GB;INT8:7.3 GB
建议GPU显存
BF16:20 GB;INT4推理:8 GB

软件与部署生态

  • Transformers
  • vLLM
  • llama.cpp
  • Ollama

部署与采购注意事项

暂无额外部署说明。

不适合或需要谨慎的场景

  • 中文任务需单独评测
  • 上下文长度低于部分新模型
HOW TO USE THIS PROFILE

不要用单个参数直接作出采购决定

权重显存只是部署下限。真实服务还需要预留KV Cache、批处理、上下文、框架运行开销和安全余量;MoE模型的激活参数也不能代替完整权重容量。

WANGYU COMPUTE SERVICE

需要形成正式方案时,由网昱继续推进

提交当前页面和项目条件,网昱将从模型、并发、硬件平台、预算与交付边界继续核对,并明确下一步交付物。