核心规格
- 模型系列
- Llama 3.2
- 厂商/维护方
- Meta AI
- 许可证
- Llama 3.2 Community License
- 输入模态
- 文本
- 架构
- Dense Transformer
- 总参数量
- 3B
- 最大上下文
- 131072 tokens
- 仅权重显存估算
- BF16:6 GB;INT4:1.5 GB;INT8:3 GB
- 建议GPU显存
- INT4推理:4 GB;BF16或长上下文:12 GB
MODEL SELECTION PROFILE
暂无额外部署说明。
权重显存只是部署下限。真实服务还需要预留KV Cache、批处理、上下文、框架运行开销和安全余量;MoE模型的激活参数也不能代替完整权重容量。
提交当前页面和项目条件,网昱将从模型、并发、硬件平台、预算与交付边界继续核对,并明确下一步交付物。