← 返回AI算力选型库

MODEL SELECTION PROFILE

MiniCPM-V 2.6

面向端侧和轻量部署的多模态模型,支持图像理解、OCR和视频内容分析。
资料更新:2026-07-27官方资料来源 →

核心规格

模型系列
MiniCPM-V
厂商/维护方
OpenBMB
许可证
模型卡所列许可
输入模态
文本、图像、视频
架构
Vision-Language Transformer
总参数量
8B
最大上下文
32768 tokens
仅权重显存估算
BF16:16 GB;INT4:4 GB;INT8:8 GB
建议GPU显存
量化推理:8 GB;高分辨率或视频:16 GB

软件与部署生态

  • Transformers
  • llama.cpp
  • Ollama

部署与采购注意事项

暂无额外部署说明。

不适合或需要谨慎的场景

  • 视频帧数和图像分辨率直接影响资源需求
  • 不同量化端的视觉能力需实测
HOW TO USE THIS PROFILE

不要用单个参数直接作出采购决定

权重显存只是部署下限。真实服务还需要预留KV Cache、批处理、上下文、框架运行开销和安全余量;MoE模型的激活参数也不能代替完整权重容量。

WANGYU COMPUTE SERVICE

让网昱继续核对这份算力方案

结合模型、并发、硬件平台、预算和交付条件,进一步确认配置边界,或匹配可租算力资源。