← 返回AI算力选型库

MODEL SELECTION PROFILE

Whisper Large V3

OpenAI发布的多语言语音识别模型,适合转写、字幕和语音内容处理。
资料更新:2026-07-24官方资料来源 →

核心规格

模型系列
Whisper
厂商/维护方
OpenAI
许可证
Apache 2.0
输入模态
音频、文本
架构
Encoder-Decoder Transformer
总参数量
1.55B
仅权重显存估算
FP16:3.1 GB;INT8:1.6 GB
建议GPU显存
高并发:16 GB;批量转写:8 GB

软件与部署生态

  • Transformers
  • faster-whisper
  • CTranslate2

部署与采购注意事项

暂无额外部署说明。

不适合或需要谨慎的场景

  • 速度受音频长度、批量和解码策略影响
  • 口音、噪声和专业术语需要真实数据评测
HOW TO USE THIS PROFILE

不要用单个参数直接作出采购决定

权重显存只是部署下限。真实服务还需要预留KV Cache、批处理、上下文、框架运行开销和安全余量;MoE模型的激活参数也不能代替完整权重容量。

WANGYU COMPUTE SERVICE

让网昱继续核对这份算力方案

结合模型、并发、硬件平台、预算和交付条件,进一步确认配置边界,或匹配可租算力资源。