OpenAI 升级 Whisper 语音转录 AI 模型,不牺牲质量速

2024-10-03 12:45:32

  OpenAI 在 10 月 1 日举办的 DevDay 活动日中,宣布推出了 Whisper large-v3-turbo 语音转录模型,共有 8.09 亿参数,在质量几乎没有下降的情况下,Whisper large-v3-turbo 语音转录模型是 large-v3 的优化版本,并且只有 4 层解码器层,作为对比 large-v3 共有 32 层。

  Whisper large-v3-turbo 语音转录模型共有 8.09 亿参数,比 7.69 亿参数的 medium 模型稍大,不过比 15.5 亿参数的 large 模型小很多。

  Whisper large-v3-turbo 语音转录模型大小为 1.6GB,OpenAI 继续根据 MIT 许可证提供 Whisper。

  援引 Awni Hannun 测试结果,在 M2 Ultra 上,将 12 分钟的内容转录为 14 秒。

  GitHub:

  模型下载:

  在线体验:

下一篇:丰田大押宝“飞行汽车”eVTOL,向 Joby 公司额外投
上一篇:《双狼》电影掀起全球狂潮,刷新苹果 Apple TV+
返回顶部小火箭