OpenAI 升级 Whisper 语音转录 AI 模型，不牺牲质量速度快 8 倍

2024-10-05 20:00:33 自媒体 66℃ 0

文 | 光锥智能，作者 | 魏琳华，编辑 | 王一粟正在规划第八轮融资的Open AI，给投资人们描述了一个光明的未来：在《纽约时报》披露的文件中，Open AI的活跃用户和营收均保持高速增长。截至今年8月，其月收入达到3亿美金，对比年初增长1700%。今年6月，其月活达到3.5亿，是三个月前的三倍以上。据其预测，2024年，Open AI预...

IT之家 10 月 3 日消息，OpenAI 在 10 月 1 日举办的 DevDay 活动日中，宣布推出了 Whisper large-v3-t bo 语音转录模型，共有 8.09 亿参数，在质量几乎没有下降的情况下，速度比 large-v3 快 8 倍。

Whisper large-v3-t bo 语音转录模型是 large-v3 的优化版本，并且只有 4 层解码器层（Decoder Layers），作为对比 large-v3 共有 32 层。

Whisper large-v3-t bo 语音转录模型共有 8.09 亿参数，比 7.69 亿参数的 medium 模型稍大，不过比 15.5 亿参数的 large 模型小很多。

OpenAI 表示 Whisper large-v3-t bo 的速度比 large 模型快 8 倍，并且所需的 VRAM 为 6GB，而 large 模型需要 10GB。

OpenAI 升级 Whisper 语音转录 AI 模型，不牺牲质量速度快 8 倍