OpenAI 升级 Whisper 语音转录 AI 模型,不牺牲质量速度快 8 倍
摘要:
今日迎来赛季季前赛揭幕湖人不敌森林狼勒布朗詹姆斯安东尼戴维斯休战湖人摆出杰克逊海耶斯克里斯蒂拉塞尔里夫斯八村塁的首发之家月日消息在月日举办的活动日中宣布推出了语音转录模型共有亿参数...
NBA今日迎来2024-25赛季季前赛揭幕,湖人107-124不敌森林狼。勒布朗-詹姆斯、安东尼-戴维斯休战,湖人摆出杰克逊-海耶斯、克里斯蒂、拉塞尔、里夫斯、八村塁的首发。
IT之家 10 月 3 日消息,OpenAI 在 10 月 1 日举办的 DevDay 活动日中,宣布推出了 Whisper large-v3-t bo 语音转录模型,共有 8.09 亿参数,在质量几乎没有下降的情况下,速度比 large-v3 快 8 倍。
Whisper large-v3-t bo 语音转录模型是 large-v3 的优化版本,并且只有 4 层解码器层(Decoder Layers),作为对比 large-v3 共有 32 层。
Whisper large-v3-t bo 语音转录模型共有 8.09 亿参数,比 7.69 亿参数的 medium 模型稍大,不过比 15.5 亿参数的 large 模型小很多。
OpenAI 表示 Whisper large-v3-t bo 的速度比 large 模型快 8 倍,并且所需的 VRAM 为 6GB,而 large 模型需要 10GB。
Whisper large-v3-t bo 语音转录模型大小为 1.6GB,OpenAI 继续根据 MIT 许可证提供 Whisper(包括代码和模型权重)。
IT之家援引 Awni Hannun 结果,在 M2 Ultra 上,将 12 分钟的内容转录为 14 秒。