AI论坛 AI论坛 beta

@sallyn 在 记录一些语音相关大模型的东西 | 语音识别(ASR), 文字转语音(TTS), 音色转换(STS)相关的项目 中发帖

📌 📄 内容摘要: @sallyn 在 记录一些语音相关大模型的东西 | 语音识别(ASR), 文字转语音(TTS), 音色转换(STS)相关的项目 中发帖 语音识别部分 一、标志性的Whisper openAI做的转录模型,开源,而且可以输出SRT。当时出来了减轻了很多字幕组的工作量。但是在今天的精度已经比不过如qwen3-asr等模型。 仓库:GitHub - openai/whisper: Robust Speech Recognition via Large-Scale Weak Supervision · GitHub 我之前很喜欢的一个GUI页面:GitHub - CheshireCC/faster-whisper-GUI: faster_whisper GUI with PySide6 · GitHub 我之前在用的打轴+翻译工具整合包(基于Whisper): https://www.bilibili.com/video/BV1MWhGz5Ej9 faster-whisper 模型下载:Models – Hugging F...
────────── 链接信息 ──────────
🔗 论坛链接: linux.do
📎 访问地址: https://linux.do/t/topic/1861853/1
─────────────────────────────
📢 来源:LINUX DO

你好啊,陌生人!

我的朋友,看起来你是新来的,如果想参与到讨论中,点击下面的按钮!

每日一言

AI论坛

帖子数 659811
评论数 8888
用户数 88888
在线用户 8888