在线生成字幕

支持格式:MP4 / MP3 / WAV,音频文件需 < 2 小时且 < 200 MB

这是 Text To Speech 提供的在线 SRT 字幕生成工具,基于 AI 语音识别,上传音视频即可自动生成带时间轴的字幕文件。

支持中文(简体)、英语、日语、韩语、德语、法语、西班牙语、葡萄牙语、意大利语、印地语等 10+ 语种,适合 YouTuber、播客、网课、短视频创作者使用,生成的 SRT 可直接导入剪映 / PR / Final Cut。

📂 点击选择或拖放音视频文件

支持 MP4 / MP3 / WAV,单文件 < 200 MB、< 2 小时

💡 使用说明

  • 上传 MP4 / MP3 / WAV 格式的音视频文件
  • 文件需 小于 2 小时小于 200 MB
  • 选择对应语种可提高识别准确率
  • 生成完成后点击"下载 SRT"即可获得带时间轴字幕文件
  • SRT 文件可直接导入剪映、Premiere、Final Cut 等剪辑软件

常见问题

生成的 SRT 字幕是什么格式?能用在哪里?

SRT(SubRip Text)是最通用的字幕格式,包含序号、时间轴(HH:MM:SS,mmm)和字幕文本三行一组。可导入剪映、Premiere Pro、Final Cut Pro、DaVinci Resolve、OBS 等绝大多数剪辑与播放工具。

支持哪些语种?识别准确率如何?

目前下拉菜单内置 13 种常用语种(中文简体 / 英语美英印 / 日韩德法西葡意印地),后端基于 Azure 语音识别。清晰人声+标准口音下准确率 90%+;背景音乐重、多人对话、方言混杂会下降。

生成失败一般是什么原因?

常见原因:① 文件超过 200MB 或 2 小时;② 音轨损坏 / 只有视频轨没有音频轨;③ 语种选错(比如日语音频选了中文);④ 含违禁或特殊字符。建议先确认音轨可播放再上传。