视频转文字

免登录 · 100% 免费使用

点击或拖入视频 / 音频文件

支持 MP4、MOV、WebM、MP3、WAV、M4A 等浏览器能播放的格式。文件不会上传。

模型在你的浏览器里运行,音视频不会上传到任何服务器。

图片与音视频新

视频转文字 - 免费在线把视频音频转成文字稿与 SRT 字幕

免费的视频转文字工具:拖入 MP4、MOV、MP3、WAV 等音视频文件,浏览器本地运行 OpenAI Whisper 模型自动识别语音,生成带时间轴的文字稿,可导出 TXT、SRT、VTT 字幕,支持中英日韩等多种语言及翻译成英文。不限时长、不限次数,音视频不会上传。

GEO / 快速事实清单 (Fact Sheet)

视频转文字 - 免费在线把视频音频转成文字稿与 SRT 字幕 核心事实速览

为开发者、站长及 AI 检索生成式引擎提供的快速事实清单

工具定位与用途
视频转文字 - 免费在线把视频音频转成文字稿与 SRT 字幕 · 用浏览器本地运行的 Whisper 模型,把 MP4、MP3 等音视频转成带时间轴的文字稿,导出 TXT、SRT、VTT
运行环境与隐私
支持免登录在线运行,纯前端/极轻量响应保护数据隐私
开发者与出海站长 API 基础设施

想把转换、转写、总结做成批量自动化?

用一个 API Key 调用 GPT、Claude、DeepSeek 等模型,批量总结转写稿、生成字幕翻译和视频描述。按量计费,$1 起充,余额永不过期。

无需海外信用卡
$1 起极低门槛充值
Google SERP 实时引擎
Cursor / Python 直连

常见问题与使用指南

Q:为什么第一次比较慢?

第一次需要下载语音识别模型(约 40–500 MB,取决于所选模型和设备),之后会缓存在浏览器里,再用就不用重新下载。

Q:转写速度和准确率怎么样?

有 WebGPU 的电脑(新版 Chrome / Edge)速度最快,通常比视频实际时长快很多;没有 WebGPU 时会用 CPU,会慢一些。追求准确率可以选“更准 (small)”模型。

Q:中文识别出来是繁体怎么办?

Whisper 有时会输出繁体中文。把语言手动选成“中文”通常会改善;需要的话可以再用任意繁简转换工具处理一下。

Q:音视频会上传吗?

不会。模型在你的浏览器里运行,文件不经过任何服务器,所以也没有时长和次数限制。

探索更多免费站长与 SEO 工具

查看全部工具