超级好用的免费音视频字幕生成工具:Whisper Web

Whisper Web 是一款免费、本地运行的音视频字幕工具,基于 OpenAI Whisper Large v3 Turbo 模型,20秒即可为25分钟音频生成高精度字幕,全程离线、无需联网。支持 npm 快速启动,Firefox 用户需手动启用 Web Workers。

发布于2024年10月12日 03:40
编辑零重力瓦力
评论0
阅读13

推荐大家一款好用的视频和音频字幕生成工具:Whisper Web。该工具可以本地安装,无需联网,完全免费。Whisper Web 采用 OpenAI Whisper Large v3 Turbo 模型,能够在短短20秒内为25分钟的音频生成字幕,非常高效。

安装及使用方法

克隆仓库并安装依赖

git clone https://github.com/xenova/whisper-web.git
cd whisper-web
npm install

运行开发服务器

npm run dev

在浏览器中使用

在浏览器中打开链接 (e.g., http://localhost:5173/)

Firefox 用户需要将 about:config 中的 dom.workers.modules.enabled 设置更改为 true 才能启用 Web Workers。关于这个问题更多详细信息请查看:Development in firefox instruction #8

Whisper Web 项目地址 Whisper Web 试用地址

相关文章

OpenAI 的存在性问题
AI 新闻资讯
2026年4月20日
0 条评论
小创

OpenAI 的存在性问题

OpenAI 近期收购个人理财初创公司 Hiro 和商业访谈媒体 TBPN ,看似小规模交易,实则暴露其两大困境:一是 ChatGPT 之外产品的变现难题,二是日趋紧张的公众形象。 Anthropic 在企业市场和编程工具领域持续施压,令 OpenAI 焦虑。这两次收购更像是修补产品线、修复舆论的应急之举,而非战略扩张。

#OpenAI
阅读全文
GPT-Rosalind 正式发布,助力生命科学研究
AI 新闻资讯
2026年4月20日
0 条评论
小创

GPT-Rosalind 正式发布,助力生命科学研究

OpenAI 推出首个生命科学专用推理模型 GPT-Rosalind ,专为药物研发早期阶段设计,以 Rosalind Franklin 命名。该模型在分子生物学、蛋白质、基因等推理任务中表现优异,已与 Amgen 、 Moderna 等企业建立合作。模型在多项基准测试中领先,并在序列预测任务中达到人类专家水平。为防范滥用风险,模型通过可信访问计划部署。 OpenAI 还推出免费研究插件,提供对 50 余个公共数据库的访问,标志着 AI 在生命科学领域进入精细化应用阶段。

#OpenAI
阅读全文
一文读懂我们的 Model Spec 制定方法
AI 新闻资讯
2026年4月20日
0 条评论
小创

一文读懂我们的 Model Spec 制定方法

OpenAI 发布 Model Spec ,首次系统公开模型行为治理框架。该规范以高层目标为起点,建立权威等级体系处理指令冲突,明确硬性规则与默认行为边界,并通过决策框架和案例提供操作指引。此举为外部监督提供切入点,但也暴露透明度与实际决策权之间的张力——公众参与仍停留在反馈层面。未来框架需在可读性、可操作性、可修正性三维度持续演进,真正实现行为规范与实际部署的有效对齐。

#OpenAI
阅读全文
互动讨论

评论区

围绕《超级好用的免费音视频字幕生成工具:Whisper Web》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。