首页 / 资讯中心 / 文章详情

Buzz 离线语音转文字:本地免费跑通 Whisper 转录的完整指南

Buzz 离线语音转文字:本地免费跑通 Whisper 转录的完整指南 ★ FEATURED ARTICLE
Buzz 离线语音转文字本地免费跑通 Whisper 转录的完整指南【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz一段两小时的会议录音躺在硬盘里你需要一份能直接读的文稿。Buzz 是一个离线语音转文字工具全部在你自己电脑上运行基于 OpenAI 的 Whisper 模型音频全程不出机器也不按量收费。适合谁用Buzz 面向想把语音变成文字、又不想把文件传到云端的人。导入文件、选模型、点运行文本就在本机生成免费开源。适用的 3 类场景做字幕的播客、视频创作者需要批量产出 SRT 文件整理访谈、讲座录音的研究员需要带时间戳的文稿活动组织者需要现场把发言实时变成字幕不适合的 2 类场景要一次转几百小时音频——本地硬件扛不住请分批处理录音含几十种语言混杂的频道切换——单语言任务表现更好安装与首次运行Windows从官方发布页下载安装包双击运行。程序未签名弹窗警告时选更多信息→仍要运行。macOS下载 .dmg 拖入应用程序。注意只支持 Apple Silicon 机型Intel 机型最后可用版本是 1.4.5。Linux一条命令装 Flatpak 版本flatpak install flathub io.github.chidiwilliams.Buzz首次运行前要下载一次模型打开偏好设置Ctrl/Cmd ,→模型选好后端和尺寸后点击下载文件会自动缓存到本机之后断网也能用。跑通第一个任务最小闭环 4 步导入按 Ctrl/Cmd O或点工具栏选一个音频或视频文件。看到任务出现在列表里即成功。配置任务选 transcribe语言手动选中文别用自动检测模型选 Whisper.cpp 的 base 或 small。运行点 Run。中等配置的笔记本用 base 模型约 10–15 秒转完 1 分钟音频转 2 小时录音约 20–30 分钟。看结果状态变成 Completed 后双击该行打开转录查看器可播放音频、搜索文字、导出 TXT/SRT/VTT。 参数怎么选模型大小对比Whisper 标准模型模型大小速度精度tiny约 75 MB最快适合试跑一般base约 142 MB快可用small约 466 MB中等较好medium约 1.5 GB慢高large约 2.9 GB最慢最高取舍建议日常速记用 base 或 small重要资料再上 large。太慢时先换后端而不是换模型——Whisper.cpp 纯 CPU 和集显都能跑Faster Whisper 需要至少 6GB 显存的 Nvidia 显卡速度比原版 Whisper 快一个量级。三个关键参数语言手动指定。自动检测在口音重或嘈杂的音频上容易判错语种。初始提示在 Advanced 按钮里填入人名、术语能明显减少专有名词的误识别。词级时间戳默认关闭只有后面要精细调字幕时才打开。放进你的场景后期制作给节目做 SRT 字幕要解决什么两小时节目音频变出能直接导入剪辑软件的字幕。用到哪些功能导入 MP3 → 语言选中文、勾选词级时间戳 → 转录完成后用 Resize 按标点拆分长句、合并过短的条目 → 导出 SRT。最后得到什么时间码对齐的 SRT 文件拖进时间线即可上屏。研究整理多人访谈分说话人要解决什么两小时双人访谈变成分角色标记的文字稿。用到哪些功能转录前打开提取语音降噪在转录查看器里逐段标注说话人导出 TXT。最后得到什么带时间戳的访谈稿边听边核对随时修改。现场活动实时字幕要解决什么培训现场把发言人内容即时投到屏幕上。用到哪些功能新建录音转录任务并选好麦克风 → 打开演示窗口投屏 → 偏好里开启实时文本导出TXT 文件可接 OBS。最后得到什么一块能投大屏的字幕画面外加一份同步给 OBS 的 TXT。常见坑转录不准先查哪按顺序查语言是否手动指定自动检测会误判→ 录音是否嘈杂开语音分离→ 模型是否偏小升一级。专名错得离谱就把词写进初始提示。完全断网的机器能用吗可以。先在有网电脑上下好模型通过偏好设置 → 模型 → 显示文件位置找到模型目录Linux 为 ~/.cache/Buzz/models整个拷到离线机的相同路径。仓库里的 scripts/download-models.py 支持批量预缓存。转录太慢或电脑卡换 Whisper.cpp 后端或把模型降一档有 6GB 以上显存的 Nvidia 卡可以试 Faster Whisper。实时转录务必用小模型否则跟不上语速。录音没声音报 PaErrorCode 错误结论多半是麦克风权限问题。检查系统隐私设置是否允许 Buzz 访问麦克风杀毒软件也可能拦截。Buzz 启动就崩溃多数是模型下载不完整到偏好设置 → 模型删掉后重新下载另注意 CPU 需要支持 AVX2太老的机器跑不起来。 使用前自查模型已下载完成能通过显示文件位置打开模型文件夹语言是手动选的没有留在自动检测导出格式选对文稿用 TXT字幕用 SRT 或 VTT实时场景已确认麦克风权限正常演示窗口能打开机器较老时先确认 CPU 支持 AVX2再排查软件问题更多细节可查 官方文档 和 常见问题。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
阅读完成 · 觉得有帮助?
咨询建站