Buzz离线转录:3分钟跑通的本地Whisper语音转文字工具
发布时间:2026/9/10 7:32:14 锦皓数字建站

Buzz离线转录3分钟跑通的本地Whisper语音转文字工具【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz是一款基于OpenAI Whisper模型的开源离线音频转录工具它把语音转文字这件事直接放在你自己的电脑上完成。音频、视频文件和麦克风实时录音都支持免费适合会议纪要、字幕制作、采访整理这类日常需求。3分钟装好Buzz并完成一次转录安装方式有三种按你的环境挑一种Windows / macOS到官方发布页下载对应系统的安装程序。Windows安装时会弹出提示程序未签名选更多信息后点仍要运行即可。Linux提供 Flatpak 和 Snap 两种包各一条命令装完。Python用户需要 Python 3.12 以上并先在系统里装好 ffmpeg一个音视频处理工具然后pip install buzz-captions python -m buzz第一次启动会提示下载语音识别模型这一步需要联网模型下载完成后之后就可以全程离线使用。第一次文件转录照着做打开 File 菜单选Import Media File快捷键 Ctrl/Cmd O或点工具栏的。选中音频或视频文件在语言栏明确指定说话语言。官方建议指定语言自动检测偶尔会误判。模型先选base或small模型越大越准但耗时也更长。点 Run。状态变成Completed后双击该行打开转录结果。结果界面支持搜索、播放和调速可导出为 TXT 文本或 SRT、VTT 字幕文件。Buzz擅长什么、不擅长什么一次说清擅长的MP3、MP4、WAV、M4A 等常见音视频格式的本地转录也支持导入 YouTube 链接麦克风实时录音配有专门的演示窗口演讲时可以把实时文字投到大屏硬件加速NVIDIA 显卡走 CUDAMac 走 Apple Silicon集显也能用 Vulkan说话人识别以及插件扩展AI 摘要、字幕自动重新分段等监控文件夹新文件自动转录和命令行接口适合批量处理不擅长或要绕一步的内置翻译任务只支持翻译成英文翻译成中文等其他语言要接云端 API可能产生费用实时录音的追加并纠错模式对系统负载最高性能一般的电脑不建议开录制电脑系统声音需要额外配置虚拟音频设备不支持没有 AVX2 指令集的老款 CPU场景一把会议录音MP3整理成文字纪要目标把一场会议的录音变成能直接阅读的文字稿。操作步骤按上文导入文件语言指定为中文模型用base。如果有常转录错的人名或术语可以在高级选项的Initial prompt里提前写上能明显减少拼写错误。产出结果一份 TXT 文字稿关键段落人工过一遍即可归档。场景二给视频做出能烧录的字幕文件目标得到可直接使用的 SRT 字幕。操作步骤导入视频文件勾选词级时间戳选项每个词都有时间方便后续合并。转录完成后打开结果点Resize按钮。设置每条字幕的最大字数、是否按标点断开执行合并。产出结果SRT 或 VTT 字幕文件每行长度和显示时长符合常见字幕规范。场景三活动现场的实时同声文字目标整场演讲都有实时文字跟播。操作步骤在 Live Recording 界面选好任务、语言和麦克风点 Record再打开演示窗口。产出结果句子实时追加到窗口在首选项里开启实时转录导出后文字还会同步写进一个文本文件方便后续集成到直播推流等工具。转录太慢这5个报错和症状这样处理症状可能原因处理办法转录明显偏慢模型过大换更小的模型或改用 Whisper.cpp 后端显存 6GB 以上的 N 卡可选 Faster Whisper启动时崩溃模型下载不完整在 Help → Preferences → Models 删掉对应模型后重新下载麦克风无法启动系统权限或杀毒软件拦截检查系统设置里 Buzz 的麦克风访问权限GPU 没生效驱动缺失更新显卡驱动Linux 补装 CUDA 12 相关库识别语言经常错用了自动检测手动指定语言补充两点完全离线的机器也可以跑在有网的电脑上下好模型把模型文件夹拷过去即可路径在 Preferences → Models 里点Show file location查看。想用命令行批量处理仓库里的 docs/docs/cli.md 有完整参数说明。数据与隐私本地处理对你意味着什么对普通用户来说本地处理意味着三件事音频文件和转录结果都留在你自己的机器上不会上传到第三方服务器断网环境照样能用前提是模型已就位存哪里、保留多久由你自己决定两个需要知道的小细节Buzz 默认会收集操作系统、架构这类基本使用统计可通过环境变量BUZZ_DISABLE_TELEMETRY关闭使用 AI 翻译功能时待翻译的文本会发给你配置的 API。模型存放位置、离线用法等细节可查 docs/docs/faq.md。获取源码继续深入项目采用 MIT 协议开源代码可以自行查阅和修改。想深入看实现直接克隆仓库git clone https://gitcode.com/GitHub_Trending/buz/buzz【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
锦
锦皓数字建站
深耕本土企业品牌数字化升级,专注原创端正雅致商务官网,从视觉设计到稳定运维全程保驾护航。