Buzz 完整指南:免费本地转录,三步把会议录音变成文字 Buzz 完整指南免费本地转录三步把会议录音变成文字【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一个免费开源的离线转录工具基于 OpenAI Whisper 在你的电脑上完成音频转录与翻译——录音不用上传到任何服务器结果直接落在本地支持 Windows、macOS、Linux 三大平台。本文从安装讲起依次走完文件转录、实时录音、字幕导出三条最常用的路径最后给你两个批量处理的自动化捷径。 第一次转录把一段会议录音变成文字三大平台各有一条安装路径Windows 下载官方 .exe 安装包安装时若提示未知发布者选更多信息 → 仍要运行即可macOS 下载 .dmg 拖入 ApplicationsLinux 任选一条命令# Flatpak 方式 flatpak install flathub io.github.chidiwilliams.Buzz # 或 Snap 方式 sudo snap install buzz导入音频做三个决定点工具栏的或 CtrlO选入 MP3、WAV、MP4 等音频或视频文件也可以粘贴 YouTube 链接。导入时只需要决定三件事任务是 Transcribe 还是翻译成英文语言建议手动指定自动检测只靠开头几秒判断混杂音频容易跑偏模型先用默认值下一节细讲。点 Run等状态变成 Completed双击该行即可打开转录结果。第一次运行的稳妥参数30 分钟以内的文件选 base 或 small 模型普通电脑几分钟能跑完语言写中文就填 zh导出格式默认 TXT 即可。⚡ 挑一个和你的硬件匹配的 Whisper 模型按大小定速tiny 到 large 差 30 倍模型体积与速度、准确率大致成正比tiny 约 75MB 最快但错字多base 约 142MBsmall 约 466MBmedium 约 1.5GBlarge 约 2.9GB 精度最高。日常会议和课程录音 small 通常够用重要内容再上 medium 或 large。模型只下载一次并缓存到本机Linux 在~/.cache/Buzz之后断网也能继续转。有 N 卡选 Faster Whisper没有选 Whisper.cpp官方 Whisper 实现准确但吃内存Faster Whisper 在 6GB 以上显存的 N 卡上快一个数量级Whisper.cpp 是 C 实现没有独显的笔记本靠集显甚至纯 CPU 也能跑实时转录Mac 上首选它。完全离线的机器把模型文件夹拷过去在一台联网电脑上下载好所需模型通过 Preferences → Models 的Show file location找到缓存目录把模型文件夹拷到离线机器的相同位置就能用仓库里的 scripts/download-models.py 就是专门用来预生成离线模型缓存的。️ 实时录音开会、听讲座边说边出字麦克风直出文字在实时录音面板选好任务、语言和麦克风点 Record说出的话逐句变成文字。实时场景官方文档建议切到 Whisper.cpp 后端并选小模型否则任务队列会越积越长。第二屏投出实时字幕录音进行中会多出一个 Presentation window 选项打开后大字号字幕投到另一块屏幕适合现场同传展示或让观众实时看到文稿。多人对话分清谁说了什么转录完成后在查看器里点 Identify speakersBuzz 会给每句话标上说话人标签可试听任意一句的 10 秒片段确认身份并把自动标签改成真名保存时勾选合并同一说话人的句子整场对话就按人归好了。✂️ 转录后处理改错字、调字幕、导出三种格式逐句校对文字与时间戳查看器里每句话都带时间轴点哪句音频就跳到哪个位置播放还能调节播放速度改错字、合并或拆分句子直接在行内表单里完成。字幕太长用 Resize 重新切分导入时若勾选了 Word-Level TimingsResize 就能按最大字幕长度把词句重新合并并按标点断句还能给每条字幕统一延长显示时长原音频文件还在的话它会分析静音区间让切分更准。导出 TXT、SRT 或 VTT改完点导出TXT 进笔记软件SRT 拖进剪辑软件当视频字幕VTT 用于网页端字幕。 两个自动化捷径命令行与文件夹监控一条命令批处理装好 PyPI 版需 Python 3.12 与 ffmpeg命令为pip install buzz-captions后终端里可以直接跑buzz add --task transcribe --language zh --model-type whisper --model-size small 会议录音.mp3加--srt --vtt可同步导出字幕文件完整参数见 docs/docs/cli.md。文件落进文件夹就自动转在 偏好设置 的 Folder Watch 标签页指定一个目录之后任何丢进去的音频都会自动排队转录——适合每天把当天录音丢进同一个文件夹的固定工作流。 落地建议三条起步路径与两个常见坑新手第一天的顺序用 base 模型转一段 5 分钟以内的短音频跑通导入 → 运行 → 打开结果全流程换 small 模型重转同一段对比错字率建立对模型大小的体感试一次实时录音并导出 TXT检查格式是否符合你的笔记习惯。两个容易踩的坑不指定语言自动检测依赖开头几秒音频中英混杂的内容经常猜错手选语言准确率明显更高。老电脑跑不起来Buzz 需要 CPU 支持 AVX2太老的机器无法运行另外模型下载残缺会导致崩溃到 Preferences → Models 删除重下一次即可。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考