Buzz 完整指南本地离线 AI 音频转录把录音免费变成可编辑字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款本地离线 AI 音频转录工具基于 OpenAI 的 Whisper 模型能把电脑里的录音和视频变成文字和时间轴字幕全程不用联网。这篇指南把从安装、调参到进阶玩法的坑都踩过一遍整理出来你照着走就能出结果不用再自己翻文档。你的痛点它替你解决如果你用在线转写网站时被按时长收费或者稍长的文件就要付费墙拦着。 如果你担心会议录音、访谈素材上传到第三方服务器后泄露。 如果你所在的环境经常断网而在线服务一断网就彻底罢工。Buzz 把音频处理全部留在本机不上传、不计时、不联网。如果你中过上面任何一条继续往下读。它和在线转写差在哪维度在线转写服务Buzz数据流向上传到第三方服务器全程留在本机费用按时长计费或订阅开源免费离线能力断网不可用完全可用平台覆盖大多只有网页版Windows / macOS / Linux性能上限受服务器排队影响GPU 加速纯 CPU 也能跑数据不出本机开源永远免费有显卡更快没有也能跑⚡ 从安装到拿到第一份文稿先装好客户端Windows 双击安装包走完向导macOS 下载 .dmg 安装Linux 用 Flatpak/Snap或pip install buzz-captions后运行python -m buzz细节见 安装说明把文件丢进去三种方式任选点工具栏的按钮按快捷键CtrlOmacOS 是CmdO直接把文件拖进窗口YouTube 链接也能粘贴进去直接导入选参数、点运行在任务面板选好任务类型、语言、模型和输出格式点运行任务进队列多个文件会排队并发处理拿结果处理完在转录窗口看到逐句带时间戳的文字可复制也可导出 TXT、SRT、VTT 三个决定输出质量的开关任务类型选转录输出和原音频同语言的文本选翻译非英语内容直接输出英文。选错的话你只是想要文字稿却拿到一份英文翻译语言自动检测对长音频够用但短片段、多语言混杂时手动指定更稳。支持 99 种语言中文、日语、德语等主流语种全覆盖模型大小tiny/base 最快适合实时转录small/medium 是日常甜点区间large 精度最高留给重要材料。选小了漏关键词选大了等得久更多选项见设置面板里的模型管理已下载的模型和可下载的模型一目了然。 容易被忽略的能力字幕整形 Resize解决字幕行要么太长看不完、要么太碎频繁跳的问题。打开转录窗口进入 Resize 工具设定目标长度它会按标点和时间间隔自动重新断句、合并过碎的字幕、拆分超长句给 B 站或 YouTube 适配格式就是改几个数字的事。实时转录 演示窗口解决会议、课堂上说话的人还在讲文字还没出来的问题。点麦克风按钮就开始吃麦克风输入说话的同时屏幕出字还能投到专门的演示窗口放大展示直播加字幕、现场出纪要都能用。说话人识别解决多人录音分不清谁说了什么的问题。转录完成后它自动给不同发言者打标签会议记录、访谈整理不用再来回猜。 让它自己干活文件夹监控在设置里指定一个监控文件夹之后新音频丢进去就自动开始转录全程不用碰鼠标适合定期更新的播客和批量堆积的课程录音入口在 监控设置源码 对应的偏好面板。插件机制内置插件按需开关AI 摘要生成、字幕优化、跳过已转录文件、增强语言检测、导出 DOCX拼一套自己的工作流即可源码在 buzz/plugins/。命令行适合批量任务和定时脚本示例# 转录单个文件并指定中文 buzz add --task transcribe --language zh audio.mp3 # 用 Whisper.cpp 后端 small 模型转录同时导出 SRT 和 VTT 字幕 buzz add --task transcribe --model-type whispercpp --model-size small --srt --vtt interview.mp4 # 把一批文件翻译成英文 buzz add --task translate *.mp3完整参数见 CLI 文档。找到你的位置学生/老师导入课程录音 → 导出 TXT 笔记 → 按时间戳跳知识点视频创作者导入视频 → Resize 统一行宽 → 导出 SRT 进剪辑软件职场人实时转录 说话人识别 → 直接产出结构化会议纪要研究者批量导入访谈 → 按说话人区分 → 导出文本做分析少走弯路的几个提醒先用小模型摸底tiny/base 快速过一遍全部文件重要的再换 large 重跑让硬件配得上模型NVIDIA 记得开 CUDAApple Silicon 直接用优化版纯 CPU 就选小一号模型先清理输入再转录环境嘈杂时先勾选提取语音准确率提升明显把专有名词填进初始提示词人名、地名、术语填进去识别率肉眼可见地变好批量任务开跳过已转录插件重复跑同一批文件时自动跳过已完成项❓ 你可能想问的Q必须联网吗A不用。所有处理在本机完成只有主动选 OpenAI API 后端时才需要网络。Q支持多少种语言A99 种中、英、日、德等主流语言都覆盖转录和翻译都支持。Q能处理多长的音频A没有硬性限制几秒到几小时的录音都可以。Q结果存到哪里A可在转录窗口直接查看和导出所选格式的 TXT/SRT/VTT 文件随源文件一起生成。Q没有显卡会慢很多吗A会但纯 CPU 照样能跑用 tiny 或 small 模型保持速度即可。一句话总结从把听写外包给第三方到变成完全可控的本地能力Buzz 让声音变成可搜索的文字资产。现在就下载它导入第一段录音看字幕长出来。官方文档docs/docs/【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考