Buzz 离线语音转文字十分钟跑通第一条本地转录【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz录音堆了一抽屉文字稿却迟迟不出Buzz 的回答是在本地转。它把 OpenAI 的 Whisper 模型跑在你自己的电脑上99 种语言开箱即用数据不出本机。这篇文章带你从安装、第一条转录走到编辑、批量处理全程离线。装上就能跑一次说清安装与启动三个平台各有一条最短安装路径一张表说清平台包管理器命令Windowswingetwinget install ChidiWilliams.BuzzmacOSHomebrewbrew install --cask buzzLinuxFlatpak / Snapflatpak install flathub io.github.chidiwilliams.Buzz或sudo snap install buzz装好后在终端输入buzz主窗口打开即代表安装成功。不想走包管理器也可以到发布页下载对应平台的安装包。Buzz 有两套入口图形界面处理单个文件和实时录音命令行处理批量任务底层共用同一套转录引擎。注意Windows 安装包未做代码签名安装时弹出安全警告属正常现象点更多信息再仍要运行即可项目本身开源可查。想追未发布的改动克隆仓库git clone https://gitcode.com/GitHub_Trending/buz/buzz按 README 装依赖即可。你的第一条转录最小路径五步导入菜单栏文件 → 导入媒体文件Ctrl/Cmd O或点工具栏的加号图标。MP3、WAV、MP4、MOV 都能选解码由内置能力完成。选参数弹窗里三个下拉框按下表填即可。参数怎么选Task任务同语言转录选 Transcribe直接出英文选 Translate to EnglishLanguage语言知道语言就手动指定自动检测偶尔判断失误Model模型新手从 base 或 small 起步运行点Run任务进入队列主界面实时显示进度。文件越大、模型越大耗时越长属正常现象。等待完成状态变为 Completed列表会记下每条任务用的模型、任务类型和最终耗时。查看结果双击任务行打开转录查看器带时间戳的文字逐段呈现。到这一步第一份转录稿已经落库。让文字真正能用编辑、断句、导出三件套双击即改在时间戳表格里双击文本单元格直接编辑改动自动落盘不用手动点保存。播放/暂停用Ctrl/Cmd P。微调片段起止时间Ctrl/Cmd ←/→调开始Ctrl/Cmd Shift ←/→调结束。查看器还有三种视图时间戳表、纯文本、翻译按需切换。断句重组字幕最怕断句生硬长句被拦腰截断。点工具栏的 Resize可设字幕最大长度、按标点分割、按静音间隙合并一键重组成规整字幕行。前提只有一个转录前勾选了词级时间戳否则这部分功能不可用。改到满意就导出。导出路径和默认文件名模板可在偏好设置里自定义格式一句话用途TXT纯文本直接放进文档SRT / VTT字幕文件导入剪映、Premiere、B 站JSON带完整元数据供程序处理DOCXWord 文档继续排版性能与质量的平衡杆模型选择策略模型从小到大为 tiny、base、small、medium、large每升一档准确率、内存、耗时同步上调。纯 CPU 就能跑有 NVIDIA 显卡再上 CUDA 加速。按你的硬件 × 你的场景对号入座低配机或实时场景whisper.cpp 后端加 tiny/base秒级出结果日常批量转录small 到 medium速度和准确率的折中点口音复杂、术语密集上 large建议配 GPU 使用内存吃紧选 whisper.cpp 的量化版如 q_5用一点精度换速度和显存。NVIDIA 用户在偏好设置里看到 CUDA 选项就打开它large 模型的转录能从小时级压到分钟级。模型管理在偏好设置 → Models已下载的和待下载的分别在左右两栏勾选后点 Download 即可。从单条到批量录音、翻译、CLI 三条扩展线如果你还需要录音出稿切到 Live Recording 标签选麦克风、语言和模型点 Record文字随语音逐行生成。实时转录吃性能务必用 whisper.cpp 加小模型。想要边说边改把录制模式切到 Append and correct它会回头修正刚生成的句子代价是更吃硬件。演示窗口能把实时字幕投到外接屏或直播间演讲同传很好用。要转录系统声音播客、会议软件Windows 装 VB-CABLE 虚拟声卡macOS 装 BlackHole 并在音频 MIDI 设置里建多输出设备Linux 用 pavucontrol 把应用音频重定向给 Buzz。如果你还要多语言任务选 Translate to English 是 Whisper 原生翻译离线可用。翻到其它目标语言需在偏好设置填一个 OpenAI 兼容的 API 地址和密钥再在查看器点 Translate 并附一句翻译指令。本地用 Ollama、LM Studio 跑个兼容模型也能接上。云端翻译一小时音频约 1 美元量级全本地则零花费。如果你要批量buzz add一次吃进多个文件——buzz add --task transcribe --model-type whispercpp \ --model-size small --srt --vtt 访谈.mp3 会议录音.wav常用参数--language zh指定语言、--prompt写入专有名词减少错字、--task translate切换翻译任务。五个高频故障的 30 秒修复中文识别不准语言停在自动检测了手动指定 zh 重新转录。实时转录跟不上语速换 whisper.cpp 后端加 tiny 或 base 小模型。Resize 断句不可用转录时没勾词级时间戳重新转录并勾选该项。GPU 没生效确认驱动装好且偏好设置里出现 CUDA 选项想强制纯 CPU设BUZZ_FORCE_CPUtrue。国内下载模型慢设HF_ENDPOINThttps://hf-mirror.com走镜像细节见官方文档。现在就去跑你的第一条转录抽屉里那堆录音从今天起有了出口装上 Buzz把最急的那份录音丢进去点 Run收一份能搜索、能编辑、能导出的文字。觉得顺手给仓库点个 Star遇到故障或新想法提 Issue 或 PR 都行。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考