离线语音转写如何上手Buzz 从零跑通第一条转录的完整指南【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz会议录音攒了几十个逐条去听实在没这个时间。Buzz 把 OpenAI Whisper 装进本地程序让录音在你自己的电脑上离线转成文字不上传、不联网也能用。一分钟认识 BuzzBuzz 是一个跨平台桌面应用Mac / Windows / Linux解决一个问题把音频或视频里的语音变成可搜索、可导出的文本还能顺手翻译成另一种语言。转写引擎跑在本地适合对录音隐私敏感、或网络不便的用户。安装三条命令以内环境要求先说清CPU 需支持 AVX2 指令集近十年内的电脑基本都有从 PyPI 安装则需 Python 3.12。pip install buzz-captions python -m buzz第一条命令装好 Buzz 及全部转写依赖第二条启动程序。Linux 用户装完 PyPI 版后如启动报缺少库补装系统依赖sudo apt-get install --no-install-recommends ffmpeg libportaudio2 libyaml-dev libxkbcommon-x11-0这条命令补齐 Buzz 读取音频、弹出窗口用到的系统级组件。不想折腾 Python 环境的话Linux 上更省事的方式是flatpak install flathub io.github.chidiwilliams.Buzz。装好后第一次使用还需要给 Buzz 准备一个转写模型。模型是语音识别的大脑 Buzz 内置了多个 Whisper 实现分支界面里的 Group 下拉框就是用来切换它们的Faster WhisperNVIDIA GPU 显存 ≥6GB 时的首选速度比原版快一个量级、更省内存Whisper.cpp没有独显时的最佳选择集成显卡甚至纯 CPU 都能跑Whisper原版实现准确但慢、吃内存HuggingFace想换社区针对小语种优化的模型时用最短路径跑通第一条转录点菜单栏File → Import Media File工具栏图标快捷键 Ctrl/CmdO选中音频或视频文件。在弹出的表单里Task选 Transcribe转写或 Translate翻译成英文Language指定源语言——自动检测偶尔会猜错手动指定更稳。Model一栏确认 Group 和模型档位若尚未下载先去File → Preferences → Models标签页选好模型点Download等它进列表。按需勾选导出格式TXT / SRT / VTT点Run任务进入下方列表。状态变成 Completed 后双击该行打开转录查看器核对结果。查看器支持全文搜索、逐句播放和变速。字幕制作时勾选 Word-level timings 可以生成词级时间戳配合字幕调整功能再合并成行。模型档位怎么选模型越大越准但下载体积、显存/内存和耗时同步上涨。Buzz 界面上的档位对应大小如下档位体积适用场景tiny~73 MB快速预览、低配电脑base~139 MB日常听写速度与质量折中small~462 MB多语种、要求略高的转录medium~1.5 GB质量与速度平衡点多数场景推荐large-v3~2.9 GB追求最高准确率偶尔会脑补原话里没有的词large-v3-turbo~1.6 GB想要 large 级质量但不想等太久带.en后缀的模型只认英语多语种音频别选。GPU 显存紧张时在首选项里打开Reduce GPU RAM对 Faster Whisper 等做 8bit 量化或启动前设置环境变量BUZZ_REDUCE_GPU_MEMORYtrue老显卡反而拖慢速度时用BUZZ_FORCE_CPUtrue强制走 CPU。完全离线的机器断网会议室、涉密环境可以这样处理在联网电脑上下载模型后把模型目录拷到目标机器的相同位置Linux 是~/.cache/Buzz/models。仓库里的 scripts/download-models.py 就是为批量准备离线模型缓存写的。排障速查转录太慢→ 模型档位超出机器能力或没用上 GPU → 换 tiny/base或改用 Whisper.cpp 分支。模型下载失败/卡住→ 网络不稳定导致文件损坏还可能让 Buzz 启动即崩溃 → 在 Models 页点Delete删掉后重新下载。麦克风报错PaErrorCode-9999→ 系统没给 Buzz 麦克风权限 → Windows 检查 设置 → 隐私 → 麦克风macOS 检查系统设置的麦克风授权。装了 NVIDIA 显卡却没加速→ CUDA 版本不匹配程序静默回落到 CPU → 确认 CUDA 12 环境PyPI 版 Windows 需额外装 CUDA 版 torch。不知道模型存在哪→ 没有固定记忆路径 → Models 页下载完成后点Show file location直接打开目录。更多细节系统音频录制、快捷键、插件都在 docs/docs/ 下的官方文档里按 docs/docs/usage/ 的使用教程顺序读一遍即可。想再看深一点转写引擎与多后端实现buzz/transcriber/界面组件转录查看器、插件对话框等buzz/widgets/模型下载与档位定义buzz/model_loader.py离线模型准备脚本scripts/下一步就去 Models 页下载一个 medium 档位的模型把今天第一段会议录音丢进去转一遍。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考