尧图精选

Buzz 语音转录:5 步跑通本地语音转文字,外加 4 个新手必踩的坑

🕒 发布时间:2026/9/6 21:09:43 📁 来源:尧图网络
Buzz 语音转录5 步跑通本地语音转文字外加 4 个新手必踩的坑【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 语音转录是一款完全免费的开源工具它在你的电脑上离线完成音频转文字和翻译由 OpenAI 的 Whisper 模型驱动不依赖云端、不上传录音适合做会议记录、课程整理和字幕制作的新手与普通用户。这篇上手手册不堆术语只回答三件事——它能干什么、怎么最快跑起来、哪里最容易翻车。第一次打开 Buzz它到底能干哪些事刚装上别急着录音。先花 30 秒认清它的四个主战场免得功能用错地方你的场景Buzz 对应的能力一个提示手里有一段录音/视频导入文件转出文字或翻译成另一语言也支持直接粘贴在线视频链接正在开会、讲课麦克风实时转录边说边出字有专门的演示窗口适合投屏环境嘈杂、多人对话转录前做语音分离 / 说话人识别能帮你分清谁说了哪句想批量、自动化监听文件夹 命令行界面新文件丢进去自动转它不是单一功能的转写器而是一套把语音变文字、再整理导出的流水线。主界面长这样左边导入、右边是任务队列安装 Buzz按你的系统只挑一条路不同系统装法不同但你只需要下面其中一行别贪多系统装法说明macOS下载官方.dmg双击安装Intel 和 Apple 芯片都支持Windows下载.exe安装应用未签名弹出警告选仍要运行Linuxsudo snap install buzz或 Flatpakflatpak install flathub io.github.chidiwilliams.Buzz想折腾pip install buzz-captions需 Python 3.12再python -m buzz⚠️ 两个新手第一关Windows 上没签名是正常现象不是中毒Linux 用 Snap 前最好先把音频依赖装全否则录音会报错。更多细节见 docs/docs/。日常使用选哪个模型Buzz 里模型其实有两层用哪种实现后端和用多大规格尺寸。先想清楚你的硬件再往下选有N 卡且显存 ≥ 6GB→ 用Faster Whisper明显更快、更省内存。只有 CPU / 集成显卡 / Mac → 用Whisper.cpp它是 C 优化版老机器和笔记本也能实时转Mac 首选它。想要特定语言的定制模型→ 用HuggingFace后端可挂上千种语言模型。尺寸上遵循小快但糙大准但慢尺寸适合谁经验参考值以你的机器为准tiny / base低配、先试水快错得多small / medium日常主力平衡速度与准确率large / large-v3求高精度慢个别语言偶尔会脑补模型下载不用自己找路径全在设置里点帮助 → 偏好设置 → 模型下完点显示文件位置就能定位。把文件变成文字日常三步这是你会用 90% 时间的流程记住三个动作就够导入拖入音频/视频或贴一个在线视频链接。挑任务transcribe转成原语言文字还是translate转成另一语言再定语言、选上面那个模型。看结果转录完进查看器能搜、能拖播放进度、能调倍速点击某句自动跳到音频对应位置。导出支持TXT / SRT / VTT做字幕直接出 SRT 就能用。实时录音会议和演讲怎么用点工具栏的录音选设备、定语言就能边说边出字。关键在转录模式三种差别很大下方追加新句排在旧句下面最直观。上方追加新句置顶方便盯最新内容。追加并修正会回头改前面没听准的句子效果最好但最吃算力老机器慎选。想把文字同步给 OBS 做直播字幕在偏好里打开实时转录导出Buzz 会把文字实时写进一个文本文件OBS 读它即可翻译版会另存一份.translated.txt。深度定制环境变量、命令行和插件界面藏起来的调优项官方用环境变量提供启动前设好。最常用的两个变量作用什么时候设BUZZ_WHISPERCPP_N_THREADSWhisper.cpp 线程数默认约为 CPU 核心的一半官方实测 16 线程机器设成 8 可提速约 15%再往上反而变慢BUZZ_FORCE_CPU强制用 CPU 不用 GPU老显卡比 CPU 还慢时救场BUZZ_MODEL_ROOT改模型存放目录想把模型挪到别的盘不想开界面命令行一条命令就能转buzz add -m whispercpp -s small -l zh --txt 会议录音.mp3需要转完自动做点别的就看 buzz/plugins/ 里的插件系统官方自带AI 摘要、转写自动整理等装上即用。避坑清单装不上、跑得慢、连不上网遇到下面这四类先照清单自查基本不用再折腾Windows 录音报错麦克风 PaErrorCode-9999→ 去系统设置里确认 Buzz 有麦克风权限。转录慢→ 先把模型调小一档有 N 卡换 Faster Whisper没有就用 Whisper.cpp别指望大模型在弱机器上飞快。想离线用→ 在联网机器下好模型整个模型文件夹拷到离线机器的对应目录偏好 → 模型 → 显示文件位置可定位重启即认。启动就崩→ 多半是模型下载不完整删掉重下再不行看帮助 → 关于里的日志反馈。注意 Buzz 需要 CPU 支持 AVX2太老的机器跑不动。下一步建议照着做即可① 先装好并拖一小段中文音频用whispercpp small跑通转录② 听一遍查看器里的定位是否准③ 再决定要不要上 GPU 后端、要不要开实时录音导出。跑通这三步才算真正把 Buzz 用顺手。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
上一篇/下一篇内容由系统自动关联 返回资讯列表 →