Buzz 四步完成离线语音转录,录音文件不出本机
Buzz 四步完成离线语音转录录音文件不出本机【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz会议录音里有客户的报价没法交给任何云端语音转文字服务。这种情况用 Buzz 就能解决它是一个本地语音识别的桌面工具把 OpenAI 的 Whisper 模型跑在你自己的电脑上音频直接在本机处理录音文件始终不离开这台机器。它也可以当作免费字幕生成器结果能导出成字幕文件交给剪辑软件直接使用。一分钟认识Buzz它是什么一款免费的离线语音转录桌面应用支持对音频和视频文件做转录也支持把内容翻译成目标语言。底层技术基于 OpenAI 的 Whisper 模型系列提供 faster-whisper、whisper.cpp 等多个推理后端可以根据自己电脑的硬件选择。运行方式完全本地。首次使用时下载一次对应模型之后断网也能继续转录。转录结果保存在本机数据库里随时可以检索历史任务。更多细节可以参考官方文档 docs/docs/。三种系统安装方法 Windows从官方发布页下载安装包并运行。程序没有做签名安装时如果弹出安全警告选择更多信息再点仍要运行即可。macOS下载 .dmg 文件把应用拖进应用程序文件夹。原生适配 Apple Silicon 芯片在 M 系列 Mac 上速度很快。Linux通过包管理器安装任选其一# Flatpak flatpak install flathub io.github.chidiwilliams.Buzz # 或 Snap sudo snap install buzz开发者也可以跳过安装包执行pip install buzz-captions后用python -m buzz启动需要 Python 3.12 环境和 ffmpeg。四步完成第一次转录 ▶️第一步导入音频。点击主界面左上角的按钮选择文件音频、视频都可以加入任务列表。第二步选模型与语言。在任务行的设置里选择模型档位——小模型快、大模型准——并手动指定音频语言。任务类型分转录和翻译两种选翻译会直接输出译文。第三步运行转录。点击运行多个文件可以排队并行处理每个任务有独立的进度条等待期间可以去做别的事。第四步查看并导出。双击任务行打开转录查看器逐行核对文字时间轴可以拖动调整文本可直接修改也支持关键字搜索。确认无误后在导出菜单里选择 TXT、SRT 或 VTT后两种可以直接导入视频剪辑软件。值得展开的功能 实时录音转录。适合开会、做讲座时需要现场出稿的场景。点击录音按钮并选择模式append below只做追加append and correct还会回头修正之前识别错的句子。产出是实时更新在界面上的文字也可以切到演示窗口投到大屏上。文件夹监视。适合一次性处理大量录音。在设置里开启文件夹监视指定输入目录和输出目录输入目录里每放入一个新的音频文件Buzz 就自动转录并把结果写进输出目录还可以勾选处理完删除源文件。说话人识别。适合访谈、圆桌这类多人对话。处理完成后文本按说话人打上标签整理成稿时能按人拆分。字幕长度调整。适合做字幕的人。调整大小功能按间隔合并或拆分字幕行控制每行字数导出 SRT 后可直接投放使用。这个功能和AI 摘要一样由插件系统 plugins/ 提供。让识别更快更准的两类设置 ⚡提速选小一档模型tiny 或 base 档位的转录速度明显更快配置低的电脑够用。选对后端Nvidia 显卡用 faster-whisper 后端更快whisper.cpp 后端支持 Vulkan 加速Mac 上用它最合适。开启 GPU 加速Buzz 对 Nvidia 显卡的 CUDA 加速开箱即用老显卡或纯 CPU 环境会自动回退。转录期间关掉占内存和 CPU 的后台程序。提准手动指定语言不要留自动检测短音频或口音明显的内容更容易判断对。填写初始提示把专有名词、人名、行业术语写进去识别会向提示词靠拢。重要内容用大模型large-v3 档位精度最高宁可多等几分钟。在安静环境录制噪音是拉低识别率的最大因素。模型也可以集中管理帮助→设置→模型里可以下载和删除各档位的模型文件它们存放在本机缓存目录没有联网条件的机器可以把模型目录整个拷过去。你可能遇到的问题 ❓转录太慢怎么办先按提速一节的四条逐项排查如果还是慢说明设备确实吃不动换小一档的 Whisper.cpp 模型再试特别长的录音可以切段分批处理。识别准确率不高怎么办对照提准一节的设置调整换更大的模型、手动指定语言、填上初始提示如果原始录音本身嘈杂最稳妥的办法还是在安静处重录一遍。支持哪些格式音频MP3、WAV、M4A、OGG、OPUS、FLAC视频MP4、WEBM、MOV、MKV、AVI、WMV。视频文件会自动提取音轨再转录不需要手动转格式。手头有不能上传云端的敏感录音或者有一批访谈要出文字稿可以先把 Buzz 装上挑一个文件从导入到导出走一遍十分钟就能验证它是否适合你的工作流。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
上一篇/下一篇内容由系统自动关联
返回资讯列表 →