Buzz 本地语音转文字:敏感录音不出门,3 步从音频到字幕
Buzz 本地语音转文字敏感录音不出门3 步从音频到字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz客户的访谈录音躺在硬盘里传云端转录既排队又担心声音数据出外网。Buzz 把 OpenAI Whisper 搬进你的电脑导入音频即可在本地离线转录免费支持 99 种语言结果导出 TXT、SRT、VTT 三种格式。Buzz 替你解决什么一句话Buzz 是跑在 Mac、Windows、Linux 上的桌面应用用 Whisper 把音频、视频和 YouTube 链接变成文字全程在你自己的机器上完成。它覆盖三类入口文件批量处理一次拖入多个音视频文件任务排队逐个转录实时录音麦克风边录边出字演讲授课时切到全屏展示窗口投给听众脚本自动化命令行接口CLI加文件夹监控适合固定流程的批量任务输出侧同样齐全TXT、SRT、VTT 三种格式字幕文件可以直接进剪辑软件多人对话还能做说话人识别转写完成后可用 AI 摘要插件自动生成概要。凭什么放心用MIT 开源协议代码公开功能不藏后门免费无订阅、无账号、无强制配置项转录完全本地化音频不经过任何服务器首次下载模型后即可断网使用官方分发齐全macOS 有 .dmgWindows 有安装包Linux 有 Snap 与 Flatpak内置 6 个官方插件并开放插件系统降噪、字幕重切、DOCX 导出都能按需启用插件源码见 buzz/plugins/安装与第一次跑通安装 Buzz。macOS 下载 .dmg 打开即用Windows 用安装包提示未验证的发布者时点更多信息→仍要运行Linux 用 Snap 或 Flatpaksudo snap install buzz开发者也可以 pip 直装需 Python 3.12 并预装 FFmpeg。选一个 Whisper 模型。首次使用会自动下载模型到本地缓存之后就是纯离线转录。把音频、视频文件拖进主界面也可以粘贴 YouTube 链接任务自动排队点开始后表格实时显示每个任务的进度完成的转写文件自动保存到本地。全程没有注册环节也没有必须填的配置。Whisper 模型大小与后端怎么选先定模型大小。没有银弹官方建议用你自己的语言实测下表可作为起点模型速度精度适合谁Tiny最快草稿级快速验证流程、低配机器Base快日常够用大批量文件的初转Small中等均衡会议、访谈等日常内容Medium较慢较好对精度有要求、硬件中等Large-V2慢高且稳定正式交付的稿件Large-V3慢最高偶发幻觉追求极致精度Turbo快速度与精度折中想要 Large 级精度又不想干等再选后端Whisper 引擎没有 N 卡或用 Mac选 Whisper.cpp走 Vulkan 可吃集显也支持纯 CPU集显笔记本上甚至能跑实时转录Nvidia 显卡且显存 6GB 以上选 Faster Whisper比原生 Whisper 快一个量级要覆盖 1000 种小语种或加载自定义模型选 HuggingFace 后端可加载 Meta 的 MMS 模型族模型名带 .En 的只支持英文小语种别选错两个立竿见影的调参习惯在初始提示里写上领域术语和人名专业内容的准确率提升明显嘈杂环境下勾选转录前语音分离多人对话的准确率会更稳进阶用法实时、字幕与脚本 实时录音边说边出字还能投屏点麦克风按钮开始录音文字随语音逐句出现。讲座或发布会时切到演示窗口转写内容放大投给现场听众。事后想核对原话在转写查看器里搜关键词、拖进度条就能定位到具体秒数。注意实时转录对算力要求高低配电脑可能追不上真实语速。字幕流水线从校对到导出视频文件走同样的转录流程完成后进入转写查看器逐句处理改错字、微调时间戳、按 2 倍速快进复查。导出菜单支持 TXT、SRT、VTT 三种格式。想让每条字幕符合播出长度启用 transcript resizer 插件按目标长度自动重切背景噪声大的录音先过一遍内置的 DeepFilterNet 降噪插件再转录效果更好。自动化文件夹监控加命令行在偏好设置里开启文件夹监控把录音固定扔进某个目录新文件会自动排队转录适合每天丢进去、下班前收结果的流程。批量场景还可以直接用 CLI 写脚本一条命令完成转录加字幕导出buzz add --model-size small --srt interview.mp3哪些情况不适合 Buzz大规模服务端批量Buzz 是桌面工具单机排队不是云端 API 服务低配电脑上的实时场景实时转录资源开销大集显笔记本建议 Whisper.cpp 加小模型或者干脆不做实时首次使用就要求完全离线模型首次需要联网下载离线机器可以先在有网电脑下载模型缓存帮助→偏好设置→模型 可定位目录再整体拷过去太老的 CPU不支持 AVX2 指令集的机器无法运行新手常问的三个问题Q转写里出现录音中根本不存在的词 A多为 Large-V3 的幻觉换 Large-V2 或 Turbo也可以先用小模型跑一遍对结果。Q没有 N 卡还能用 GPU 加速吗 A可以。Whisper.cpp 通过 Vulkan 支持集显Mac 走 Apple Silicon 优化路径。Q模型下载不完整导致 Buzz 崩溃怎么办 A在帮助→偏好设置→模型里删除已下载的模型重新下载日志可在关于 Buzz里查看并留存。更多细节参考官方文档 docs/。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
上一篇/下一篇内容由系统自动关联
返回资讯列表 →