
Buzz 离线语音转文字实操指南5 分钟转好、改好、导出字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款基于 OpenAI Whisper 的本地语音转文字工具丢进音频或视频产出带时间轴的文字稿全程离线文件不出你的电脑。整理采访、写会议纪要、给视频做字幕都在这一个工具里完成。 快速上手第一次转录只需四步最省事的装法是下载对应系统的安装包Windows 用户双击安装即可macOS 用户下载 DMG 拖入应用程序Linux 可以执行sudo snap install buzzPython 用户pip install buzz-captions后用python -m buzz启动。首次运行按这四步走准备模型打开「Help → Preferences → Models」选中一个模型比如 base 或 small并下载。首次联网拉取模型文件之后彻底离线可用。导入文件菜单 File 里选 Import Media File或按 CtrlO也可以直接点工具栏的 。音频、视频文件都行。设置任务在弹出的表单里选 Transcribe转写或 Translate翻译手动指定音频语言——官方建议别依赖自动检测效果更稳再确认模型。运行并查看点 Run。状态变为 Completed 后双击该行打开转录详情页。主界面就是任务队列每行记录文件、模型、任务类型和实时进度。关掉窗口任务会在后台继续跑批量导入几十个文件也不用守着。 核心功能转录选项与模型怎么选解决什么问题Whisper 模型分五个档位速度和准确率是跷跷板选错了要么干等几小时要么拿到一堆错别字。在哪里操作模型选择就在导入文件后的任务表单里模型的下载与删除在「Preferences → Models」页面管理。关键选项怎么选模型档位速度准确率适合场景Tiny最快一般首次试跑、实时转写Base快尚可随手笔记、语音备忘Small中等良好会议纪要、访谈初稿Medium较慢很高重要内容精转Large最慢最高字幕制作、交付级文本建议直接给随手记录选 Base 就够要交付的字幕一步到位上 Large。档位之外还要选 whisper 类型后端Whisper官方实现稳但慢吃内存。Whisper.cppC 优化版任何显卡都能加速纯 CPU 也能实时转写Mac 用户首选。Faster Whisper有 6GB 以上显存的 NVIDIA 卡选它快一个量级。HuggingFace支持大量社区定制模型想试某语言专用优化模型就选它。任务表单的「Advanced...」按钮下还有个易漏的选项Initial prompt。把音频里会出现的专有名词、易拼错词写进去转录结果就不会写错。访谈录音尤其值得用。✍️ 转录详情页把文稿变成能用的东西双击已完成的任务进入转录详情页。它不是只读视图而是一个可以编辑的字幕工作台。解决什么问题Whisper 切出来的句子长短不一文本不能直接用需要改错、切字幕长度、再导出。在哪里操作详情页顶部工具栏集中了视图切换、搜索、播放控制、翻译、Resize字幕调整、导出等入口。每段文字都带起止时间戳点哪段就跳到音频对应位置。播放面板支持 0.5 倍到 2.0 倍速可勾选「Loop Segment」循环播放当前段、「Follow Audio」让文字跟随音频滚动。改文字自动保存用 Ctrl← / Ctrl→ 可以按 0.5 秒为单位微调段落时间戳。关键选项怎么选想导字幕导入文件时勾选 Word-Level Timings 生成词级时间戳之后点 Resize 把词级片段合并成字幕行——可设每条字幕最大长度、按标点断句、按音频静音间隙合并碎片。调完从 Export 菜单导 SRT 丢进剪辑软件即可只当文字笔记就导 TXT 或 VTT。延伸阅读文件导入文档️ 进阶用法三条主流程之外的场景1. 会议、课堂实时转写。打开 Live Recording 界面选好麦克风、语言和模型点 Record说话的同时文字就出来。长会议用 Whisper.cpp 后端配小模型默认 Whisper 的资源消耗扛不住。开始录音后还能打开演示窗口把实时文字投到大屏上结束录音后文稿以普通任务形式存在列表里可继续编辑导出。2. 文件夹监控自动转录。开启 watch folder 功能后新音频丢进指定文件夹Buzz 自动排队转写。团队协作用它最顺手录音丢进共享目录文字稿自己出来。重复导入已转过的文件时内置的 Skip Already Transcribed 插件会自动跳过不重复跑模型。3. 命令行批量处理。习惯脚本的话内置 CLI 一条命令搞定buzz add --task transcribe --model-type whispercpp --model-size small --srt 你的视频.mp4加--hide-gui还能完全隐藏界面跑批处理适合写进自动化流水线。参数全集见 CLI 文档。另外 Buzz 还有插件系统Help → PluginsAI 摘要、DOCX 导出、DeepFilterNet 降噪等都是内置项拖拽即可调整执行顺序也可以照着 plugins 源码 自己写。❓ 常见问题转得太慢怎么办换小一号的模型或把后端换成 Whisper.cpp / Faster Whisper有 NVIDIA 卡就吃满 GPU 加速同时别开太多并行任务。任务一直卡在排队多半是模型没下载完。先去「Preferences → Models」确认模型就位再添加任务。启动后闪退大概率是模型文件下载不完整在 Models 页面删掉对应模型重新下载另注意 Buzz 要求 CPU 支持 AVX2太老的机器带不动。完全离线的电脑能用吗能。先在联网机器下载好模型点「Show file location」定位模型目录整体拷贝到离线机器的同一路径即可。Buzz 适合手里语音素材多、又不想把录音传到云端的你。下一步打开「Preferences → Models」下载一个 base 模型把第一段音频丢进去。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考