
Buzz 语音转文字离线 Whisper 转写的完整本地方案【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz两小时的会议录音存了三个月整理文案的时间比开会还长。Buzz 让语音转文字这件事在你自己的电脑上离线完成音频不出本地断网也能用。这篇文章带你装好 Buzz、跑通第一次离线 Whisper 转写并搞懂模型怎么选、字幕怎么导出、卡住了怎么办。适合谁用Buzz 的能力边界音频不上云转写完全在本地运行基于 WhisperOpenAI 的语音识别模型适合合同录音、采访素材这类不想上传的音频。免费无调用费不像在线转写服务按分钟收费本地跑没有 API 费用。不是在线服务它不提供服务端部署也不能多人共享一个转录库是单机桌面工具。不吃特殊硬件普通 CPU 电脑可用 Whisper.cpp 引擎Nvidia 显卡可装 CUDA 加速没有显卡也不会卡死只是慢。不适合的场景如果你需要网页端团队协作、或者音频格式极特殊如电话回路的单声道老磁带Buzz 帮不上忙。五分钟跑通第一次转录按最短路径走装好 → 导入 → 出字。平台操作注意点Windows从 SourceForge 下载官方安装包双击安装安装包未签名弹警告时选仍要运行首次会下载基础模型预留约 1GB 空间macOS下载.dmg直接安装仅支持 Apple 芯片Intel Mac 需使用 1.4.5 及更早版本Linux执行flatpak install flathub io.github.chidiwilliams.Buzz从 Flathub 安装snap 方式装完还需执行sudo snap connect buzz:password-manager-service接入系统密码管理器装好后做这三步按CtrlO导入一个 mp3 或 wav 文件左侧任务列表出现一条新任务模型保持默认Base 就够验证等进度条走完双击结果右侧逐句显示文字和时间戳——流程通了。更细的系统依赖和 pip 安装方式见 docs/docs/installation.md。三个最常用的使用场景把已有音频转成带时间戳的文档目标一段录音变成可校对、可改错、可导出的文字稿。步骤CtrlO导入文件 → 选语言和模型 → 等待完成 → 双击结果进入查看器 → 点中任何一句直接改字不用重跑CtrlP边听边校对。产出物TXT 纯文本或 SRT/VTT 字幕导出按钮在结果区右上角。CtrlE看纯文本、CtrlT看时间戳、CtrlL看译文。开会边说边出字目标会议、讲座进行中实时生成字幕。步骤CtrlR打开录音窗口 → 选麦克风和语言 → 模型选 Base 或 Small实时场景速度比准确率要紧→ 选转录模式新句子排末尾或排最前直播字幕选追加在上方→ 点录制。产出物实时刷新的文字流在偏好里打开 Live transcript exports 后文字还会同步写进 txt 文件可以接 OBS 做投屏字幕。导出能直接用的字幕文件目标把碎句合并、长句拆开输出长度均匀的字幕。步骤转录时开启 word-level timings → 结果区点Resize → 设定每行最大长度 → 按规则自动合并拆分 → 导出 SRT 或 VTT。产出物符合字幕规范的 SRT/VTT 文件可直接挂到播放器或视频软件上。模型怎么选看电脑配置和用途引擎层面Whisper.cpp 最适合大多数人本地跑、支持量化、CPU 也能用Hugging Face / Faster Whisper 适合有 Nvidia 显卡想要 CUDA 加速的情况OpenAI Whisper API 则把音频发出去处理与不上云的定位相悖除非你只是测试。你的情况直接选会议录音、日常转写Small主流配置跑得快准确率足够实时录音Base 或 Tiny跟得上说话速度是第一优先正式文稿、长文档定稿Medium 或 Large慢但错字最少磁盘紧张、只要个草稿Tiny1–2 分钟就能出结果会议录音选 Small 就够了Large 纯属浪费算力。偏好窗口Ctrl,可以下载和删除模型不用自己去网页找文件选 Whisper.cpp 时还能填.bin文件的下载链接加载任意量化模型如q_5。两个真正改变体验的调优现象原因一条解法长音频转得慢默认线程数是 CPU 核心数的一半未必是这台机器的最优值设环境变量BUZZ_WHISPERCPP_N_THREADS8官方测试 16 线程笔记本设 8 提速约 15%再往上反而变慢显存不够、长音频爆掉模型占满 GPU 内存偏好里开Reduce GPU RAM等价于BUZZ_REDUCE_GPU_MEMORYtrue用 8bit 量化压缩模型环境变量写在启动脚本里最省事Linux/macOS#!/bin/bash export BUZZ_WHISPERCPP_N_THREADS8 export BUZZ_FAVORITE_LANGUAGESzh,en,ja buzzBUZZ_FAVORITE_LANGUAGES把常用语言置顶BUZZ_FORCE_CPUtrue可在显卡出问题时强制走 CPUBUZZ_MODEL_ROOT用来给模型换存储盘。完整清单见 docs/docs/preferences.md。卡住了怎么办故障速查现象处理办法转得太慢换小一号模型Small→Base把BUZZ_WHISPERCPP_N_THREADS调到核心数一半左右模型下载中断、加载失败偏好窗口删掉该模型重新下载磁盘满了设BUZZ_MODEL_ROOT换目录GPU 报错、驱动冲突BUZZ_FORCE_CPUtrue强制 CPU 模式慢一点但稳实时转录跟不上说话速度实时场景换 Small 或 Base别用 Medium/Large语言列表太长找不到BUZZ_FAVORITE_LANGUAGESzh,en置顶常用语言常用快捷键都在偏好窗口的快捷键页里可改完整定义在 buzz/settings/shortcut.pyCtrlO导入文件、CtrlR录音、CtrlF搜文字、CtrlX取消当前转录。下一步丢一段 1–2 分钟的音频用 Base 模型跑一遍确认流程通了再挑大模型处理正式素材。Buzz 的价值在于把语音变文字从付费云服务变成了本地免费工具音频全程不出机器。想扩展能力可以在 Help → Plugins 里启用 AI 摘要、导出 Word、说话人识别等内置插件用法见 docs/docs/usage/7_plugins.md。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考