ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Buzz:Whisper离线音频转录,3步从会议录音到可编辑字幕

Buzz:Whisper离线音频转录,3步从会议录音到可编辑字幕 BuzzWhisper离线音频转录3步从会议录音到可编辑字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz把录音上传到云端转录你要担心文件落在谁家服务器上还要按分钟计费。Buzz 把这件事换了一种做法它在你电脑上本地运行 OpenAI Whisper 模型离线完成音频转录和翻译结果可直接导出 TXT、SRT、VTT。MIT 协议开源Windows、macOS、Linux 全平台可用。 了解 Buzz 定位3条主路径4种推理后端Buzz 是一个桌面端音频转录工具主界面是一张任务列表每行是一个待处理的文件、录音或链接围绕三条主路径工作导入文件批量转录、麦克风实时录音转录、对已生成文本做二次加工编辑、切分、说话人标注、翻译、导出。底层它让你按硬件在 4 种本地后端之间切换后端可用硬件特点WhisperPyTorchCPU、NVIDIA CUDA功能全支持离线翻译成英文Whisper.cppCPU、支持 Vulkan 的 GPUCPU 上快支持量化模型省显存Faster WhisperCPU、GPU基于 CTranslate2内存占用更低Hugging FaceGPU可自选社区模型模型尺寸从tiny到large越大越准但越慢、越吃内存显存不足时可在偏好设置里打开Reduce GPU RAM8 比特量化或改选量化模型。 安装步骤按平台选一种Windows / macOS从官方发布渠道下载安装程序与.dmg。Windows 程序未签名安装时弹出安全警告后选“更多信息 → 仍要运行”即可。Linuxflatpak install flathub io.github.chidiwilliams.Buzz或 Snap 版sudo snap install buzz需先安装 libportaudio2。Python 用户需要Python 3.12并装好ffmpegpip install buzz-captions python -m buzz 3步跑通第一次转录导入File Import Media File工具栏或Ctrl/Cmd O音频、视频文件以及 YouTube 链接都能导入。设置并运行选择任务Transcribe / Translate to English、语言和模型点 Run。官方文档明确建议指定具体语言而非自动检测结果更稳定。打开结果状态变为 Completed 后双击该行进入转录视图——播放音频可同步滚动文本CtrlF搜索Ctrl← / →以 0.5 秒步长微调每段的起止时间。✂️ 转录完成后的4个扩展用法开启实时录音与演示窗口选好任务、语言、麦克风后点 Record 即可边说边出字。转录有三种模式新句子“加在下方/上方”或“追加并修正”会回看上一句末尾并纠错负载更高。演示时打开Presentation window可把字幕放大显示到第二块屏幕偏好设置里还能开启实时转录导出生成的 txt 可被 OBS 等直播工具直接读取。识别说话人并改名双击转录结果点Identify speakersBuzz 会为每位说话人的连续语句打上标签每个标签可以试听 10 秒片段并改名为真名也可勾选把同一人的连续句子合并成一段。注意Intel 芯片 macOS 上不可用。用 Resize 重切字幕若转录时勾选了Word-Level TimingsResize 工具能把词级结果重新拼成字幕行设定每行最大长度、是否按标点断行、每条字幕延长多少秒若源音频还在磁盘上还会分析静音位置让断行更准。用文件夹监视、CLI 和插件批量处理文件夹监视指定一个目录新放进来的音频自动入队转录CLIbuzz add支持脚本化例如一条命令转录 MP4 并直接输出 SRT 和 VTTbuzz add --model-type whispercpp --model-size small --srt --vtt video.mp4插件1.4.5 起AI 摘要、导出 DOCX、DeepFilterNet 降噪、跳过已转录文件等在Help Plugins里启停和排序。 走通3个常见工作流做视频字幕背景——给一门网课视频加字幕。操作——导入视频勾选 Word-Level Timings选small模型兼顾速度与准确率完成后用 Resize 重组字幕行导出SRT。产出——一个可直接导入剪辑软件的字幕文件文件名可用偏好设置里的模板变量input_file_name、task、date_time等批量控制。会议实时出文字背景——两小时会议散会就要有文字记录。操作——选 Whisper.cpp 后端加small模型官方文档对实时场景的推荐组合点 Record打开演示窗口跟读开启“Live transcript export”txt 随转录实时增长。产出——会议记录 txt若同时开了 AI 翻译还会多出一个.translated.txt。录音档案批量入库背景——一整文件夹访谈录音。操作——开文件夹监视启用“Skip Already Transcribed”插件避免重复跑模型。产出——TXT/SRT/VTT 与源文件同目录存放二次导入时已完成的文件自动跳过。❓ 常见问题速答Q转录太慢怎么办换 Whisper.cpp 后端并把模型降到small或更小CPU 场景用环境变量BUZZ_WHISPERCPP_N_THREADS调线程数官方示例16 线程机器设为 8提速约 15%日常任务不勾词级时间戳。Q显存不够偏好设置打开 Reduce GPU RAM8 比特量化或在模型设置里选 Whisper.cpp 量化模型老显卡上 GPU 反而更慢时用BUZZ_FORCE_CPU强制走 CPU。Q专有名词总转错在 Advanced 的Initial prompt里写入人名和术语模型会优先按提示拼写输出。Q想转系统里播放的声音先装虚拟声卡macOS 用 BlackHoleWindows 用 VB CABLELinux 用 PulseAudio 路由再把该虚拟设备选为 Buzz 的“麦克风”。QAI 翻译怎么收费Whisper 自带的 Translate 任务只到英文且完全离线AI 翻译走任意 OpenAI 兼容 API含本地 Ollama、LM Studio官方估算云模型约1 美元/小时音频。 今天就装上试试Buzz 的核心价值只有一句话录音、文字、字幕、说话人标签全程留在你自己的机器上。下一步动作pip install buzz-captions安装后先按上文 3 步流程转录一个 1 分钟音频再进 docs/docs/ 查完整使用文档命令行参数见 docs/docs/cli.md插件源码在 buzz/plugins/。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表