ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

三步搞定 Windows 离线语音转文字:TMSpeech 免费工具备手指南

三步搞定 Windows 离线语音转文字:TMSpeech 免费工具备手指南 三步搞定 Windows 离线语音转文字TMSpeech 免费工具备手指南【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeechTMSpeech 是一款免费开源的 Windows 离线语音转文字工具它捕获电脑正在播放的声音识别计算全部在本地完成结果实时上屏为字幕并同步落盘成日志文件。适合需要会议纪要、课程笔记和字幕生成的用户。 三步上手解压、装模型、开始识别TMSpeech 无安装向导、无需注册账号最短路径如下获取程序从 Release 页面下载压缩包并解压或执行git clone https://gitcode.com/gh_mirrors/tm/TMSpeech拉取源码自行构建运行TMSpeech.exe首次启动会自动生成配置文件与日志目录无需手动初始化安装模型后开始进入设置界面的资源页给中/英/双语模型之一点安装等待下载完成中文模型约 300MB回到主界面点开始按钮即可出字幕。配置改乱了也没关系运行 Release 包自带的配置重置脚本bat即可回到出厂默认状态。能解决什么问题整条链路属于本地语音识别音频文件不离开你的电脑同时也是一个离线字幕生成器。按场景看用法会议纪要捕获会议软件的内音并实时转成文字当天识别结果按日期落盘会后稍作整理即成纪要在线课程讲解内容变成字幕实时跟随漏听的要点可事后从历史记录里回看原文无字幕视频把视频声音转成语幕条窗口放在播放器下方不遮挡画面听力练习搭配英文或中英双语模型边听外语材料边对照字幕校准理解。关键配置怎么选音频源、识别器与模型三组核心选项按用途直接对号入座选项组选项适用场景建议音频源系统音频电脑播放的全部声音覆盖会议、课程、视频默认选择系统静音也能取到内音音频源麦克风录你本人的说话声语音笔记、口述草稿时使用音频源进程音频只捕获指定应用的声音想隔离单个程序时切换识别器Sherpa-Onnx面向普通 CPU 优化默认选择装好模型即用识别器Sherpa-Ncnn速度、资源占用表现更激进对性能要求高时尝试识别器命令行识别器自行接入任意可输出文字的程序进阶用户模型中文 / 英文 / 中英双语均为 Zipformer-transducer 系列纯中文场景装中文模型字幕与记录字幕显示在无边框小窗口中可任意拖动与缩放右键可修改字体、字号、颜色、透明度、阴影配置保存在%AppData%/TMSpeech/config.jsonJSON 格式修改后程序即时更新对应模块无需重启识别结果按日期自动存到我的文档下的TMSpeechLogs文件夹历史记录界面支持右键菜单或 Ctrl-C 复制方便摘取关键段落。常见问题速查现象 → 处理现象识别准确率不高→ 处理先排除环境噪声、多人同时说话、音频源选错都正常就换语言模型或在设置里手动指向更合适的流式模型路径。现象录不到系统声音→ 处理多为 Windows 设备设置问题在声音控制面板的录制页启用立体声混音设备面板中看不到时通过显示禁用的设备选项打开它再设为音频源。现象找不到日志文件→ 处理确认我的文档\TMSpeechLogs文件夹存在且有写入权限权限异常时以管理员身份运行程序。现象CPU 占用偏高→ 处理换成更省资源的识别器、改用更小的模型、关闭实时标点等附加处理。作者在 AMD 5800u 笔记本上实测默认配置下占用低于 5%。 进阶插件机制与自定义识别器插件结构通用能力插件管理、任务调度、配置管理、资源管理集中在src/TMSpeech.Core/具体功能以独立插件放在src/Plugins/下音频源、各识别器等程序启动时扫描plugins目录按各插件目录中的tmmodule.json加载程序集。新增音频来源、识别引擎或翻译功能只需实现IAudioSource、IRecognizer、ITranslator等对应接口后放入插件目录核心代码保持不变。命令行识别器它启动一个外部子进程并遵循简单约定——子进程的标准输出作为字幕来源输出新的一行即刷新当前句子随后跟一个空行两个换行表示该句完成并写入历史记录标准错误输出写入日志文件双方统一 UTF-8 编码。这种协议允许模型在出字过程中回头修正之前的内容最终留存的是稳定句子。注意两点此模式下子进程自行采集音频设置里的音频源切换不生效批处理脚本要在开头加隐藏回显结尾不要写pause。参考脚本见项目external_recognizer/目录。使用上有不顺手之处或想要新功能可直接提 Issue 或发起讨论熟悉 Windows/C# 开发可提交 Pull Request发现更优秀的开源模型也欢迎推荐给社区。结尾TMSpeech 的定位是一款 Windows 平台的免费语音转文字软件与本地语音识别方案音频不出本机、断网可用、解压即跑。适合经常开会、需要课程笔记或要批量给视频补字幕的用户命中任一需求即可安装体验。【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表