公司动态

免费离线Windows实时语音转文字工具TMSpeech上手指南:从安装到会议记录自由

📅 2026/8/20 19:26:56
免费离线Windows实时语音转文字工具TMSpeech上手指南:从安装到会议记录自由
免费离线Windows实时语音转文字工具TMSpeech上手指南从安装到会议记录自由【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech会议室里领导突然转头问你刚才小李说的那个方案你补充两句你手心冒汗——刚才那一分钟你的思绪早就飘到周末去哪玩了。这就是很多人开会的日常。如果此刻有一块小小的字幕条把你听到的每一句话都实时变成文字存下来你就再也不用靠临时抱佛脚度过这种时刻了。TMSpeech就是这样一款 Windows 实时语音转文字工具它捕获电脑内部正在播放的声音把语音实时转成文字像歌词一样悬浮在屏幕上整个过程完全离线运行免费、开源。更妙的是它抓取的是电脑内音而非麦克风所以哪怕你把音量彻底静音识别照常进行。项目名字就来源于此——开会时可以更放心地走神被喊到的时候看一眼历史记录就行。先看看主界面长什么样后面所有的操作都围绕它展开。一、安装与首次启动十分钟完成环境准备上手前你不需要装任何依赖项目本身就是开箱即用的绿色程序。下载 Release 压缩包如果愿意折腾源码也可以git clone https://gitcode.com/gh_mirrors/tm/TMSpeech自行编译解压到任意目录双击运行TMSpeech.exe首次启动会自动生成配置文件建议顺手在桌面建个快捷方式之后一键唤起。启动后屏幕上会出现一条半透明的字幕窗口。默认情况下它已经处于待命状态——只要设置里勾选了启动开始识别你听到的任何声音都会立刻开始转写。遇到奇怪问题解压目录里通常带有重置配置的批处理脚本运行一下删掉旧配置往往就能恢复如初。二、认识主界面三个按钮搞定日常使用主窗口是无边框设计可以任意拖动、调整大小鼠标移上去时顶部会浮现一排控制按钮播放/停止按钮开始或结束本轮识别红色计时器显示当前这轮识别跑了多久红色代表正在工作中历史按钮时钟图标呼出全部识别记录锁定按钮锁形图标把界面锁住防止开会时不小心拖到或点到设置按钮齿轮图标进入配置中心。日常你只需要两个动作开始识别、结束后去翻历史。就这么简单。三、最高频的三个设置项识别器、音频源、外观点击齿轮进入配置窗口左侧是分类菜单。对新手来说真正需要动的只有三个地方。1. 语音识别器怎么选在语音识别页你会看到三个候选引擎它们的区别一句话就能讲清识别器特点适合谁SherpaOnnx 离线识别器基于 CPU资源占用低、兼容性好绝大多数普通用户SherpaNcnn 离线识别器可调用 GPU识别速度更快追求性能的玩家命令行识别器调用外部程序完成识别开发者、爱折腾的用户2. 听哪路声音在音频源页里选源头系统音频捕获电脑播放的所有声音开会、看视频首选麦克风只收你说话的声音适合个人口述进程音频指定某个软件的声音比如只听某个会议客户端。3. 字幕长什么样显示页负责外观字体、字号、颜色、阴影大小、文字对齐、背景透明度都能调。把它调成半透明、大字、贴边悬浮既不影响看屏幕又足够醒目。小提示设置页底部如果出现当前工作正在运行部分配置可能无法更改的提示先停止识别再改。四、给识别器装上大脑语音识别模型安装识别器只是一副骨架真正干活的是语音模型。打开资源页你会看到可用的模型清单中文模型、英文模型、中英双语模型。选中需要的那个点右侧安装按钮等下载完成状态就会变为已安装。安装好的模型会放在插件目录里。区分两种来源随软件自带的资源在应用目录的plugins/下你自己后装的资源在用户目录的plugins/下——后者删掉就等于卸载该模型。模型装好后回语音识别页确认识别器指向了正确的模型。如果官方模型效果不满意TMSpeech 基于 sherpa-onnx 框架开发你完全可以下载其他流式模型替换识别器的配置项里可以直接指定模型路径。五、会议记录自动生成与历史回看识别结果默认按日期自动保存到我的文档下的TMSpeechLogs文件夹一个会议开完文字稿就齐了。想看当天记录点主界面的时钟图标每条记录都带时间戳右键可以单条复制也可以一键全选——把整场会议的台词拷进文档、翻译软件或者 AI 工具都很顺手。这一条流水线下来会议纪要基本不用手动写了。六、进阶玩法用命令行识别器接入任意引擎如果你手头有更好的模型或第三方识别服务命令行识别器就是为你准备的。它的协议很简单以 UTF-8 把识别结果输出到标准输出stdout单个换行表示更新当前句子多个换行连续两个以上表示这句话结束了可以存入历史。标准错误输出stderr则会被记录为日志。一个最小可用的例子是这样import sys while True: audio sys.stdin.buffer.read(4096) # 从stdin读取音频 result your_model(audio) # 你的识别逻辑 print(result, flushTrue) # 单换行更新临时字幕 if is_sentence_end(result): print(\n, flushTrue) # 双换行句子完成两点提醒命令行识别器需要自己独立获取音频源所以在设置里切换音频源对它不生效如果写的是.bat批处理脚本开头加个隐藏命令回显结尾也别放pause否则程序没法判断进程正常退出。七、新手最容易踩的四个坑模型没装就开跑识别器指向不存在的模型字幕自然一片空白。先去资源页确认模型状态。设置改了没生效识别运行中部分配置锁定记得先停止再修改。命令行识别器乱配音频它用的是外部程序自己的音频通道别在 TMSpeech 里换音频源白费力气。配置改坏了别慌运行重置配置脚本或删掉生成的配置文件重启即可。另外提一句性能得益于内录采集与轻量模型TMSpeech 在 AMD 5800u 这类普通笔记本上 CPU 占用实测不到 5%内存占用也很克制开着它追剧开会都不心疼。八、下一步行动从今天开始记录你的会议现在就按这条路径走一遍下载并解压 Release运行TMSpeech.exe在资源页安装中文模型在语音识别页确认选择 SherpaOnnx 识别器在音频源页选系统音频开始识别 → 开会/看课 → 结束后去TMSpeechLogs翻记录。整个过程不超过十分钟你收获的是一个 7×24 小时待命的语音速记员。当然这个项目还有很多值得打磨的地方。如果你遇到识别不准、想要新功能或者你是 C#/Windows 开发爱好者想贡献代码都欢迎直接去仓库提 issue、发讨论或提交 pull request——好用的工具是靠大家一起喂大的。记住真正让你安心的不是不会走神而是走神之后还能把内容找回来。TMSpeech 帮你补上的正是这最后一环。【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考