它做什么
做甲方项目的人都遇到过:需求沟通会上说好的一句话,三个月后变成扯皮。会议证据链把会议录屏本地转写成带时间戳的文字,每句话点开就能回到那一秒的声音和画面。它给的不是「AI 生成的纪要」,而是可以逐条核对的证据。
为什么要看画面
会议里最关键的信息常常在共享屏幕上,而所有只处理音频的工具都拿不到它。2026 年 9 月一场 28 分钟真实会议的实测:语音识别把产品名听成「Conexion」、把「墨水屏」听成「墨水瓶」,而同一秒的画面上白纸黑字写着「KINEXON ePaper Tag」。飞书妙记、通义听悟、剪映这类工具只处理音频轨,这个信息一个都拿不到。
它的短板(先说清)
- 说话人分离只能大致分得开,两人抢话会归给一个人。
- 无显卡的机器上 1 小时会议要跑约 1 小时(标准档);快速档专名识别明显更差。
- 喂术语表不像教程说的那样有效:实测 26 个术语只修好 1 个错误,还改变了断句。
- 不敏感、不需要举证的会议,用免费的在线工具就够了。
怎么拿到
本地运行的 Windows 软件,安装包与授权码在 meet.crosx.cn 获取;语音模型约 1.5 GB 从 ModelScope 下载。
常见问题
会议纪要工具为什么记不住屏幕上的型号?
因为多数工具只处理音频轨。语音识别的语言模型会把低频专业词纠正成高频日常词,而型号、产品名往往只出现在共享屏幕上。会议证据链同时抽取画面帧,用画面上的文字校正听错的词。
会议证据链和飞书妙记、通义听悟有什么区别?
它们在线、免费、够用于不敏感的会议。会议证据链本地运行、不上传录屏、带画面证据、输出可逐条核对的时间戳而不是整体接受或推翻的成品纪要。需要举证、资料敏感时才用它。
会议录屏转文字需要显卡吗?
不需要,但没显卡慢:8 核 CPU 上标准档约 1 倍实时,1 小时会议跑 1 小时。
会议证据链的转写准确率多少?
2026 年 9 月一场 28 分钟真实会议前 5 分钟人工核对:关键术语基本正确,错误全部是同音字且落在核心名词上,其中两处靠画面 OCR 可以修正。具体基线公开在文章里。
喂术语表能提高会议转写准确率吗?
作用有限。实测喂 26 个术语的完整词表只修好 1 个错误,耗时增加 28%,还改变了断句边界。术语表是软提示不是强制词表。