WorkBuddy语音识别需三步:文件路径合规(英文无特殊符号)、权限到位、指令明确;识别后必须校准发言人、错字和决策项;最终按指令生成对应格式纪要。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

WorkBuddy语音模型识别会议录音,核心是“本地识别+语义理解”双步完成,不上传音频、不依赖网络,全程在你电脑沙箱中运行。关键不在模型本身多强,而在你是否做对了三件事:文件路径合规、权限到位、指令明确。
录音文件准备:路径和格式必须干净
语音识别失败,八成卡在这一步。系统只认标准音频格式(MP3/WAV/M4A),且路径不能含中文、空格、括号或特殊符号。比如:
✅ 正确路径:D:\WB\meet_20260920.mp3
❌ 错误路径:C:\我的会议\【9月复盘】.mp3(含中文、括号、全角符号)
建议新建英文命名文件夹(如D:\WB_Audio),把录音统一放进去,避免识别中途报错或静默失败。
启动识别:两种入口,效果一致
你可以任选其一,底层调用的是同一套本地ASR引擎:
• 拖入式:直接把MP3文件拖进WorkBuddy主界面对话框,松手即开始识别;
• 指令式:在对话框输入类似“请分析D:\WB_Audio\meet_20260920.mp3,提取发言人、议题和待办事项”,AI会自动触发识别流程。
注意:无论哪种方式,识别进度条走完才代表语音转文字完成——此时你看到的是一段带时间戳、未分角色的原始文字稿,还不是纪要。
使用 draw.io(.drawio 格式)和 SVG 生成兼容 Microsoft Visio 的架构图。当用户需要以下任一场景时触发: - 用于 Visio 或技术文档的架构/系统/网络图 - 带连接标注的分层控制系统图 - 将 draw.io XML 转换为稳定、可嵌入的 SVG - 修复 Visio 或 draw.io 无法打开的故障排查类图表 - 任何需专业级布局且文本可编辑的图表
校准环节:必须手动点三下,否则纪要不准
识别完成后,系统弹出「校准面板」,这步跳不过,也别偷懒:
• 补全发言人:点击每段发言前的头像图标,填入真实姓名+部门(例:“王磊→产品部”),否则所有待办都归为“发言人1”;
• 修正错字:拖动时间轴到听不清的位置,点「重听」确认原意,再双击文字修改(仅限改错别字,不能增删句子);
• 勾选决策项:在「决策项」区域,把会上明确拍板的内容逐条打钩——没勾的,不会进最终纪要的“决议”和“待办”栏。
生成与导出:一句话决定输出样式
校准完成后,点击「生成纪要」,3–8秒出结果。输出内容由你输入的指令决定:
• 想要正式汇报版?加一句“按公司标准会议纪要模板输出”;
• 只需快速同步给同事?写“输出简洁版Markdown,去掉日期和主持人字段”;
• 需要回溯原声?选「高级导出」→「带时间戳精简版PDF」,每条结论后自动标注[10:23]这类时间锚点。
导出前务必检查“责任人”字段是否填满——空着的待办事项,后续邮件提醒功能将失效。

















