钉钉上线智能语音输入:说完即定稿,口语直接变工作语言
近日,钉钉新版本上线智能语音输入功能,成为首个支持全场景 AI 语音输入的协同办公平台。不近日,钉钉新版本上线智能语音输入功能,成为首个支持全场景 AI 语音输入的协同办公平台。不同于传统语音转文字,钉钉在语音识别基础上叠加了 AI 语义理解能力,开口即可成章,语音由此成为用户在钉钉上的原生工作语言。目前,该功能已覆盖千问办公、IM 消息、搜索栏、文档、AI 表格等钉内高频场景,同时支持在外部浏览器、桌面智能体平台等任何需要文字输入的环境中使用。
语音输入并不新鲜,但过去的语音输入解决的是听清,留下的是未经加工的口语原貌。钉钉智能语音输入要解决的是下一步:说完之后,内容能不能直接用。口语中常见的“嗯、那个”等填充词在转写时被直接过滤;语序散乱的长内容自动整理为清晰要点;说话时的口误和自我修正,比如“不对不对,我意思是”,不会留下改口痕迹,只保留最终意图。一段碎碎念说完,输出的就是能直接发的话。
在钉钉内,这意味着一个快捷键即可调度整个工作台:在千问办公中给 AI 下达指令,在 IM 对话框快速回复消息,在搜索栏用说话代替打字找人找内容,在文档中口述灵感和段落,在 AI 表格中用自然语言录入数据。用户不需要“想好再说”,AI 把“想到哪说到哪”变成“说完就能用”。
当 AI 的执行速度越来越快,人的表达速度就是新的生产力上限。支撑这一体验的,是阿里自研语音识别大模型Qwen-Audio-3.0-ASR-Flash-Message。在全球权威 AI 评测平台 Artificial Analysis 上,Qwen-Audio 家族模型以 1.7% 字符错误率位列全球第一,超越 GPT-Realtime-2 等国际顶尖模型。钉钉智能语音输入所接入的,正是这一模型家族中面向消息场景深度优化的ASR引擎,在识别精度之上进一步强化了语义整理和意图提取能力。
即日起,所有用户升级至钉钉最新版即可免费使用:Windows 端长按右 Alt 键唤起,Mac 端长按 fn 键唤起,移动端点击对话框话筒按钮即可开口。
