阿里云盘网页端支持直接转写云端音频并生成文字摘要,需实名认证后进入AI实验室启用权限,上传MP3等兼容格式音频,通过“AI处理”触发转写与摘要,导出Markdown或纯文本结果。

你需要把存在阿里云盘里的会议录音、访谈音频或培训语音快速转成文字摘要,但不想下载到本地再处理——阿里云盘内置AI语音转写与摘要功能可直接在网页端完成,全程不离开云端环境。
确认账号已开通AI功能权限
登录阿里云盘网页版(pan.aliyun.com),点击右上角头像→「设置」→「账号安全」,检查是否已完成实名认证。未实名用户无法调用AI语音处理服务,【未实名将提示“功能暂不可用”,且无法跳过】。
进入「AI实验室」页面(地址栏直接输入 https://pan.aliyun.com/ai ),若页面显示“AI功能试用中”或“已启用”,说明权限就绪;若显示空白或404,请退出账号后用手机淘宝App扫码登录一次,自动补全AI服务授权。
上传音频并触发AI语音转写
方法一:网页端直接上传
在「我的云盘」任意文件夹内,点击「上传」→「上传文件」,选择MP3、M4A、WAV或AAC格式的音频文件(单个≤100MB)。上传完成后,鼠标悬停在该文件上,点击右侧浮现的「…」→「AI处理」→「语音转文字」。
方法二:批量处理已有音频
勾选多个音频文件(最多20个),右键→「AI处理」→「批量语音转文字」。系统会为每个文件单独生成SRT字幕和TXT文本,不混在一起。
注意:FLAC、OGG、AMR等非常规格式需先转码为MP3再上传,否则AI模块无法识别——这不是报错,而是静默跳过,文件列表里不会出现任何提示。
生成摘要并导出结果
第一步:等待转写完成
音频时长≤30分钟,通常60–90秒内生成初稿;超过30分钟按每10分钟增加约25秒估算。进度条卡在99%超2分钟未动,刷新页面重试即可。
第二步:点击生成的「.txt」文件右侧「AI摘要」按钮
系统默认使用通义听悟模型提取核心信息,输出5–8条要点,每条控制在35字以内,自动过滤语气词、重复应答和无意义停顿。
第三步:导出结果
点击右上角「导出」→选择「Markdown格式」,保留原始时间戳锚点;如需粘贴到微信或飞书,选「纯文本」更稳妥。导出文件命名规则为「原文件名_摘要_日期」,避免覆盖原音频。

















