响应中断是服务端或客户端强制截断所致,需通过检测+重发+上下文加固三步恢复:先用脚本检测实际输出长度,再精简提示词(删客气话、拆短指令、禁用膨胀词),最后复制完整上下文并插入【接续点】标记后重发。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

通义千问对话过程中突然中断、生成内容戛然而止、JSON缺右括号、代码少结尾大括号,或明明写了“请分三段输出”却只返回第一段——这不是模型故障,而是响应被服务端或客户端强制截断,必须通过检测+重发+上下文加固三步操作才能恢复,不能靠刷新页面或重写提示词蒙混过关。
确认是否真被截断
打开浏览器开发者工具(F12 → Console),粘贴并执行以下检测脚本:
fetch('https://dashscope.aliyuncs.com/api/v1/services/aigc/text-generation/generation', {method: 'POST', headers: {'Content-Type': 'application/json','Authorization': 'Bearer your-api-key'}, body: JSON.stringify({model: 'qwen-plus',prompt: '测试',max_tokens: 1})}).then(r => r.json()).then(j => console.log('实际最大输出长度:', j.usage?.output_tokens || 0));
【必须复制整段,漏一个字符都会报错】
若返回值远低于你设定的 max_tokens(比如设了2048却只返回32),说明服务端已主动限长;若返回值接近设定值但输出仍不全,问题出在输入上下文过长。
精简提示词本身
方法一:删掉所有“请”“希望”“麻烦”“能否”开头的客气话——通义千问不靠礼貌触发理解,反而会把这类软性表达解析为“语气修饰”,自动补一堆解释性废话。
方法二:把复合长句拆成带编号的短指令。例如原提示词:“请围绕‘社区团购团长运营难点’这个主题,结合最近三个月数据,分析原因并给出可落地的解决方案”,改成:
① 列出3个高频出现的具体运营动作(如:拉新群、发拼团链接、处理售后)
② 对每个动作标注对应的数据异常点(如:拉新群7日留存率<12%)
③ 针对每个异常点,只写1条无需培训即可执行的动作指令(如:“把‘进群领券’按钮移到首屏顶部”)
使用AIsa生成图像与视频。仅需一个API密钥即可调用Gemini 3 Pro Image(图像)和Qwen Wan 2.6(视频)。
方法三:禁用5类膨胀词——在提示词末尾加一句:“禁止使用以下词汇:‘深入’‘全面’‘有效’‘显著’‘进一步’;每句话动词必须前置,不得出现‘当……时’‘如果……就’结构。”
重建并加固上下文
第一步:在当前聊天窗口中,复制上一轮完整提问 + 上一轮千问返回的**全部可见内容**(包括中断处的半句话)
第二步:新开一个对话窗口,粘贴刚才复制的内容,末尾追加:“请从‘【接续点】’开始继续输出,不要重复前面内容,保持原有格式和编号逻辑。”
第三步:在中断位置手动插入【接续点】标记——比如原输出停在“② 用户点击后跳转至支付页,但”,就在“但”字后面立刻加上【接续点】,再提交。
这一步最关键:模型只有看到明确锚点才会识别中断位置,否则它默认从头重写,导致重复或逻辑断裂。

















