必须手动配置自定义OpenAI兼容模型:①模型名严格为claude-3-5-sonnet-20241022;②API Key来自jiekou.ai;③Base URL填https://api.jiekou.ai/v1;再通过system prompt加JSON声明、请求体注入cache_control字段、Agent中调用跨文件代码生成,方可启用毫秒缓存与JSON强约束。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要在Dify中实际启用Claude 3.5 Sonnet的毫秒级缓存推理与JSON强约束输出能力,必须绕过默认模型列表,手动配置兼容OpenAI API的自定义模型入口。
获取合法可用的Claude 3.5 Sonnet API凭证
访问 jiekou.ai 控制台注册账号,进入「API密钥」页面生成专属Key;该Key支持调用 claude-3-5-sonnet-20241022 与 claude-3-5-sonnet-20240620 两个正式版本,不兼容旧版命名如“claude-3.5-sonnet”或带空格写法。
注意:DMXAPI等中转服务已同步上线Claude 3.5系列模型,但需确认其Base URL返回的models列表中明确包含上述全称——若仅显示“claude-3-5-sonnet”,则无法通过Dify模型校验。
在Dify中配置Claude 3.5 Sonnet为自定义模型
进入Dify控制台 → 【设置】→【模型供应商】→【+ 添加模型供应商】→ 选择「OpenAI API Compatible」类型。
填写以下三项必填字段:
① 模型名称:严格输入 claude-3-5-sonnet-20241022(不可简写、不可加空格、不可替换连字符);
② API Key:粘贴从jiekou.ai获取的密钥;
③ Base URL:填入 https://api.jiekou.ai/v1(非anthropic官方地址,否则会因鉴权失败直接报错401)。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
保存后,该模型将出现在「应用编辑页 → 模型选择下拉框」中,但此时尚未激活ICI智能缓存机制。
启用Claude 3.5 Sonnet专属能力
方法一:强制JSON结构化输出
在应用的「提示词编排」区域,于system prompt末尾添加声明:{"response_format": {"type": "json_object"}};此配置将触发模型原生JSON Schema解析器,无需任何额外提示词引导。
方法二:开启语义缓存推理
在工作流节点的「高级参数」中勾选「启用缓存」,并手动在请求体中注入cache_control字段:{"type":"semantic","ttl_seconds":3600,"verify_on_hit":true};【verify_on_hit为true时,若缓存知识图谱版本不匹配,将自动降级为全量推理,不会返回陈旧结果】。
方法三:调用跨文件代码生成工具链
在Agent工作流中添加「代码生成」节点,输入需求如“基于Go语言AST分析,为user_service.go中GetUserProfile函数补全repo.FindByID调用逻辑”,模型将自动索引项目内models/user.go与repo/user_repo.go完成类型推导——这一步依赖Claude 3.5 Sonnet内置的上下文感知引擎,旧版模型无法识别跨文件符号引用。

















