讲师中心 微信公众号
AI工具推荐 视频效率加速

DeepSeek与LangChain结合,构建复杂的AI应用教程

千芳小哥_3791

千芳小哥_3791

发布时间:2026-02-11 20:04:54

|

845人浏览过

|

来源于php中文网

原创

需完成模型接入、链式编排与组件协同配置:一、构造适配器使DeepSeek符合BaseLLM协议;二、构建工具调用Agent并约束JSON输出;三、用DeepSeekTokenizer优化RAG分块与检索;四、通过vLLM+FastAPI部署限流API;五、结合LangChainTracer与自定义回调实现日志与logits追踪。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

deepseek与langchain结合,构建复杂的ai应用教程

如果您希望将DeepSeek大语言模型与LangChain框架集成,以支持多步骤推理、外部工具调用或结构化数据处理等复杂AI应用,则需完成模型接入、链式编排与组件协同配置。以下是实现该集成的具体操作步骤:

一、配置DeepSeek模型为LangChain兼容的LLM实例

LangChain要求第三方大模型通过统一接口暴露invoke或generate方法。DeepSeek官方未提供原生LangChain封装,需手动构造适配器类,使其符合BaseLLM协议。

1、安装必要依赖:pip install langchain-core langchain-community transformers torch。

2、使用transformers加载DeepSeek-V2或DeepSeek-Coder权重,设置trust_remote_code=True以启用自定义模型类。

3、继承langchain_core.language_models.base.BaseLLM,重写_call方法,在其中调用模型generate并返回纯文本响应。

4、在初始化时传入temperature、max_new_tokens等参数,并确保stop序列能被正确识别和截断。

二、构建支持工具调用的Agent工作流

LangChain的AgentExecutor可协调LLM决策与外部函数执行。DeepSeek模型需输出符合JSON格式的工具调用指令,因此必须启用其结构化输出能力并约束响应模式。

1、使用DeepSeekTokenizer对提示词进行预处理,插入<|begin▁of▁sentence|>与<|end▁of▁sentence|>标记。

2、在系统提示中明确指定输出格式为{"action": "tool_name", "action_input": {"arg1": "value1"}},并禁止自由发挥。

3、配置Tool对象时,将每个函数包装为StructuredTool,确保输入参数类型与描述被LangChain自动解析。

4、将适配后的DeepSeek LLM与create_tool_calling_agent结合,生成AgentExecutor实例。

三、集成向量存储实现RAG增强推理

RAG流程依赖检索结果注入上下文,而DeepSeek对长上下文敏感,需控制总token数并优化chunk匹配精度。LangChain的RetrievalQA链需适配其分词器特性。

1、使用deepseek-ai/deepseek-coder-6.7b-base对应的DeepSeekTokenizer初始化RecursiveCharacterTextSplitter,按代码符号切分而非空格。

One API key for 70+ AI models. Route to GPT, Claude, Gemini, Qwen, Deepseek, Grok and more
One API key for 70+ AI models. Route to GPT, Claude, Gemini, Qwen, Deepseek, Grok and more

统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。

下载

2、将文档嵌入前,先通过tokenizer.encode统计长度,确保单个chunk不超过2048 token,避免截断关键逻辑。

3、选用Chroma作为向量库,配置embedding_function为HuggingFaceEmbeddings,模型选择BAAI/bge-small-zh-v1.5以匹配中文语义。

4、构造RetrievalQA时,将prompt模板中的{context}字段替换为retriever.get_relevant_documents(query)返回的文本拼接结果,并限制最多3条。

四、部署为可调用API服务

将LangChain链封装为HTTP端点后,需确保DeepSeek模型在推理时内存占用可控、响应延迟稳定,且不因并发请求引发CUDA out of memory错误。

1、使用vLLM启动DeepSeek服务,命令中指定--tensor-parallel-size 2与--gpu-memory-utilization 0.9以提升吞吐。

2、在LangChain中通过RemoteRunnable连接vLLM的/generate接口,设置model_name参数为部署时注册的模型别名。

3、用FastAPI编写路由,接收JSON请求体,提取input字段传入chain.invoke,并捕获torch.cuda.OutOfMemoryError异常。

4、对每个请求添加semaphore限流,最大并发数设为min(4, GPU显存总量 // 8GB),防止OOM。

五、调试与日志追踪集成

LangChain内置LangChainTracer可记录每步调用细节,但DeepSeek的内部attention权重与logits需额外导出,以便分析幻觉或逻辑断裂点。

1、在适配器类的_call方法内,调用model.generate(..., output_logits=True),并将logits保存至线程局部变量。

2、配置LangChainTracer指向本地langsmith实例,设置环境变量LANGCHAIN_TRACING_V2=true与LANGCHAIN_ENDPOINT=http://localhost:1984。

3、在AgentExecutor初始化时传入callbacks=[LangChainTracer(), CustomLogCallback()],后者负责提取并序列化logits张量。

4、日志中所有涉及tool_input与tool_output的字段,均需用json.dumps(..., ensure_ascii=False)处理,避免中文乱码。

热门AI工具

更多
切问学术

切问学术是一款AI论文写作工具,复旦大学NLP团队推出的AI学术智能体。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

AionClaw
AionClaw Hot

AionClaw是一款面向办公、创作和编程任务的AI桌面智能体。

LibLibAI
LibLibAI Hot

一款AI视频创作工具,主要用于国内领先的AI创意平台,以海量模型、低门槛操作与“创作-分享-商业化”生态,让小白与专业创作者都能高效实现图文乃至视频创意表达,适合需要提升相关任务效率的用户。

火山引擎

火山引擎是一款面向企业的云计算与AI服务平台。

SkildArt
SkildArt Hot

SkildArt是一款AI文本写作工具,一站式 AI 视觉创作平台。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

UP简历
UP简历 Hot

一款AI办公效率工具,主要用于基于AI技术的免费在线简历制作工具,适合需要提升相关任务效率的用户。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

相关专题

更多
LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

100

2026.09.30

LLVM RISC-V参数配置教程
LLVM RISC-V参数配置教程

本专题介绍LLVM对RISC-V基础ISA和扩展的支持方式,涵盖RV32、RV64、标准扩展、实验性扩展、厂商扩展、-menable-experimental-extensions和版本差异。

100

2026.09.30

LLVM IR中间表示入门指南
LLVM IR中间表示入门指南

本专题整理LLVM IR的核心概念,包括中间表示作用、模块结构、函数、基本块、SSA形式、类型系统和常见语法,帮助新手理解LLVM编译流程中的关键层。

80

2026.09.30

PDF转图片方法
PDF转图片方法

需要把 PDF 页面用于上传、预览、分享或图片归档时,PDF 转图片方法专题整理 JPG/PNG 格式选择、逐页导出、清晰度设置、批量下载和结果检查等流程,帮助用户稳定完成 PDF 图片化处理。

60

2026.09.30

PixTV AI视频生成与无限画布创作
PixTV AI视频生成与无限画布创作

PixTV专题整理AI视频与视觉内容创作相关功能使用教程,涵盖AI生图、视频生成、无限画布、多模型创作、素材管理、声音音乐及视频剪辑等功能,帮助用户快速掌握PixTV从创意到成片的完整制作方法。

80

2026.09.29

Buffalo框架数据库开发全教程
Buffalo框架数据库开发全教程

本专题围绕Buffalo框架数据库开发,讲解database.yml多环境配置、soda与fizz迁移生成回滚、模型结构体标签、增删改查与条件查询、一对多与多对多关联、数据校验、回调钩子、事务处理及原生SQL执行能力。

280

2026.09.23

Buffalo框架路由与请求处理实操指南
Buffalo框架路由与请求处理实操指南

本专题讲解Buffalo框架路由与请求处理机制,涵盖路由注册与分组、资源路由、Handler编写规范、Context上下文方法、参数绑定、中间件编写挂载、Session与Cookie读写、Flash消息及错误页面定制方法。

180

2026.09.23

Buffalo框架零基础入门教程
Buffalo框架零基础入门教程

本专题整理Buffalo框架入门内容,涵盖Go环境准备、buffalo CLI安装、新项目生成、目录结构说明、dev热加载启动、数据库连接配置与常见报错排查,帮助新手按约定优于配置的思路跑通第一个Buffalo框架应用。

140

2026.09.23

Conan创建软件包配方指南
Conan创建软件包配方指南

本专题介绍通过conanfile.py创建软件包的方法,讲解包名、版本、依赖和构建设置等基础信息,以及source、build、package、package_info等常用方法的作用及编写思路。

80

2026.09.22

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn