HiAgent平台支持零代码搭建智能体,5分钟内可完成客服问答、合同审核或知识助手的快速验证;SDK提供Python直连、WebSocket和HTTP三种接入方式;微调需准备JSONL数据、LoRA训练及云上部署三步。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

用HiAgent平台零代码搭建智能体
想快速验证一个客服问答、合同审核或内部知识助手的想法,又不想写一行后端代码,HiAgent就是最直接的路径。
打开火山引擎控制台→进入AI开发板块→点击“HiAgent AI应用创新平台”→新建智能体项目。
在画布界面拖入“知识库”节点,上传PDF/Word/Excel格式的业务文档,系统自动解析并构建向量索引;这一步必须等右上角显示“索引构建完成”,【未完成就跳过会导致后续所有问答都返回空结果】。
接着拖入“大模型”节点,选择豆包Doubao-1.5或DeepSeek-R1-V3,把知识库节点输出连到大模型节点输入;最后加一个“回复格式化”节点,设置输出为纯文本或带标题分段样式。
立即进入“豆包AI人工智官网入口”;
立即学习“豆包AI人工智能在线问答入口”;
点击右上角“发布”,生成专属链接或嵌入代码,整个流程5分钟内可对外使用。
用SDK接入自有系统做深度集成
如果你已有Web后台、CRM或ERP系统,需要把大模型能力嵌入具体业务动作中,比如销售录入客户信息时自动补全行业标签、审批流中实时分析合同风险条款,就得走SDK调用路线。
方法一:Python SDK直连(推荐测试阶段)
安装火山引擎官方SDK:pip install volcengine → 初始化Client时填入Access Key ID和Secret → 调用invoke_model接口,传入model_id(如deepseek-r1-v3)、input_text和temperature参数。
方法二:WebSocket长连接(适用于实时语音/多轮对话)
前端建立WebSocket连接至wss://api.volcengine.com/v1/ws/chat → 发送JSON消息体包含{"model": "doubao-1.5", "messages": [{"role": "user", "content": "你好"}]} → 后端收到流式响应后逐帧拼接,注意处理event: message_delta事件类型。
方法三:HTTP POST(适合批处理)
向https://api.volcengine.com/v1/chat/completions发送POST请求,Header中携带Authorization: Bearer <your_token></your_token>,Body为标准OpenAI格式JSON;【token需通过火山引擎IAM控制台申请,且必须绑定对应模型调用权限】。
从本地模型微调到云上部署全流程
当通用大模型无法满足专业术语理解、固定话术风格或私有数据不出域要求时,必须走微调路线。整个过程分三步走:
第一步:准备高质量微调数据
每条样本必须是严格遵循{"prompt": "用户输入", "completion": "理想回复"}格式的JSONL文件;提示词中禁止出现“请回答”“请解释”等引导性表述,模型会照搬进输出;建议每类业务场景准备至少800条标注数据。
第二步:在火山引擎训练平台启动LoRA微调任务
上传数据集→选择基础模型(如deepseek-r1-v3)→配置LoRA Rank=64、学习率=2e-5、训练轮次=3→点击“开始训练”;训练耗时取决于数据量,800条约需22分钟,GPU资源自动按秒计费。
第三步:部署为API服务
训练完成后,在模型列表页点击“部署”→选择实例规格(g4il.xlarge起步)→设置QPS上限和自动扩缩容策略→获取专属Endpoint;此时即可用标准HTTP请求调用,无需修改原有SDK接入逻辑。


















