需在H100/A100 80G(显存≥40GB)集群部署Hy4 preview,vLLM启动必加--attention-backend FLASHMLA_SPARSE与--enable-prefix-caching;ima知识库支持多模态切片与腾讯文档同步;Hyra-1.0智能体需配置三阶段处理流程并发布为Webhook。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要一个能自动提取会议纪要、解析PDF讲义、关联知识点并生成结构化学习笔记的工具,而不是手动复制粘贴再排版。
用腾讯混元Hy4 preview搭建本地笔记整理Agent
这一步必须在支持FP8精度的NVIDIA H100或A100 80G集群上操作,【显存低于40GB将无法加载Hy4 preview全量权重】。使用vLLM 0.7.2+版本启动服务,命令中必须包含--attention-backend FLASHMLA_SPARSE参数,否则1M上下文会触发OOM崩溃。
执行部署命令:vllm serve --model Tencent-Hunyuan/Hy4-preview --tensor-parallel-size 2 --dtype fp8 --attention-backend FLASHMLA_SPARSE --enable-prefix-caching。注意不要省略--enable-prefix-caching,它能让连续提问时复用前序token缓存,节省63%推理延迟。
验证服务是否就绪:向http://localhost:8000/v1/chat/completions发送POST请求,携带含"tools": [{"type": "function", "function": {"name": "extract_learning_points"}}]的payload。返回状态码200且响应体含"tool_calls"字段即表示Agent功能已激活。
接入ima知识库构建个人学习中枢
打开ima桌面端(v2.0.3及以上),点击左下角「知识库广场」→「新建私有知识库」→命名“我的学习中枢”。
方法一:拖入本地文件夹。支持直接拖入含PPTX/PDF/MD/MP4的混合目录,ima会自动调用混元Large模型做多模态切片——PPT每页转为独立知识卡片,PDF按语义段落拆解,MP4提取关键帧+ASR字幕对齐。
方法二:绑定腾讯文档链接。粘贴腾讯文档中课程大纲、实验步骤、小组讨论记录的分享链接,ima自动同步最新版本并打上时间戳水印。注意:该操作需文档权限为“可编辑”或“可评论”,仅“仅查看”权限会导致同步失败且无错误提示。
完成导入后,在ima右上角启用「Copilot模式」,输入指令:“把‘机器学习导论’知识库中所有含‘梯度下降’的卡片,按公式推导→代码实现→常见陷阱三级结构重排”。系统将在8秒内返回带超链接锚点的新笔记页。
定制Hyra-1.0智能体处理学习流
第一步:在腾讯元宝网页版登录账号,进入「智能体工坊」→「新建Hyra-1.0实例」。
第二步:在系统提示词框粘贴以下内容:
“你是一个专注学习科学的AI助教。当用户上传文件时,先用混元Large提取核心概念图谱;收到‘整理笔记’指令时,调用Hy4 preview执行三阶段处理:①从1M上下文中定位所有定义性陈述与反例;②用CL-Bench Life标准校验逻辑链完整性;③输出符合费曼技巧要求的解释性文本。禁止生成任何未在输入材料中出现的新概念。”
第三步:点击「发布为Webhook」,复制生成的endpoint URL。
第四步:在腾讯文档中打开任意课程笔记,点击「更多」→「AI工具」→「自定义Agent」,粘贴该URL。此后每次点击「整理笔记」按钮,都会触发Hyra-1.0调用Hy4 preview完成全流程处理。


















