WorkBuddy提供四种本地功耗监控方法:一、内置Web看板(http://127.0.0.1:8080/hardware);二、Claw协议微信推送快照;三、HTTP API轮询JSON数据(端口8081);四、企业微信机器人异常告警。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

当您通过远程方式操作 WorkBuddy 执行大模型任务(如 DeepSeek-V3.2 或 GLM-5.0 推理)时,本地电脑的 CPU、GPU 与内存功耗会显著上升。若未实时监控,可能引发过热降频、任务中断或电源适配器持续高负载运行。以下是针对该场景的多种功耗监控方法:
一、启用WorkBuddy内置硬件指标看板
WorkBuddy 客户端在运行大模型任务期间,会通过系统 API 实时采集本机核心硬件资源占用数据,并以内嵌 Web 看板形式暴露于本地 HTTP 服务中,所有指标均来自操作系统内核级采样,无需额外驱动或管理员权限。
1、确保 WorkBuddy 桌面客户端已启动且处于活跃任务状态(托盘图标为蓝色脉动状态)。
2、在电脑浏览器中访问地址:http://127.0.0.1:8080/hardware,确认页面加载成功并显示“CPU温度”“GPU功耗(W)”“内存带宽(MB/s)”等字段。
3、手机端连接与电脑同一局域网后,在浏览器中输入:http://[电脑局域网IP]:8080/hardware(例如 http://192.168.1.102:8080/hardware)。
4、页面每5秒自动刷新一次,显示当前大模型推理进程所占 GPU 核心利用率、显存温度及封装功耗(TDP)估算值。
二、调用Claw协议推送实时功耗快照至微信
该方法利用 Claw 远程通信通道,将硬件监控模块与微信客服号深度绑定,使功耗数据以结构化消息形式主动推送至手机端,适用于远程触发长时推理任务后的无人值守监控场景。
1、在 WorkBuddy 桌面端点击右上角个人中心 → 进入「Claw 设置」→ 开启「硬件指标同步」开关,并勾选「GPU功耗超120W时告警」与「CPU温度超85℃时暂停任务」。
2、在已绑定的微信对话窗口中发送指令:/power snapshot,立即触发一次完整硬件状态快照采集与回传。
3、微信将收到含时间戳的消息卡片,字段包括:“gpu_power_w”:138.6、“cpu_temp_c”:82.3、“package_power_w”:215.4、“throttle_reason”:“thermal”。
4、若检测到持续高温或功耗越限,WorkBuddy 将自动降低大模型 batch_size 并向微信推送调整日志,无需人工干预。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
三、通过本地HTTP API轮询JSON功耗数据流
WorkBuddy 在端口 8081 上提供低开销的 RESTful 接口,返回纯 JSON 格式的实时功耗指标流,支持手机端轻量工具(如 HTTP Bot、Termux + curl)进行定时拉取与可视化,数据不经过任何中间服务器,全程本地闭环。
1、确认电脑防火墙已放行 TCP 端口 8081,且 WorkBuddy 设置中「高级监控」→「API服务」处于启用状态。
2、在手机终端中执行命令:curl -s "http://[电脑局域网IP]:8081/api/power?format=json"(需替换为实际 IP)。
3、返回内容为标准 JSON,包含字段:“timestamp”:1744540023,“gpu”:{"power_w":142.1,"temp_c":79.6,"util_pct":94},“cpu”:{"package_w":228.3,"max_core_c":84.1}。
4、可配合手机端自动化工具设置每10秒执行一次该命令,并将结果写入本地日志文件用于事后分析。
四、使用企业微信机器人推送功耗异常事件
该方式将功耗监控与企业级告警体系打通,当大模型任务导致硬件指标突破预设阈值时,WorkBuddy 会通过企业微信机器人 Webhook 主动推送带操作按钮的富文本卡片,支持一键暂停任务或切换至低功耗模型。
1、进入企业微信管理后台 → 「应用管理」→ 「自建应用」→ 找到 WorkBuddy 机器人 → 复制其 Webhook 地址。
2、在 WorkBuddy 设置页 → 「通知设置」→ 「硬件告警」中粘贴该地址,并启用「GPU功耗突增检测」与「温度梯度超限」两项。
3、在「阈值配置」中设定:GPU 功耗 >135W 持续3秒,或 CPU 温度上升速率 >3.5℃/秒,即触发告警。
4、告警卡片中包含「立即暂停当前任务」「切换至 MiniMax-M2.5 模型」两个可点击按钮,点击后直接生效,响应延迟低于800ms。

















