【php中文网快讯】据智谱官方披露,此前一周在国际开发者圈引发广泛关注的匿名大模型 ox alpha(中文社区昵称为“牛来”),实为智谱最新发布的 glm-5.3-flash(320b-a18b)。8月26日晚,智谱正式宣布该模型上线,并同步开源。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜
图源:智谱,下同
智谱指出,Ox Alpha 以匿名形式入驻 OpenCode 与 OpenRouter 平台展开大规模公测,迅速跃居当周热度榜首,刷新两大平台单周调用量纪录(相关详情可参见PHP中文网此前报道:《神秘牛来大模型 Ox Alpha 冲上榜一,刷新单日模型用量纪录》)。所有测试流量均由国产AI芯片提供底层算力支撑。
极致轻量高效架构
性能数据显示,GLM-5.3-Flash 在综合能力上全面超越前代 GLM-5.2。在国际权威评测体系 Artificial Analysis Intelligence Index(AA 综合智能指数)中斩获 57 分,稳居全球第一梯队,得分与 Anthropic 推出的 Claude Opus 4.8 持平;在智谱自研 Z.ai Code Bench 编程专项测评中,其代码生成与逻辑推理能力亦达到同等水准。
该模型聚焦极致成本优化设计,总参数规模达 320B,但实际激活参数仅 18B。依托覆盖 30T Token 的多模态预训练语料库,模型在显著降低硬件资源消耗的同时,实现了更优的推理表现。其 API 定价仅为 GLM-5.3 的十分之一;限时优惠期内进一步压降至二十分之一,约为 Claude Opus 4.8 官方报价的四十分之一。
在架构层面,GLM-5.3-Flash 是全球首个将稀疏注意力机制与线性注意力机制深度融合的开源前沿大模型,在保障长文本理解精度的同时,大幅压缩长上下文服务开销;同时引入创新性的流形约束超连接(mHC)技术,显著增强模型在不同规模下的扩展适配能力。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
GLM-5 系列首款原生多模态模型
本模型内置高性能视觉编码模块,不止于基础图像识别,更可深度支持前端开发、游戏内容生成及三维仿真等复杂任务。模型具备自主判断是否启用视觉能力的智能决策机制,并能结合视觉反馈持续迭代输出结果。智谱 AI 同步构建了端到端的视觉编码数据合成流水线,训练模型形成自我审视与闭环优化能力;在前端开发场景中,还融合环境反馈强化学习机制,依托真实用户操作路径完成 Agent 功能验证,评估维度延伸至页面渲染质量、交互响应体验等实际指标。
模型还可通过编程任务驱动现实知识的逻辑推演与结果验证。在无任何外部素材输入的前提下,GLM-5.3-Flash 独立运行 16 小时,成功在 Blender 中构建出一套总面积约 400㎡ 的主厨住宅及配套测试厨房三维场景。借助 ZCode 平台提供的 Browser Use Agent 与 Computer Use Agent,模型可无缝打通代码执行、网页浏览与图形界面操作,在实时交互与渲染过程中主动识别并修正输出偏差。
不止于编程的全能协作者
除代码开发外,该模型在办公文档处理方面亦实现质的突破。针对 PPTX、PDF、DOCX、XLSX 等主流格式文件,新增的视觉理解能力使其能够自主完成内容审查与结构优化,并具备初步审美判断力,可依据视觉上下文对输出结果进行多维度校验。
目前,GLM-5.3-Flash 已面向全球开发者免费开源,已接入 ZCode 等主流编程协作平台,并开放标准化 API 接口。同时,该模型已纳入 GLM Coding Plan 计划,每日限量发放一万张体验卡,供开发者快速上手体验。

















