近日,spacex ai正式发布其全新升级的旗舰级人工智能大模型——grok4.6。该模型专为应对高复杂度、长周期的agent任务而深度优化,并在多项权威基准测试中展现出与openai最新旗舰模型gpt-5.6sol旗鼓相当、部分场景甚至更胜一筹的卓越能力。
回溯技术发展路径,SpaceX AI早在7月便携手Cursor,依托数万张英伟达GB300 GPU的强大算力,成功训练并推出了Grok4.5。以此为基石,Grok4.6实现了质的跃升:其训练策略全面聚焦于长程任务建模,大量引入涵盖多步逻辑推理、前沿技术原理阐释及工业级高质量工程代码的合成数据;同时,模型还经历了覆盖知识型工作流、通用编程任务及多个垂直领域交互环境的强化学习训练,在视觉理解、多轮交互与可执行应用构建等场景下,显著提升了初始响应质量与任务完成稳定性。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

使用 @youdotcom-oss/teams-anthropic 将 Anthropic Claude 模型(Opus、Sonnet、Haiku)添加到 Microsoft Teams.ai 应用程序中。可选集成 You.com MCP 服务器以进行网页搜索和内容提取。
据全球知名AI评测机构Artificial Analysis发布的九项主流基准综合指数显示,Grok4.6已成功追平GPT-5.6Sol的整体表现,当前仅略逊于Claude Opus5与Fable5Max。细分来看,在侧重逻辑推演与常识知识整合能力的GDPval-AA v2测试中,Grok4.6斩获1753分Elo评分;而在专门评估长周期知识工作者Agent行为效能的私有基准AA-Briefcase中,亦取得1577分Elo成绩,两项核心指标均稳居Claude Opus5之后,位列第二。
在性能大幅提升的同时,Grok4.6延续了高效能与高性价比并重的设计理念:推理吞吐量高达80TPS;基础版本输入/输出价格分别为每百万Token 2美元与6美元;高速优化版则为每百万Token 4美元与12美元。目前,Cursor平台用户及Grok Build开发者已可即刻启用;所有外部开发者亦可通过标准化API快速集成调用。


















