【php中文网快讯】据腾讯科技消息,美国时间9月3日,openai正式发布全新大模型——gpt-6 astra。与以往聚焦问答响应、内容创作及工具调用的传统大模型不同,astra具备端到端执行连续性任务的能力:从接收用户指令、自主操作软件界面,到依据实时运行反馈动态调整后续步骤,全程无需人工干预。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜
让 AI 真正“动手用电脑”
Astra 最具突破性的能力,在于其原生支持的计算机交互功能。过去,企业若想借助AI完成实际业务操作,往往需自行开发插件、对接API、集成检索模块等多重中间层,才能打通模型与内部系统之间的通路。而Astra则跳过这些复杂适配环节,直接通过视觉识别屏幕内容,并模拟真实用户的鼠标点击、键盘输入与浏览器操作,实现对本地及云端应用的原生控制。
OpenAI将Astra定义为“全球最强的桌面级操作型AI模型”。其适用范围已远超网页浏览、邮件收发、电子表格处理等基础办公场景,成功延伸至Power BI、KiCad、FreeCAD等专业级工程与数据分析平台,可切实支撑数据分析建模、硬件电路设计、自动化测试执行、系统故障诊断等高复杂度业务流程。
根据官方公布的基准测试数据,Astra在多项关键指标上实现显著跃升,尤其体现在计算机操控精度、长链路编程任务、工程制图理解以及科研类多阶段推理任务中。在ExploitBench安全渗透测试中,Astra取得满分100%成绩;在计算机操作与CAD相关评测中,表现大幅领先前代GPT-5.6 Sol。
不止于写代码,更能独立闭环推进复杂项目
依托深度集成的桌面操作能力,Astra的服务边界进一步拓展。OpenAI明确将其定位为面向软件开发、专业办公协作与前沿科学研究的下一代智能助手,不仅能承接耗时数小时甚至跨天的长周期任务,还能结合环境变化实时优化执行策略。
针对长周期Codex编码任务,Astra进行了专项增强。传统大模型受限于上下文窗口长度,在处理大型项目时常被迫压缩历史记录生成摘要,极易丢失关键细节,如某次失败的补丁尝试、某模块的历史异常日志等。Astra则可在任务执行过程中持续保留关键节点信息,支持按需回溯查询任意阶段的原始输入、工具输出及中间状态,便于复盘需求变更、回归测试结果与具体操作轨迹。
用于在用户想通过浏览器自动化与 Google Gemini 或 ChatGPT 交互时。触发短语包括“ask Gemini”“ask ChatGPT”“ask GPT”“让...”。
此外,Astra还具备高质量文档生成能力:输入一份PPT模板,即可自动继承原有版式结构与语言风格,生成逻辑连贯、视觉统一的新演示文稿;同时能主动甄别核心信息,剔除冗余重复内容,提升产出效率。
面对不完整或模糊的初始指令,Astra展现出更强的语义理解与判断力:当关键参数缺失时,会主动发起澄清式提问;若仅为次要信息不足,则基于合理假设继续推进;在编程场景中,若用户暂未回应某处确认请求,模型可先行处理其他并行模块,仅在涉及架构决策或安全风险的关键节点暂停等待人工裁定。
能力跃进的同时,安全挑战亦同步升级
OpenAI指出,Astra已触及公司内部网络安全就绪评估体系的关键红线——它不仅具备发现未知软件漏洞的能力,甚至可自主构建完整的漏洞利用链(Exploit Chain)。因此当前版本默认屏蔽所有高危网络安全操作请求。与此同时,模型在任务边界的识别准确性、模糊指令的理解鲁棒性、以及自身能力边界的自解释能力等方面均有明显改进,幻觉(Hallucination)发生率约为GPT-5.6 Sol的三分之一。
目前,Astra正以有限范围形式向部分合作机构率先开放。未来数日内,将陆续向ChatGPT Plus、Pro、Business及Enterprise订阅用户全面推送,并同步上线OpenAI官方API与Amazon Bedrock平台。API标准计费方案为:每百万输入Token 10美元,每百万输出Token 50美元,定价为GPT-5.6 Sol的2.5倍,与近期发布的Fable 5.1保持一致。
OpenAI称GPT-6 Astra是“当前全球最先进、且对齐水平最高的通用人工智能模型”。在发布会尾声,OpenAI联合创始人兼总裁Greg Brockman宣布:“Welcome to the AGI era(欢迎来到通用人工智能时代)”,赋予Astra超越技术迭代层面的时代象征意义。CEO山姆・奥特曼(Sam Altman)亦表示,Astra或将催生新一轮创业浪潮与科研范式变革。

















