跳至正文
AI 观察 · 3 分钟

GPT-6 Astra正式发布:OpenAI的新一代旗舰模型有多强?

一、基本情况

一、基本情况

9.4日凌晨,OpenAI正式发布新一代旗舰模型GPT-6 Astra,总裁Greg Brockman在发布会上直言,我们已经步入了AGI时代。

GPT-6 Astra在API里的模型编号是gpt-6-astra。

上下文窗口是1.05M,也就是大约105万Token。

最大输出长度是128K Token。

知识截止日期是2026年4月30日。

推理强度有low、medium、high、xhigh、max五档。

API标准价格是每百万输入Token 10美元,每百万输出Token 50美元。

这个价格基本上就是跟Claude Fable 5完全一致了,但是缓存读取上比Claude Fable 5.1贵。

二、GUI Agent,Computer Use能力暴涨

过去我们讨论Agent落地,最常听到的词是API、MCP或者各类接口。

理想状态下,每一个软件都应该为AI留出一道口子,让模型可以直接通过结构化数据交互。

但现实世界远比我们想象的粗糙。

大量企业内部使用的专业系统、工业软件和报税平台,可能还是十几二十年前的老架构,不仅没有开放接口,连开发文档都早已遗失。

GPT-6 Astra这次的核心突破在计算机使用(Computer Use)上。

它的逻辑很直接:既然屏幕交互是人类使用电脑最通用的方式,只要AI能看懂屏幕、找准按钮、挪动鼠标、敲击键盘,整套桌面系统就可以直接当作现成的接口来用。

在官方演示里,Astra不仅能在KiCad中自主完成PCB电路板元器件摆放和走线,还能在Blender中依据静态图完成房屋建模,并直接导入虚幻引擎5生成可行走场景。

从填写报税表、做前端测试,到在Power BI里制作复杂报表,它不需要依赖专有接口,直接像人类员工一样坐在屏幕前操作软件。

三、更强的判断力、长任务处理能力

在实际办公场景中,很多自动化流程跑不下去,往往卡在交互的分寸感上。

过去的模型经常走向两个极端:一种是完全没有主见,把琐碎格式和参数全部抛给用户,问几十个无关紧要的问题;另一种则是盲目脑补,不声不响埋头干了几个小时,交付出来的东西完全不符合预期。

Astra这次专门强调了一项名为判断力(Judgment)的能力。

面对日常工作里的模糊指令,属于常规可推断范畴的细节,模型会主动结合上下文补齐;当缺失信息足以动摇最终方向时,它会停下来发起一次非常聚焦的提问。

同时,长任务处理也补齐了关键短板。

以往模型处理数小时的复杂工程时,一旦上下文窗口被占满,就只能靠反复生成摘要来压缩历史,经常在此过程中丢掉前期的关键约束和报错细节。

Astra引入了跨上下文窗口的笔记检索机制,让长程智能体拥有一套主动记录和按需搜索的外部记忆,关键细节不再随着会话拉长而丢失。

最后,一个大好消息,Openai掌握codex重置的Tibo在推特宣布,一天用不上Astra,发一天重置卡!

继续阅读豆包手机被围堵后,大家为什么还要往里冲?