OpenAI 确认 Astra 为其下一代主要模型系列
OpenAI 于 8 月 1 日确认 Astra 为其下一代主要模型系列,该未发布系统成功解决了 10 道数学难题。这一消息发布在 Anthropic 推出 Claude Opus 5 的一周之后。
要点
OpenAI 在 8 月 1 日的一篇研究文章中确认了 Astra 的名称,该文章描述了十道被解决的数学难题。
Astra 能够协调多个智能体,针对同一问题持续工作数小时甚至数天。目前该模型尚未发布,且没有具体的发布日期。
Claude Opus 5 于 7 月 24 日发布,定价为每百万输入 token 5 美元、每百万输出 token 25 美元,并支持 100 万 token 的上下文窗口。
OpenAI Astra 模型详情
OpenAI 在一篇研究文章中公布了这一名称,其中将内部版本的 Astra 归功于在数学和理论计算机科学领域取得的十项成果,每项成果都至少困扰了学界十年。这些工作涵盖了高维几何、编码理论和量子复杂度,其中一项证明确定了非 sofic 群的存在。
这一方向的核心卖点在于持续时间而非原始速度,因为 Astra 能协调多个智能体,共同针对一个问题工作数小时甚至数天。
早前的报道曾将其与 Sol、Terra 和 Luna 系列并列,但尚未公布发布日期,也未决定是否将其标记为 GPT-6 或 GPT-5.7。
山姆·奥特曼(Sam Altman)曾向华盛顿的政策制定者演示了该系统,该系列预计将成为首个在拟议的联邦审批框架下接受审查的模型。
Claude Opus 5 定价与基准测试
Anthropic 于 7 月 24 日推出了 Claude Opus 5,定价为每百万输入 token 5 美元、每百万输出 token 25 美元,与 Opus 4.8 的费率一致。该模型在人工智能分析智能指数(Artificial Analysis Intelligence Index)上以 61 分位居榜首,而每项任务的成本大约是 Fable 5 的一半。
该模型支持 100 万 token 的上下文窗口,输出上限为 128,000 token。在 ARC-AGI-3 测试中得分为 30.2%,约为已公布最佳结果的 3 倍;在 Terminal-Bench 2.1 测试中,以最大努力得分 89.1%。Anthropic 的一位发言人建议买家在做出决定前,先在一个有界任务和一个长周期任务上运行竞争模型进行对比。
Astra 的专家反应
Astra 目前没有公布价格、基准测试表格或外部测试结果,这使得买家需要在已发布的产品与研究声明之间进行权衡。
曼彻斯特大学的数学家托马斯·布鲁姆(Thomas Bloom)在 X 平台上称这十项成果是“大新闻”,并认为其重要性超过了 OpenAI 早前的证明。不过,布鲁姆也反驳了关于该模型将取代数学家的说法,因为人类构建并训练了它,而训练数据正是来自数学家们所有著作。
OpenAI 研究员诺姆·布朗(Noam Brown)指出,这些成果并未解决任何千禧年大奖难题,并称团队在每道题上的投入并不大。
认知科学家加里·马库斯(Gary Marcus)认为,这些成果是真实的,但被过度吹捧为解决了整个领域。
这一公告发布之前,同一长期研究系列在 5 月取得了一项成果,推翻了离散几何中长达 80 年的厄尔多斯单位距离猜想。菲尔兹奖得主蒂莫西·高尔斯(Tim Gowers)当时表示,他会毫不犹豫地推荐该证明发表在《数学年鉴》上。

资金费率
资金费率热力图
多空比
大户多空比
币安/欧易/火币大户多空比
Bitfinex杠杆多空比
账号安全
资讯收藏
自选币种