AI数学的最后一道高墙,塌了!GPT-6 Astra刷穿FrontierMath Tier 4
AI数学的最后一道高墙,塌了!GPT-6 Astra刷穿FrontierMath Tier 4OpenAI的GPT-6 Astra攻破了FrontierMath Tier 4最后一道难题,使该研究级数学测试被Epoch AI正式宣布饱和,所有题目均已至少被AI成功解出过一次。
搜索
OpenAI的GPT-6 Astra攻破了FrontierMath Tier 4最后一道难题,使该研究级数学测试被Epoch AI正式宣布饱和,所有题目均已至少被AI成功解出过一次。
OpenAI发布的GPT-6 Astra在Insilico Medicine构建的DDD Benchmark抗体可开发性预测测试中以37.98分登顶第一,在不依赖外部专用工具的情况下击败所有前沿模型,标志着通用大模型正在突破抗体成药性预测这一生物医药研发的"死亡之谷",成为AlphaFold之后最具震撼性的科学范式转移。
OpenAI发布GPT-6 Astra并称在ARC-AGI-3基准上以99.9%分数"饱和"测试,但出题机构ARC Prize指出标准环境下得分仅62.7%并拒绝承认AGI,黄仁勋随即在X上宣布"AGI已到来",而OpenAI总裁Brockman仅以"个人判断"定性,折射出AGI的定义权与宣布权背后掺杂算力销售和商业利益博弈的混乱局面。
GPT-6 Astra也是一个集美模型。
OpenAI因GPT-6 Astra算力需求激增,于9月10日正式暂停200美元/月ChatGPT Pro档新订阅与升级,其他套餐及现有用户不受影响。
AI大模型评测平台Arena宣布用户可在直接模式中限时免费使用GPT-6 Astra(仅限medium级别),大量开发者涌入体验开发游戏,目前该模型在Agent Arena榜单中整体排名第二、前端网页开发排名第一。
一周之内大语言、图片、视频模型都迎来新赛季:OpenAI的GPT-6 Astra让编码 Agent更好地使用游戏引擎和Blender,自己改场景、自己跑、自己测;GPT-image-2.5上线,更快更强,图片编辑和关键帧动画显著提升;fal和Yoroll分别发布 H3 MaxTurbo和H3 Superfast后训练加速模型,5秒视频3秒内推理,实时生成和互动玩法纷纷涌现。
刚刚,OpenAI 发文投下一颗重磅新闻,称他们使用一种比 GPT-6 Astra 更强大的、未公开的下一代前沿大模型,联合约 10000 个并发协作的 AI Agent,仅耗时 88 个小时,便攻克了克雷数学研究所设立的七大千禧年难题之一 —— 纳维 - 斯托克斯方程(Navier-Stokes Equation)的存在性与光滑性问题。
模型正在接手更多复杂工具。
这几天,大家应该都用GPT-6 Astra了吧。