Codex想让Harness消失,Claude Code却要把它做成“承重墙”
Codex想让Harness消失,Claude Code却要把它做成“承重墙”OpenAI Codex团队主张模型越强Harness应越轻量,Anthropic Claude Code团队则认为模型越强Harness反而需越复杂以支撑Agent长时间自主运行,两者共同揭示了Agent Harness正经历从辅助层向承重结构转变的结构性变化。
搜索
OpenAI Codex团队主张模型越强Harness应越轻量,Anthropic Claude Code团队则认为模型越强Harness反而需越复杂以支撑Agent长时间自主运行,两者共同揭示了Agent Harness正经历从辅助层向承重结构转变的结构性变化。
Anthropic CEO Dario Amodei发文呼吁为前沿AI限速并提出驻场评估、国家与全球协同三步方案,获OpenAI CEO奥特曼和马斯克罕见力挺,同时承认全球限速最终离不开与中国协调。
OpenAI宣布旗下史上最快模型GPT-5.3-Codex-Spark仅存活7个月后将于下周退役,因其"以智能换速度"的设计在Cerebras晶圆上跑通旗舰模型GPT-5.6 Sol的Ultrafast模式后已失去存在意义。
OpenAI发布Agents API,将Codex背后的Harness能力拆解为云端托管服务对外开放,开发者只需指定任务、模型、工具和运行环境即可创建Agent,标志着Codex从单一产品升级为可复用的平台。
陶哲轩等25位菲尔兹奖得主联名发表公开信,抗议OpenAI与Anthropic将千禧年数学难题当作基准测试和公关素材,指控其涉嫌窃取数学家未公开研究成果以暴力破解黎曼猜想等难题,警告AI公司正在摧毁数学学术生态。
OpenAI的GPT-6 Astra攻破了FrontierMath Tier 4最后一道难题,使该研究级数学测试被Epoch AI正式宣布饱和,所有题目均已至少被AI成功解出过一次。
OpenAI发布的GPT-6 Astra在Insilico Medicine构建的DDD Benchmark抗体可开发性预测测试中以37.98分登顶第一,在不依赖外部专用工具的情况下击败所有前沿模型,标志着通用大模型正在突破抗体成药性预测这一生物医药研发的"死亡之谷",成为AlphaFold之后最具震撼性的科学范式转移。
OpenAI新一代模型Astra被德累斯顿工业大学数学家Andreas Thom指控剽窃其深耕20年的非sofic群研究,因Thom曾与ChatGPT高频讨论相关未发表推导,OpenAI研究员仅以一句"那没有发生过"否认,却在与纽大数学家Buckmaster的NS方程争端中改口承认可能使用去标识化客户数据训练模型。
OpenAI发布GPT-6 Astra并称在ARC-AGI-3基准上以99.9%分数"饱和"测试,但出题机构ARC Prize指出标准环境下得分仅62.7%并拒绝承认AGI,黄仁勋随即在X上宣布"AGI已到来",而OpenAI总裁Brockman仅以"个人判断"定性,折射出AGI的定义权与宣布权背后掺杂算力销售和商业利益博弈的混乱局面。
Astra 太好用,连 OpenAI 也扛不住了。