当智能体开始替人花钱,如何证明「它是谁」?
当智能体开始替人花钱,如何证明「它是谁」?智能体商业的 ChatGPT 时刻正在到来,但要让 AI 真正替人办成事,必须先补上代码自主交易的信任基石。 作者|徐珊 编辑|郑玄 在蚂蚁集团,负责 AI 支付安全的陈树鹏是个深度的智能体使用者。日
搜索
智能体商业的 ChatGPT 时刻正在到来,但要让 AI 真正替人办成事,必须先补上代码自主交易的信任基石。 作者|徐珊 编辑|郑玄 在蚂蚁集团,负责 AI 支付安全的陈树鹏是个深度的智能体使用者。日
OpenAI发布的GPT-6 Astra在Insilico Medicine构建的DDD Benchmark抗体可开发性预测测试中以37.98分登顶第一,在不依赖外部专用工具的情况下击败所有前沿模型,标志着通用大模型正在突破抗体成药性预测这一生物医药研发的"死亡之谷",成为AlphaFold之后最具震撼性的科学范式转移。
OpenAI新一代模型Astra被德累斯顿工业大学数学家Andreas Thom指控剽窃其深耕20年的非sofic群研究,因Thom曾与ChatGPT高频讨论相关未发表推导,OpenAI研究员仅以一句"那没有发生过"否认,却在与纽大数学家Buckmaster的NS方程争端中改口承认可能使用去标识化客户数据训练模型。
OpenAI发布GPT-6 Astra并称在ARC-AGI-3基准上以99.9%分数"饱和"测试,但出题机构ARC Prize指出标准环境下得分仅62.7%并拒绝承认AGI,黄仁勋随即在X上宣布"AGI已到来",而OpenAI总裁Brockman仅以"个人判断"定性,折射出AGI的定义权与宣布权背后掺杂算力销售和商业利益博弈的混乱局面。
Astra 太好用,连 OpenAI 也扛不住了。
GPT-6 Astra也是一个集美模型。
OpenAI因GPT-6 Astra算力需求激增,于9月10日正式暂停200美元/月ChatGPT Pro档新订阅与升级,其他套餐及现有用户不受影响。
AI大模型评测平台Arena宣布用户可在直接模式中限时免费使用GPT-6 Astra(仅限medium级别),大量开发者涌入体验开发游戏,目前该模型在Agent Arena榜单中整体排名第二、前端网页开发排名第一。
一周之内大语言、图片、视频模型都迎来新赛季:OpenAI的GPT-6 Astra让编码 Agent更好地使用游戏引擎和Blender,自己改场景、自己跑、自己测;GPT-image-2.5上线,更快更强,图片编辑和关键帧动画显著提升;fal和Yoroll分别发布 H3 MaxTurbo和H3 Superfast后训练加速模型,5秒视频3秒内推理,实时生成和互动玩法纷纷涌现。
个性化在通用AI产品中一直是个加分项。无论是ChatGPT、Gemini还是Claude,还是今年的Openclaw、Harmes都把记忆和个性化当成核心卖点,理由是它能提高可用性、参与度和用户满意度。学术界对个性化的研究,也几乎全部集中在"如何做得更好、更准、更符合用户口味"上。