AI技术研报-这里有最前沿的人工智能技术解读

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
从Chat、Code到Discovery,AI开始学着做科学家

从Chat、Code到Discovery,AI开始学着做科学家

从Chat、Code到Discovery,AI开始学着做科学家

成立才一个多月,估值就要冲到 500 亿美元。

来自主题: AI技术研报
7619 点击    2026-09-15 14:32
Vidu S2:实时数字人,实时改视频

Vidu S2:实时数字人,实时改视频

Vidu S2:实时数字人,实时改视频

刚刚,生数上线了最新的 实时视频模型 S2,输出提高到 720p,保持 25—42 FPS,包含下面两款:

来自主题: AI技术研报
6964 点击    2026-09-15 14:32
Meta新研究:字节模型蒸馏后,天花板破了

Meta新研究:字节模型蒸馏后,天花板破了

Meta新研究:字节模型蒸馏后,天花板破了

Token词元替代了Byte字节,但不意味着大模型都得是Token。

来自主题: AI技术研报
5777 点击    2026-09-15 13:59
ECCV 2026|不靠「上帝视角」,也不等「完美指令」:REAL 让具身智能体走向开放世界

ECCV 2026|不靠「上帝视角」,也不等「完美指令」:REAL 让具身智能体走向开放世界

ECCV 2026|不靠「上帝视角」,也不等「完美指令」:REAL 让具身智能体走向开放世界

真实家庭任务往往从「不完整的信息」开始:机器人不知道目标在哪里,用户也未必能一次说清自己想要什么。面对「帮我从餐桌上拿点零食」这样的模糊指令,机器人不仅要主动寻找候选物体,还要在发现面包和多个甜甜圈后进一步询问用户,确认究竟该拿哪一个。

来自主题: AI技术研报
6212 点击    2026-09-15 13:36
3B模型成功率94.5%!Token级奖励打开长链路智能体训练新思路

3B模型成功率94.5%!Token级奖励打开长链路智能体训练新思路

3B模型成功率94.5%!Token级奖励打开长链路智能体训练新思路

多轮智能体任务只有一个终点奖励,但在一条包含搜索、工具调用和多轮决策的轨迹里,决定成败的往往是一个不起眼的查询词、动作或对象选择。

来自主题: AI技术研报
8390 点击    2026-09-15 13:35
「人类造的最后一个AI」还有多远?一张图看懂OpenAI、Anthropic等大厂的RSI进度

「人类造的最后一个AI」还有多远?一张图看懂OpenAI、Anthropic等大厂的RSI进度

「人类造的最后一个AI」还有多远?一张图看懂OpenAI、Anthropic等大厂的RSI进度

「人类造的最后一个 AI」还有多远?OpenAI、Anthropic 等头部厂商进度如何?定义中国 RSI 的 roadmap——前沿 AI 研究机构 Theseus Labs 结合 72 家产业实践,推出「RSI 五级框架」

来自主题: AI技术研报
6847 点击    2026-09-15 10:35
网页藏毒,劫持Agent?你需要会「追凶」的自进化女警系统

网页藏毒,劫持Agent?你需要会「追凶」的自进化女警系统

网页藏毒,劫持Agent?你需要会「追凶」的自进化女警系统

今天的AI Agent,已经不只是聊天窗口里「会说话」的模型。它们正在接入浏览器、文件系统、终端、API、MCP服务和各种自动化工作流,开始真正替用户执行任务。

来自主题: AI技术研报
9175 点击    2026-09-15 09:44
一个月 20 刀的 Antigravity CLI,可能被很多人低估了

一个月 20 刀的 Antigravity CLI,可能被很多人低估了

一个月 20 刀的 Antigravity CLI,可能被很多人低估了

众所周知,现在的大模型基本每隔 35 天左右就会换一轮。

来自主题: AI技术研报
7037 点击    2026-09-14 15:32
AI开始改进“改进自己的方法”,RSI进入平方时代丨MetaRSI

AI开始改进“改进自己的方法”,RSI进入平方时代丨MetaRSI

AI开始改进“改进自己的方法”,RSI进入平方时代丨MetaRSI

让模型自己生成训练数据、自己改写提示词、自己修复代码,这条路线被称为: 递归自我改进(Recursive Self-Improvement,RSI)。

来自主题: AI技术研报
10083 点击    2026-09-14 15:30
告别「只会相似度检索」:腾讯最新T-Mem让AI学会「联想回忆」

告别「只会相似度检索」:腾讯最新T-Mem让AI学会「联想回忆」

告别「只会相似度检索」:腾讯最新T-Mem让AI学会「联想回忆」

大语言模型智能体正越来越多地进入长期陪伴聊天这类场景 —— 不再答完一个问题就走,而是和用户处成一段长久的关系。

来自主题: AI技术研报
8141 点击    2026-09-14 15:04
视觉理解和生成究竟能否相互促进?从视觉表征、任务到系统重新审视UMM

视觉理解和生成究竟能否相互促进?从视觉表征、任务到系统重新审视UMM

视觉理解和生成究竟能否相互促进?从视觉表征、任务到系统重新审视UMM

理解生成统一模型(Unified Multimodal Models, UMMs)正在成为多模态模型的重要发展方向。相比传统的理解模型 + 生成模型,UMM 希望在同一个模型中同时完成视觉理解和图像生成,让文本和图像能够在统一上下文中被理解、推理和生成。

来自主题: AI技术研报
6663 点击    2026-09-14 15:03
Astra写的代码,人类已经看不懂了

Astra写的代码,人类已经看不懂了

Astra写的代码,人类已经看不懂了

Astra,每天都有新新闻。昨天攻克 A,今天攻克 B,明天可能要一起解决 CDE……进步之快,让人目不暇接。而就算你目力过人,你可能也看不懂 Astra 在做啥了。

来自主题: AI技术研报
8802 点击    2026-09-14 10:22
全网震撼!菲奖得主未解难题,竟被两名高中生用AI攻破了

全网震撼!菲奖得主未解难题,竟被两名高中生用AI攻破了

全网震撼!菲奖得主未解难题,竟被两名高中生用AI攻破了

新智元报道 你敢信? 人没上大学,研究已经接上了「菲尔兹奖得主」的工作了。 就在今天,UCLA数学圈传出了一条让所有人震惊的消息—— 两名高中生Aayush Bathija和Prince Rohatg

来自主题: AI技术研报
5900 点击    2026-09-14 10:22
配套CLI与Skills,浙大开源可插拔Agent评测底座

配套CLI与Skills,浙大开源可插拔Agent评测底座

配套CLI与Skills,浙大开源可插拔Agent评测底座

同一套模型,换一个coding agent运行时,测试得分和实际消耗往往大相径庭。

来自主题: AI技术研报
9014 点击    2026-09-14 09:49
vLLM-Omni 上的 MiniMax H3:从系统级优化到基于 FastVideo FastH3 的实时服务

vLLM-Omni 上的 MiniMax H3:从系统级优化到基于 FastVideo FastH3 的实时服务

vLLM-Omni 上的 MiniMax H3:从系统级优化到基于 FastVideo FastH3 的实时服务

MiniMax H3 的服务是一个系统问题。一个请求要经过一个庞大的 Qwen3-VL 编码器、一个长序列的音视频 DiT、相互独立的视频与音频 VAE、设备与进程的边界,最后还要完成 H.264/AAC 的封装。只优化 DiT,其余环节的时延依然留在那里。

来自主题: AI技术研报
6929 点击    2026-09-14 09:47
个性化智能体强化学习框架上线,8B模型盲测第一

个性化智能体强化学习框架上线,8B模型盲测第一

个性化智能体强化学习框架上线,8B模型盲测第一

当个性化Agentic RL遇上现实用户平台场景时,一直存在一个常见难点:面对同样的query,不同用户往往偏好不同的规划策略、工具调用和最终表达。

来自主题: AI技术研报
9014 点击    2026-09-14 09:22
2000+真实场景搬进仿真!一个导航模型零样本“通吃”四种机器人本体

2000+真实场景搬进仿真!一个导航模型零样本“通吃”四种机器人本体

2000+真实场景搬进仿真!一个导航模型零样本“通吃”四种机器人本体

过去一年,具身智能的技术迭代明显加快。VLA、世界模型持续演进,强化学习重新成为机器人学习的重要技术路径,Sim2Real加速从仿真走向真机,全身控制能力也在快速突破。

来自主题: AI技术研报
8371 点击    2026-09-14 09:22
算法工程师要失业了?阿里和浙大联手提出Astar,用AI指导AI系统进化

算法工程师要失业了?阿里和浙大联手提出Astar,用AI指导AI系统进化

算法工程师要失业了?阿里和浙大联手提出Astar,用AI指导AI系统进化

如今的 AI 已经能顺畅地帮你写代码、跑实验、做评估。算法工程师的每一天,几乎变成了:让 LLM 整理昨天的实验结果,让 LLM 实现新想法,让 LLM 监控实验运行…… 似乎只需把需求告诉 AI,它就能完成大部分算法工作。

来自主题: AI技术研报
7014 点击    2026-09-14 09:21
清华发布物理引导的扩散模型,无线信道多尺度预测提升37.19% | TMC'26

清华发布物理引导的扩散模型,无线信道多尺度预测提升37.19% | TMC'26

清华发布物理引导的扩散模型,无线信道多尺度预测提升37.19% | TMC'26

清华大学与北京邮电大学联合提出物理引导扩散模型Channel-Diff,将传播模型、阴影遮挡与多径几何嵌入条件扩散模型,实现无线信道多尺度RSRP预测,在两套真实数据集上相较次优方法分别取得37.19%和25.15%的综合性能提升。

来自主题: AI技术研报
7493 点击    2026-09-13 12:58
AI又攻克了一个40年数学猜想

AI又攻克了一个40年数学猜想

AI又攻克了一个40年数学猜想

Shengtao Guo、Ethan X. Fang和Junwei Lu署名的预印本论文宣称利用Odin Automatic AI Research Agent证明了悬而未决40年的Komlós猜想并给出常数界3√(2π),次日陶哲轩等25位菲尔兹奖得主发表联合声明《AI在数学中的严重失准》,警告AI证明速度已远超学界验证与消化的能力。

来自主题: AI技术研报
9219 点击    2026-09-13 12:57
AI自动写综述做到什么程度了?浙大、上交提出DAS,1小时生成面向发表的Academic Survey

AI自动写综述做到什么程度了?浙大、上交提出DAS,1小时生成面向发表的Academic Survey

AI自动写综述做到什么程度了?浙大、上交提出DAS,1小时生成面向发表的Academic Survey

浙江大学与上海交通大学团队提出Deep Academic Survey(DAS),通过Stateful Agentic框架与DAS-2M文献元数据库,可在1小时内自动生成面向发表的学术综述,在DAS-Bench 30个主题评测中平均得分4.34,并已开放220篇完整Survey供查看。

来自主题: AI技术研报
9288 点击    2026-09-13 12:57
刚刚,国产世界模型Motus 2发布!灵巧操作开始「自进化」

刚刚,国产世界模型Motus 2发布!灵巧操作开始「自进化」

刚刚,国产世界模型Motus 2发布!灵巧操作开始「自进化」

9月10日,生数科技在外滩大会发布面向灵巧操作的自进化通用世界模型Motus2,首次将策略、仿真器与评估器统一于同一模型,实现"行动—预测—评估—反馈"闭环,五项真机任务平均成功率84%。

来自主题: AI技术研报
7525 点击    2026-09-13 12:56
世界模型到底是什么?李飞飞、朱军等如何解读?

世界模型到底是什么?李飞飞、朱军等如何解读?

世界模型到底是什么?李飞飞、朱军等如何解读?

针对世界模型定义的分歧,李飞飞将其分为渲染器、模拟器和规划器,朱军及生数科技团队则提出理解、想象、行动三项核心能力与五级进化路线图,Motus2通过策略、模拟器、评估器一体化架构推动机器人行动闭环自进化。

来自主题: AI技术研报
7799 点击    2026-09-11 16:01
第一篇AI4AI综述:让AI改进AI,发展到哪步了?

第一篇AI4AI综述:让AI改进AI,发展到哪步了?

第一篇AI4AI综述:让AI改进AI,发展到哪步了?

第一篇AI4AI综述论文将long horizon智能体、AI4AI与recursive self-improvement纳入同一研究地图,指出AI能在明确目标与评价规则下承担部分研发工作,但单项能力提升无法证明完整流程可靠,持续自我改进仍面临组合鸿沟等验证挑战。

来自主题: AI技术研报
10315 点击    2026-09-11 15:59
EMNLP 2026 | DiffuTester: 加速扩散语言模型生成单元测试

EMNLP 2026 | DiffuTester: 加速扩散语言模型生成单元测试

EMNLP 2026 | DiffuTester: 加速扩散语言模型生成单元测试

清华大学AI Agent课题组提出加速扩散语言模型单元测试生成的框架DiffuTester,通过抽象语法树动态挖掘多个测试用例间的共享结构模式,在解码过程中保留相关token,在保持测试覆盖率的同时实现最高约2–3倍加速,相关论文已被EMNLP 2026接收。

来自主题: AI技术研报
7474 点击    2026-09-11 15:58
openJiuwen首发双维度RSI框架,AI自修改,落地办公智能体,算力亲和助力又快又省

openJiuwen首发双维度RSI框架,AI自修改,落地办公智能体,算力亲和助力又快又省

openJiuwen首发双维度RSI框架,AI自修改,落地办公智能体,算力亲和助力又快又省

openJiuwen首发双维度RSI框架,在WorkSwarm蜂群办公智能体上落地Harness与Artifacts双维度优化,支持科研论文和算法程序两类交付产物迭代,并依托昇腾算力亲和能力降低多轮优化的时延与资源开销。

来自主题: AI技术研报
8739 点击    2026-09-11 15:58