AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

过去几年,大模型推理系统优化的核心目标一直围绕一个问题展开:如何让 GPU 更高效地计算权重、激活、KV Cache 等高维张量?从并行策略、请求调度、显存管理到算子优化,学界业界大量优化技术不断提升模型推理效率。

来自主题: AI技术研报
10019 点击    2026-08-17 15:18
仿真到真机零负担!轻量级方案让机械臂首次领悟“空间轨迹”

仿真到真机零负担!轻量级方案让机械臂首次领悟“空间轨迹”

仿真到真机零负担!轻量级方案让机械臂首次领悟“空间轨迹”

当机器人把书放进抽屉,它看到的是一串二维图像,然而真正需要完成的,却是一段发生在三维空间、持续随时间演化的动作。

来自主题: AI技术研报
9316 点击    2026-08-17 15:01
最高涨1100%!DeepSeek新定价今日生效

最高涨1100%!DeepSeek新定价今日生效

最高涨1100%!DeepSeek新定价今日生效

今日零时起,DeepSeek正式执行新版API价格,DeepSeek-V4-Flash和DeepSeek-V4-Pro两款主力模型首次采用峰谷定价,闲时价格统一为高峰时段的一半。此次调整同步抬高了两款模型的基础价格。DeepSeek-V4-Flash高峰时段每百万Tokens缓存命中输入、缓存未命中输入和输出价格分别为0.1元、3元和9元,闲时分别降至0.05元、1.5元和4.5元。

来自主题: AI资讯
9991 点击    2026-08-17 14:38
奥特曼放话:半年内,GPT上下文覆盖你的一切

奥特曼放话:半年内,GPT上下文覆盖你的一切

奥特曼放话:半年内,GPT上下文覆盖你的一切

预计半年内,ChatGPT的下一代模型将能监视你的屏幕、记录每一次会议与通话,并完整掌握关于你生活的全部上下文。

来自主题: AI资讯
8664 点击    2026-08-17 10:54
速来网吧线下真实所有大模型

速来网吧线下真实所有大模型

速来网吧线下真实所有大模型

最近,葬AI和我们的朋友钟经纬、正阳一起,推出了懂模帝这个产品,现在任何人都可以登陆 fuckai.md 去看各种各样的benchmark。

来自主题: AI资讯
8539 点击    2026-08-17 10:53
ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」

ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」

ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」

请想象这样一种居家场景:当你戴着 AI 眼镜在厨房准备晚饭,用刀切菜时,它会立刻提醒你注意安全;当你连续几天形成举着手机长时间录像的习惯时,它会主动建议你换一种更省力的记录方式。

来自主题: AI技术研报
7556 点击    2026-08-17 09:45
马斯克的新生图模型,让我笑了一整晚

马斯克的新生图模型,让我笑了一整晚

马斯克的新生图模型,让我笑了一整晚

毫无疑问,四月份发布的生图模型 GPT-Image-2,现在依然是当之无愧的 AI 生图之王。

来自主题: AI资讯
10260 点击    2026-08-17 09:44