谷歌连发两款实时语音模型:Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻
谷歌连发两款实时语音模型:Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻谷歌发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音模型,后者支持后台异步推理与工具调用以解决语音 Agent 在任务执行中的沉默问题,两款模型已在 Gemini API 和 Google AI Studio 向开发者开放。
搜索
谷歌发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音模型,后者支持后台异步推理与工具调用以解决语音 Agent 在任务执行中的沉默问题,两款模型已在 Gemini API 和 Google AI Studio 向开发者开放。
AI职场社交平台Articuler.ai宣布完成数千万元种子轮融资,由麟阁创投领投,拙朴投资及小米联合创始人王川家族办公室跟投,聚焦线下活动场景的职业匹配需求。
OpenAI 可能正在酝酿一次大规模产品更新。
AI 视频,正在变成一个可以边播、边演、边改的实时系统。
GPT-6 Astra 把大模型的能力边界,又向 3D 世界推了一步。它可以操作 Blender、编写代码,直接生成 3D 模型和场景。当通用模型开始学会建模,专门做 3D 生成的创业公司会被吃掉吗?
就在今天,洛杉矶All-In峰会现场上演了名场面。
AI把考卷刷到接近满分,下一张,还能考什么?
中国科技又拿下“全球第一”,这次突破难在哪?
想象一下这个场景:一场多人线上会议,有人说话时画面自动聚焦到发言者;一段综艺素材,后期系统能自动识别谁在讲话并生成字幕;一段监控录像,系统能在人群中持续追踪正在说话的那个人。
零样本学习的目标,是让模型识别训练时从未出现过的类别。