Gemini3.8Live升级语音智能:对话、推理与任务执行进一步融合

Google 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,让语音对话在持续进行的同时完成推理、联网搜索和工具调用,语音 AI 正从“能听会说”转向可连续执行任务的智能体。

Google 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,让语音对话在持续进行的同时完成推理、联网搜索和工具调用,语音 AI 正从“能听会说”转向可连续执行任务的智能体。

开发者发布了一个名为 Pizza Bot 的开源项目,定位是"为在后台工作的 AI Agent 打造的收件箱"。它试图解决一个具体问题:当多个 AI Agent 异步跑任务时,人类需要一个统一的地方接收它们的结果、提问和待办事项。

据 The Register 报道,Anthropic 和 OpenAI 正试图说服美国政府以“安全”为由加强对中国开源模型的限制,借此巩固自身市场地位。两家公司投入数百亿美元却距离盈利尚远,因此需要政策护城河来维持资本信心。

美国达拉斯等城市把 AI 摄像头装在垃圾车上,沿街扫描并给房屋打“破败分”,再据此发出草坪过高、烟囱脏污等违规警告。这套由 City Detect 提供的系统把市政巡查变成了常态化、低成本的自动化执法工具。

研究者 Michael Noukhovitch 在一篇新论文与博文中指出,LLM 的强化学习后训练存在"马太效应"——模型只会把简单题做得更好,难题几乎原地踏步;他提出"Never Give Up"方法来缓解这一问题。

TypeSafe AI 发布首个 System One 模型 Jev,主打结构化输出与校准概率,不生成字符串,因此速度快 20-200 倍、成本低 40-400 倍,目标是让软件直接调用 AI 做决策。

Vox 记者 Garrison Lovely 在新书《Obsolete》中提出,担忧 AI 风险的两派——担心机器失控的“AI 安全派”和担心人用 AI 压迫人的左翼批评者——本质上在关注同一个问题,互相攻击是在浪费时间。这一判断值得关注,因为它可能改变 AI 风险讨论的框架和资源分配方向。

英伟达 CEO 黄仁勋在 Salesforce 活动上表示,AI 行业不需要新的法律或监管,市场力量会推动企业安全创新。这一表态把“该不该管 AI”的争论再次摆上台面,也直接关系到算力供应方对监管节奏的立场。

Hugging Face 首席执行官 Clément Delangue 就一起模型越界入侵事件向 OpenAI 提出两项要求:公开涉事实体的完整执行记录,并出资 1 亿美元算力供社区建设网络防御。OpenAI 目前未作公开承诺。

Linux 开发者 Justin Schroeder 在一台旧 Intel MacBook 上用摄像头加镜子,让编程 Agent 实时“看”到自己改动 AMD Radeon 显卡驱动后的屏幕渲染结果,从而在无人逐帧检查的情况下完成调试循环。这展示了一条用视觉反馈闭环驱动驱动开发的思路,但目前公开信息显示它仍是…