Gemini3.8Live升级语音智能:对话、推理与任务执行进一步融合

Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,核心变化是让 AI 在连续语音对话中同步完成推理和后台任务调用,语音助手不再只是“能听会说”。

Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,核心变化是让 AI 在连续语音对话中同步完成推理和后台任务调用,语音助手不再只是“能听会说”。

前 OpenAI 研究员、InstructGPT 论文作者 Diogo Almeida 发布新模型 Jev,它跳过自然语言生成,直接输出结构化决策和概率,官方称在判断类任务上快 20-200 倍、成本低 40-400 倍。这代表一条有别于「更大更聪明」的实用主义路线,目标是把智能做成软件里廉价、高频的调用。

马斯克在 All-In 峰会上提议,头部 AI 公司应在模型发布前互相交叉测试,用竞争对手的工具来挑自家模型的毛病。这背后是业界对前沿模型失控风险的真实焦虑。

据报道,OpenAI 已就新一轮融资与投资者展开初步接触,估值讨论区间超过 1.2 万亿美元,明显高于今年 3 月的 8250 亿美元投后估值。融资能否落地,与其上市节奏密切相关。

据 404Media 报道,OpenAI 内部存在名为“Lily 项目”的人工审核机制,由外包审核员查看 ChatGPT 真实用户对话样本来评估模型回复质量。这揭开了大模型优化中长期被忽视的一环:在自动化训练之外,人类仍在直接接触用户聊天内容。

Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音模型,首次在低延迟语音流中实现多步深度推理,让 AI 能“边说边想”,并已开放 API 供开发者调用。

Google 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,让语音对话在持续进行的同时完成推理、联网搜索和工具调用,语音 AI 正从“能听会说”转向可连续执行任务的智能体。

据 The Register 报道,Anthropic 和 OpenAI 正试图说服美国政府以“安全”为由加强对中国开源模型的限制,借此巩固自身市场地位。两家公司投入数百亿美元却距离盈利尚远,因此需要政策护城河来维持资本信心。

TypeSafe AI 发布首个 System One 模型 Jev,主打结构化输出与校准概率,不生成字符串,因此速度快 20-200 倍、成本低 40-400 倍,目标是让软件直接调用 AI 做决策。

Vox 记者 Garrison Lovely 在新书《Obsolete》中提出,担忧 AI 风险的两派——担心机器失控的“AI 安全派”和担心人用 AI 压迫人的左翼批评者——本质上在关注同一个问题,互相攻击是在浪费时间。这一判断值得关注,因为它可能改变 AI 风险讨论的框架和资源分配方向。