Gemini3.8Live升级语音智能:对话、推理与任务执行进一步融合

Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,核心变化是让 AI 在连续语音对话中同步完成推理和后台任务调用,语音助手不再只是“能听会说”。

Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,核心变化是让 AI 在连续语音对话中同步完成推理和后台任务调用,语音助手不再只是“能听会说”。

前 OpenAI 研究员、InstructGPT 论文作者 Diogo Almeida 发布新模型 Jev,它跳过自然语言生成,直接输出结构化决策和概率,官方称在判断类任务上快 20-200 倍、成本低 40-400 倍。这代表一条有别于「更大更聪明」的实用主义路线,目标是把智能做成软件里廉价、高频的调用。

马斯克在 All-In 峰会上提议,头部 AI 公司应在模型发布前互相交叉测试,用竞争对手的工具来挑自家模型的毛病。这背后是业界对前沿模型失控风险的真实焦虑。

Anthropic 发布 Claude 的 Salesforce 插件测试版,把客户数据、商机和销售管道接入对话界面,销售可以在 Claude 里完成客户调研、会议准备和记录更新,且更新动作需人工确认后才执行。

据报道,OpenAI 已就新一轮融资与投资者展开初步接触,估值讨论区间超过 1.2 万亿美元,明显高于今年 3 月的 8250 亿美元投后估值。融资能否落地,与其上市节奏密切相关。

Salesforce 在 Dreamforce 大会上发布首个推理大模型 Koa,基于英伟达 Nemotron 开源权重联合微调,主打销售、营销、客服等企业场景,训练全程未使用真实客户数据。

据 404Media 报道,OpenAI 内部存在名为“Lily 项目”的人工审核机制,由外包审核员查看 ChatGPT 真实用户对话样本来评估模型回复质量。这揭开了大模型优化中长期被忽视的一环:在自动化训练之外,人类仍在直接接触用户聊天内容。

Google 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音模型,首次在低延迟语音流中实现多步深度推理,让 AI 能“边说边想”,并已开放 API 供开发者调用。

Google 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,让语音对话在持续进行的同时完成推理、联网搜索和工具调用,语音 AI 正从“能听会说”转向可连续执行任务的智能体。

据 The Register 报道,Anthropic 和 OpenAI 正试图说服美国政府以“安全”为由加强对中国开源模型的限制,借此巩固自身市场地位。两家公司投入数百亿美元却距离盈利尚远,因此需要政策护城河来维持资本信心。