微软首款自研全双工 AI 语音模型曝光:听说并行,16 种语言自由切换

微软正在测试自研的实时语音模型 MAI Realtime,它支持 16 种语言,能边听边说、允许用户随时打断。语音助手正在从“轮流说话”走向“同时听说”,这对聊天体验和语音应用开发都会产生直接影响。

微软正在测试自研的实时语音模型 MAI Realtime,它支持 16 种语言,能边听边说、允许用户随时打断。语音助手正在从“轮流说话”走向“同时听说”,这对聊天体验和语音应用开发都会产生直接影响。

稀宇科技(MiniMax)开源了视频生成大模型 H3,其能力被认为可对标字节跳动的 Seedance,但许可证却将美国、欧盟、英国和韩国用户排除在外。原因是好莱坞片商的版权诉讼仍在进行,这次限制属于法律自保,而非地缘政治封锁。

IBM 发布《2026 年数据泄露成本报告》,指出 92% 的 AI 相关安全事件并非源于模型本身,而是企业访问控制缺失等基础安全问题。AI 相关泄露平均成本已达 533 万美元,比非 AI 泄露高出约 63 万美元。

Visa 宣布以约 24 亿美元现金收购以色列反欺诈公司 BioCatch。支付巨头要用行为生物识别在“支付发生前”拦截诈骗,应对生成式 AI 大幅拉低的攻击成本——这笔交易的价格本身说明,AI 攻防战已经从模型层烧到了金融基础设施层。

Hugging Face CEO Clément Delangue 在 CNBC 公开表态,认为中国正凭借开放科学和开放模型的路线赢得 AI 竞赛,并预计中国可能在年底或明年初开始主导前沿 AI 领域。这一判断正值美国政策圈激烈辩论是否限制中国开放权重模型的敏感时刻。

以色列网络安全初创公司 Zenity 完成 1.25 亿美元 C 轮融资,主攻 AI Agent 安全。它认为大模型本身不是主要风险,真正危险的是被授权在企业系统内自主行动的 AI 代理。

通义千问正式发布 Qwen3.8-Max,参数规模达 2.4T,下周开放权重并同步开源 27B 小模型。它以低价、快速推理和意外的写作能力,成为当前开源大模型中最值得关注的新选择。

MySpace 母公司所有者确认将“重新推出”这一老牌社交平台,但令行业观察者意外的是,这次回归目前并未宣布任何 AI 大模型或生成式 AI 相关计划。在 AI 叙事主导科技行业的当下,一个没有 AI 标签的社交平台复活计划,反而成了值得关注的反常信号。

MarkTechPost Research 发文讨论生产环境中 AI 代理、MCP 服务器和 LLM 应用的安全防护,核心是从“模型能用”转向“系统可信”。当代理开始调用工具、MCP 连接外部数据时,安全边界已经成为规模化落地的前置条件。

过去24小时内,阿里巴巴、DeepSeek等中国实验室密集发布开放权重模型,加上社区优化和海外云平台适配,中国AI正从“发布模型”转向铺开一层可全球部署的算力基础设施,而这一进程已难以撤回。