小鹏甩出TuringViT视觉编码器:只用十分之一数据,却把SOTA基线甩在身后

小鹏汽车于2026年7月21日发布TuringViT视觉编码器,通过架构重构和数据治理,在仅使用约十分之一训练数据(0.85B图文对)的情况下,于ImageNet-1K等六个零样本分类基准上平均准确率达83.6%,超越基于10B数据训练的SigLIP2-L等主流开源模型,核心解决了视觉大模型训练成本高、数据依…

小鹏汽车于2026年7月21日发布TuringViT视觉编码器,通过架构重构和数据治理,在仅使用约十分之一训练数据(0.85B图文对)的情况下,于ImageNet-1K等六个零样本分类基准上平均准确率达83.6%,超越基于10B数据训练的SigLIP2-L等主流开源模型,核心解决了视觉大模型训练成本高、数据依…

中国电信自研的5G无线网络规划大模型已完成实地验证,将基站选址、覆盖预测、方案生成等环节全面交给AI,规划效率提升50%,方案准确率超过75%。这标志着运营商从“人工经验选站”正式转向“模型驱动建网”,重构了通信基建的底层逻辑。

《第九区》导演尼尔·布洛姆坎普(Neill Blomkamp)正式发布首部完全由字节跳动 Seedance 2.0 大模型生成的 AI 短片《阴兵》(Yin Bing),时长约13分钟。这标志着顶级导演首次将 AI 生成工具用于完整短片的端到端制作,并计划以此探索长片电影。

谷歌 DeepMind 团队发布 GenCeption 模型,将传统视频生成模型逆向改造为视觉分析引擎,可一次性完成深度估计、图像分割、3D 姿态估计等五项视觉任务,训练数据仅用了约 7500 段单人合成视频。

YouTube 于 7 月 16 日更新政策,明确禁止三类低质 AI 生成内容参与广告分成。这是平台首次针对 AI 带来的内容泛滥问题出台系统性限制,可能改变大量依靠搬运、模板化视频的创作者生态。

月之暗面旗下新模型Kimi3上线后用户需求远超预期,导致平台算力资源紧张。公司已暂停新用户注册,优先保障现有付费用户的服务稳定性,并正在通过优化模型效率与补充算力两个方向缓解瓶颈。

企业 AI 落地的关键不再仅靠让更多员工使用工具,而是重新设计工作流程和角色分工。本文基于一篇译介观点,讨论从“人+AI”到“AI原生协作”的范式转变,这对企业的组织架构、项目管理和开发者协作方式产生实质影响。

美国民众对AI数据中心建设的反对情绪正转化为直接的选举压力,部分支持AI项目的政客已经因此丢掉席位。这场反对浪潮的核心不是AI技术本身,而是数据中心对电力、水资源和社区环境的侵占。未来,任何AI公司想在美国大规模建数据中心,都不得不先把“社区关系”列入成本清单。

Hacker News 讨论指出,Meta、Oracle 等五家美国科技巨头通过影子银行体系(私人信贷)为 AI 项目融资,表外债务规模可能达到 1.65 万亿美元。一旦 AI 投资回报不及预期,这些“隐形债务”将流向银行系统,可能引发类似 2008 年的金融风险。

DoorDash 公开了其 AI 助手 Ask DoorDash 的架构细节——该助手并未将全部任务交给大型语言模型,而是通过专用的 AI 代理、工具调用和三层记忆系统来协同工作。初步测试显示,这一设计使生鲜杂货的结账转化率提升了约 24%,购物车规模增加了 17%。