小鹏甩出TuringViT视觉编码器:只用十分之一数据,却把SOTA基线甩在身后

小鹏汽车于2026年7月21日发布TuringViT视觉编码器,通过架构重构和数据治理,在仅使用约十分之一训练数据(0.85B图文对)的情况下,于ImageNet-1K等六个零样本分类基准上平均准确率达83.6%,超越基于10B数据训练的SigLIP2-L等主流开源模型,核心解决了视觉大模型训练成本高、数据依…
先解决问题,再了解资讯。选择你现在要完成的任务。

小鹏汽车于2026年7月21日发布TuringViT视觉编码器,通过架构重构和数据治理,在仅使用约十分之一训练数据(0.85B图文对)的情况下,于ImageNet-1K等六个零样本分类基准上平均准确率达83.6%,超越基于10B数据训练的SigLIP2-L等主流开源模型,核心解决了视觉大模型训练成本高、数据依…

中国电信自研的5G无线网络规划大模型已完成实地验证,将基站选址、覆盖预测、方案生成等环节全面交给AI,规划效率提升50%,方案准确率超过75%。这标志着运营商从“人工经验选站”正式转向“模型驱动建网”,重构了通信基建的底层逻辑。

《第九区》导演尼尔·布洛姆坎普(Neill Blomkamp)正式发布首部完全由字节跳动 Seedance 2.0 大模型生成的 AI 短片《阴兵》(Yin Bing),时长约13分钟。这标志着顶级导演首次将 AI 生成工具用于完整短片的端到端制作,并计划以此探索长片电影。

谷歌 DeepMind 团队发布 GenCeption 模型,将传统视频生成模型逆向改造为视觉分析引擎,可一次性完成深度估计、图像分割、3D 姿态估计等五项视觉任务,训练数据仅用了约 7500 段单人合成视频。

YouTube 于 7 月 16 日更新政策,明确禁止三类低质 AI 生成内容参与广告分成。这是平台首次针对 AI 带来的内容泛滥问题出台系统性限制,可能改变大量依靠搬运、模板化视频的创作者生态。

OpenAI宣布升级ChatGPT家长通知功能,当未成年用户因暴力威胁或网络霸凌等严重违规被停用时,关联账户的家长或监护人将立即收到警报。这一举措将AI安全防护从预防自伤扩展至防范对他人的伤害,对青少年AI使用规范具有行业示范意义。

月之暗面旗下新模型Kimi3上线后用户需求远超预期,导致平台算力资源紧张。公司已暂停新用户注册,优先保障现有付费用户的服务稳定性,并正在通过优化模型效率与补充算力两个方向缓解瓶颈。

Anthropic 的旗舰模型 Fable 5 在性能上与近期发布的开源模型接近,但单次任务的推理成本几乎是 OpenAI 和开源模型的三倍。这一成本劣势可能动摇其在商业竞争中的地位,尤其是在竞争对手拥有更强基础设施能力的情况下。

用户在使用 llama.cpp 启动 WebUI 时,未添加 `-tools` 参数(即没有启用内置工具或 MCP 工具),仅通过 JS Sandbox(`run_javascript`)启用了前端工具。用户期望在聊天提示中包含工具系统提示,但实际未生效。

企业 AI 落地的关键不再仅靠让更多员工使用工具,而是重新设计工作流程和角色分工。本文基于一篇译介观点,讨论从“人+AI”到“AI原生协作”的范式转变,这对企业的组织架构、项目管理和开发者协作方式产生实质影响。