具身智能新突破:蚂蚁集团开源LingBot-Vision,让机器人拥有“空间感”

蚂蚁集团旗下具身智能公司 Robbyant 于近日正式开源了 LingBot-Vision 系列视觉模型。该模型通过“边界建模”这一新思路,让机器人在感知物体空间位置、轮廓和深度方面取得显著突破,甚至在多个指标上以更小的参数量超越业界知名模型 DINOv3,为低成本实现高精度的机器人物理交互打开新路径。

蚂蚁集团旗下具身智能公司 Robbyant 于近日正式开源了 LingBot-Vision 系列视觉模型。该模型通过“边界建模”这一新思路,让机器人在感知物体空间位置、轮廓和深度方面取得显著突破,甚至在多个指标上以更小的参数量超越业界知名模型 DINOv3,为低成本实现高精度的机器人物理交互打开新路径。

GitHub 在 Copilot 使用指标 API 中新增了两项代码审查速度指标(平均审核时间和平均审核轮次),并按 AI 采用阶段进行拆解,帮助团队量化 Copilot 对代码审查流程的实际影响。

出门问问联合企业微信推出TicNote合作款AI录音硬件,这是企业微信首次引入专属AI硬件设备。该产品将企业微信AI能力延伸至线下口头沟通场景,把会议和面聊中的语音自动转化为可追溯的协作记录,为企业数字化流填补了语音环节的空白。

美国零售巨头 Target 开发了一套基于大语言模型(LLM)和向量检索的语义匹配系统,用于在营销活动启动前自动匹配最相似的历史案例,替代了此前成本高昂的规则匹配方案,据称在 Top-3 推荐下覆盖率可达 100%。

多位网络安全专家在 InfoQ 虚拟座谈会上指出,AI 正在从防御工具变为攻击者手中的利器,最具破坏力的两类攻击已不是单纯的技术漏洞,而是 AI 增强的“工业化”社会工程学攻击,以及通过间接提示注入对代理系统权限的滥用。这意味着传统的“补丁-修复”安全思维已失效,安全工程师必须掌握机器学习、模型行为和数据治理…

腾讯混元与新南威尔士大学联合提出 E-GRM 框架,通过检测模型自身对答案的“自信程度”来决定是否进行深度思考,在奖励模型推理中实现了延迟降低 62%、算力节省近半的同时准确率反而提升 3.3%。这一成果被 ACL 2026 收录,为 RLHF 系统的成本优化打开了新路径。

Anthropic 于7月8日发布了 Claude Code 的 v2.1.204 版本,修复了一个关键 bug——在 headless 模式下,SessionStart 钩子中的事件流未能正常传输,导致远程工作节点在钩子执行期间被误判为空闲而中断。这个修复对使用 Claude Code 进行自动化远程协作的…

NVIDIA 发布了一款名为 Audex(全称 Nemotron-Labs-Audex-30B-A3B)的新型音频-文本统一大语言模型,核心创新在于它能处理音频输入,但保持了其骨干文本模型(Nemotron-30B 架构)的推理能力,避免了传统多模态模型在迁移到音频任务时常见的“文本性能损失”。

蚂蚁集团旗下Robbyant团队于7月7日宣布开源LingBot-Vision,这是一个仅含10亿参数、专为密集空间感知任务设计的视觉基础模型。它通过“边界中心”的设计思路,在机器人、自动驾驶等需要精确理解物体边缘和位置关系的场景中,展现出优于大参数模型的效率与精度。这一开源动作,直接降低了高精度空间感知AI…

公众号“数字生命卡兹克”基于斯坦福经典课程《人生设计课》的理论框架,编写了一款 Claude 提示词,让大模型以“人生设计师”的角色,通过四阶段、6-9个主线问题,引导用户像做设计项目一样梳理现状、探索方向、制定五年计划。实测效果超出预期,这款 Prompt 已在微信群公开。