蚂蚁集团Robbyant开源LingBot-Vision:用于密集空间感知的1B边界中心视觉基础模型

蚂蚁集团旗下Robbyant团队于7月7日宣布开源LingBot-Vision,这是一个仅含10亿参数、专为密集空间感知任务设计的视觉基础模型。它通过“边界中心”的设计思路,在机器人、自动驾驶等需要精确理解物体边缘和位置关系的场景中,展现出优于大参数模型的效率与精度。这一开源动作,直接降低了高精度空间感知AI…

蚂蚁集团旗下Robbyant团队于7月7日宣布开源LingBot-Vision,这是一个仅含10亿参数、专为密集空间感知任务设计的视觉基础模型。它通过“边界中心”的设计思路,在机器人、自动驾驶等需要精确理解物体边缘和位置关系的场景中,展现出优于大参数模型的效率与精度。这一开源动作,直接降低了高精度空间感知AI…

公众号“数字生命卡兹克”基于斯坦福经典课程《人生设计课》的理论框架,编写了一款 Claude 提示词,让大模型以“人生设计师”的角色,通过四阶段、6-9个主线问题,引导用户像做设计项目一样梳理现状、探索方向、制定五年计划。实测效果超出预期,这款 Prompt 已在微信群公开。

蚂蚁集团副总裁周俊在AICon大会上提出,万亿参数大模型的算力成本已达到“每运行15分钟消耗一辆特斯拉”的惊人水平,行业必须从追求Token数量转向提升Token密度,即用更少Token完成同等智力任务。核心解法是协同改造模型架构、训练策略和智能体能力,而非单点优化。

Claude 开发者官方团队披露了两种高效多智能体架构模式——Advisor(顾问)和 Orchestrator(编排者),通过让高性能模型 Fable 5 与低成本模型 Sonnet 5 混合协作,能在保留顶级模型近 92%-96% 性能的同时,将成本压缩至 46%-63%。这为 AI 应用的工程化落地提供…
![[Feature Request] Allows registering custom trackers to internal tracker type registry](https://www.chat-gpts.plus/wp-content/uploads/2026/07/2734-142e0fc6-768x403.jpg)
用户在 Huggingface Accelerate 框架中开发自定义追踪器(Custom Tracker)时,期望像内置追踪器(如 wandb、tensorboard)一样通过 Accelerator(log_with=args.tracker_names) 统一初始化,但现有内部注册表 LOGG

用户在 Gradio 应用中使用 `gr.Interface` 配合 `gr.Examples` 和 `cache_examples=True`,且输出为 `gr.Number` 类型时触发。当函数返回负数(如 `-0.5678` 或 `-42`),点击示例会出现崩溃。

Feyn Labs 于 2025 年 6 月 25 日发布 Pulpie 模型系列,以 1/20 的成本实现了与现有最佳网页内容提取器相当的精度,其最小模型在参数量仅为对手 1/3 的情况下,处理速度提升 20 倍,每处理 10 亿页的成本从 15.9 万美元降至 7,900 美元。这意味着大规模高质量网页数…

SpaceX已正式向美国联邦通信委员会(FCC)提交申请,计划发射并运营一个由10万颗卫星组成的第三代星链星座,目标不仅是覆盖偏远地区的互联网,更是要为AI时代打造全球通信基础设施。

英伟达研究团队正式发布了名为 Audex 的统一音频-文本大语言模型,旨在解决当前多模态模型中音频处理与文本逻辑能力难以兼得的问题。该模型基于 MoE 架构,在音频理解、生成等任务上表现优异,同时几乎无损地保留了原始大模型的推理与文本处理能力。

前 OpenAI 研究员田永龙被曝已加入腾讯,将主导混元大模型的多模态视觉语言模型(VLM)研发。这是继姚顺雨之后,又一位具备 OpenAI 核心研发背景的人才加入腾讯,反映出腾讯在大模型领域正在持续加大投入,特别是在多模态和视觉理解方向。