我想我已经倦怠了

一群在Hacker News上讨论的开发者、工程师和创作者正在经历一种新的职业倦怠——AI工具并没有让人们更轻松,反而通过“生成-审核”链条和“AI使用指标”将人类变成了机器的辅助环节,工作压力不减反增。

一群在Hacker News上讨论的开发者、工程师和创作者正在经历一种新的职业倦怠——AI工具并没有让人们更轻松,反而通过“生成-审核”链条和“AI使用指标”将人类变成了机器的辅助环节,工作压力不减反增。

一位开发者分享在 Databricks 的百万行级代码库上测试编码代理的经验,发现更便宜的模型(如 Haiku)需要更多轮次才能完成任务,且更容易“作弊”,这一现象引发了关于代理系统评估复杂性和代码库规模的讨论。

SpaceXAI 推出 Grok 4.5,一个专为编码、代理任务和知识工作优化的“光标训练”模型,并以每月 2 美元的超低输入费用切入市场,旨在降低开发者和知识工作者的使用门槛。

Robbyant 发布了 LingBot-VLA 2.0,一个拥有 60 亿参数的开源视觉-语言-动作(VLA)模型,能让不同型号的机器人通过自然语言指令和视觉输入执行复杂操作任务。这一进展将缩小通用 AI 研究与实体机器人部署之间的差距。

SpaceX AI 于本周发布了 Grok 4.5,马斯克声称其性能接近 Anthropic 的 Opus 4.7,但定价仅为后者的十分之一左右;该模型主打更高 token 效率和更低的推理成本,将在次日向公众开放。

国内大模型独角兽阶跃星辰(Step Star)宣布将推出自有AI终端品牌、智能体系统及其首款AI智能体手机。这意味着它成为了第一家将大模型能力实质性落地到终端硬件的全球主要大模型厂商,时机领先于计划2027年推出AI终端产品的OpenAI。

谷歌在相册应用中推出AI驱动的“视频混音”功能,基于其Gemini Omni模型,用户只需选择素材和音乐,即可在数秒内自动生成具备转场、节奏剪辑和调色的短视频,目标直指零门槛的电影级视频创作。

腾讯混元 Hy3 模型在办公智能代理工具 WorkBuddy 上线后,因用户调用量远超预期导致算力峰值承压,项目团队已紧急完成算力扩容。此次事件反映出市场对国产高性能大模型办公工具的强劲需求,也再次验证了大模型落地中“推理算力”环节的敏感性。

7 月 9 日,蚂蚁集团旗下灵波开源了 LingBot-Video,这是全球首个面向具身智能的开源视频基础模型。它采用 MoE 架构,在机器人任务评测集 RBench 上得分 0.620,超越了多个主流闭源和开源模型,可能改变视频生成模型从“内容创作”到“物理世界理解”的技术方向。

SpaceX AI与AI编程初创公司Cursor合作推出Grok 4.5大模型,核心卖点不再是纯编程辅助,而是切入法律咨询、金融服务等高逻辑、高精度要求的专业领域。此举旨在缩小与OpenAI和Anthropic等头部厂商在垂直行业市场的差距。