一份有主见的AI使用指南

Ethan Mollick 更新了其广受关注的 AI 使用指南,核心变化是从一年前的“聊天模型选择”转向了“代理系统(agentic systems)实战”。Google 的 Gemini 因缺乏成熟的代理模式被剔除推荐,而 ChatGPT 与 Claude 则围绕“Work/Cowork”和“Codex/C…

Ethan Mollick 更新了其广受关注的 AI 使用指南,核心变化是从一年前的“聊天模型选择”转向了“代理系统(agentic systems)实战”。Google 的 Gemini 因缺乏成熟的代理模式被剔除推荐,而 ChatGPT 与 Claude 则围绕“Work/Cowork”和“Codex/C…

Kimi AI 与其关联团队 kvcache-ai 联合开源了名为 AgentENV 的分布式系统,该系统专门用于智能体强化学习(RL)训练,是支撑其 Kimi K3 模型训练的关键基础设施。这件事值得关注,因为它首次将大模型智能体 RL 训练的底层分布式框架开放出来,可能降低该领域的研发门槛。

微软CEO萨提亚·纳德拉7月27日在CNN节目中警告,完全依赖单一AI实验室(如OpenAI、Anthropic)的企业将无法存活。他建议企业保留使用模型时的元数据并训练自有模型,同时将编程工具(harness)与模型分离,以实现多模型切换。

当作者想测试中国新版ChatGPT对手Kimi时,发现App因用户太多而无法登录。这个卡顿现象暴露了AI行业当前最现实的瓶颈:模型再强,没有足够的服务器和GPU支撑,用户依然用不了。

美国阿尔康州立大学一位历史教授在考试题目中用白色字体嵌入隐形指令,要求AI在回答时插入关于“马达加斯加”的荒谬内容,结果35名学生中有32人直接复制粘贴AI输出,作弊行为被当场识破。这一事件提醒我们:AI工具滥用正在倒逼反作弊手段升级,但单纯依赖模型本身可能难以解决这一矛盾。

微软发布了自研的轻量级网络安全模型 MAI-Cyber-1-Flash,在漏洞检测基准测试中表现领先,但最复杂的推理任务仍需调用 OpenAI 的 GPT-5.4。微软正从单纯的模型提供商转变为“AI 模型编排者”,这一策略在实践中已显示出成本和性能的平衡优势。

上周末,大量使用 Claude“共享聊天”功能创建的链接被 Google 等搜索引擎公开收录,其中包含医疗记录、企业内部文档和儿童个人信息。Anthropic 将问题归因于用户将链接发布到了公开平台,但外界质疑其设计之初就未对“公开链接”施加足够防护。

Kimi 团队发布 PerceptionBench,一个专门测试 AI 模型纯视觉感知能力的基准,通过 3000 道隔离单一感知能力的问题,暴露出当前多模态大模型在“看”的环节上存在系统性的缺陷,而不是推理或知识不足。

OpenAI 分析了超过 80 万条工作相关的 ChatGPT 消息,发现 43.5% 的岗位特定查询实际涉及另一职业——市场和工程任务跨界最多。小公司中,非专业人士大量用 AI 代劳合同审查、数据分析等原需专长的工作,这可能是岗位定义正在前移的一个早期信号。

英伟达正通过股权投资、以股换芯等方式深度绑定下游客户,形成“英伟达出钱→客户买卡→客户再融资→继续买卡”的循环。规模据估算已达7500亿美元级别,一旦AI收入无法覆盖债务,可能引发类似2008年的信贷危机。