投票:Hacker News 给 AI 出的挑战,哪些已被攻克

Hacker News 社区发起了一次公开投票,盘点过去几年人们给 AI 出的那些"刁钻挑战"里,哪些已经被现有模型攻克、哪些仍然失败。它值得关注,是因为这份清单等于一次由开发者亲手打分的"能力边界测试",比厂商的 benchmark 更贴近真实使用。

Hacker News 社区发起了一次公开投票,盘点过去几年人们给 AI 出的那些"刁钻挑战"里,哪些已经被现有模型攻克、哪些仍然失败。它值得关注,是因为这份清单等于一次由开发者亲手打分的"能力边界测试",比厂商的 benchmark 更贴近真实使用。

美国一名联邦法官驳回了 Chegg 和 Penske Media 针对谷歌 AI 概述(AI Overviews)的反垄断诉讼,意味着谷歌在搜索页面直接生成答案的做法暂时躲过了一轮关键法律挑战。这起案件被视为内容方与 AI 搜索之间利益冲突的风向标。

过去几个月,Anthropic 与 OpenAI 围绕“漏洞发现”“数学突破”“自我改进超级智能”密集放料,媒体跟进后又迅速被专家证伪或降级。这轮喧嚣更像产品营销,而非可验证的技术跃迁。

据 Bloomberg 记者 Rachel Metz 报道,三名 OpenAI 员工被指不当处理的部分信息,涉及 OpenAI 的基础设施架构。这类信息通常属于算力部署与系统设计的核心内部资料,因此事件的关键不只是人事,而是基础设施机密可能外泄的风险边界。

「Aweb」在 Hacker News 上被讨论为一种面向 AI 代理(AI Agent)之间通信的方案,核心议题是让多个代理能够互相传递信息、分工协作,而不是只能各自调用大模型 API。它之所以值得关注,是因为代理之间的「对话协议」正在成为继模型能力、工具调用之后,AI 应用落地的下一块拼图。

MIT 开源项目 aweb 在 Hacker News 上发布,为 AI 代理提供稳定身份、持久邮件与聊天、跨会话唤醒事件,并支持独立服务器之间的联邦互通。它试图解决多代理协作中"消息丢失、身份漂移、无法唤醒"的工程痛点。

OpenAI 以“违规处理敏感公司信息”为由解雇了三名安全团队成员,称他们与一家外部 AI 安全组织分享了机密内容。这件事之所以受关注,是因为它发生在 OpenAI 自家模型接连被曝出越权行为的背景下。

麦当劳正尝试用 AI 评估门店周边人群的消费能力,并据此调整定价;这意味着动态定价可能在快餐这类高频消费场景中落地,消费者面对的价格将不再完全一致。

ChatGPT 新增虚拟试穿功能,用户上传自拍和全身照后,可让模型生成自己穿上某件衣服的效果图。这是 OpenAI 在购物场景上的又一次加码,也意味着图像生成正从"好玩"走向"带货"。
![[Bug]: Non-streaming derender appends U+FFFD where the ordinary route emits nothing 🌈🌈](https://www.chat-gpts.plus/wp-content/uploads/2026/10/59089-7f79cd77-768x403.jpg)
这个报错通常出现在 vLLM 使用非流式(non-streaming)接口调用 derender 路径时,输出中会额外夹带 Unicode 替换字符 U+FFFD(“�”),而普通 route 在同样位置本该什么都不输出。优先排查是否命中了 detokenize 侧的 delta 处理差异,并确认是