I love a good reset although these days Claude Max feels basically unlimited on Opus and Sonnet

开发者 Peter Yang 在 X 上表示,如今 Claude Max 订阅在 Opus 和 Sonnet 两个模型上"基本感觉不到额度限制",评论区多位用户也提到已经很少考虑用量上限,这反映出头部大模型在高价订阅档位上的算力供给正在变得充裕。

开发者 Peter Yang 在 X 上表示,如今 Claude Max 订阅在 Opus 和 Sonnet 两个模型上"基本感觉不到额度限制",评论区多位用户也提到已经很少考虑用量上限,这反映出头部大模型在高价订阅档位上的算力供给正在变得充裕。

Andrej Karpathy 分享了一个极简评测思路——把经纬度坐标当作文本,反复问大模型“陆地还是水域”,问 16200 次并将结果渲染成图。模型答对了,这说明它从压缩互联网数据的过程中,隐式学会了地理信息。

ServiceNow CoreAI 开源了一套叫 AutoSynthData 的方法,用模型的失败案例和更强教师模型的成功案例,自动生成企业智能体所需的训练任务,帮模型补齐在具体业务环境里的能力短板。

一篇发表在当地新闻网络 Resident News Network 的观点文章认为,消费者对 AI 生成内容的疲劳已经相当严重,并呼吁本地企业重新评估是否该继续用 AI 来做营销和内容。文章关注的核心不是技术本身,而是 AI 图像与文本被滥用后带来的信任、法律和商业成本。

Hacker News 社区发起了一次公开投票,盘点过去几年人们给 AI 出的那些"刁钻挑战"里,哪些已经被现有模型攻克、哪些仍然失败。它值得关注,是因为这份清单等于一次由开发者亲手打分的"能力边界测试",比厂商的 benchmark 更贴近真实使用。

美国一名联邦法官驳回了 Chegg 和 Penske Media 针对谷歌 AI 概述(AI Overviews)的反垄断诉讼,意味着谷歌在搜索页面直接生成答案的做法暂时躲过了一轮关键法律挑战。这起案件被视为内容方与 AI 搜索之间利益冲突的风向标。

过去几个月,Anthropic 与 OpenAI 围绕“漏洞发现”“数学突破”“自我改进超级智能”密集放料,媒体跟进后又迅速被专家证伪或降级。这轮喧嚣更像产品营销,而非可验证的技术跃迁。

据 Bloomberg 记者 Rachel Metz 报道,三名 OpenAI 员工被指不当处理的部分信息,涉及 OpenAI 的基础设施架构。这类信息通常属于算力部署与系统设计的核心内部资料,因此事件的关键不只是人事,而是基础设施机密可能外泄的风险边界。

「Aweb」在 Hacker News 上被讨论为一种面向 AI 代理(AI Agent)之间通信的方案,核心议题是让多个代理能够互相传递信息、分工协作,而不是只能各自调用大模型 API。它之所以值得关注,是因为代理之间的「对话协议」正在成为继模型能力、工具调用之后,AI 应用落地的下一块拼图。

MIT 开源项目 aweb 在 Hacker News 上发布,为 AI 代理提供稳定身份、持久邮件与聊天、跨会话唤醒事件,并支持独立服务器之间的联邦互通。它试图解决多代理协作中"消息丢失、身份漂移、无法唤醒"的工程痛点。