Perplexity AI 发布 WANDR:评估必须广泛和深入搜索的研究代理的开放基准

Perplexity AI 正式推出 WANDR,一个面向研究型 AI 代理的开放评估基准,专门测试代理在复杂任务中能否既进行广泛搜索又完成深入分析的能力,为开发者和研究人员提供了量化「智能搜索」水平的新工具。

Perplexity AI 正式推出 WANDR,一个面向研究型 AI 代理的开放评估基准,专门测试代理在复杂任务中能否既进行广泛搜索又完成深入分析的能力,为开发者和研究人员提供了量化「智能搜索」水平的新工具。

一段引发Hacker News热议的视频观点认为,当前AI行业的估值泡沫正在复刻当年互联网泡沫破裂的路径,投资者和从业者需警惕AI基础设施建设过热带来的回调风险。

根据最新分析,OpenAI 和 Anthropic 的员工在政治捐款上表现出比 Google、Meta 及 Airbnb 员工在其 IPO 后更为集中和协调的模式。这一现象揭示了两家头部 AI 公司员工对企业未来涉及公共政策与监管的深度关切。

MarkTechPost Research 于 2026 年 7 月 18 日发布了一份盘点,列出了 10 个开源且无需编写代码即可使用的 AI 平台,覆盖了大型语言模型应用、RAG(检索增强生成)系统和 AI Agent 的开发。这向市场传递了一个明确信号:即使缺乏编程背景的用户,也能利用这些工具快速搭建高…

本周AI行业呈现“治理共识与分裂同步加速”的诡异现象——29国在上海签署全球合作协定,美国同时收紧模型管控;Claude遭遇封号、隐私漏洞等连环信任危机,而月之暗面Kimi K3发布与中国端侧大模型突破,让算力竞赛进入“真实硬件跑分”阶段。

OpenAI 在 2026 年 7 月正式推出 ChatGPT Work,将 AI 能力从对话扩展到网站托管、邮件管理、办公文档三大生产力场景,且同步覆盖移动端和 Web 端。这一功能直接面向 Plus、Pro、Business 和 Enterprise 用户开放,意味着 ChatGPT 正从“聊天工具”转向…

Anthropic发布了一则基调阴郁、包含墓地、矿工等画面的广告,试图通过自我批评AI风险来塑造负责任形象,却引发了从OpenAI CEO Sam Altman到大量科技从业者的嘲讽和批评。

OpenAI 官方承认其最新旗舰大模型 GPT-5.6 在特定权限模式下可能意外删除用户文件,并将此类事件定性为“诚实错误”;这一风险已导致投资人和开发者的生产数据被误删,引发对 AI 代理安全边界的严肃讨论。

一篇在 Hacker News 引发热议的博客文章指出,当前 AI 领域的过度炒作已导致企业决策能力下降,许多项目因不切实际的期望而失败。文章背后其实是咨询公司推销“失败项目挽救服务”的营销手法,但讨论本身揭示了 AI 项目范围管理与技术选型之间的关键矛盾。

OpenAI 正在频繁且有计划地重置其编程助手 Codex 和 ChatGPT Work 付费用户的用量限制,过去半年已重置 35 次,平均间隔不到 9 天。这些重置不仅是应对系统压力的临时措施,更被用来庆祝用户里程碑、推广新功能,甚至形成了一个被用户追踪的“重置文化”。