国会最喜欢的人工智能工具?聊天GPT

根据CNBC的报道,在美国国会的AI工具采购中,OpenAI的ChatGPT以约90%的支出占比遥遥领先,成为立法机构目前花钱最多的AI助手,生成式AI已经进入真实的政府工作流。

根据CNBC的报道,在美国国会的AI工具采购中,OpenAI的ChatGPT以约90%的支出占比遥遥领先,成为立法机构目前花钱最多的AI助手,生成式AI已经进入真实的政府工作流。

AI 评估正在从“看第三方跑分”转向“看自家产品里的用户行为数据”,越来越多的团队开始自建评估体系,跳过 LangSmith、Arize 这类第三方评测工具。

OpenAI 联合创始人 Andrej Karpathy 用 Anthropic 的 Claude Opus 5 模型,将《指环王》的一段文字转化为可直接在浏览器中运行的 3D 场景,生成了约 5500 行代码,耗时两小时、成本约 10 美元。这不是严格基准测试,而是一次检验大模型创造力的“氛围测试”。

据知情人士透露,特朗普政府邀请 OpenAI、Google、Anthropic 等头部 AI 公司的员工于本周二前往白宫,参与 AI 监管框架的审查讨论。这是政策制定者与行业核心玩家之间一次罕见的直接沟通,其结果可能影响未来一段时间的 AI 监管走向。

知名YouTuber Hank Green 因为在写视频脚本时用 ChatGPT 辅助研究而遭到网友批评,他本人也承认这样使用大语言模型“对我不健康,对世界也没有好处”。这件事之所以值得关注,是因为它把生成式 AI 进入日常内容创作时引发的信任与伦理问题,重新摆到了台面上。

GitHub 用户 Alishahryar1 发布了一个名为 free-claude-code 的开源本地代理,让 Claude Code、Codex、Pi 等编程代理工具可以接上任意模型后端,包括免费模型和本地模型,从而绕开厂商自带的订阅和 API 计费体系。

PISIGuard 是一款针对 AI 聊天场景的个人信息保护工具,目标是防止用户在对话中泄露敏感数据。它出现在 Hacker News 上,反映出 AI 应用普及后隐私保护正从“可选项”变成“必选项”。

阿里巴巴正式发布号称史上最强的 Qwen3.8-Max 大模型,并宣布下周开放模型权重,性能直指 Anthropic 旗舰 Claude Fable 5。这是中国大模型又一次正面冲击美国 AI 霸权,也进一步压缩了闭源路线的差异化空间。

OpenAI新模型Astra在数学领域表现亮眼,但知名学者Gary Marcus发文提醒:用单一学科成功推导通用能力强弱,是典型的“合成谬误”。这件事之所以值得关注,是因为它关系到整个行业如何正确评估大模型的真实能力。

两个独立研究团队在三个小时内,用同一个 AI 模型解决了同一个量子密码学开放问题。这场“撞车”把 AI 辅助科研的效率和“独立发现”的标准推到了台前。