标签: Anthropic

NanoGPT Speedrun Frontier

NanoGPT Speedrun Frontier

Prime Intellect 发布了一项“AI 研究员”基准测试,让多个前沿大模型在纳秒级 nanoGPT 优化挑战中独立完成训练效率研究,以检验大模型的自动化科研能力,并首次引入了可重复的多轮随机运行机制。

v2.1.241

v2.1.241

Anthropic 于 8 月 23 日发布 Claude Code 命令行工具 v2.1.241 版本,主要进行 Bug 修复与可靠性改进。在 AI 编程助手竞争白热化的节点,这类高频迭代是维持开发者体验和工具稳定性的关键动作。

NanoGPT Speedrun Frontier

NanoGPT Speedrun Frontier

Prime Intellect 发布了 NanoGPT Speedrun 排行榜,通过让 20 款最新大模型各自运行 9 天编码智能体任务,量化它们逼近人类表现记录的速度。目前 Fable 5 以 81.7% 的差距闭合率位居榜首,而传统霸主 GPT-5.6 与 Claude Opus 5 仅位列中游。

猜猜这些LLM输出哪个带水印

猜猜这些LLM输出哪个带水印

Hacker News 上围绕“LLM 输出水印”展开了一场技术辩论,焦点不在水印能不能检测,而在于多次加印、结构化输出撕裂以及水印被滥用为 DRM 的可能性——这直接动摇了“AI 内容可溯源”的可行性根基。

OpenAI 呼吁加州加强 AI 安全法规

OpenAI 呼吁加州加强 AI 安全法规

OpenAI 一改此前反对立场,公开支持加州 SB 53 人工智能安全法案,并呼吁州立法机构进一步扩大监管范围,要求对前沿大模型在训练和评估阶段进行安全监控。这家公司态度反转,反映出前沿模型安全失控风险已从理论担忧变成真实事件。