标签: 大模型

Claude Fable 给出了雅可比猜想的一个反例

Claude Fable 给出了雅可比猜想的一个反例

AI 模型 Claude Fable 在验证一个著名数学猜想(雅可比猜想)时,直接给出了一个反例,并且后续多名 AI 和人类研究者确认该反例有效。这一事件展示了先进 AI 在逻辑推理与自我验证流程上的突破性进展,也暴露了不同模型在面对统一数学问题时的能力差距。

企业 AI:方法论易得,交付力难求

企业 AI:方法论易得,交付力难求

阿里云 CIO 蒋林泉在三年内落地 28 类 AI 数字员工后,将 RIDE 方法论和内部能力产品化为“睿系列”,采用 RaaS(结果即服务)模式交付可量化的业务结果,直接回应企业从 PoC 到生产之间“自研做不起、通用不够用”的两难困境。

不会代码也能做产品:一份从0开始的Vibe Coding保姆级教程

不会代码也能做产品:一份从0开始的Vibe Coding保姆级教程

《数字生命卡兹克》公众号发布了一篇实用指南,详细拆解了零基础用户如何借助国产大模型和辅助开发工具,从0到1完成一个完整产品的开发、部署与上线。这篇文章在Kimi K3、Qwen 3.8 Max等国产模型能力迅速提升的背景下,为“不会写代码但想落地产品”的创作者提供了一条可复用的实操路径。

喊出”再来两周”的用户赢了:腾讯混元Hy3 限免延长到 8 月 5 日,295B MoE模型白嫖期续命

喊出"再来两周"的用户赢了:腾讯混元Hy3 限免延长到 8 月 5 日,295B MoE模型白嫖期续命

腾讯混元大模型最新的 Hy3 模型,原本两周的免费试用期在用户强烈要求下延长至 8 月 5 日。一个总参数 295B、激活参数仅 21B 的 MoE 架构模型,能在有限算力下提供长上下文推理,这次的“续命”让更多开发者和企业用户有机会零成本深度测试该模型的实际效果。

Hugging Face says it used the open-weight GLM-5.2 hosted on its own compute for breach forensics, after US frontier model safety guardrails blocked the requests (Edward Targett/The Stack)

Hugging Face says it used the open-weight GLM-5.2 hosted on its own compute for breach forensics, after US frontier model safety guardrails blocked the requests (Edward Targett/The Stack)

Hugging Face 在遭受安全事件后的取证分析中,选择使用自身计算资源部署的开源权重模型 GLM-5.2,而非美国前沿模型的安全护栏服务,因为后者拒绝了其排查请求。这一事件暴露了美国对先进大模型访问的限制在实际应急场景中的缺位,也凸显了开源模型在自主可控方面的独特价值。

如何打造能够自我纠错的 AI 循环?

如何打造能够自我纠错的 AI 循环?

一位开发者社区成员提出了一套构建 AI 自纠错循环的系统架构,将人类从手动校对和反复提示的循环中解放出来。这个方案区分了仅仅“使用 AI”和真正“落地 AI 系统”的边界,核心是通过三个独立角色(构建者、评审者、管理者)的工程化设计,让 AI 输出在交付前自动完成校验与修正。