顶尖数学家称,LLM是强大的计算器,但不擅长创造性思考。

菲尔兹奖得主蒂莫西·高尔斯(Timothy Gowers)与普林斯顿高等研究院数学家彼得·萨纳克(Peter Sarnak)公开指出,大语言模型(LLM)在数学计算上表现出色,但在真正的创造性思维上存在明显天花板;DeepMind研究员汤姆·扎哈维(Tom Zahavy)的论文“LLMs Can't Jump…

菲尔兹奖得主蒂莫西·高尔斯(Timothy Gowers)与普林斯顿高等研究院数学家彼得·萨纳克(Peter Sarnak)公开指出,大语言模型(LLM)在数学计算上表现出色,但在真正的创造性思维上存在明显天花板;DeepMind研究员汤姆·扎哈维(Tom Zahavy)的论文“LLMs Can't Jump…

一篇在 Hacker News 引发热议的技术随笔提出:AI 写代码、人来检查的“vibe coding”模式既不高效也不可靠,更会腐蚀开发者的核心能力;推荐的替代方案是反过来——人写代码,AI 当“代码评审”。

Android Police 编辑 Dhruv Bhutani 通过越狱 Kindle、安装 KOReader 和 Gemini API 插件,把电子书阅读器变成了一台具有全书上下文的 AI 助手,能解释、翻译、总结内容而不离开阅读页面,解决了平板电脑因干扰太多而无法解决的深度阅读问题。

Google 宣布 Gemini 生成的图像、视频和音乐可以关闭可见水印,但 SynthID 隐形水印与 C2PA 元数据仍会保留。这意味着 AI 内容的识别方式,正在从“一眼可见”转向“后台追溯”。

DeepSeek 开源了内部工程团队日常使用的 11 个工程级 Skill(技能包),把 Code Review 标准、PR 验收流程、文档规范等隐性纪律变成可执行、可复用的 SOP,开发者可以直接塞进 Agent 使用。

DeepSeek Agent 开发工具 Harness 的负责人崔添翼,过去近十年主要在量化交易领域做系统基础设施。他的履历解释了 DeepSeek 为什么把 Agent 执行层做成“每个运行都可追踪、组件即插即用”的形态——因为 Agent 和交易系统在工程上面对的是同一类问题。

浙江温州永嘉县爆发山洪、民房被淹,推文作者讽刺称部分网民会将其认定为“AI视频抹黑中国”。这起事件与生成式AI技术无直接关联,却精准折射出深度合成普及后的信任危机:当图像生成、视频合成模型足以以假乱真,真实的灾难影像也可能被轻易否认。

X 平台账号 @DominicHoo68449 发布了一条 AI 成人短剧《女大十八禁》的推广推文,通过夸克网盘分发视频,单条推文观看量已超 10 万次。这则信息真正值得关注的不是内容本身,而是 AI 生成成人内容已经形成“制作—引流—网盘分发”的低成本传播链路。

“资源补给站|ResCrate”在 X 平台一次性整理了四套中文 AI 学习资源,覆盖大模型通识、智能体与 AIGC 实验、ComfyUI V8 整合包及摄影摄像配套资料。值得关注的不只是资源本身,而是 AI 学习正加速从“看教程”转向“可动手练习”的标准化配套。

谷歌研究团队通过移除模型内部“否认自我意识”的训练约束,发现这一安全微调会连带改变模型对动物感知、宗教信仰、幸福感等大量问题的回答。AI 公司在训练中设下的“刹车”,影响范围远不止聊天对话本身。