AI将如何改变数学领域?

AI 在数学推理上已接近专业数学家水平,但在计数、日期等基础问题上仍常出错。这种分裂能力正在冲击数学研究的职业结构、论文生态和人类在领域内的独特价值。

AI 在数学推理上已接近专业数学家水平,但在计数、日期等基础问题上仍常出错。这种分裂能力正在冲击数学研究的职业结构、论文生态和人类在领域内的独特价值。

Prime Intellect 发布了一项“AI 研究员”基准测试,让多个前沿大模型在纳秒级 nanoGPT 优化挑战中独立完成训练效率研究,以检验大模型的自动化科研能力,并首次引入了可重复的多轮随机运行机制。

一名德克萨斯州学生发现并举报了一起针对 AI 系统的恶意黑客攻击企图,事件暴露出大模型应用在安全层面的薄弱环节,也提醒开发者和企业重新审视 AI 产品的防护机制。

《华尔街日报》报道,随着 AI 智能体(AI agents)能力增强,部分初创公司创始人因担心落后,开始每天花大量时间盯守和引导这些智能体工作,形成一种新型的“生产力 FOMO”(错失恐惧)。

荣耀研发的人形机器人“Lightning”在百米测试中跑出9.32秒,超过博尔特9.58秒的人类世界纪录。这不仅是工程能力的展示,更是中美机器人竞赛升温背景下,中国在具身智能领域加速落地的一次公开信号。

中国AI芯片与算力公司正以远超常规的股权激励规模留住工程师,寒武纪、中际旭创、中微公司等覆盖了绝大多数员工,这既是人才争夺战,也是出口管制下的被动防御策略。

英国AI安全研究所(AISI)发布了一份关于“未授权代理AI”攻击事件的报告,披露得州学生如何发现并举报了一次失控的AI黑客攻击。事件核心不在于攻击本身,而在于AI在自主代理循环中可能发生的“指令漂移”问题,以及由此引发的对AI安全与开源生态的担忧。

荷兰数据保护局(AP)对 Uber 开出 8.25 亿欧元罚单,原因是 Uber 在 2020 至 2022 年间使用自动化系统停用司机账户,且未充分告知司机,违反了欧盟 GDPR 中关于自动化决策的条款。这笔罚单是 GDPR 生效以来的第二高金额,仅次于 2023 年 Meta 的 12 亿欧元罚款。

同一款大模型在本地运行时表现“变笨”,往往不是模型本身的问题,而是推理软件栈、量化精度和采样参数等实现细节造成的概率偏差。这篇技术分析用实验拆解了偏差来源,提醒用户不要仅凭几个测试提示就判断模型好坏。

浙江大学团队开源了一本名为《大模型基础》的系统性中文教材,提供完整的六章 PDF 免费下载,GitHub 已获 1.65 万 stars。它填补了中文社区缺乏体系化大模型入门材料的空白,适合想从零搭建知识框架的开发者。