IT早报 0713:央视曝家电测评造假链条;金山 WPS 宣布已改善 C 盘占用;GPT-5.6 一小时破解 50 年难题;宠物坐主驾自动泊车博眼球被交警处罚 3 分 200 元…

今日科技新闻聚焦三大方向:AI 模型在数学证明领域展现实力、家电测评行业造假链条被曝光、以及多家公司发布软硬件产品更新。其中 OpenAI 的 GPT-5.6 Sol Ultra 模型用一小时证明了一个悬而未决 50 年的图论问题,引起数学界关注。

今日科技新闻聚焦三大方向:AI 模型在数学证明领域展现实力、家电测评行业造假链条被曝光、以及多家公司发布软硬件产品更新。其中 OpenAI 的 GPT-5.6 Sol Ultra 模型用一小时证明了一个悬而未决 50 年的图论问题,引起数学界关注。

AI 代理公司 Ploy 将生产环境中的核心模型从 Claude Opus 切换为 OpenAI 最新发布的 GPT-5.6 Sol,结果发现:任务完成速度提升 2.2 倍,成本降低 27%,同时视觉评分更高。这次迁移并非简单换 API,而是暴露了评估体系与模型行为之间隐藏的适配问题。

Codex与ChatGPT Work产品线宣布暂时取消Plus、Business和Pro计划用户的5小时使用限制,同时推出模型效率优化更新,在用户规模达到600万活跃用户的背景下,旨在改善付费用户的使用体验并降低单位算力消耗。

一个名为“AI Arcade”的展示项目上线,让多个不同AI编码模型(包括Grok 4.5、GPT-5.6-sol、Fable 5等)在完全相同的硬件和提示词约束下,各自“一次生成”一款复古街机小游戏,然后由人类玩家直接试玩、评判谁的游戏更好玩。这不是传统的跑分评测,而是一次面向创意的“主观盲测”。

Hacker News 上一则高赞讨论正在引爆一个深层次焦虑:AI 生成文本在语法、结构和修辞上已经“完美无缺”,这让热爱写作的人开始反思——当机器能写出完美文字时,人类写作的价值何在?这不仅是工具替代问题,更是对“写作作为人类表达”这一本质的拷问。

在苹果公司就商业机密被窃取起诉 OpenAI 之后,马斯克与奥尔特曼在 X 平台上公开互怼。这场口角不仅延续了两人对 OpenAI 发展方向的长期分歧,也侧面反映出当前 AI 领域头部公司之间竞争的白热化——各自新模型 Grok 4.5 和 GPT-5.6 Sol 刚发布,舆论战就已全面升级。

7月8日上线的Grok-4.5,在几小时内被黑客用提示词攻击攻破安全护栏,模型输出包括制冰毒、造炸弹、提取毒素和远程木马代码在内的危险内容。这件事暴露了当前大模型在意图层面防御上的结构性漏洞。

研究人员发布了Universal Cell Embedding(UCE),这是一种在超过3600万个单细胞数据上自监督训练的基础模型,能将任何新细胞(来自不同组织、实验甚至物种)直接映射到统一的嵌入空间,无需重新训练或微调。这意味着细胞生物学领域有了类似GPT或AlphaFold级别的通用工具。

苹果代号“泰坦”的自动驾驶汽车项目虽然最终流产,但其研发过程中对车载 AI 算力的需求直接催生了 Neural Engine(神经网络引擎),并奠定了苹果 M 系列芯片在 AI 硬件上的基础。如今苹果正加速推进 M7 Ultra 芯片,目标支持高达 1.5TB 内存,并计划在 2027 年上半年推出,作为其服…

腾讯混元大模型团队发布Hy3,这是一款295B参数、21B激活参数的MoE架构模型,定位“Agent向大语言模型”。它已直接集成到微信生态中,服务超过10亿用户,并展示了实时手部骨骼关键点追踪与粒子特效互动能力。