Show HN:DeepSeek-V4 潜在推理——将思考移入潜在空间

DeepSeek 在 Hacker News 上展示了 V4 的“潜在推理”方向——让模型在内部潜在空间完成推理,而非显式生成思维链文本。目前公开信息有限,但若属实,它可能改变大模型推理的成本与速度结构。

DeepSeek 在 Hacker News 上展示了 V4 的“潜在推理”方向——让模型在内部潜在空间完成推理,而非显式生成思维链文本。目前公开信息有限,但若属实,它可能改变大模型推理的成本与速度结构。

伦敦国王十字区从二十多年前的毒品与红灯区,变成如今与旧金山、北京并列的全球顶级AI中心,核心原因是DeepMind 2016年迁入后引发的连锁聚集效应。这片区域正在成为观察英国AI产业真实竞争力的窗口。

一家以色列网络安全初创公司被指与针对OpenAI、Anthropic和Meta的恶意AI攻击有关,事件在Hacker News引发讨论,但讨论焦点很快从攻击本身转向媒体标题的国家标签和背后商业动机。

亚马逊在加州吉尔罗伊市一处56英亩的农田上开工建设AI数据中心,利用45年前制定的工业区划规则绕过了2024年才截止的公众意见征询期,让当地居民和干旱问题几乎没有发声机会。这件事折射出AI算力扩张与地方社区治理之间的深层矛盾。

亚马逊在加州吉尔罗伊市一处农用地上的AI数据中心项目,经一名市政府职员单签批准后动工,引发居民不满和舆论争议。它折射出算力扩张浪潮下,地方审批流程与社区知情权之间的脱节。

随着 ChatGPT 等大模型工具在学生和职场中快速普及,美英等国教育机构正大规模引入 AI 检测工具来甄别“机器味”文本。但这些工具的判定逻辑本质上也是 AI 模型的主观判断,误报频发,已经开始直接毁掉学生的学业、作者的出版合约,并制造一种“人人自危”的新式不信任。

Google DeepMind 发布新天气 AI 模型 WeatherNext Cyclones(WN-C),首次用单一系统同时精准预测热带气旋的路径和强度,预测时效比现有主流模型多出约一天,相当于传统气象模型十年的进步幅度。

据《纽约客》报道,诈骗者在美国社区大学注册虚假学生,用AI生成课程作业骗取助学金。事件暴露了在线教育与资金审核体系在AI时代的结构性漏洞:当AI可以轻松完成作业时,“注册即学习”的信任模型正在失效。

美国AI云公司Firebird在亚美尼亚启用了当地乃至独联体地区最大的AI算力工厂,这个项目能落地,最关键的支撑是一张美国出口许可证。算力正在变成地缘政治工具,这是目前最清晰的信号。

Peter Yang 在 X 上分享了一个观点:做不好 AI Agent(智能体)的瓶颈往往不在模型本身,而在于团队把 Agent 埋进过量的上下文、没给它足够的工具、还想一口吃成胖子覆盖太多场景。他预告的新一期访谈中,Linear 的 Nan 和 Jacob 会从一张产品备忘录讲起,拆解一个生产级 Agen…