华为计划2027年第一季度推出新款AI芯片,挑战Nvidia

华为把下一代 AI 芯片 Ascend 960DT 的发布计划从 2027 年第三季度提前到 2027 年第一季度,并称性能翻倍,直接对标 Nvidia。这意味着国产算力追赶的节奏在加快,但配套系统规模出现缩水,值得留意。

华为把下一代 AI 芯片 Ascend 960DT 的发布计划从 2027 年第三季度提前到 2027 年第一季度,并称性能翻倍,直接对标 Nvidia。这意味着国产算力追赶的节奏在加快,但配套系统规模出现缩水,值得留意。

GPT-6 Astra 在《宝可梦 火红》中仅用约 18 小时通关,远超前代模型近百小时的成绩,并首次在《我的世界》中推进到末地传送门阶段;但一次苦力怕爆炸让它丢失全部关键物资,随后数小时只在种土豆。

Unsloth 同时推出 Docker 镜像和桌面应用 Unsloth Desktop,让用户在本地就能训练和运行 500 多个模型,覆盖 NVIDIA 和 AMD 显卡,并支持 Mac、Windows 与 Linux。

Snap 推出名为 Specs Intelligence 的 AI 助手,定位为可在 iPhone、Mac 与 Specs 智能眼镜之间协同的“预判式 AI 服务”,试图把 AI 从被动应答推向主动推送。

OpenAI 一次性披露了六起新的 AI 安全事件,把过去多发生在内部评估、红队测试或模型灰度阶段的异常情况公开化。这值得关注,因为它把“模型出事之后怎么讲”变成了可被外部审视的常规动作。

Anthropic CEO Dario Amodei 提出由前沿 AI 公司互设“嵌入式评估员”,并呼吁政府放宽反垄断法以便协调安全标准;作者 Tom Evslin 认为,这类安排的真实效果是把大厂之间的信息互通合法化,将潜在挑战者挡在门外。

Pangram 是一款同时支持文本和图像检测的 AI 内容识别工具,声称能识别 ChatGPT、Claude、Gemini 等主流模型生成的内容,并已获得芝加哥大学、马里兰大学等第三方研究者的准确性验证,目前在 Hacker News 上引发讨论。

《大空头》原型、投资人 Michael Burry 公开质疑 OpenAI、Anthropic 等公司呼吁“放缓 AI 发展”的动机,认为这是为增长放缓和 IPO 造势的自利行为。这场争论把 AI 安全话语与商业竞争、监管俘获的边界问题摆上了台面。

Hacker News 上出现一篇题为《DeepSeek-v4.1 Flash:把 KV Cache 压缩推到极限》的技术文章,讨论该模型在 KV Cache 压缩与前缀缓存上的表现,评论区有开发者称其把长会话推理成本压到接近免费。

DeepSeek-V4.1-Flash 技术报告公开,核心是把 KV Cache 压缩到前代约四分之一,同时用 Causal Encoder-Decoder 架构把 Prefill 激活参数降到 8B、Decode 保持 16B。它解决的是长任务 Agent 场景下显存、SSD 和互联带宽被 KV Cache…