OpenArch——现代大型语言模型(LLM)架构的 PyTorch 实现

GitHub 上出现了一个名为 OpenArch 的开源项目,用纯 PyTorch 从零手写实现了 GPT-2 XL、Llama 3、DeepSeek R1、Kimi K2、GLM 4.5 等十余个现代大模型架构,目标不是追求性能,而是让每种架构的注意力、归一化、位置编码等设计选择变得可读、可对比。

GitHub 上出现了一个名为 OpenArch 的开源项目,用纯 PyTorch 从零手写实现了 GPT-2 XL、Llama 3、DeepSeek R1、Kimi K2、GLM 4.5 等十余个现代大模型架构,目标不是追求性能,而是让每种架构的注意力、归一化、位置编码等设计选择变得可读、可对比。

Salesforce 年度大会 Dreamforce 2026 于 9 月 15 日至 17 日在旧金山举行,CEO Marc Benioff 将在开幕主题演讲中公布最新 AI 进展,重点大概率落在 Agentforce 360 与 Slackforce 上,这是观察企业级 AI 代理走向落地的一次窗口。

在 AI"末日论"引发科技股抛售的同时,网络安全板块逆势大涨,CrowdStrike、Zscaler 等单日涨幅达 8%–16%。市场逻辑是:AI 越强,攻击面越大,防守需求越刚。

Anthropic 的 Dario Amodei、OpenAI 的 Sam Altman 与 xAI 的 Elon Musk 近期先后呼吁“放慢 AI 前沿开发”,理由是安全治理跟不上模型能力;而特朗普政府与中国外交部均不接受这一说法,前者担心让中国追上,后者称其为“冷战剧本”式的恐吓。

Hugging Face 主动申请成为 Anthropic 的嵌入式第三方审计方,而它自己正被 Nvidia 以 129.3 亿美元收购,Nvidia 同时还在洽谈以锚定投资者身份向 Anthropic 的 IPO 投入最多 100 亿美元。一个志愿者,正处在被“利益相关方”收购的过程中。

AI 语音克隆已经逼真到能冒充家人紧急求助行骗,而研究显示约 36% 的成年人可能因此上当。识别亲人声音这一传统身份验证方式,正在失效。

微软发布了一份约束自家 MAI 模型的 AI 行为准则,明确否决“模型可能值得被赋予福利或权利”这一说法;而它投资 50 亿美元、同时在云和 Office 产品上深度合作的 Anthropic,恰好正在研究这个方向。

OpenAI 欧洲、中东和非洲地区政策负责人 Tom Duff Gordon 公开呼吁英国出台具有约束力的 AI 监管规则,建立"持久、强制、基于能力"的要求。这意味着头部大模型公司开始主动为监管背书,而不是被动等待立法。

中国监管机构正把目光投向以“AI男友”“AI女友”为代表的陪伴型聊天机器人,相关合规要求可能影响国内一批情感陪伴类 AI 应用的上线节奏与产品形态。

OpenAI 和 Anthropic 近期讨论的“放缓前沿训练”,表面上是减速,实则可能把闲置算力和研究精力转向后训练、Agent 可靠性与安全对齐,从而更快推动大模型在真实产品中的落地。