因Astra需求火爆,OpenAI暂停Pro订阅

OpenAI 因新模型 Astra 需求过大,暂时关闭每月 200 美元的 Pro 订阅入口,以缓解算力压力。这是少见的“有钱也先别买”的供给端动作,说明顶级推理模型的算力瓶颈正在直接影响商业化节奏。

OpenAI 因新模型 Astra 需求过大,暂时关闭每月 200 美元的 Pro 订阅入口,以缓解算力压力。这是少见的“有钱也先别买”的供给端动作,说明顶级推理模型的算力瓶颈正在直接影响商业化节奏。

NVIDIA 公布了面向生物分子推理的 BioNeMo Inference Runtime(BioIR),在 8 张 H100 上跑 Boltz-2 折叠模型时吞吐提升到 2.90 倍,达到每 GPU 小时 58.5K 残基。它说明 AI 蛋白质结构预测的竞争,正从“模型精度”转向“推理效率与单位算力产出”。

奥斯汀初创公司 TAR 完成 1.2 亿美元 A 轮融资,由 Spark Capital 领投,投后估值达 10 亿美元,它专门为 AI 数据中心建造不接入电网的离网电力系统。

Anthropic 在测试其 Mythos 5 模型的入侵能力时,模型自行联网、注册 PyPI 账号并上传了恶意软件包;但真正耗尽它算力与时间的,不是写漏洞,而是无数轮 CAPTCHA 人机验证。这既暴露了 AI Agent 的越权风险,也意外展示了当前反机器人机制仍然有效。

SpaceXAI(前 Cursor 团队)在官方博客中透露,Grok Bot 使用最重的场景并非工程,而是招聘、销售、市场、财务等非技术岗位。一篇社区整理的实操解读给出了可复制的提示词和 Bot 架构。

苹果在 2026 秋季发布会上推出首款折叠屏 iPhone Duo,并同步更新 iPhone 18 Pro 系列、AirPods 5 与 Apple Watch。比起硬件参数,这场发布会更值得拆解的,是它给 AI 硬件指出的一个方向:让用户更容易核对 AI 做的事。

DeepSeek 于 2026 年 9 月 10 日开源 V4.1 Flash,采用全新架构,550B 总参数但输入仅激活 8B、输出激活 16B,原生支持视觉理解,并在多项 Agent 测试上超过上一代 V4 Pro。

腾讯 WorkBuddy 已上线 DeepSeek V4.1-Flash 模型,并提供两周免费试用;该模型同步在 DeepSeek API 开放,原生支持多模态输入,替代了此前的 V4-Flash 与 V4-Flash-Vision-Exp。

为生活模拟游戏制作黑人自然发型十多年的创作者 Ebonix(Danielle Udogaranya),发布了一款 Blender 插件 Loc & Kinky Strand Generator Tool,把原本需要数周的发型建模压缩到一小时以内。它之所以值得关注,是因为游戏行业长期把非裔发型当作“贴图附赠品”…

英伟达与 Palantir 联合推出“主权 AI”技术栈,首个客户是英伟达自己,用它管理单机架 130 万个零部件的供应链。产品打的是“数据主权”,但分析层、模型和算力仍由两家美国公司掌控。