GLM-5.3上线:AA智能指数60分并列开源第一,成本更低

智谱AI发布最新一代基座模型GLM-5.3,在AA智能指数评测中获得60分,与开源阵营头部模型并列第一,同时宣称推理成本进一步下降。这是国产开源大模型在能力与成本平衡上的一次关键卡位。

智谱AI发布最新一代基座模型GLM-5.3,在AA智能指数评测中获得60分,与开源阵营头部模型并列第一,同时宣称推理成本进一步下降。这是国产开源大模型在能力与成本平衡上的一次关键卡位。

PICO 官方宣布新款头显 PICO Space Pro 将于 9 月 2 日发布,该设备采用双芯架构与 4000 PPI 微型 OLED 屏幕,性能目标直指当前主流 XR 芯片的两倍,是 PICO 在空间计算硬件上的又一次关键布局。

阿里达摩院玄铁 C950 芯片在无 GPU、无模拟层的条件下,原生跑通了通义千问 3.8-27B 大模型,这是 RISC-V 架构首次独立完成 270 亿参数模型的推理任务。

NVIDIA 推出 TensorRT Model Connect 公共预览版,开发者只需两条命令即可将 Hugging Face 上的模型检查点转换为原生 C++ 推理引擎,省去了手动编写优化代码的环节。

国家超算互联网平台(SCNet)以远低于 DeepSeek 官方 API 的价格提供 DeepSeek 模型服务,最低 30 元/月即可获得大量 Token 额度,相当于国家级算力基础设施在给开发者“补贴”模型调用成本。

佐治亚理工学院流出的 2026 年 LLM 课程大纲,实质上是一份经过学术筛选的大模型前沿论文阅读清单。它把 Agent、强化学习、推理时扩展等技术放在与预训练同等重要的位置,反映出 LLM 研究重心正在从“训练更大模型”转向“让模型更聪明地用工具、记忆和算力”。

Modular 团队正式将编程语言 Mojo 及其编译器、工具链全部开源,采用 Apache 2.0 许可(含 LLVM 例外)。这意味着面向 GPU 与 AI 加速场景的系统级编程,终于有了一个可自由修改、构建和分发的开源底座。

Cerebras 发布了新一代晶圆级 AI 推理系统 CS-4,基于 WSE-3 Turbo 芯片,官方称推理速度最高可达 GPU 系统的 30 倍,并已开始接受出货,瞄准超大规模数据中心的部署场景。

OpenAI 于 8 月 19 日发布了一揽子安全新规,核心是在模型测试与后期训练阶段引入更严格的监控和网络隔离,并暂停了最前沿的强化学习项目。这是自 7 月 Hugging Face 安全事件曝光后,OpenAI 首次大规模公开调整安全实践。

一篇在 Hacker News 上获得热议的技术评论指出,AI 提升的是“做事的速度”,而非“做对事的方向”。大型企业真正的问题——表演式工作与管理层级臃肿——并不会因为引入 Agent 或大模型而解决,反而可能加剧内耗。