标签: 算力

可能很多人不知道,现在全网最便宜的 DeepSeek 供应商,是中国科技部牵头做的国家超算互联网🫡 国家超算互联网 SCNet 有一个 Token Plan,最低30 块钱一个月给 60000 Credits。 拿来跑 V4-Flash,缓存命中只要 0.012 元 / 100万 Token,未命中输入 0.6 元,输出 1.2 元。 对比 DeepSeek 的梁文峰价格,便宜了 8.3 倍、5 倍和 7.5 倍。 也就是说,30 块…

可能很多人不知道,现在全网最便宜的 DeepSeek 供应商,是中国科技部牵头做的国家超算互联网🫡 国家超算互联网 SCNet 有一个 Token Plan,最低30 块钱一个月给 60000 Credits。 拿来跑 V4-Flash,缓存命中只要 0.012 元 / 100万 Token,未命中输入 0.6 元,输出 1.2 元。 对比 DeepSeek 的梁文峰价格,便宜了 8.3 倍、5 倍和 7.5 倍。 也就是说,30 块…

国家超算互联网平台(SCNet)以远低于 DeepSeek 官方 API 的价格提供 DeepSeek 模型服务,最低 30 元/月即可获得大量 Token 额度,相当于国家级算力基础设施在给开发者“补贴”模型调用成本。

最近看到佐治亚理工 2026 年的 LLM 课程,光看课表就很值得收藏。 它很像一份已经帮你筛过一遍的「2026 大模型前沿论文阅读清单」。 前面还有 Pretraining、Embedding、MoE 这些基础,但很快就进入 Agent Harness、GRPO、DAPO、自博弈 RL、Test-Time Scaling、Long Context。 后面甚至已经排到了 Linear Transformer、Diffusion LM、…

最近看到佐治亚理工 2026 年的 LLM 课程,光看课表就很值得收藏。 它很像一份已经帮你筛过一遍的「2026 大模型前沿论文阅读清单」。 前面还有 Pretraining、Embedding、MoE 这些基础,但很快就进入 Agent Harness、GRPO、DAPO、自博弈 RL、Test-Time Scaling、Long Context。 后面甚至已经排到了 Linear Transformer、Diffusion LM、…

佐治亚理工学院流出的 2026 年 LLM 课程大纲,实质上是一份经过学术筛选的大模型前沿论文阅读清单。它把 Agent、强化学习、推理时扩展等技术放在与预训练同等重要的位置,反映出 LLM 研究重心正在从“训练更大模型”转向“让模型更聪明地用工具、记忆和算力”。

Cerebras CS4

Cerebras CS4

Cerebras 发布了新一代晶圆级 AI 推理系统 CS-4,基于 WSE-3 Turbo 芯片,官方称推理速度最高可达 GPU 系统的 30 倍,并已开始接受出货,瞄准超大规模数据中心的部署场景。

AI解决不了“表演式工作”的问题

AI解决不了“表演式工作”的问题

一篇在 Hacker News 上获得热议的技术评论指出,AI 提升的是“做事的速度”,而非“做对事的方向”。大型企业真正的问题——表演式工作与管理层级臃肿——并不会因为引入 Agent 或大模型而解决,反而可能加剧内耗。