标签: GPT-4

加速GPT-5.6 Sol超高速

加速GPT-5.6 Sol超高速

Hacker News 上的讨论提出一个关键观点:如果大模型可以毫秒级完成多轮自我审查和迭代,输出质量会显著提升;而 GPT-5.6 Sol 的 Ultrafast 模式正是以 7 倍速度优势展示了这一路径的可行性。

Tokenomics:AI有损益表,该读一读了

Tokenomics:AI有损益表,该读一读了

亚马逊、谷歌、Meta、微软等巨头今年将在AI基础设施上合计投入超过5000亿美元,但真正的成本大头可能不是训练模型,而是模型日常运行时的“推理”开销。业界正在用“Tokenomics”(代币经济)重新审视AI的真实账单。

Qwen3.8-2.4T

Qwen3.8-2.4T

阿里通义团队正式发布 Qwen3.8 开源模型家族,旗舰版本总参数 2.4T、激活参数 95B,并同时放出 FP8 量化权重,首次将 Qwen-Max 级能力开放给开源社区,推理成本与部署门槛显著降低。