标签: API

vLLM v0.28.0

vLLM v0.28.0

开源大模型推理框架 vLLM 发布 v0.28.0,包含 584 个提交,重点针对 Kimi-K3 和 DeepSeek V4 等前沿模型做了深度推理优化,并默认提高了单次批处理上限。对 AI 推理速度和成本敏感的开发者和企业,这属于值得跟进的基础设施级更新。

小学接送风波与前路

小学接送风波与前路

一位工程师以发布技术事故报告的方式,详细复盘了自己因 Zoom 会议超时 47 分钟而错过小学接孩子的事件。这篇发布在 Hacker News 上的“事故报告”用 AI 行业惯用的术语体系包装日常家庭冲突,因精准的讽刺和真实的人性洞察获得广泛共鸣。

LLM 让我失去精明劲

LLM 让我失去精明劲

Hacker News 上一场关于“LLM 是否让开发者失去思考能力”的讨论引发关注。核心争议是:当 AI 助手从“橡皮鸭”变成“资深结对程序员”,开发者可能因缺乏纠错反馈而逐渐丧失独立判断的敏锐度。