标签: 大模型

Kimi Linear:一种表现力强且高效的注意力架构

Kimi Linear:一种表现力强且高效的注意力架构

Kimi 团队发布了新型混合线性注意力架构 Kimi Linear,在短上下文、长上下文和强化学习场景下,全面超越了传统全注意力模型,同时将 KV 缓存占用降低最多 75%,1M 上下文解码吞吐量提升高达 6 倍。这可能是继 Mamba 后,对 Transformer 注意力机制最实用的一次效率革新。

查尔斯·布考斯基能给AI开发者们什么启示?

查尔斯·布考斯基能给AI开发者们什么启示?

Hacker News 上一条关于“查尔斯·布考斯基能给AI开发者什么启示”的帖子引发热议。核心观点是:劳动节约型技术并未真正解放人类,反而可能催生新的996;布考斯基主动停止产出劣质文字、走向家人和猫的行为,提醒AI从业者警惕“无用产出”的陷阱,重新审视休息与创造力的关系。

Show HN:形式验证的 3D CSG:相信93行规格,而非1000行AI代码

Show HN:形式验证的 3D CSG:相信93行规格,而非1000行AI代码

一位开发者利用AI辅助生成并验证了一个3D布尔运算(CSG)核心代码,其创新之处在于:人类只需检查93行的形式化规格说明,由Lean证明助手自动验证AI生成的60000行证明,从而确保1000多行实现代码的正确性。这挑战了“AI代码不可信赖”的固有认知,并为高可靠性场景下的AI编程提供了新范式。

《纽约时报》能否从AI霸主手中拯救新闻业?

《纽约时报》能否从AI霸主手中拯救新闻业?

《纽约时报》出版人A.G. Sulzberger在接受Wired访谈时,系统阐述了该报起诉OpenAI和微软侵犯版权、特朗普政府打压新闻自由、以及AI重塑信息消费方式三重危机,认为新闻业正面临“生存级”挑战。这场法律战不仅是商业纠纷,更可能确立AI训练数据合法使用的边界。

三星博通联手超 2000 亿美元,全面押注下一代AI芯片

三星博通联手超 2000 亿美元,全面押注下一代AI芯片

三星与博通宣布长期深度合作,共同投资超过2000亿美元(预计到2030年业务规模),围绕三星的sub-2nm工艺和HBM内存联合开发下一代AI定制芯片。这标志着AI芯片从依赖通用GPU转向“设计+制造”深度整合,代工与存储的协同将直接影响未来大模型的训练效率和推理速度。