标签: 算力

突破三值 LLM 的 1.58-bit 极限

突破三值 LLM 的 1.58-bit 极限

Hacker News 上围绕三值大模型(ternary LLM)的讨论指出,1.58-bit 量化的效率优势被高估了——存储位数低不等于每个参数真正保留了等量的有效信息,这直接关系到三值模型能否撑起下一代定制 AI 芯片。

我们该对 AI 恐慌持怀疑态度吗?

我们该对 AI 恐慌持怀疑态度吗?

Anthropic 研究员 Jacob Coxon 辞职并发帖称 AI“可能在本十年末杀死所有人”,引发 1.5 亿次浏览和行业连锁反应;Anthropic CEO Dario Amodei 随后呼吁全行业“放慢前沿研究节奏”。这值得关注,因为它把硅谷内部长期存在的安全焦虑推到了公开政策和商业层面。

三元大语言模型突破1.58比特障碍

三元大语言模型突破1.58比特障碍

一篇 arXiv 论文指出,三元大模型权重里“0”的比例最高可达 51.5%,据此提出的 BITCOS 存储布局把实测存储位宽压到最低 1.485 比特/权重,打破了常见的 1.58 比特门槛,并带来最高约 1.28 倍的推理加速。

华盛顿短期内不会监管AI

华盛顿短期内不会监管AI

华盛顿原本在酝酿一个类似 FINRA 的 AI 监管机构,但在科技高管集体游说和特朗普本人反对后陷入停滞,短期内美国联邦层面推出前沿 AI 监管的可能性极低。