标签: 大模型

SubQ 1.1 小型

SubQ 1.1 小型

AI 公司 SubQ 发布了其新一代长上下文模型 SubQ 1.1 Small,通过自研的次二次稀疏注意力(SSA)架构,在 12M token 上下文下实现了近乎完美的检索能力,并将计算成本降低了近 1000 倍。这直接挑战了过去因注意力机制二次复杂度而受限的“长上下文推理”痛点。

GateGPT:FPGA 上每秒 56k 个令牌,频率为 80 MHz

GateGPT:FPGA 上每秒 56k 个令牌,频率为 80 MHz

开发者 fguzman82 实现了一个名为 GateGPT 的项目,在 FPGA 上以 80 MHz 的频率运行小型 Transformer 模型,推理速度达到每秒 56k 个令牌。该项目的核心价值不在于跑赢 GPU,而在于展示了完全定制化硬件执行 AI 推理的可行性,以及机器人辅助开发 FPGA 的新工作流…

Qwen-Robot Suite:物理世界智能的基础模型套件

Qwen-Robot Suite:物理世界智能的基础模型套件

阿里通义千问团队发布了 Qwen-Robot Suite,一套旨在让大模型指挥机器人完成导航、操作等物理世界任务的模型套件。这套方案展示了从“看到世界”到“动手执行”的完整技术路径,引发了社区关于其架构先进性、实际可用性(未开放权重)以及何时能进入产品的讨论。