标签: 算力

无需显卡,也无需大内存Mac,HuggingFace 上开源的 ASR 和 TTS模型直接能跑!我花了一周时间,把 HuggingFace 上真正值得关注的语音模型全部理了一遍: 先搞清楚一件事 ASR(听):大模型架构(Encoder-LLM)负责多语种与高精度语义纠错,但端侧声学小模型在 CPU 上同样能打 TTS(说):目前早就是小模型的天下,几十 MB 的 ONNX 模型在普通 CPU 上就能跑出播放速度 4 倍以上的生成速度…

无需显卡,也无需大内存Mac,HuggingFace 上开源的 ASR 和 TTS模型直接能跑!我花了一周时间,把 HuggingFace 上真正值得关注的语音模型全部理了一遍: 先搞清楚一件事 ASR(听):大模型架构(Encoder-LLM)负责多语种与高精度语义纠错,但端侧声学小模型在 CPU 上同样能打 TTS(说):目前早就是小模型的天下,几十 MB 的 ONNX 模型在普通 CPU 上就能跑出播放速度 4 倍以上的生成速度…

独立开发者 WquGuru 实测了 HuggingFace 上当前主流的开源 ASR 与 TTS 模型,结论是语音合成(TTS)已进入几十 MB 小模型的 CPU 可跑时代,而语音识别(ASR)则呈现“多语种大模型保精度、端侧小模型拼速度”的并行路线。

Anthropic几个小时前宣布了一件可能被严重低估的研究: 几十个Claude智能体用11天60亿token,几乎完全独立地完成了人类几十年来一直想完成、原本预计仍需数年的费马大定理端到端形式化证明。 https://t.co/LRGD2KsIft 但“AI证明了费马大定理”其实不是这里最有意思的地方。 几个细节非常震撼: Wiles 当年的证明只有129页。Claude把它变成了约1300万行Lean代码,最终用到约29,500个…

Anthropic几个小时前宣布了一件可能被严重低估的研究: 几十个Claude智能体用11天60亿token,几乎完全独立地完成了人类几十年来一直想完成、原本预计仍需数年的费马大定理端到端形式化证明。 https://t.co/LRGD2KsIft 但“AI证明了费马大定理”其实不是这里最有意思的地方。 几个细节非常震撼: Wiles 当年的证明只有129页。Claude把它变成了约1300万行Lean代码,最终用到约29,500个…

Anthropic 用几十个 Claude 智能体耗时 11 天、消耗约 60 亿 token,端到端完成了费马大定理的 Lean 形式化证明。这件事的重点不仅在于“AI 证明了数学难题”,更在于它展示了一种新的 AI 科研范式:大模型 + 多智能体协作 + 外部验证框架,可以连续运转两周完成超大规模工程任务…

Here’s one practical thing you can do this weekend to get better at building AI products. Pick a workflow you know well – from your personal life or your work. Automate the whole thing with AI. Use the AI product you’…

Here’s one practical thing you can do this weekend to get better at building AI products. Pick a workflow you know well - from your personal life or your work. Automate the whole thing with AI. Use the AI product you’...

AI 产品顾问 Madhu Guru 在 X 上分享了一个朴素但有效的建议:与其花一个月读 AI 产品方法论,不如花一个周末,用 AI 工具完整自动化一件你熟悉的个人或工作流程。这条帖子获得超过 5000 次浏览,核心观点是“只有通过构建才能真正学会构建 AI 产品”。

NVIDIA Releases Personal AI Router (PAIR): An Open Source Virtual Inference Router that Distributes Local AI Requests Across RTX, DGX Spark, and Mac Nodes

NVIDIA Releases Personal AI Router (PAIR): An Open Source Virtual Inference Router that Distributes Local AI Requests Across RTX, DGX Spark, and Mac Nodes

英伟达发布了一款名为 PAIR 的开源虚拟推理路由器,能让本地 AI 请求自动分配到 RTX 显卡、DGX Spark 工作站甚至 Mac 设备上运行。这意味着不再只有云服务商能做模型调度,个人开发者也能用手头设备组建自己的“分布式推理小集群”。

Gimlet 的 B 轮融资

Gimlet 的 B 轮融资

AI 推理基础设施公司 Gimlet Labs 宣布完成 3 亿美元 B 轮融资,由 Andreessen Horowitz 领投。该公司主推“异构芯片”推理云,试图在不增加功耗的前提下把大模型推理速度提升数倍,以应对 token 生成量激增带来的算力瓶颈。