标签: DeepSeek

亲身体验 AMD Ryzen AI Halo

亲身体验 AMD Ryzen AI Halo

有用户实际测试了 AMD 锐龙 AI 处理器在本地运行大模型的能力,在运行 Qwen3.6 MoE A3B 模型时可达 60-70 tokens/秒,但指出当前本地模型在编程等复杂任务上仍有局限,本地大模型的实用性取决于内存成本和模型量化进展。

AI模型协同设计:硬件友好的LLM设计

AI模型协同设计:硬件友好的LLM设计

NVIDIA 发表技术博客,系统阐述如何通过调整大语言模型(LLM)的宽度(hidden dimension)、层数(L)与中间投影维度(H’),在保持精度的前提下,系统性提升推理吞吐量与交互响应速度。这并非一篇单纯的研究报告,而是一份指导模型开发者在设计阶段就对齐硬件特性的实用手册。

Thinking Machines Lab:构建延伸人类意志与判断的 AI

Thinking Machines Lab:构建延伸人类意志与判断的 AI

Thinking Machines Lab 发布博文,明确提出其使命是构建“延伸人类意志与判断”的 AI,而非追求完全自主的智能。其核心观点是当前主流 AI 训练方式过于集中和静态,未能利用人类工作中持续产生的、分散的、隐性的知识,这与其技术路线形成了鲜明对比。

首席投资策略师:“我们用于人工智能的支出几乎占GDP的3%”,股市对全球冲突置若罔闻,只关注“天文数字般的投资”

首席投资策略师:“我们用于人工智能的支出几乎占GDP的3%”,股市对全球冲突置若罔闻,只关注“天文数字般的投资”

Glenmede首席投资策略师Jason Pride在7月10日接受CNBC采访时指出,目前美国每年用于AI基础设施建设的支出已接近GDP的3%,这一“天文数字般的投资”正驱动企业利润增长,使市场对全球地缘政治冲突“脱敏”,股市仅关注AI带来的动量效应。