亲身体验 AMD Ryzen AI Halo

有用户实际测试了 AMD 锐龙 AI 处理器在本地运行大模型的能力,在运行 Qwen3.6 MoE A3B 模型时可达 60-70 tokens/秒,但指出当前本地模型在编程等复杂任务上仍有局限,本地大模型的实用性取决于内存成本和模型量化进展。

有用户实际测试了 AMD 锐龙 AI 处理器在本地运行大模型的能力,在运行 Qwen3.6 MoE A3B 模型时可达 60-70 tokens/秒,但指出当前本地模型在编程等复杂任务上仍有局限,本地大模型的实用性取决于内存成本和模型量化进展。

NVIDIA 发表技术博客,系统阐述如何通过调整大语言模型(LLM)的宽度(hidden dimension)、层数(L)与中间投影维度(H’),在保持精度的前提下,系统性提升推理吞吐量与交互响应速度。这并非一篇单纯的研究报告,而是一份指导模型开发者在设计阶段就对齐硬件特性的实用手册。

腾讯正洽谈收购 AI Agent 初创公司 Manus 的多数股权,估值与 Meta 此前被叫停的交易相同(20 亿美元)。这笔交易是在北京迫使 Meta 放弃收购 Manus 并禁止外资投资后展开的,标志着中国 AI 生态在政治干预下的内部整合加速。

韩国存储芯片巨头SK海力士通过美国IPO募集265亿美元,创下非美国公司在美国上市的最大规模纪录。募资将用于韩国本土的新晶圆厂与封装设施,而美国商务部长已公开呼吁其考虑在美建厂,以减少对亚洲芯片生产的过度依赖。

Thinking Machines Lab 发布博文,明确提出其使命是构建“延伸人类意志与判断”的 AI,而非追求完全自主的智能。其核心观点是当前主流 AI 训练方式过于集中和静态,未能利用人类工作中持续产生的、分散的、隐性的知识,这与其技术路线形成了鲜明对比。

Perplexity 在账户设置中新增“Computer Analytics”功能,允许用户和开发者在账户设置中追踪不同 AI 模型的信用额度消耗情况,让算力使用更透明、更可控。

GitHub 发现给 Copilot 代码审查换上更强大的通用代码探索工具后,反而导致成本上升、问题检出率下降。问题不在于工具,而在于为工具编写的指令。修改指令以匹配人类审查者的阅读习惯后,成本降低了约 20%,质量保持不变。

Termaxa 是一个轻量级的策略网关,在 AI 编码代理(如 Claude Code、Cursor)与真实 shell 命令之间增加了一道“风挡”——它能在命令执行前预判影响、自动备份高风险操作、阻止意图明确的破坏行为,而不是简单地把代理放进沙箱或完全信任它。

Meta Platforms股价在2026年7月10日盘前上涨6%至670美元,因内部备忘录和研报显示其AI基础设施建设成本降至先前预估的一半,CEO扎克伯格计划出租AI算力,直接挑战亚马逊AWS和云计算服务商CoreWeave。

Glenmede首席投资策略师Jason Pride在7月10日接受CNBC采访时指出,目前美国每年用于AI基础设施建设的支出已接近GDP的3%,这一“天文数字般的投资”正驱动企业利润增长,使市场对全球地缘政治冲突“脱敏”,股市仅关注AI带来的动量效应。