Karpathy:用语音与LLM长谈可提升理解效率

AI 领域的权威人物 Andrej Karpathy 分享了一种被他验证有效的 LLM 使用技巧——用语音进行长篇、意识流式的对话,而非精确的文本输入。他认为这种方法能显著提升模型对人意图的理解效率,并有助于生成更清晰的输出,对于需要借助 AI 整理思路的用户而言具有实践价值。

AI 领域的权威人物 Andrej Karpathy 分享了一种被他验证有效的 LLM 使用技巧——用语音进行长篇、意识流式的对话,而非精确的文本输入。他认为这种方法能显著提升模型对人意图的理解效率,并有助于生成更清晰的输出,对于需要借助 AI 整理思路的用户而言具有实践价值。

OpenAI 于近日发布一项关于 AI 模型“奖励寻求行为”的最新研究,旨在探索大模型在训练和推理过程中是否会主动寻求人为设定的奖励信号,以及这种行为对模型安全与对齐的影响。这一研究直接关系到未来 AI 系统在复杂任务中的可控性与可靠性。

Google DeepMind 于周二推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型,聚焦效率、成本和特定安全场景。但备受期待的旗舰模型 Gemini 3.5 Pro 依然缺席,显示出 Google 在大模型竞赛中面临的内部进展压力。

一位开发者通过对比传统编译器的“分层”工作方式与 Claude 等大模型的跨层能力,提出 Claude 本质上是一种能同时参与战略、产品、代码到机器码的通用工具,比编译器更灵活、更高效。

xAI 正式发布 Grok for Microsoft Outlook 加载项,让 Grok 模型直接在邮件系统内完成摘要、草拟回复和收件箱整理。这是 Grok 从聊天界面走向办公场景的重要一步,也意味着 xAI 开始与微软的 Copilot 在生产力工具层面直接竞争。

Anthropic 副首席信息安全官 Jason Clinton 公开了该公司在 AI 原生软件开发周期中的安全策略。当前 Claude 已参与创作约 80% 的合并代码,安全团队面临代码量和部署速度指数级增长带来的挑战,需要在不显著拖慢开发速度的前提下,防范智能体被注入恶意指令、供应链投毒以及传统漏洞等威胁…

OpenAI 于2026年7月21日宣布推出“ChatGPT小型企业计划”,旨在通过AI工具帮助小企业解决人力与资源不足的问题。该计划包含虚拟培训、线下AI学院、操作指南以及针对小型企业的专用智能体和合作伙伴生态,核心目标是让ChatGPT Work成为小微企业的“业务倍增器”。

NVIDIA 在 GB300 NVL72 系统上,用 256 块 GPU 实现了 DeepSeek-V3 671B 模型的预训练,每块 GPU 达到 1,648 TFLOPs(万亿次浮点运算/秒)的算力利用率,比上一代 GB200 NVL72 提升了约 3 倍,创造了混合专家(MoE)模型预训练速度的世界纪录…

英伟达在本周高调发布新一代Vera Rubin芯片系统,不仅升级GPU,还首次将自研CPU作为独立产品力推,意图从AI算力提供商转型为数据中心全栈芯片供应商。这标志着AI行业对“智能体”系统需求激增,正在改变服务器内部的芯片分工格局。

NVIDIA 发布了 Vera CPU 的技术细节,其核心“Olympus”专为 Agentic AI 工作负载设计。与通用云 CPU 不同,它追求极致的单线程性能与可预测的低延迟,以应对大模型执行工具调用、代码解释等复杂任务时对CPU性能提出的新要求。