中国背景黑客利用AI发动史上首次针对台湾地区的“自主”网络攻击。

以色列安全公司 Dream 称,疑似中国背景的黑客用开源 AI 智能体系统,在七月初对台湾地区政府系统发动了可能是有记录以来首次全程自主的网络攻击,窃取超过 2500 份人事档案,并波及核安全机构与至少 7 家能源企业。

以色列安全公司 Dream 称,疑似中国背景的黑客用开源 AI 智能体系统,在七月初对台湾地区政府系统发动了可能是有记录以来首次全程自主的网络攻击,窃取超过 2500 份人事档案,并波及核安全机构与至少 7 家能源企业。

Anthropic 发布了 Claude Code 的 v2.1.229 版本,但截至撰文时原始发布说明页面暂时无法访问。作为终端 AI 编程工具的持续迭代,该版本大概率集中于功能优化与稳定性改进,具体更新内容有待官方页面恢复后确认。

AI 笔记硬件公司 Sandbar 认为,戒指形态的语音可穿戴设备是 AI 硬件的下一个突破口,关键在于让用户始终掌控数据与交互。其主打产品 Stream 已累计融资 3600 万美元,正在验证“语音优先”的硬件路线是否成立。

目前公开信息显示,AllenAI 开源了 Instruct Tulu 3 的完整后训练方案,覆盖 SFT、DPO、RLVR、GRPO 与基于验证器的评估,把一套可复现的大模型对齐流水线直接交到了开发者手中。

Google Research 的一项新研究发现,前沿大模型(如 Gemini 3 和 GPT-5)的许多事实性错误,并非因为模型"没学过"这些知识,而是因为它"想不起来"——即编码没有问题,问题出在回忆环节。这为理解和改善大模型幻觉问题提供了新的诊断思路。

DeepSeek V4 Pro 0813 的基准测试成绩在 Hacker News 曝光,多项编程与 Agent 任务指标相比前代大幅提升;与同期 Qwen 旗舰模型对比,多数核心项目占优,且价格明显更低,性价比成为最大看点。

AI 物流公司 ClearJet 完成 2500 万美元 B 轮融资,用算法把货主与商业航班闲置腹舱运力实时匹配。这件事值得关注,是因为它代表 AI 正在进入传统货运交易环节,用供需匹配创造可见的商业价值。

OpenAI 更新了 ChatGPT 的 Chrome 扩展,新增的“Side Chat”侧边对话窗口可以直接总结 YouTube 视频、跨多个标签页整合信息,还能解释网页中高亮选中的文本。这不是一次简单功能叠加,而是让 AI 从“对话窗口”进入“浏览器操作层”,意味着 AI 助手的交互方式正在向日常浏览行为…

Hacker News 上出现了标题为“Grok 4.6”的讨论帖,但 xAI 官方尚未发布正式公告。这可能是继 Grok 4.5 之后的一次快速迭代,说明 xAI 仍在以高频节奏推进大模型更新。

OpenRouter 推出针对实时网页搜索的基准测试,重点考察搜索能力与智能体场景的适配度,为开发者选择搜索方案提供可量化的参考依据。