Google Cloud 的 Always-On Memory Agent 用 Gemini 3.1 Flash-Lite 上的持续 LLM 整合取代了 RAG 和嵌入

Google Cloud 发布了一款名为“Always-On Memory Agent”的新服务,该服务摒弃了传统的检索增强生成(RAG)和嵌入向量技术,转而基于 Gemini 3.1 Flash-Lite 模型,通过持续的大语言模型内部状态整合来实现长期记忆功能。这是对现有 AI 记忆架构的一次直接技术路线…

Google Cloud 发布了一款名为“Always-On Memory Agent”的新服务,该服务摒弃了传统的检索增强生成(RAG)和嵌入向量技术,转而基于 Gemini 3.1 Flash-Lite 模型,通过持续的大语言模型内部状态整合来实现长期记忆功能。这是对现有 AI 记忆架构的一次直接技术路线…

美国海军部正式批准一项名为“武器化数据与人工智能”的新战略,核心是将大语言模型和智能体AI直接部署到军舰和远征部队,即使通信中断也能运行。这份手册明确将“缓慢采用”视为比“系统对齐不完美”更大的风险,并把“平均时间到效果”(MTTE)作为关键衡量指标。

Hacker News 上一条热门讨论引发了关于 Claude Code(Anthropic 推出的 AI 编程助手)能否被非专业开发者、甚至普通用户有效使用的广泛疑问;这背后反映出 AI 编程工具正在从专业程序员向更广泛用户群体渗透的趋势,但实际门槛仍然不低。

微软CEO萨提亚·纳德拉在X平台发表长文,指责OpenAI、Anthropic等顶级AI模型提供商存在“双重标准”——它们利用公开数据和用户交互训练模型,却通过服务条款阻止其他公司对模型进行蒸馏,导致知识和经济价值单向集中。

澳大利亚总理阿尔巴尼斯宣布,将要求大型AI数据中心实现自身发电自给自足,并为训练AI系统的内容创作者保留控制权。这是全球首个将AI环境、能源和版权问题纳入统一国家框架的尝试。

顶级风投 Index Ventures 联合创始人 Neil Rimer 公开表示,AI 创造的巨额财富可能面临“再分配”,并呼吁科技领袖主动参与这一过程,否则可能被强制征收。这一观点罕见地出自成功投资人之口,且背景恰逢美国慈善捐赠萎缩、多地酝酿对富豪征税,引发对 AI 财富流向的广泛讨论。

Anthropic 宣布,其最新模型 Claude Fable 5 将于 7 月 20 日面向付费用户开放,但不同订阅计划的调用额度差异很大。Max 和 Team Premium 用户可使用 50% 的配额,Pro 和 Team Standard 用户则需通过用量积分使用,高门槛可能会限制模型的实际普及速度。

用户展示了通过 API 将 AI 代码生成工具 Codex 与 Photoshop(PS)对接后的全自动操作流程,实现了从文字指令到 PS 内图层处理、滤镜应用的完整工作链。这一尝试将大模型的编程能力直接延伸至设计师的核心工具中,值得关注。

火山引擎基于豆包视频通话的真实大规模用户场景,自研了一套面向 AI 的多模态传输系统(MMT),以解决传统音视频技术在 Agent 交互中延迟、稳定性、成本等方面的问题,这一系统已在亿级 DAU 的豆包中落地验证,并开始对外输出。

苹果起诉OpenAI窃取商业机密,不仅是一场知名科技公司之间的法律纠纷,更可能直接影响OpenAI正在推进的硬件研发计划,并对整个AI行业的合作与竞争规则产生连锁效应。