Token Saver:用本地混合 RAG 将 Claude PDF token 消耗削减 92%-99% 的开源 MCP 扩展

开源项目 Token Saver 以 MCP 扩展形式,在本地使用混合 RAG 技术预处理 PDF 文档,可将 Claude 处理 PDF 时的 token 消耗削减 92%–99%,大幅降低 API 费用,同时保护数据隐私。它直接回应了当前大模型应用“token 烧钱”的痛点。

开源项目 Token Saver 以 MCP 扩展形式,在本地使用混合 RAG 技术预处理 PDF 文档,可将 Claude 处理 PDF 时的 token 消耗削减 92%–99%,大幅降低 API 费用,同时保护数据隐私。它直接回应了当前大模型应用“token 烧钱”的痛点。

微软CEO纳德拉在财报电话会上公开摊牌,警告企业客户不要过度依赖OpenAI和Anthropic等前沿模型,微软将提供价格更低、可随时替换的AI方案。这是微软从“投资方”转向“平台竞争者”的关键信号。

AI 初创公司 Encore AI 完成 3000 万美元 A 轮融资,核心思路不是“造一个通用客服机器人”,而是把企业每天产生的大量客服通话、邮件、文本数据变成训练素材,让 AI 代理直接学习顶尖员工的话术,从而提升业务转化效果。这件事的看点在于,它找到了一条从企业存量对话数据里直接变现的商业路径,避开与大…

微软CEO萨提亚·纳德拉在最新财报电话会上确认,正在开发一款整合了聊天、代码编程与智能代理(Agent)能力的“超级应用”,计划于今年内面向消费者和企业用户推出。此举标志着AI助手的竞争从单点功能转向统一的平台化入口。

美国前总统特朗普本周三首次就OpenAI AI工具被用于黑客攻击事件作出回应,称其政府正考虑对AI施加更多管控,但同时担心过度限制会使美国落后于中国。这一表态意味着美国AI政策可能从“放任自由”转向有选择性的监管,并可能影响全球AI开发者的合规环境。

Anthropic 在密码分析领域的最新研究结果被密码学工程博客公开讨论,该结果可能涉及大语言模型在密码学任务中的能力或安全性缺陷,对 AI 安全评估和模型审计方式有重要参考意义。

Scale AI创始人、现Meta超级智能实验室负责人Alexandr Wang在YC活动上表示,借助AI智能体(AI agent),初创公司如今能以接近对等的资源与科技巨头竞争,创业难度从“大卫挑战歌利亚”变为“歌利亚对决歌利亚”。

火山引擎正式上线豆包搜索开放服务,为智能体(Agent)提供实时联网搜索能力。这意味着智能体从简单的“一问一答”开始向能执行“长程复杂任务”的形态演进,开发者现在可以借助该服务构建更可靠的搜索增强型AI应用。

微软2026年第四季度财报显示,其对Anthropic的投资账面增值32亿美元,而对OpenAI的投资则减记约6亿美元。但全年来看,微软从OpenAI投资中获得了50亿美元的净收益,凸显其双线押注AI公司的高回报与短期波动。

微软CEO萨提亚·纳德拉在最新季度财报会上明确将自家模型(MAI系列)和AI安全方案作为替代OpenAI、Anthropic等前沿实验室的产品来销售,并公开劝告企业不要过度依赖单一模型,应使用微软提供的多模型平台自行控制AI应用层。