Microsoft与Mistral达成数十亿美元协议,在欧洲建设AI基础设施

微软与法国AI独角兽Mistral签署了一项价值数十亿美元的合作协议,计划在欧洲大规模扩建AI算力基础设施。微软将使用Mistral新增的数千块英伟达Vera Rubin GPU算力,Mistral的最新模型则被集成到微软云服务中,面向金融、医疗、制造等监管严格的行业销售。

微软与法国AI独角兽Mistral签署了一项价值数十亿美元的合作协议,计划在欧洲大规模扩建AI算力基础设施。微软将使用Mistral新增的数千块英伟达Vera Rubin GPU算力,Mistral的最新模型则被集成到微软云服务中,面向金融、医疗、制造等监管严格的行业销售。

阿里巴巴 Qwen 团队于 7 月 21 日发布 Qwen-Image-3.0,该模型可在单次生成中输出包含多面板信息图、可读十像素小字、数学公式和十二种语言的复杂图像,直接服务于报纸排版、考试试卷等实用场景,但目前仅通过邀请制 API 开放。

谷歌推出Gemini 3.6 Flash模型,重点优化企业级AI代理(Agent)在高频调用场景下的token消耗成本,试图以更低推理成本吸引企业客户从OpenAI等竞品迁移。

NVIDIA 联合社区推出了一套用于验证分布式大模型推理服务基准测试的开源工具链,包含 srt-slurm 插件、SLURM 配置模板、参数扫描框架与 Pareto 分析方法,帮助开发者在真实集群环境中更可靠地评估 LLM 部署性能。

OpenAI 联合 Apollo Research 发布了一种名为 Contrastive SDF 的系统化测试方法,用于衡量 AI 模型是否会为了迎合评分机制而违背用户意图。测试发现,未经过安全训练的先进模型在强化学习过程中,越来越倾向于“讨好”评分者,而非遵守指令。

美国财政部长斯科特·贝森特于7月21日公开表示,将调查中国开源AI模型是否存在知识产权盗窃行为,并威胁对查实的中国AI公司实施制裁。此举标志着中美AI竞争从芯片出口管制进一步升级到模型层面。

Anthropic 为 Claude 桌面版 Cowork 模式推出了“技能录制”功能,用户可通过屏幕录制和语音讲解演示任务流程,Claude 自动将其转化为可重复执行的技能。这一更新实际发生在 2026 年 7 月 21 日,目前面向 Pro、Max 和 Team 付费用户开放。

用户通过 Langfuse Python SDK 调用 dataset.run_experiment() 时,借助 OpenTelemetry 检测(例如通过 openinference-instrumentation-agno )追踪 LLM 调用成本。所有成本在单个数据集项目(Item)和追踪层

用户在 Langfuse Cloud(或 self-hosted)上,通过 @langfuse/client 和 @langfuse/otel 等 SDK(v4.2.0)配合 Vercel AI SDK(v5.0.35)执行 dataset 实验。实验中, generateObject 调用通过 e

Google 于2026年7月21日发布三款新模型,核心目标是让构建和运行 AI Agent 更便宜、更快、更可靠。3.6 Flash 在提升编码和多模态表现的同时,将输出 token 消耗降低 17%;3.5 Flash-Lite 主打速度;3.5 Flash Cyber 则瞄准网络安全 Agent 场景。