标签: Anthropic

Perplexity Computer 推出 Projects 功能

Perplexity Computer 推出 Projects 功能

Perplexity 为其计算机产品(Perplexity Computer)推出 Projects 功能,本质上是将 AI 从单次对话升级为具备持久记忆、共享文件系统和多用户协作的多智能体工作空间。CEO Aravind Srinivas 称其为“多智能体协作操作系统”,并引入了离线自我改进循环机制(Com…

OpenRouter 下调 GPT-5.6 Terra/Luna 价格

OpenRouter 下调 GPT-5.6 Terra/Luna 价格

OpenRouter 宣布跟进 OpenAI 官方的降价,对 GPT-5.6 Terra 和 Luna 模型再叠加 50% 独家折扣,使 Luna 的输入价格降至每百万 token 0.1 美元、输出 0.6 美元;Terra 则降至输入 1 美元、输出 6 美元。这是目前公开市场上使用 GPT-5.6 系列…

GPT-5.6 如何推进性价比前沿

GPT-5.6 如何推进性价比前沿

OpenAI 在 2026 年 7 月 30 日宣布 GPT-5.6 系列降价并推出更快的 API 处理模式:旗舰经济型模型 Luna 降价 80%,均衡型 Terra 降价 20%,高端模型 Sol 新增“Fast mode”(速度提升 2.5 倍、价格翻倍)。这标志着 OpenAI 将模型效率优化直接转化…

前向部署工程师成为AI行业最新的人才争夺焦点

前向部署工程师成为AI行业最新的人才争夺焦点

美国猎头公司Christian & Timbers的最新报告显示,全美仅有约2000名能帮企业真正实现AI投入回报的前向部署工程师(FDE),需求预计在年底激增2100%。OpenAI、Anthropic等头部公司已成立专门子公司争夺这类人才,企业也开始组建内部FDE团队来保护商业流程。

GPU管理:为何闲置GPU成了新的停飞飞机

GPU管理:为何闲置GPU成了新的停飞飞机

企业AI的竞争焦点正从“拥有多少GPU”转向“用好了多少GPU”。Hugging Face博客一篇分析指出,GPU利用率正在成为类似航空业飞机利用率的决定性指标——闲置GPU如同停飞的飞机,成本每天在产生但收益为零,决定AI项目盈亏的已不是算力总量,而是算力实际被调用的比例。

GCC指导委员会宣布AI政策

GCC指导委员会宣布AI政策

GCC(GNU编译器套件)指导委员会发布了AI政策,明确禁止AI代理(LLM)在未经人工审查的情况下修改代码库。开发者社区迅速响应,通过在README中加入提示注入(prompt injection)语句来阻止AI编辑代码,并围绕法律责任、开源伦理和“恶意捣乱”式防御展开了激烈争论。

微软AI押注廉价专业模型,而非追逐前沿

微软AI押注廉价专业模型,而非追逐前沿

微软AI正将竞争重心从单一超大规模模型转向多个低成本专业模型,最新发布的网络安全模型MAI-Cyber-1-Flash以一半成本在基准测试中超越Anthropic同类产品,同时图像生成模型GPU成本降低84%。这意味着AI行业正在从“越大越好”转向“够用且便宜”的路线。

OpenAI says using its Responses API harness with GPT-5.6 Sol tripled its ARC-AGI-3 score and used fewer tokens, after Sol with the official harness scored 7.8% (OpenAI)

OpenAI says using its Responses API harness with GPT-5.6 Sol tripled its ARC-AGI-3 score and used fewer tokens, after Sol with the official harness scored 7.8% (OpenAI)

OpenAI 通过其 Responses API 的调用框架(harness)与 GPT-5.6 Sol 模型搭配,在 ARC-AGI-3 基准测试上将得分从 7.8% 提升至约 23.4%(即翻了三倍),同时使用的 token 更少。这表明 API 层面的调用策略对模型实际推理效果影响巨大,而不仅是模型本身…