我用 Gemini 规划假期和预算,以后再也不换别的方式了。

一位 Android Police 编辑尝试用 Google Gemini 规划一次跨国旅行和预算,通过自然语言提示和 Google Maps 数据整合,成功获得个性化餐厅、路线和日程建议,节省数小时规划时间,也暴露了提示词微调对结果质量的决定性影响。

一位 Android Police 编辑尝试用 Google Gemini 规划一次跨国旅行和预算,通过自然语言提示和 Google Maps 数据整合,成功获得个性化餐厅、路线和日程建议,节省数小时规划时间,也暴露了提示词微调对结果质量的决定性影响。

一位 OpenAI 策略师提出 AI 实验室应作为独立力量与政府权力相抗衡,引发 Hacker News 社区激烈争论。讨论表面是 AI 治理立场之争,实则折射出技术社区对私营公司集中算力与财富、监管失衡的深层担忧。

Anthropic 在 2026 年 7 月对 Claude 语音模式进行了一次关键升级,让它不再只是“快速问答玩具”,而是能够调用 Sonnet、Opus 等更强模型和第三方应用完成实际工作。语音交互正从“能说话”走向“能做事”,竞争也进入更细分的体验与能力比拼阶段。

DeepSeek 向用户发出涨价预警,称将对 AI 服务实施“大幅”提价,但未说明具体涨幅。这是其长期“超低价”策略可能转向的信号,对整个 AI 服务的定价体系都有参考意义。

开发者 nmitchko 发布了一个基于 DeepSeek-V4-Flash-0731 的开源模型,它把推理过程中的“思考”压缩进潜在空间,而不是生成可见的思考 token。这个项目让“潜在推理”从论文概念变成了可运行的工程实现。

攻击者用付费 Google 广告投放了一个托管在 claude.ai 官网域名下的假 Claude Code 安装教程,诱导 Mac 用户执行恶意命令,最终在设备上植入名为 MacSync 的窃密木马,可直接掏空 Ledger、Trezor 等硬件加密钱包。整个攻击没有利用任何系统漏洞,而是把 Anthrop…

DeepSeek V4 Flash 0731 在 Terminal-Bench 2.1 公开评测环境中取得 82.7% 的成绩,说明该模型的终端智能体能力已经达到较高水准,也再次印证“高效率模型”在真实操作类任务上的竞争力。

OpenAI 一位策略师公开提出,AI 实验室不应只是技术公司,而应成为能与政府权力相抗衡的独立力量。这一观点挑战了当前“技术服从监管”的主流治理框架,也为 AI 权力归属的争论增加了新的变量。

Anthropic 研究人员表示,通过模型训练与输入探测等多层防护,Claude 已在实践中“基本解决”提示注入攻击。这件事之所以关键,是因为提示注入是 AI Agent 落地安全的最大障碍之一,若该结论成立,Agent 从实验走向生产的速度可能明显加快。

巴克莱策略师用历史复盘而非市场情绪,总结出软件公司挺过 AI 冲击的四项财务特征,并据此筛出“韧劲股”清单。它提示我们:AI 时代的赢家未必跑得最快,而是资产负债表最健康的那批。