Gemini 3.7 Flash

有开发者用同一套网页设计需求横向测试 Gemini 3.7 Flash、Opus 5 与 Grok 4.6,结论是 Gemini 3.7 Flash 在图像生成上表现突出,但在 HTML 还原和整体任务完成度上仍未超过 Opus 5,而且比 Grok 4.6 的优势也没有想象中明显。

有开发者用同一套网页设计需求横向测试 Gemini 3.7 Flash、Opus 5 与 Grok 4.6,结论是 Gemini 3.7 Flash 在图像生成上表现突出,但在 HTML 还原和整体任务完成度上仍未超过 Opus 5,而且比 Grok 4.6 的优势也没有想象中明显。

Hacker News 上一篇题为《家里的AI 第1部分:一盒零碎》的帖子引发讨论,作者记录了自己从一堆散装硬件开始搭建家用 AI 设备的真实过程,反映 AI 正在从云端 API 走向个人化、本地化部署的社区趋势。

Google 发布 Gemini 3.7 Flash,这是 Flash 系列在性能与价格上的又一次跃迁——编码和智能体能力大幅提升,输入价格却降至 3.6 Flash 初始定价的一半。值得关注的是,距离 3.6 Flash 发布仅三周,Google 明显在加快模型迭代节奏,以应对竞争压力。

DeepSeek于8月13日正式发布V4 Pro版模型,同步上线App、网页端和API,重点强化Agent能力并原生适配OpenAI Responses API;同时宣布采用峰谷定价,闲时调用价格降至高峰时段的50%。

Google Sheets 推出 Sheets canvas,用户用自然语言向 Gemini 描述需求,就能把表格数据变成交互式迷你应用。它把“做自定义工具”从编程任务变成打字任务,是办公软件 AI 化的一个值得关注的实际产品。

AWS 发布 Strands Robots 与 Hugging Face LeRobot、Storage Buckets 的完整数据闭环方案,让机器人演示数据的录制、存储、训练和部署在同一套 Agent 工具链中完成,训练时不再需要下载全量数据集,而是直接流式读取 Hub 上的数据。

据《华尔街日报》报道,Apple 正在与新闻出版商谈判,计划以“按内容使用付费”的方式获取新闻内容授权,用来强化计划随 iOS 27 发布的 Siri AI。这件事值得关注,因为 Apple 正在尝试走一条与 OpenAI 等 AI 公司不同的内容采购路线。

Hud与ClickHouse联合推出集成,将函数级运行时行为数据与ClickStack基础设施可观测性打通,为AI生成代码构建从发布前评估、上线后验证到异常自动回滚的反馈闭环。其背景是AI生成的代码占比已超过四成,生产环境数据正从“事后排查工具”变成“开发决策依据”。

<section class

Liquid AI 发布了一款名为 LFM2.5-VL-3B 的端侧视觉语言模型,参数量仅 3B,却支持读屏、物体识别和调用设备工具,意味着轻量级多模态模型正在从“能看”走向“能做”。