在LLM中选择最佳图像输入细节级别

OpenRouter 最新基准测试发现,在 GPT-5.5 等推理模型中,使用“低细节”(low)图像输入不仅会大幅降低准确率,反而可能因为模型“费力思考”而增加推理成本。清晰的图像配合降低推理努力,才是更优的省钱策略。

OpenRouter 最新基准测试发现,在 GPT-5.5 等推理模型中,使用“低细节”(low)图像输入不仅会大幅降低准确率,反而可能因为模型“费力思考”而增加推理成本。清晰的图像配合降低推理努力,才是更优的省钱策略。

Claude 官方公布了一组基于 120 万条会话样本的使用数据,显示一半的 Cowork 会话集中在“工作的周边”——即跨岗位的事务性任务,而非核心专业职责。这为 AI 如何融入知识工作者的日常提供了真实切口。

Anthropic 于 2026 年 7 月 7 日宣布,其 AI 代理功能 Claude Cowork 从桌面端扩展至移动端(iOS/Android)和网页端(claude.ai),支持任务跨设备延续、后台静默运行及手机端审核。此举将 Cowork 的使用场景从本地办公打通至全天候移动场景。

Liquid AI 开源了名为“Antidoom”的技术方案,专门用于修复大语言模型在推理过程中容易陷入无意义死循环(Doom Loops)的问题。该方法不依赖昂贵的重新训练,而是通过优化最终 Token 的偏好,为开发者提供了一种低成本、即插即用的修复手段。

Google DeepMind 于 2026 年 7 月 7 日宣布,Gemini Interactions API 的 Managed Agents 新增后台异步执行、远程 MCP 服务器连接、自定义函数调用及网络凭证刷新等功能,将 Agent 从同步调用升级为可独立运行的生产级异步工作负载。

GitHub 现已正式上线“限制谁可以驳回 Pull Request 审查”的功能,让仓库管理员在规则集中精准控制哪些用户、团队或应用有权取消已批准的审查,从而提升代码合并前的安全门槛。

GitHub 秘密扫描功能正式推出扩展元数据检查与多部分验证能力,帮助开发者和安全团队更快判断泄露密钥的归属、活跃状态和影响范围,减少误报和人工排查时间。
![[技术栈] 有没有大神能教教我如何突破模型道德边界开发开发辅助呀](https://www.chat-gpts.plus/wp-content/uploads/2026/07/ai_cover_5-171-768x403.jpg)
V2EX 用户“djlen520”发帖求助如何突破主流大模型的道德限制,用于开发辅助工具,引发社区讨论——核心答案指向本地部署无审查的开源模型。这反映出开发者对“去护栏”模型的真实需求,以及AI安全机制与工具实用性之间的矛盾。
![[Claude] 刚才被 Claude 坑了。。。。。。](https://www.chat-gpts.plus/wp-content/uploads/2026/07/ai_cover_4-175-768x403.jpg)
一名开发者在 V2EX 上反馈,在使用 Claude 检查 Git 代码时,因未注意 token 消耗,一小时内被扣除了约 3000 万 token,费用远超预期。该事件暴露了 AI 工具在持续推理任务中的 token 计费风险。

临床数据显示,越来越多的用户正在将生成式AI(如聊天机器人)用作护肤诊断和产品推荐的替代方案,但皮肤科专家和化学家警告称,这类“AI护肤建议”存在误诊、推荐无效甚至有害产品的风险,其安全边界和与专业医疗的权责划分亟需关注。