标签: Midjourney

The agent evaluation gap: Enterprise AI organizations have a reality-alignment problem, not a coverage problem — and most are shipping to production anyway

The agent evaluation gap: Enterprise AI organizations have a reality-alignment problem, not a coverage problem — and most are shipping to production anyway

VentureBeat 2026 年 6 月针对 157 家企业的调研显示,50% 的企业曾将内部评测通过的 AI Agent 直接部署到生产环境,结果导致客户可见的失败。企业信任的自动化评测与真实世界表现之间存在严重错位,但三分之二的企业仍计划在未来 12 个月内让 Agent 完全脱离人工审核自动上线。

Manta AI

Manta AI

Manta AI 发布了一款面向 Web 应用的自主测试智能体,开发者只需提供 URL 或用自然语言描述测试流程,就能自动完成应用探索、Bug 发现和生成可自愈的测试用例。它最大的特点是测试脚本无需人工编写,且能在 UI 变化后自动适应,解决传统自动化测试维护成本高的问题。

电脑警察:向警方销售AI的大生意内幕

电脑警察:向警方销售AI的大生意内幕

美国警方正大规模采购AI产品,从自动化报告撰写、面部识别到决策辅助平台,形成了一条以公共安全资金为目标的产业链。但业内警告,缺乏监管的“黑箱算法”可能侵蚀透明度,重蹈早期预测警务失败的覆辙。

千问APP联合武汉发布举办AI求职实战课,演示简历诊断与办公自动化

千问APP联合武汉发布举办AI求职实战课,演示简历诊断与办公自动化

阿里旗下千问APP与武汉市人社局、武汉发布联合举办了一场线下AI求职实战课,现场演示了用千问进行简历诊断、PPT应急生成以及销售数据表格分析的完整流程。这次活动并非单纯的用户教育,而是阿里将大模型能力从“聊天”推进到“结构化办公”的一次实地验真,展示了千问在文档、表格、幻灯片三大办公场景下的可操作路径。

改进秘密扫描与公共监控

改进秘密扫描与公共监控

GitHub 在 2026 年 7 月 15 日对秘密扫描功能进行了一系列升级,包括新增合作伙伴 Resend、扩展检测类型、默认阻止特定密钥泄露,并为安全团队提供了更清晰的监控面板。这意味着开发者和企业在追踪敏感的 API 密钥、令牌等秘密信息时,将获得更强的自动保护和更直观的态势感知。