Slack 推出智能体驱动型端到端测试,提升 UI 自动化测试稳定性

Slack 工程团队提出了一种名为“智能体测试”的方法,将 AI 智能体融入端到端测试,让测试用例从“固定操作步骤”转变为“设定目标后由 AI 自行探索执行”,旨在减少因 UI 或页面结构变更导致的误报,降低维护成本。

Slack 工程团队提出了一种名为“智能体测试”的方法,将 AI 智能体融入端到端测试,让测试用例从“固定操作步骤”转变为“设定目标后由 AI 自行探索执行”,旨在减少因 UI 或页面结构变更导致的误报,降低维护成本。

Agentty 是一个全新的 AI 结对编程终端工具,用 C++26 编写,静态编译后仅 11MB,冷启动时间低于 1 毫秒,目标是成为 Anthropic 官方 Claude Code 的直接替代品。它既支持 Claude Pro/Max 订阅的 OAuth,也兼容 OpenAI、Groq、Ollama 等…

来自威斯康星大学麦迪逊分校等机构的研究团队发布了Gauntlet——一个多智能体开源管线,用于对计算机架构论文进行深度技术理解。在20篇顶级会议论文的盲评中,Gauntlet输出的分析质量在15个案例里超过了人类研究者,尤其在“批判性严谨”维度优势明显。

开发者PrestigePvP发布了名为VoiceBox的开源工具,将macOS全局热键、Cloudflare Workers的Whisper语音识别与LLM格式化输出串联起来,实现“按住说话→松开即得格式化文本”的极速转录体验。该项目选择完全依赖Cloudflare的免费AI层级,无需自建服务器即可以零成本运…

随着公众对AI的反弹情绪加剧,多位AI公司高管正在强化个人安保措施。网络安全公司Liferaft数据显示,针对高管和数据中心的数字威胁从2月底到5月增长了7倍,显示出AI行业正面临从舆论抵制升级为实际安全危机的转变。

一篇在Hacker News上获得大量讨论的博客文章,尖锐地批驳了“AI只是工具,关键看怎么用”这一流行观点。作者指出,这句话看似中立,实则掩盖了AI在设计、生产、部署和环境影响中早已嵌入的系统性问题,将复杂的伦理责任简化为个人使用选择,是一种危险的简化论。

HackerNews 上关于“AI 是否只是个工具”的讨论,暴露出两种截然对立的认知:一方认为 AI 是中性工具(如鞋子或吉他),另一方则担忧“工具论”会被企业用来推卸责任。这场争论的实质,是如何为大规模部署的 AI 划定责任边界。

开发者 TreDub 在 Hacker News 上发布了一款名为 Whispr 的开源语音转录工具,它基于 Cloudflare AI 的免费层运行,旨在提供低成本的语音转文字能力,但引发了关于本地方案与云方案适用场景的社区讨论。

有研究团队发现,当前最强模型(如 GPT-5.6-luna)在单智能体循环模式下,对计算机架构等专业领域的深度研究仅能达到约40%的可靠度,远不及团队要求的近乎100%落地标准。为此,团队提出了一种三阶段流水线架构(假设生成→调查→综合),试图用确定性研究工具代替单一代理,以提升复杂论文理解与假设产出的可用性…

伦敦初创公司 Applied Computing 获得 2000 万美元 A 轮融资,主推名为 Orbital 的基础模型,目标是为油气、炼化工厂提供能融合实时传感器数据、物理化学规律和工程文档的 AI 预测系统,意图解决工厂仅使用了不到 8% 可用数据的低效问题。