标签: 大模型

Manta AI

Manta AI

Manta AI 发布了一款面向 Web 应用的自主测试智能体,开发者只需提供 URL 或用自然语言描述测试流程,就能自动完成应用探索、Bug 发现和生成可自愈的测试用例。它最大的特点是测试脚本无需人工编写,且能在 UI 变化后自动适应,解决传统自动化测试维护成本高的问题。

我们的生物韧性策略

我们的生物韧性策略

2026年7月16日,Google DeepMind 与 Isomorphic Labs 联合发布了一项名为“生物韧性”的综合性策略,旨在利用其前沿AI模型——如AlphaFold、Gemini、AlphaEvolve——来主动应对传染病暴发和生物安全威胁。这标志着AI在治理领域从“被动响应”向“主动预防”的…

更新型号,同样的优势

更新型号,同样的优势

Dharma AI 团队发布的 DharmaOCR 模型,在与 Mistral OCR4 等最新模型的对比测试中,仍然在巴西葡萄牙语的文档识别任务上保持领先。这意味着通过特定领域专业化训练的小模型,可以在局部任务上胜过参数更多、架构更新的大模型。

btw, i have used ai to refine ideas and from time to time, some of the standard AI-isms leak into my writing. have since moved to consciously using ai mainly during the brainstorming phase and keeping final writing hu…

btw, i have used ai to refine ideas and from time to time, some of the standard AI-isms leak into my writing. have since moved to consciously using ai mainly during the brainstorming phase and keeping final writing hu...

知名AI领域博主Madhu Guru公开反思了自己在使用AI辅助写作过程中出现的“AI腔”问题,并主动调整了工作流程:将AI限制在头脑风暴阶段,最终成文回归人类主导。这一表态揭示了当前AI写作工具普遍存在的同质化表达问题,也代表了一部分创作者对“AI味儿”文本的克制和清醒。

LLMs能否深度理解计算机架构论文

LLMs能否深度理解计算机架构论文

来自威斯康星大学麦迪逊分校等机构的研究团队发布了Gauntlet——一个多智能体开源管线,用于对计算机架构论文进行深度技术理解。在20篇顶级会议论文的盲评中,Gauntlet输出的分析质量在15个案例里超过了人类研究者,尤其在“批判性严谨”维度优势明显。

别再说AI只是个工具,关键看怎么用了。

别再说AI只是个工具,关键看怎么用了。

一篇在Hacker News上获得大量讨论的博客文章,尖锐地批驳了“AI只是工具,关键看怎么用”这一流行观点。作者指出,这句话看似中立,实则掩盖了AI在设计、生产、部署和环境影响中早已嵌入的系统性问题,将复杂的伦理责任简化为个人使用选择,是一种危险的简化论。

别再说AI只是个工具,关键看怎么用了。

别再说AI只是个工具,关键看怎么用了。

HackerNews 上关于“AI 是否只是个工具”的讨论,暴露出两种截然对立的认知:一方认为 AI 是中性工具(如鞋子或吉他),另一方则担忧“工具论”会被企业用来推卸责任。这场争论的实质,是如何为大规模部署的 AI 划定责任边界。