标签: Claude

Genebench-Pro 内部

Genebench-Pro 内部

OpenAI 在 2026 年 6 月底发布了 Genebench-Pro 基准测试的案例研究,详细展示了该基准如何以真实生物实验数据检验 AI 在复杂基因分析任务上的推理能力。这不仅是模型性能测试,更是对 AI 在医疗、制药等领域落地可靠性的直接拷问。

Claude Science 科研工作台正式上线

Claude Science 科研工作台正式上线

Anthropic 于 2026 年 6 月 30 日推出了 Claude Science,这是一款面向科学家的 AI 工作台,将文献分析、编程、数据计算和论文撰写整合在一个环境中,并提供超过 60 个预配置的科学数据库与技能连接器。这款产品的核心价值在于减少科研人员在多个工具间切换的碎片化工作,并通过可追溯…

GitHub 代码覆盖率合并保护拉取请求

GitHub 代码覆盖率合并保护拉取请求

GitHub 为代码仓库新增了基于测试覆盖率的合并保护机制,允许团队在拉取请求合并前设定最低覆盖率或降幅阈值,阻止覆盖率不达标的变更进入主分支。该功能以分支规则集形式提供,目前处于公开预览阶段。

Claude Sonnet 5 一般可用于 GitHub Copilot

Claude Sonnet 5 一般可用于 GitHub Copilot

Anthropic 发布的最新 Sonnet 级模型 Claude Sonnet 5 现已正式集成至 GitHub Copilot,开发者可在 IDE、CLI 以及 Copilot 移动端和桌面应用中选用该模型。这一举措为 Copilot 用户提供了一个新的高性能推理与代码生成选项,尤其适合日常开发和基于 C…