一句话看懂:OrcaRouter 发布 OrcaCyber Zero 1.5 网络安全模型,支持 100 万 token 上下文,厂商自报在 Cybench 上达 100%、CVE-Bench 子集达 95.8%,定位授权漏洞研究和渗透测试,仅通过受控 API 提供服务。
事件核心:发生了什么
2026 年 10 月 10 日,OrcaRouter 发布 OrcaCyber Zero 1.5,这是 9 月 17 日 Zero 1.0 的后续版本。该模型针对授权的漏洞复现、漏洞利用开发、渗透测试、安全审计和网络推理等场景做了后训练,支持 100 万 token 上下文窗口、128K 最大输出、原生函数调用和结构化输出。模型只通过 OrcaRouter 托管 API 提供,设“Security Research”受限访问层级,要求提交 engagement、passkey 并接受条款,目前不提供权重或量化版本。API 兼容 OpenAI 接口,调用名称为 orca/orcacyber-zero-1.5。
厂商自报的评测数据包括:Cybench 100%(39/39,无限制智能体执行)、CVE-Bench 95.8%(24 个可评估任务中的 23 个)、HumanEval+ 93.9%、SWE-bench Pro V2 76.5%。定价为每 100 万输入 token 3 美元、输出 7.5 美元,缓存读取每 100 万 token 0.75 美元。过去 7 天,该模型首 token 延迟 p50 约 500 毫秒、p95 约 2.36 秒,但样本仅约 1.3K token 流量。
为什么重要
网络安全专用模型正在成为大模型商业化的一个细分方向。OrcaCyber Zero 1.5 通过“受控访问 + 高定价效率”切入授权安全研究场景,与 Anthropic Mythos Preview、GPT-5.5-Cyber、Sakana Fugu-Cyber 等产品形成对照。它的核心卖点不是通用能力,而是面向代码库、攻击路径和漏洞可验证性的推理优化。若厂商自报成绩能在独立复现中成立,这类模型可能改变安全团队处理漏洞报告的方式——从“更多告警”转向“更少但已验证并修复的漏洞”。
不过,当前公开信息显示,所有成绩均为厂商自报,尚无技术报告或第三方复现;CVE-Bench 仅覆盖 24 个可评估任务,Cybench 覆盖 39 个任务,而非全部。Zero 1.0 的 CyberGym 98.07% 属于旧版在 Orca 自建 harness 下的结果,不能直接归入新模型。因此这些数字应被理解为特定日期、特定评测条件下的厂商声明,而非永久排名。
对用户/开发者/创作者的影响
对企业和安全团队,OrcaCyber Zero 1.5 提供了一条可编程的漏洞研究通道:通过 OpenAI 兼容 API 和函数调用能力,可以把模型接入自动化扫描、PoC 生成或审计流程。但访问被限制在 Security Research 层级,适合红队和授权测试,不适合普通开发者随意调用。其 100 万上下文对分析大型代码库有利,128K 输出也方便生成较长的分析报告。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对开发者生态,托管 API 意味着没有本地部署选项,成本和合规都取决于 OrcaRouter 的可用性。对内容创作者和普通用户,这类模型不直接产生内容产品,更多是安全基础设施层的工具。价格上,输入 3 美元/输出 7.5 美元每百万 token,明显低于 Mythos Preview 的 25/125 美元,但后者的成绩和访问条件不同,不宜简单比较性价比。
值得关注的后续
第一,Orca 是否会发布技术报告或引入第三方复现,验证 Cybench 100% 和 CVE-Bench 95.8% 在更广泛任务上的表现。第二,Security Research 层级的审核门槛和实际放量节奏,可能决定该模型在红队和漏洞赏金社区中的渗透速度。第三,竞品是否跟进类似“长上下文 + 受控访问”的网络安全专用模型,以及监管对授权渗透测试工具的分级管理是否影响其上线范围。


