B 站上线“AI 无限竞技场”:百大模型同台 PK,GPT-6 Astra 暂居榜首

B 站上线"AI 无限竞技场"大模型评测榜单,由不同分区 UP 主用真实工作流出题实测,首轮结果中 GPT-6 Astra 暂居第一,前五名有三款国产模型。它值得关注的地方在于:评测标准不再由厂商或固定跑分定义,而是由真实使用场景决定。

B 站上线"AI 无限竞技场"大模型评测榜单,由不同分区 UP 主用真实工作流出题实测,首轮结果中 GPT-6 Astra 暂居第一,前五名有三款国产模型。它值得关注的地方在于:评测标准不再由厂商或固定跑分定义,而是由真实使用场景决定。

一篇在 Hacker News 上引发讨论的文章指出,企业若连自身数据的口径、来源和归属都理不清,接入再多 AI 应用也无法产生可靠结果。它把讨论焦点从模型能力拉回到数据治理这个更基础的问题上。

一个名为 "Is This Image AI?" 的网页小游戏,让玩家在 60 秒内对每张图片判断是真实照片还是 AI 生成,每人每张图只有 10 秒。它把"AI 图像鉴别"这件专业事,变成了一次面向普通人的直觉测试。

一位开发者在 Hacker News 发布开源项目 Enzo,把市面上多种免费可用的模型 API 聚合到一个本地运行的全功能平台里,主打代理、邮件日程、编程预览和 API 密钥加密管理。它值得关注的点在于:当闭源 AI 产品越做越重,本地化、可审计的开源聚合方案正在成为一部分用户的替代选项。

开发者 theguysudo 在 Hacker News 发布开源项目 ENZO,一个可本地部署、聚合 9 家供应商 300 多个模型的全功能 AI 平台,用户自带 API Key,直接按供应商原价付费,中间没有任何抽成或订阅。

北京服贸会上一条“金龙鱼”机器人走红网络,它其实是博雅工道研发的自主水下航行器 BG-5,能自主规划路线、避开障碍。外形逼真加上军用背景,让这款产品同时具备军事侦察和反偷猎两种现实用途。

前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 发布了新 Transformer 模型 Jev,它不生成文本,只输出概率,主打为软件自动化提供低成本、可校准的决策能力。

一份据称出自微软应用科学总监 Brent Hecht 的内部备忘录,把大模型抓取人类作品称为“人类历史上最大的劳动力盗窃”;与此同时,Hacker News 上的开发者用自己的亲身经历指出,大模型不仅白用你的内容,还会刻意隐藏来源。

《纽约时报》诉 OpenAI 和微软版权案中,一批内部文件被引述,显示两家公司高管私下承认 AI 抓取内容是对创作者的“史上最大劳动力盗窃”,并视 ChatGPT 为出版商的“生存威胁”。这些表态可能削弱 OpenAI 的“合理使用”抗辩。

UmanWrite 正在以 63.20 美元促销其终身 Unlimited Plan,核心卖点是让用户用自己过去的写作样本训练专属 Voice Profile,使 AI 生成内容更接近个人语气和词汇,而不是通用 AI 腔。