行为特征溯源 Ox Alpha 的训练数据来源

第三方模型供应商在 OpenRouter 上发布的 Ox Alpha,被独立分析认定为 GLM-5 系列模型。它的行为指纹显示,其审查机制高度集中于国内政治议题,而在疆藏台等国际关注话题上与美系模型几乎一致,这一发现对理解中国大模型的审查边界和开源生态有重要意义。

第三方模型供应商在 OpenRouter 上发布的 Ox Alpha,被独立分析认定为 GLM-5 系列模型。它的行为指纹显示,其审查机制高度集中于国内政治议题,而在疆藏台等国际关注话题上与美系模型几乎一致,这一发现对理解中国大模型的审查边界和开源生态有重要意义。

NVIDIA 在 Dynamo 中推出 Shadow Engine Recovery 预览功能,通过常驻内存的备用引擎,将大模型推理故障恢复时间从数百秒压缩到数秒,显著降低服务中断对用户的影响。

LangChain 与数据集成平台 Airbyte 推出了一项反向深度集成,将 LangChain 作为 Airbyte 的一个目标端(Destination),让开发者能在 Airbyte 的调度框架内直接完成文本切分和向量化,为检索增强生成(RAG)应用提供生产级的数据摄取管道。

GitHub 团队在将 LLM 用于 secret scanning 时发现,基准测试表现好不等于生产环境可靠,并据此总结出一套以产品决策为导向、离线评估当作集成测试的大模型上线前评估方法。

开源项目 Yeschef 让 Claude Code 和 Codex 能调用你局域网内闲置的 GPU 机器,把本地 Ollama、vLLM 等模型变成“后厨”,实测 3 台 NUC 小主机集群可跑出 627 tok/s,既省 API 费用又绕开限流。

Skild AI 发布机器人基础模型 S1,宣称该模型能仅凭单个视频演示,学会预训练阶段从未见过的任务,且无需微调。这一进展指向机器人从“预设技能”向“即时场景理解”过渡的可能。

一位开发者用 Google AI Studio + Gemini,仅靠自然语言提示,在手机上直接生成了一款功能完整的 Android 日记应用 Reflect,其 AI 分析功能还能自动识别用户情绪和精力变化模式。这件事说明 AI 应用开发的门槛正在从“会写代码”进一步降低为“会描述需求”。

AI 安全公司 Alice(原 ActiveFence)完成 1.4 亿美元融资,投后估值约 10 亿美元。它用八年积累的互联网有害内容数据库,为 Anthropic、Google 等大模型厂商做上线前的安全压力测试,本轮融资由 Apax Digital Funds 领投。

Anthropic 将 Claude 聊天与 Claude Cowork 的记忆系统合并,默认开启,共享全部对话上下文。这意味着 Claude 从一个“多产品”变成了一个“连续助手”,但也把记忆能力延伸到了能执行任务的 agent 上,隐私与安全边界被重新划定。

一位开发者展示了自己在树莓派上本地运行 Qwen 模型、结合 OBD2 数据打造车载 AI 助手的项目,声称可离线解答车辆问题,并在断网时联动云端 AI 完成订票等任务。该项目在 Hacker News 引发热议,核心争议在于:树莓派跑本地大模型的真实性,以及如何安全接入汽车厂商云端 API。