本机速度 vLLM 变压器建模后端

本机速度 vLLM 变压器建模后端

Hugging Face 团队于 2026 年 7 月 8 日宣布,Transformers 库在 vLLM 推理引擎中的建模后端性能已追平甚至超越原生 vLLM 的手写实现。这意味着模型开发者无需为 vLLM 单独编写优化代码,就能直接获得与定制实现相同或更快的推理速度。

GitLab (GTLB) 大力进军企业级人工智能工作流领域

GitLab (GTLB) 大力进军企业级人工智能工作流领域

2026年6月10日,GitLab 宣布了一系列企业级 AI 功能更新,包括将代码克隆替换为 API 访问以提速50倍、推出统一上下文图谱“GitLab Orbit”以及 AI 审计与合规控制,旨在解决自动化工作流中的效率、成本和合规风险问题。同时,GitLab 与 Google Cloud 扩大合作,推出由…