一句话看懂:KCD 杭州站正式开放议题征集,将于 2026 年 11 月 28 日落地,核心议题从“AI + 云原生”升级为“Agent on Kubernetes”,聚焦 Agent 工作负载的运行时隔离、可观测性保障和推理引擎调度三大方向。
事件核心:发生了什么
Kubernetes 社区日(KCD)杭州站宣布启动 2026 年演讲征集,截止时间为 9 月 30 日。本次活动由 CNCF 提供支持,阿里巴巴、OpenTelemetry、vLLM 等项目的核心维护者担任分论坛出品人,包括 Kata Containers 架构委员会成员 Fupan Li、OpenKruise Maintainer 张振、OpenTelemetry 治理委员会成员 Juraci Paixão Kröhling,以及 HAMi Community Manager 宋净超。
会议设置了三个分论坛:Agent Infra 关注 K8s 上的 Agent 沙箱隔离与 MCP/A2A 流量治理;Observability & Reliability for AI 讨论 OpenTelemetry 的 GenAI 语义规范与多 Agent Trace 关联;AI Infra & LLM Serving 则聚焦 vLLM、SGLang 在 K8s 上的推理性能优化与 GPU 调度。议题形式包括 30 分钟标准演讲和 10 分钟闪电演讲。
作为参照,上一届 KCD 杭州以 AI + Cloud Native 双 Track 吸引了 82 份投稿、39 位讲师和 316 名到场参会者,线上观众超过 2 万。
为什么重要
这次活动把三个原本相对独立的技术议题——Agent 运行时、可观测性、大模型推理——统一到“Kubernetes 作为 Agent 标准运行时”的叙事下。过去一年,MCP 协议和推理引擎优化是各自推进的,但生产环境里,Agent 的沙箱隔离、流量治理和 GPU 调度是同一套基础设施问题。
另一个信号是出品人阵容:红帽大中华区 CTO、阿里云开源办公室、蚂蚁集团开源项目管理人员均参与其中,说明云原生社区和大型互联网公司的基础设施团队正在把 Agent 工作负载当作下一阶段 Kubernetes 的核心扩展场景,而非实验性功能。
对用户/开发者/创作者的影响
对于正在做 AI 应用开发的工程师,需要关注的不再只是模型选型,而是 Agent 跑在 K8s 上的隔离方案和流量治理方式。例如 OpenTelemetry 正在制定 GenAI 语义规范,这将直接影响 Agent 调用链路的监控标准化,早期接入成本会低于后续迁移。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对于运维和平台工程团队,vLLM、SGLang 与 K8s 调度深度结合意味着 GPU 资源管理从“按 Pod 分配”转向“按推理请求动态调度”,这关系到推理成本能否真正降下来。活动采用定向邀请制,参会需要组委会审核,但议题投稿不受此限制。
值得关注的后续
第一,9 月 30 日投稿截止后的议题名单,将反映当前 Agent 基础设施领域最集中的痛点在哪里;第二,OpenTelemetry 的 GenAI 语义规范在会议前是否有新版本发布,直接影响 Track 2 的讨论深度;第三,杭州作为 DeepSeek、宇树科技等公司的所在地,本地 AI 团队是否会带来 K8s 之外的替代运行时方案,值得现场观察。
来源:InfoQ CN


