应聘 AI Agent 工程师,面试官问了一个这样的问题,我刚好做过,如图。 问:在 LLM 流式输出模式下,如何最大限度的保证 UI 渲染的性能? 核心是别让 UI 做蠢事: 1. 不要每次 token 到来都从头渲染整段内容 应该增量追加节点,或按节流窗口批量刷新。否则输出越长,每次重绘成本越高。 2. 不要塞重型 UI 组件。比如现成的代码高亮渲染、重型表格等,可以自己封装轻量渲染组件。 3. 流式渲染要节流 LLM token…

一位工程师在 X 上分享了面试 AI Agent 工程师时关于 LLM 流式输出 UI 渲染性能的回答,核心思路不是“更快地重绘”,而是“少重绘、轻节点、按需交互”。这类实践正在成为大模型应用前端开发的通用经验。








