一句话看懂:一位面试官用“/goal 命令是怎么实现的”这一道题,在垂直业务 agent 研发岗位的候选人里初筛掉约 90%。这个问题背后,是 agent harness(运行框架)中最难做的状态管理与任务闭环,而不是某个命令的表面功能。
事件核心:发生了什么
据 @LinearUncle 2026 年 9 月 26 日发布的推文,他这周帮其他团队电话面试了几位应聘垂直业务 agent 研发的候选人,开场第一个问题就是“/goal 命令是如何实现的”,结果基本能初筛掉 90% 的面试者。他强调,只有真正做过 harness 的人才知道 goal 有多难搞,难点包括完成判断、验收标准、状态持久化、异常兜底、预算控制、上下文压缩不丢任务、缓存命中不被打乱等。
评论区也印证了这一点。用户 @Poyang_rex 表示,认真讲清楚这个问题起步就要半小时,他们内部曾用三个小时做分享,事后发现当初的不少分析“错误的离谱”。@KakaluoteW45042 则给出实践细节:goal 状态最难,完成判断如果交给模型自评必然乐观,最后只能把验收标准做成 checklist 逐条验证;上下文压缩前必须显式持久化当前任务,否则模型会自己“发明”一个新目标。
为什么重要
这道题之所以有区分度,是因为它不考 API 调用或 prompt 技巧,而是考 agent 从“能跑起来”到“能交付”的工程能力。垂直业务 agent 要面对真实任务:什么时候算完成、失败怎么回滚、token 预算怎么控、长上下文压缩后任务目标会不会漂移。这些正是 harness 层要解决的问题。
目前公开信息显示,行业里大量 agent 项目仍停留在 demo 阶段,完成判断依赖模型自评、状态散落在对话历史里,一旦上下文被压缩或缓存命中发生变化,任务就可能断掉。能把 /goal 讲清楚的人,通常意味着他处理过生产环境里的异常和验收,而不是只调过几个大模型接口。
对用户/开发者/创作者的影响
对开发者来说,这类面试题释放了一个信号:agent 研发岗位的考察重心正在从“会不会用模型”转向“会不会做 harness”。如果你在简历上写做过 agent,面试前最好能把完成判断、状态持久化、预算控制这几个环节讲出具体实现,而不是只谈模型选型。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对使用 agent 工具的用户和创作者,这意味着产品体验的差异会越来越体现在“任务能不能稳定做完”上。一个 agent 是否会在长任务中跑偏、是否在压缩上下文后忘掉原目标,比它单轮回答多聪明更重要。选工具时,验收机制和状态管理值得优先关注。
值得关注的后续
一是这类面试题是否会成为垂直 agent 岗位的常见考察点,反映招聘市场对 harness 能力的需求变化;二是主流 agent 框架和闭源产品是否会把 goal 状态管理、任务验收、上下文压缩做成标准能力;三是开发者社区是否会围绕“任务不漂移”沉淀出可复用的开源方案,而不仅停留在 prompt 层面的讨论。
来源:@LinearUncle


