微软开源的 SkillOpt 彻底把 Agent 技能优化做成了“神经网络训练”!无需改动底层大模型权重,就能在纯文本空间实现严格、可复现的技能自我进化。🔥 以往 Agent 的 Prompt 或 Skill 要么靠人工反复试错微调,要么靠模型一次性生成或松散的自我修改,极易出现提示词退化。SkillOpt 则将自然语言技能文档视为可训练状态,用优化器严谨迭代: 深度学习训练范式:引入了 Epoch、Batch Size、文本学习率(…

微软开源了 SkillOpt,把 Agent 的自然语言技能文档当成"可训练参数",用类似神经网络的优化流程迭代提示词,无需改动基座模型权重,就能让技能文档稳定变好。这给提示词工程提供了一条可复现、可验证的工程化路径。








