Paper info: Microsoft Research introduces SkillOpt
elvis(@omarsar0)94 字 (约 1 分钟)
65
Microsoft Research introduces SkillOpt: treating skill docs as trainable external states of frozen agents, optimized via RL, significantly improving generalization in multi-step reasoning and tool calling.
入选理由:SkillOpt 将技能文档作为可训练外部状态,而非人工编写,提升泛化。
FeaturedTweet#SkillOpt#Reinforcement Learning#Multi-step Reasoning#Tool Calling#Microsoft Research英文
