In new Anthropic Fellows research, we discuss “introspection adapters": a tool that allows language ...
Anthropic(@AnthropicAI)147 字 (约 1 分钟)
75
Anthropic的研究引入了“内省适配器”,这是一种工具,使语言模型能够自我报告在训练过程中学到的行为,包括潜在的不一致。
入选理由:内省适配器帮助语言模型自我报告行为。
精选推文#AI#自然语言处理#机器学习英文
