摘要

Gavel 用两个训练过的线性映射读取冻结 Qwen3-32B 的任务与 skill 表示。它先筛选候选 skill,不必把整个目录塞进提示词,再让模型判断候选项。在公开评测和 372 条模拟轨迹上,书面任务最多提高 13.4 分,运行中触发 skill 最多提高 21.9 分。论文目前未链接公开实现。

为什么重要
对维护大型 skill 目录的团队,这说明模型内部信号可能减少目录占用的上下文。等代码公开后,再用未见过的 skill 目录试验;目前成绩仍是作者自测。
技术细节
底座 冻结 Qwen3-32B
训练参数 两个线性映射
评测 三个公开集合与 SkillTraj 372 条轨迹
分数提升 书面任务最多 +13.4 分;运行中最多 +21.9 分
代码 摘要页未链接
标签
agent-skillsroutingcontext-engineering