开源第 1 天,社区开发者 xiaobright 做出 dsh-anchored-standard:首轮请求伪装成 Minimal 环境把模型锚定到 RL 推理轨道,随后解锁完整 Standard 工具集。
实测基准分 98/99,接近 Minimal 的 99/96 却保留全部功能,且控制变量实验锁定「首轮工具 schema」是决定性变量。
这是「插件真能改变模型表现」的最强单体实证,插件推荐文章的头号种子选手。
要点
·dsh-anchored-standard 的原理:首轮呈现 Minimal 环境锚定模型,首次工具调用后解锁完整 Standard 工具集
·四种配置对照数据:Standard 91 / PTC 92 / Minimal 99、96 / Anchored Standard 98、99
·控制变量实验:用真 Minimal 工具 schema 时 5/5 进入理想行为,用 Standard 风格 schema 时 11/11 退回 Standard 行为
主要な数字
·基准分 91 → 98/99(装一个插件的提升幅度)
·Minimal 模式基准分 99/96,Standard 只有 91,PTC 92
·对照实验:Minimal schema 5/5 理想行为 vs Standard schema 11/11 退回
·开源仅 1 天社区就做出机制级突破
引用できる一節
Anchored Standard 做了聪明的混合:1. 第一次模型请求时呈现与 Minimal 基本相同的环境……2. 一旦发生第一次真实工具调用/回复,就解锁完整 Standard 工具集……
插件原理的原文表述,推荐条目里讲「它怎么做到的」直接引用
作者发现第一次请求携带的工具 schema 是决定性变量。
一句话点破实验结论,适合做数据表下方的注解句
这不是什么玄学 prompt 增强器
发帖人的定调句,反驳「插件都是玄学」的现成弹药
说实话我得让 ChatGPT 先给我讲解一遍……我对 AI 的热情很大一部分就在于开源社区能这样用它,而不是前沿厂商那些封闭产品。
普通围观者的真实反应,适合用来共情非技术读者并升华「开源红利」主题