修复 / 增强小模型(3B–14B)与任意 LLM/API 不稳定输出的 OpenClaw 技能包 —— JSON 修复、代码识别、信息提取、截断检测等 8 项能力,A/B 实测平均分 10.5 → 89.2(Δ+78.8),skillscore 100/A。
small-model-enhancer 面向小模型(3B–14B)及任意 LLM/API 的不稳定输出:坏 JSON、漏判的代码、全角标点、截断文本、格式混乱的列表等。以 OpenClaw 技能(SKILL.md)形式交付,宿主 LLM 按管道规则自动修复/增强,另附确定性工具 scripts/fix.py 保证可复现。
GitHub 仓库:https://github.com/SuiJQ/Beyond
[TRUNCATED] 标记[Fallback Output] + 原文,禁止空响应每步只在命中时改写输出;所有 JSON 输出统一 data + meta 契约(code 模式与列表/截断输出除外)。
OpenClaw 只把技能的 name + description 注入 system prompt(正文不在 prompt 内),因此 description 能否触发模型主动调用 = 技能是否真正被用。C0 = 中性引导(纯 description 触发力),C+ = 真实环境引导(模拟 OpenClaw 部署,任务匹配时优先调用)。
| 版本 / 引导 | 采纳率 |
|---|
配对验证 v18.0.0(F3b)vs v17.1.0(E4b),xiaomi/mimo-v2.5,每任务 3 次(运行 python3 tests/ab_test.py --adopt-runs=3 复现)
平台模型 xiaomi/mimo-v2.5,runs=3,9 用例(v16 历史基线 + v17 重跑,2026-08-03 更新)。
| 用例 | baseline | skill | Δ |
|---|---|---|---|
| json_basic 坏JSON修复 | 0 | 100 | +100 |
| json_brace 缺右括号 | 0 | 100 | +100 |
| code_c C代码识别 | 0 | 100 | +100 |
| code_escape 引号转义 | 0 | 100 | +100 |
| extract 信息提取 | 0 | 50 | +50 |
| decision 立场分析 | 0 | 50 | +50 |
| trunc 截断检测 | 0 | 100 | +100 |
| list 列表格式化 | 100 | 100 | 0 |
| fact 事实标注 | 0 | 100 | +100 |
平均:baseline 10.5 → skill 89.2(Δ+78.8),胜 9、平 1、败 0。
明细见 ab_result.json(本表由 ab_result.json 动态注入,发版只需更新该文件),可运行 python3 tests/ab_test.py --runs=3 复现。v16 基线含 normalize 独立能力;v17 起 normalize 移除(全角修复收敛为 json 管道子能力),该用例移入负例集(回归哨兵)。extract/decision 单次 0 分属采样波动,baseline 仍为 0、skill 均为正收益。
下载数由 GitHub Release 官方统计(实时更新)。
完整仓库也可从 main.zip 下载(无官方计数);单文件也可直链 /SKILL.md(无官方计数)。
# 作为确定性工具(stdlib 零依赖)
python3 scripts/fix.py route '<text>' # code|json|list|text
python3 scripts/fix.py json '<json>' # 修复 + data/meta 输出
python3 scripts/fix.py norm '<text>' # 全角→半角(独立工具保留, json 管道子能力)
python3 scripts/fix.py sanitize '<text>' # Step 1 去噪(机械子集)
python3 scripts/fix.py extract '<text>' # §C 提取(日期/金额/数字)
python3 scripts/fix.py trunc '<text>' # 截断检测
python3 scripts/fix.py --selftest # 内置回归自测
# 回归验证
python3 tests/verify_31.py # 57/57 断言
python3 tests/ab_test.py --runs=2 # A/B 实测(需平台模型代理)
SKILL.md # 技能主文件(v18.0.0)
README.md # 使用文档
ASSESSMENT.md # 全方位评估报告
FIXPLAN.md # 缺陷诊断与修复方案(含 fix.py 附录)
ab_result.json # A/B 实测最终结果
references/examples.md # 输入→期望输出逐字锚点
scripts/fix.py # 确定性工具(route/json/norm/sanitize/extract/trunc + selftest)
scripts/check_version.py # 版本一致性检查(CI 用)
tests/ # ab_test / verify_31(CI 自动跑)