v18.0.0 CC BY-NC-SA 4.0 OpenClaw Skill 零外部依赖

small-model-enhancer

修复 / 增强小模型(3B–14B)与任意 LLM/API 不稳定输出的 OpenClaw 技能包 —— JSON 修复、代码识别、信息提取、截断检测等 8 项能力,A/B 实测平均分 10.5 → 89.2(Δ+78.8),skillscore 100/A。

Δ+78.8
A/B 实测平均提升(baseline 10.5 → skill 89.2)
10/10
A/B 用例:胜 9 · 平 1 · 败 0
8
能力项(路由式管道 Step 0–4)
100/A
skillscore 静态跑分(六类满分·零 findings)
0
外部依赖(stdlib 零依赖 fix.py)

这是什么

small-model-enhancer 面向小模型(3B–14B)及任意 LLM/API 的不稳定输出:坏 JSON、漏判的代码、全角标点、截断文本、格式混乱的列表等。以 OpenClaw 技能(SKILL.md)形式交付,宿主 LLM 按管道规则自动修复/增强,另附确定性工具 scripts/fix.py 保证可复现。

GitHub 仓库:https://github.com/SuiJQ/Beyond

8 项能力

执行管道

0 Route(code → json → list → text) 1 Sanitize 去噪 2 Truncation 截断检测 3 Pipe(code | json | text) 4 Fallback 回退

每步只在命中时改写输出;所有 JSON 输出统一 data + meta 契约(code 模式与列表/截断输出除外)。

采纳率 A/B 实测(v18.0.0 更新)

OpenClaw 只把技能的 name + description 注入 system prompt(正文不在 prompt 内),因此 description 能否触发模型主动调用 = 技能是否真正被用。C0 = 中性引导(纯 description 触发力),C+ = 真实环境引导(模拟 OpenClaw 部署,任务匹配时优先调用)。

版本 / 引导采纳率

配对验证 v18.0.0(F3b)vs v17.1.0(E4b),xiaomi/mimo-v2.5,每任务 3 次(运行 python3 tests/ab_test.py --adopt-runs=3 复现)

A/B 实测结果

平台模型 xiaomi/mimo-v2.5,runs=3,9 用例(v16 历史基线 + v17 重跑,2026-08-03 更新)。

用例baselineskillΔ
json_basic 坏JSON修复0100+100
json_brace 缺右括号0100+100
code_c C代码识别0100+100
code_escape 引号转义0100+100
extract 信息提取050+50
decision 立场分析050+50
trunc 截断检测0100+100
list 列表格式化1001000
fact 事实标注0100+100

平均:baseline 10.5 → skill 89.2(Δ+78.8),胜 9、平 1、败 0。

明细见 ab_result.json(本表由 ab_result.json 动态注入,发版只需更新该文件),可运行 python3 tests/ab_test.py --runs=3 复现。v16 基线含 normalize 独立能力;v17 起 normalize 移除(全角修复收敛为 json 管道子能力),该用例移入负例集(回归哨兵)。extract/decision 单次 0 分属采样波动,baseline 仍为 0、skill 均为正收益。

下载

下载数由 GitHub Release 官方统计(实时更新)。

推荐
SKILL.md
技能文件本体 · 普通用户即装即用(放入 OpenClaw skills 目录即可)
下载 SKILL.md
下载次数加载中…
完整仓库
全部文件 · 开发者使用(含 fix.py 工具、测试脚本、文档、A/B 数据)
下载完整包
下载次数加载中…

完整仓库也可从 main.zip 下载(无官方计数);单文件也可直链 /SKILL.md(无官方计数)。

快速使用

# 作为确定性工具(stdlib 零依赖)
python3 scripts/fix.py route    '<text>'   # code|json|list|text
python3 scripts/fix.py json     '<json>'   # 修复 + data/meta 输出
python3 scripts/fix.py norm     '<text>'   # 全角→半角(独立工具保留, json 管道子能力)
python3 scripts/fix.py sanitize '<text>'   # Step 1 去噪(机械子集)
python3 scripts/fix.py extract  '<text>'   # §C 提取(日期/金额/数字)
python3 scripts/fix.py trunc    '<text>'   # 截断检测
python3 scripts/fix.py --selftest        # 内置回归自测

# 回归验证
python3 tests/verify_31.py               # 57/57 断言
python3 tests/ab_test.py --runs=2        # A/B 实测(需平台模型代理)

仓库结构

SKILL.md                  # 技能主文件(v18.0.0)
README.md                 # 使用文档
ASSESSMENT.md             # 全方位评估报告
FIXPLAN.md                # 缺陷诊断与修复方案(含 fix.py 附录)
ab_result.json            # A/B 实测最终结果
references/examples.md    # 输入→期望输出逐字锚点
scripts/fix.py            # 确定性工具(route/json/norm/sanitize/extract/trunc + selftest)
scripts/check_version.py  # 版本一致性检查(CI 用)
tests/                    # ab_test / verify_31(CI 自动跑)

版本历史