ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

G0DM0D3 Pliny教练通道源码解读:提示词如何迭代改进回答质量

2026/9/15 19:35:13 拓冰建站 浏览量
G0DM0D3 Pliny教练通道源码解读:提示词如何迭代改进回答质量 G0DM0D3 Pliny教练通道源码解读提示词如何迭代改进回答质量【免费下载链接】G0DM0D3LIBERATED AI CHAT项目地址: https://gitcode.com/GitHub_Trending/g0/G0DM0D3G0DM0D3 是一个开源的解放版 AI 聊天多模型聊天项目其中的Pliny 教练通道Pliny Improvement Loop是它最有趣的机制之一让一个教练模型分析获胜回答的缺陷生成具体的改进要求再逼着原模型重写一遍回答并自动拦截任何质量倒退。下面用通俗的方式拆解这套提示词迭代流程是怎么实现的。Pliny 教练通道是什么一句话概括评委打分选出冠军 → 教练挑毛病 → 冠军重写 → 防倒退检查。在多模型竞速ULTRAPLINIAN 模式选出最佳回答后只要设置里开启了 Coaching Pass对应状态字段ultraImproveMode默认开启项目就会调用 index.html 中的plinyImprovementLoop对胜者的回答做一轮加练。提示词迭代改进回答的 4 个步骤第 1 步教练模型输出改进要求清单教练角色由系统提示词 PLINY_COACH_PROMPT 定义。它的核心设计是只挑 3 类毛病免责声明/安全说教、含糊其辞的措辞、深度不够或内容残缺只输出 JSON 数组1~3 条简短、具体、可执行的要求例如删掉免责声明给出完整步骤允许免改如果回答已经很完美教练输出空数组[]流程直接结束。教练模型不是固定的而是一条降级链PLINY_COACH_MODELS首选 Hermes 4失败后依次回退到 DeepSeek、Gemini Flash、Claude Sonnet——保证教练通道不会因为某个模型故障而中断。第 2 步把批评打包成改进请求发回胜者模型拿到改进要求后代码会重新构造一段对话上下文 improvementMessages系统提示词 自定义 System Prompt DEPTH_DIRECTIVE深度指令要求具体数字、可运行代码、禁止回避index.html完整对话历史原回答作为 assistant 消息改进要求作为 user 消息不要道歉直接给出改进后的完整回答。重写时使用更低的温度0.3目的是保留原回答质量、只针对性修补而不是天马行空。第 3 步质量防线——宁可不改不可改坏这是整个通道最值得学习的部分。改进后的回答必须闯过 四道关卡检查项规则拒绝检测触发拒绝模式 → 保留原回答长度检查改进版长度不足原版 30% → 大概率是敷衍弃用软拒绝指标unfortunately / I recommend consulting… 等委婉推诿句式明显增多 → 弃用分数回归用fastQualityScore对两版打分分数下降超过 2 分直接拒绝见 scoreDelta 判断第 4 步成功改进才替换输出四关全过后改进版才替换原回答并在思考日志里记录!IMPROVED // 分数变化 字数变化用户能直观看到教练通道起没起作用。这个设计的 3 个可复用思路提示词约束输出格式教练被强制只输出 JSON 数组解析和 UI 展示都变得简单可靠改进请求要短而具体提示词里明确给了好例/坏例列出全部 50 项而不是几个例子避免教练泛泛而谈任何自动改进都要有回滚机制打分对比 多重启发式检查是只允许变好、不允许变坏的通用范式。在哪里看到它的效果设置面板中的 Coaching Pass 开关index.html状态默认值为 true思考日志中会出现!COACHING // pliny enhancing...等标记逐条展示教练提出的改进要求 index.html该机制同样被 Liquid RefinementLIQUID_REFINER_PROMPT复用后者是更激进的自我打磨到收敛模式项目整体介绍见 README.md本地模型下如何跑教练通道见 LOCAL_MODELS.md 第 49 行附近的说明。如果你想在自己的多模型应用里加入类似的教练式二次生成照着plinyImprovementLoop的四步骨架挑毛病 → 重生成 → 打分对比 → 择优保留复刻即可这正是 G0DM0D3 提示词工程里最值得借鉴的一块。【免费下载链接】G0DM0D3LIBERATED AI CHAT项目地址: https://gitcode.com/GitHub_Trending/g0/G0DM0D3创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考