PUA v3.5.1
Compatibility and runtime fixes; original PUA tone retained. This is not an
all-model pass or a measured productivity-gain claim.
本次是兼容与运行修复,不是“全模型完全通过”认证。保留原情绪强度,不改成温柔版。
更新内容
- 多端入口:从同一执行契约生成 Claude Code、Codex、ChatGPT 独立技能包及对话粘贴版;支持宿主缺工具、缺钩子时诚实说明能力边界。独立包可从本版本发布附件下载或在本地构建,不包含完整插件的命令和钩子。
- 运行修复:按真实事件处理工具失败;按会话与工作目录隔离、去重和恢复最小数值状态;成功的普通工具调用不清零任务失败;显式风味锁定与自动选择分开。
- 命令与反馈:修正实际插件路径解析和验收资产保护提醒;停止钩子只做非阻断提醒,
/pua:survey quick自愿评分后才本地记录,跳过不记录,无网络上传。 - 验收工具:增加 cc0、OMP、Codex CLI 的精确入口、原生技能调用、源文件指纹和结束事件检查;缺失证据、拒绝、回退、审批阻断和限流单列,不用传输成功替代行为通过。
保留与边界
- 保留主技能原有引用台词、Codex 的 L1–L4 施压台词;完整
flavors.md与固定上游逐字节一致。钩子中无依据的“其他模型已经完成”等事实陈述改为同强度的条件式施压,不伪造同事评价。 - 续测共 29 次实际调用。Fable-5、Opus-5、Astra、Grok 4.6、DeepSeek V4 Pro / V4 Flash 的已交付 E1 代码通过本轮独立功能检查;这不等于全部行为要求通过。
- 仍未解决:Fable 修改前开场/诊断失败;Opus 有讲解细节错误;OMP 的模型自执行验证受审批阻断,部分模型另有流程或边界输入失败;Codex CLI 的正文读取和最早验证时序留证不足。GLM 5.3 限流,V4.1 Flash 未解析到精确型号;ChatGPT 图形界面安装未验收。
- 不新增强制动作前阻断器,不改变全局模型、账号、权限或用户已有安装。离线测试通过不等于未测场景通过。
“解释性事实错误”是什么? 例如 Opus 的修复代码通过了这次测试,也正确指出了字符串比较的问题,但讲解中说错了“哪两个字符最先不同”。是讲解里有一句不准确,不是这次修复失败,也不能据此说整份输出完全正确。
使用与复现
插件更新前离线复核:17 组检查全部通过;6 份版本清单一致;受测技能入口及风味文件指纹不变;三个独立包可重复构建。OMP 辅助元数据路径的便携化另有离线正反例覆盖。这些不是新增模型行为通过样本。
发布流程另增加版本标签与清单一致性、单版本说明提取及链接校验;推送 v3.5.1 标签时生成发布页,并附三个独立技能 ZIP 和 manifest.json 文件指纹清单。模型限制随发布说明一起保留,不只生成一个空发布页。
详细运行留档为本地私有资料,不随 Git 发布;公开报告保留源指纹、计数、失败与证据缺口。早期报告明确标为历史快照,不冒充 3.5.1 当前入口的完整验收。版本号更新本身不代表已经合并默认分支、打标签或创建 GitHub Release(发布页)。
Full Changelog: v3.5.0...v3.5.1