| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
重做红旗词检测:全文扫描收敛为结构化字段扫描,research/降级WARN 对抗审查(P1-22/23/24/25)实测:旧版全文红旗词扫描对10条合理句子 误杀9条——「诚实边界:xx未实测」是项目自己要求写的内容,写了反被 机器判成造假;「不是自评分」越澄清越被拦。本次重做: 1. 只扫关键字段行(测试日期/总分/各维评分等,须为「字段名+冒号/ 表格分隔符」结构),正文叙述一概不扫——审查报告9条误杀句全部 通过,「评分日期格式统一为YYYY-MM-DD」这类说明句也免疫 2. 否定语境免疫:命中词前文若是「不是/绝不/NOT a」等否定表达, 视为主动澄清不算命中 3. 英文词绑定分数上下文(estimated score),不再拦 "Estimated reading time";删掉裸placeholder/self-assess全文匹配 4. references/research/ 从❌降为⚠️(15个官方examples里5个自己都 没有:elon-musk/feynman/munger/naval/taleb,硬门槛比官方示范 还严),文案注明这是CONTRIBUTING期望结构,请人工确认可溯源性 5. 新规则写进CONTRIBUTING.md收录门槛清单,机器拒PR有据可依 6. 顺手修同一行内的截断提示(命中>8项时标「…等N项」,P2-27) 验证:①5个PR#70式坏样本(日期占位/预估分/NN没填/维度待跑/英文 estimated score)全部检出;②审查报告9条误杀句+1条对照句0误杀; ③15个官方FIDELITY.md红旗0命中,5个仅WARN不拦;④模板本体 references/fidelity-scorecard.md 仍如设计意图被检出。 Co-Authored-By: Claude Fable 5 <noreply@anthropic.com> | 1 个月前 | |
feat: 社区收录PR半自动检查——GitHub Action自动验形式门槛(只改COMMUNITY.md/仓库存在/FIDELITY≥70/诚实边界/调研底稿)并贴评论,人工只判伦理红线 Co-Authored-By: Claude Fable 5 <noreply@anthropic.com> | 2 个月前 |