PaperSpine Authorial Voice Restoration:基于证据绑定的学术作者声音恢复实战指南
发布时间:2026/10/12 3:07:45 锦皓数字建站

AI 技能AI 写作人工智能深度研究AI 应用【免费下载链接】PaperSpinePaperSpine5 — local-first, evidence-bound paper research, writing, figures, review and delivery. Download: https://wubing2023.github.io/PaperSpine/v5/项目地址https://gitcode.com/gh_mirrors/pa/PaperSpine点击查看免费下载导读本文是 PaperSpine 中humanize路线的权威操作手册系统讲解“作者声音恢复Authorial Voice Restoration”的完整能力边界、工作流定位、六步实操方法与可执行门禁命令。读者将掌握如何先冻结主张/证据/术语权威文件如何基于授权语料构建作者声音档案如何区分“无需改写的 clean-text no-op”与“最小必要改写”以及如何用确定性不变量、独立语义审计和 SHA-256 绑定确认跑通author_voice_check.py与progress_check.py两级验证——全程不依赖任何 AI 检测器、不宣称任何“AI 百分比”。一、能力边界这是声音恢复不是 AI 检测规避PaperSpine 将历史humanize路线重新定义为Authorial Voice Restoration作者声音恢复。其目标是在贡献contribution、主张/证据图claim/evidence graph、术语terminology以及面向读者的稿件修订被冻结之后恢复作者本人的学术表达移除空壳框架empty framing、机械式段落角色、缺乏证据支撑的评价性语言、虚假润色与重复脚手架同时严格保持科学含义不变数字、引用、否定、因果方向、模态/不确定性与主张强度均须守恒。按照 humanize.md 的明确表述该能力不是“让文本通过 AI 检测器”且红线清单包括不得承诺检测通过、不得报告编造的 AI 百分比不得针对 AI 分类器或单词黑名单优化文风不得为了“看起来像人”而故意加入错误、俚语、反问、第一人称或句子长短变化未经明确授权不得模仿其他学者不得把多跳翻译/回译作为最终改写手段不得让“模式计数”决定作者身份或强制改动。从源码看这一边界被写进了检查器的模块级文档字符串author_voice_check.py 开头明确声明“The checker does not identify AI authorship and does not estimate an AI rate”仅验证修订来源provenance与硬语义不变量模板化文风模式只作为 advisory 诊断输出。相应的 Markdown 报告模板也固定输出两行Authorship inference: not_performed与Detector pass / AI percentage: not_claimed见 author_voice_check.py 的to_markdown函数。配置开关从兼容字段到新字段历史humanize_tierlight|medium|heavy仍是兼容开关仅用于启用本路线不再选择检测器阈值新配置应使用author_voice_restorationstandard|strict|off。在 intake_wizard.py 的字段帮助文本中可以看到这一定位“humanize_tier —— 作者声音恢复兼容字段”。三个取值在 assertive-scientific-writing.md 中有精确定义off普通科学编辑ordinary scientific editingstandard保留作者的特征术语、强调与有效措辞仅修正具体弱点strict对作者表达与论证结构做最小必要改动重大重构须在修订说明中解释。两种取值都不允许改动结果、主张强度或科学含义。配置的实际解析逻辑见 progress_check.py 的author_voice_requested()优先读取author_voice_restoration支持布尔/字典/字符串形式仅在未设置时回退检查humanize_tier是否属于light|medium|heavyartifact_check.py 的config_requests_author_voice()采用同样的判断规则。二、工作流定位在既有文本之后、独立审查之前本路线在单条 Skill 流程中的位置如下原文完整继承confirmed contribution frozen claim/evidence/terminology ↓ reader-facing manuscript draft immutable original snapshot ↓ author-voice profile (authorized corpus or explicit unavailable receipt) ↓ claim/evidence/limitation reverse outline ↓ clean-text no-op decision or minimum necessary rewrite ↓ deterministic invariants advisory pattern scan ↓ independent semantic audit with veto authority ↓ author confirmation bound to the revised SHA-256 ↓ independent editorial review声音恢复必须在散文已存在之后应用。独立评审员应使用保存的首选项对实际原文与修订文进行比较缺失历史作者声音回执不阻止该评审。也就是说本路线是一个“修订后的质量闸门”而非写作前的规划阶段——这也是 progress_check.py 将其编排在drafting产出final_paper/main.tex之后、integrity_audit之前的原因见STAGES列表中的author_voice_restoration阶段定义其必需产物为author_voice_profile.json、author_voice_revision.json、author_voice_receipt.json、author_voice_report.md。三、第一步改写前冻结权威快照所有支配本次修订的文件例如confirmed_contribution.md、scientific_evidence_ledger.json、术语来源与当前稿件在author_voice_revision.json.authority_files中记录它们的相对路径、用途与 SHA-256 值。最少需要一个权威文件且每项必须带有非空purpose——这是 author-voice-restoration.schema.json 的强制约束authority_files数组minItems: 1author_voice_check.py 会在校验时对缺失的权威快照直接报 BLOCKERmissing_authority_snapshot。将改写前的稿件复制到不可变路径例如author_voice/original_manuscript.tex修订后的文件通常仍是final_paper/main.tex。绝不能覆盖唯一的原始字节。检查器在_verify_file_spec()中会逐文件核验路径必须解析在输出根目录内防止路径逃逸、文件必须存在、声明哈希必须是 64 位十六进制且与当前文件字节一致否则分别产生unsafe_path、missing_file、invalid_declared_hash、hash_mismatch等 BLOCKER 级 finding。四、第二步构建作者声音档案按 author-voice-profile.schema.json 创建author_voice_profile.json。档案的核心字段与约束包括字段取值/约束说明contractpaperspine.author-voice-profile契约标识必须精确匹配schema_version1.0与检查器SCHEMA_VERSION一致statusavailable|unavailable有授权语料或如实声明不可用output_language语言标签如en、zh-CN每种输出语言须分别评估authorized_sources[]每个来源含pathsha256authorizationsource_kindauthorization∈author_owned|explicitly_authorizedprotected_terms[]字符串数组去重受保护术语身份不得漂移first_person_policypreserve_source_pattern|allow|avoid|not_profiled第一人称策略unavailable_reason字符串statusunavailable时必填语料来源仅限作者本人或明确授权的文本优先选择同作者过往论文、开题报告或学位论文章节、审稿回复信、反映作者真实推理过程的研究笔记。将授权来源快照到reference_materials/author_voice/逐条绑定 SHA-256 与authorization并记录不得漂移的方法名、变量、统计术语、数据集名等受保护术语。若没有可用授权语料设置statusunavailable、保持authorized_sources[]、说明原因然后继续但不模仿任何人。这是诚实的能力边界而不是借用名家文风的理由。检查器对此有两条强制约束unavailable档案不得携带未验证来源unavailable_profile_has_sources且必须填写原因missing_profile_reason同时产生一条 ADVISORY 提示“No authorized author corpus is available; do not imitate another scholar”。档案与修订契约的语言一致性也受强制约束若 profile 与 revision 声明的输出语言不同检查器报language_declaration_mismatchBLOCKER并明确“不静默映射为英语”——这正是 assertive-scientific-writing.md 与 current-method-routing.json 中强调的多语言各自评估原则。五、第三步改写前先做 no-op 决策先问是否存在具体的读者可见问题。仅凭模式匹配不够——清晰、准确、切合章节功能的文本即使使用常见连接词、重复的流程性句法或较低的句长方差也应判定为 clean-text no-op。no-op 时设置modeno_op保持原始与修订字节完全一致保持changes[]记录现有散文为何已履行其章节功能使用semantic_audit.audit_methoddeterministic_identity或独立审计复用作者既有偏好与授权未改动的段落不需要再次进行哈希绑定确认。no-op 是正面的精确性证据不是“错过降低 AI 分数机会”的遗憾。检查器对 no-op 模式的强制校验包括原始哈希与修订哈希必须逐字节一致否则invalid_no_opBLOCKER、changes必须为空否则invalid_no_op_logBLOCKER、审计方法必须是deterministic_identity或independent_agent。测试夹具 test_progress_check.py 的_add_valid_author_voice_no_op()给出了一个可直接复刻的最小合法 no-op 样例modeno_op 原文/修订同哈希 changes[]semantic_audit六项计数全为 0 author_confirmation绑定当前哈希随后用author_voice_check.py的--write --json生成本次回执并通过 gate。六、第四步从段落功能改写而非表层同义词对每个受影响段落从冻结权威中恢复四件事该段落所承载的主张或问题为其背书license的证据会改变解释的局限或替代方案该段落与前后单元的关系。必要时隐藏原文措辞从这些功能重新构建优先删除空壳框架而非做同义词替换。author_voice_revision.json.changes中每一条改动都必须带 source/revised 定位符、有界的理由和证据锚点。schema 对changes[].reason规定了枚举值delete_empty_framing、restore_author_preference、clarify_claim_evidence_link、remove_unsupported_evaluation、repair_paragraph_function、section_register、other_reader_facing_problem见 author-voice-restoration.schema.json。应用章节感知规则Methods方法规则的句法与重复结构往往是对的。保持术语稳定、主语清晰、一个概念一个名称不要强推 burstiness句长起伏。Results结果直接陈述观察数字与比较紧贴其证据避免无依据的评价。Discussion讨论恢复作者本人的优先级、竞争性解释、权衡、反例与真实局限不要制造犹豫或自信。Introduction/Abstract引言/摘要删除泛化的“重要性”框架让问题-缺口-贡献的关系具体对应冻结的主张边界。回译back-translation只能作为差异探针绝不自动采纳其措辞一旦它暴露含义变化立即回到原主张。这与红线清单“不得把回译作为最终改写”相互印证。七、第五步硬语义不变量按 author-voice-restoration.schema.json 创建author_voice_revision.json然后运行python scripts/author_voice_check.py paper_rewriting_output --markdown --write命令行为见 author_voice_check.py 的parse_args()output_dir位置参数默认paper_rewriting_output--request/--profile覆盖默认的author_voice_revision.json/author_voice_profile.json--json输出 JSON--markdown输出 Markdown 报告--write同时写入author_voice_receipt.json与author_voice_report.md。检查器绑定并比较以下内容对应invariant_extractors字典不变量提取方式语言依赖原始/修订字节与 SHA-256全文件哈希否冻结的主张/证据/术语权威文件逐文件哈希核验否数字与单位NUMBER_UNIT_RE正则提取支持%、mg、μL、mM、°C等单位否引用键\cite与 Pandoc 格式[key]两种语法否公式行内$...$、显示\[...\]、equation/align/gather/multline环境否受保护术语与专有名词profile/revision 中的protected_terms合并去重后计数否否定标记中/英词表not/no/never…、不/未/无…是因果/关联方向中/英词表cause/because/leads to…、导致/归因于…是模态、不确定性与主张强度中/英词表may/suggest/likely…、可能/提示/似乎…是确定性的差异是“去检查受影响含义”的信号对数字、归属、否定、因果方向或应有确定性的真实改动必须修复但不得仅仅因为标记计数不同就阻止等价表达。模式组如空壳框架、流程泄漏始终只是 advisory不识别作者、也不单独要求改写。advisory 诊断在scan_diagnostics()中定义了五组模式empty_framingit is worth noting that、值得注意的是等generic_importanceplays an important role、具有重要意义等mechanical_enumerationfirstly/secondly、首先/其次/综上所述等writing_process_leakthis section discusses、本节将讨论等promotional_precision_gapgroundbreaking、突破性的、高度稳健等。此外当授权语料可用时检查器计算_style_deviation()的描述性归一化距离句长均值、句长变异系数、连接词/第一人称/模糊语每千字频率五个分量的欧氏距离并明确标注descriptive_distance_only_not_authorship_evidence——仅供描述不作作者身份证据、也不作验收阈值。八、第六步独立语义审计与作者确认对于moderewrite必须由不同的 Agent在不对文本做润色的前提下比较冻结原文与修订文。审计人拥有否决权veto authority且必须把回执绑定到两个哈希。以下六项计数必须全部为 0unsupported_new_claims无依据的新主张claim_strength_drift主张强度漂移causal_direction_changes因果方向改变negation_changes否定改变modality_uncertainty_changes模态/不确定性改变citation_meaning_changes引用含义改变。对应 schema 的semantic_audit对象要求audit_method∈independent_agent|deterministic_identity、reviewer_id、independent_from_rewriter、status、两个 SHA-256 以及上述六项整数计数。检查器的强制校验包括rewrite模式必须是independent_agent且independent_from_rewriterTrue否则non_independent_auditBLOCKER重写者与审计者身份必须不同same_rewriter_reviewerBLOCKER审计哈希必须与当前文件一致stale_semantic_auditBLOCKER六项计数任一非零即 BLOCKERsemantic_audit_drift。author_confirmation对象要求statusconfirmed、confirmed_sha25664 位哈希与confirmed_at若状态非 confirmed 或哈希与当前修订不一致分别触发author_confirmation_missing与stale_author_confirmation。独立语义审查通过后保留当前修订及其具体发现后续进一步编辑只重查受影响段落只有超出既有指示的新的实质性选择才需要请求作者输入——常规授权编辑与未改动段落不需要新的哈希绑定批准。九、产物清单与门禁路线启用时的必需产物author_voice_profile.jsonauthor_voice_revision.jsonauthor_voice_receipt.jsonauthor_voice_report.md契约命名的不可变原始稿件快照与授权语料快照。门禁命令python scripts/progress_check.py paper_rewriting_output --gate author_voice_restorationprogress_check.py中的author_voice_restoration阶段config_dependentTrue在启用时检查上述四个产物其 gate 执行逻辑直接调用validate_author_voice(output_dir)见 progress_check.py 中stage_key author_voice_restoration分支任一 hard finding 都会导致 GATE FAILED 并列出每条 finding 的code: message。同时该阶段在integrity_audit阶段会被再次复查integrity_auditgate 会重验 voice receipt 的缺失/过期/阻断未启用时返回 opt-out 消息“Authorial Voice Restoration explicitly disabled; gate passes (opt-out)”——test_progress_check.py 验证了author_voice_restoration: off时 gate 通过、standard时缺少回执则 gate 失败退出码 1artifact_check.py 在config_requests_author_voice()为真时同样要求这四件产物test_artifact_check.py 覆盖了“启用才要求、关闭不要求”的行为。报告内容必须包含原始/修订哈希、改动理由、保留的不变量、语义审计状态、可用时的相对授权作者文本描述性偏差、未解决的诊断模式与作者确认并显式报告authorship inferencenot_performed不宣称检测通过。十、兼容性说明humanize_check.py的定位humanize_check.py仍是旧产物的兼容诊断工具。其 D1–D5 观察sentence structure、paragraph similarity、information density、connector frequency、term-context matching仅具 advisory 意义没有任何 readiness 权威。源码 humanize_check.py 明确声明authority diagnostic_only、readiness_authority False、报告标头固定输出Readiness gate: not_authoritative与Authorship inference: not_performed。值得注意的兼容行为当输出目录中存在author_voice_revision.json或author_voice_profile.json时humanize_check.py的main()会直接委托给validate_author_voice()并重定向到新路线同时写一个humanize_report.md说明“legacy report has no independent gate authority”否则才回退读取旧的humanize_matrix.md表格做 D1–D5 兼容分析。这与 SKILL.md 的质量规则一致“Use evidence-boundauthor_voice_check.py;humanize_check.pyand detector scores are diagnostics, not paper-quality verdicts”。十一、与当前公共宿主工作流的衔接在当前公共宿主工作流中优先使用保存的偏好与 assertive-scientific-writing.md 中的方法文末所述的历史 Runner 序列记录的是更早的路线其冻结权威文件、回执与哈希绑定作者确认不是当前单一 Skill 下正常编辑或独立评审的前提。当前方法保留作者表达偏好off走普通科学编辑standard保留作者特征术语与有效措辞、只修具体弱点strict只做最小必要改动无论哪一档都不允许改变结果、主张强度或科学含义。语料缺失时如实声明“无法学习个人声音”继续有用的写作不虚构一种声音也不要求新的写作语料。总结Authorial Voice Restoration 的完整闭环可以概括为一条铁律先冻结、再档案、先 no-op、再最小改写、用不变量兜底、用独立审计收口、用哈希绑定确认。它把“让文本更像作者写的”这一模糊目标转译成了一套可执行、可审计、可门禁的工程协议——author_voice_profile.json界定“作者是谁”、author_voice_revision.json界定“改了哪里、为什么改”、author_voice_check.py界定“科学含义是否守恒”、author_voice_receipt.json/author_voice_report.md界定“这条链路是否可信”最终由progress_check.py在流程中强制卡位。全程不识别作者身份、不宣称检测通过将改写行为牢牢锚定在证据与作者授权之上。关键文件索引供深入阅读能力边界与流程 humanize.md、assertive-scientific-writing.md核心检查器 author_voice_check.py兼容诊断器 humanize_check.py契约 schema author-voice-profile.schema.json、author-voice-restoration.schema.json、author-voice-receipt.schema.json门禁与配置判定 progress_check.py、artifact_check.py测试证据 test_progress_check.py、test_artifact_check.py、test_humanize_check.py质量规则 SKILL.md赞分享AI 技能AI 写作人工智能深度研究AI 应用【免费下载链接】PaperSpinePaperSpine5 — local-first, evidence-bound paper research, writing, figures, review and delivery. Download: https://wubing2023.github.io/PaperSpine/v5/项目地址https://gitcode.com/gh_mirrors/pa/PaperSpine点击查看免费下载相关推荐PaperSpine 作者声音恢复评估指南从检测器阈值校准到证据绑定评估体系PaperSpine 作者声音恢复评估指南从检测器阈值校准到证据绑定评估体系 导读 本文解读 PaperSpine 仓库中 Authorial Voice RAI 技能AI 写作人工智能深度研究AI 应用快速指南用 RemoveWindowsAI 彻底清除 Windows 11 的 AI 组件快速指南用 RemoveWindowsAI 彻底清除 Windows 11 的 AI 组件 刚装好的 Windows 11 上任务栏的 Copilot 图标隐私合规应用安全PaperSpine Evidence Reviewer Agent基于证据与引文质量的独立审稿人设计与实战指南PaperSpine Evidence Reviewer Agent基于证据与引文质量的独立审稿人设计与实战指南 导读 本文围绕 PaperSpine5 技能AI 技能AI 写作人工智能深度研究AI 应用上一篇超实用Lottie-iOS动画响应式布局完全指南告别变形适配全设备下一篇.NET runtime 便携式 PDB 元数据格式全解Portable PDB v1.0 规范深度剖析创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
锦
锦皓数字建站
深耕本土企业品牌数字化升级,专注原创端正雅致商务官网,从视觉设计到稳定运维全程保驾护航。