首页/新闻资讯/正文详情

如何阻止 AI 编造参考文献?ARS 防泄漏协议 4 道防线 + 2 个标记机制完整指南

发布时间:2026/9/26 8:18:46 来源:云帆数科 栏目:资讯中心
如何阻止 AI 编造参考文献?ARS 防泄漏协议 4 道防线 + 2 个标记机制完整指南
如何阻止 AI 编造参考文献ARS 防泄漏协议 4 道防线 2 个标记机制完整指南【免费下载链接】academic-research-skillsAcademic Research Skills for Claude Code: research → write → review → revise → finalize项目地址: https://gitcode.com/GitHub_Trending/ac/academic-research-skills用 AI 写论文最怕是参考文献看着像真的、其实根本不存在。Claude Code 学术技能包 ARSAcademic Research Skills里的防泄漏协议用知识隔离加多重防线让 AI 幻觉引用和虚构实验方法过不了流水线。先把流水线看全防泄漏协议只是写作环节的一道闸门拿到这个项目后先建立一张全景图。ARS 是一条完整流水线五个环节依次推进研究 → 写作 → 评审 → 修订 → 定稿对应四组核心技能deep-research做研究、产出材料、academic-paper写作、academic-paper-reviewer评审、academic-pipeline编排与一致性把关。数据不会凭空安全。一项对 arXiv、bioRxiv、SSRN、PMC 上 250 万篇论文、1.11 亿条参考文献的大规模审计Zhao et al., 2026估计仅 2025 年就有 146,932 条幻觉引用约 14.6 万保守估计ARS 团队自己的一次校验也发现68 条参考文献里有 21 条存在问题31% 错误率而这 21 条全部骗过了 3 轮一致性检查——内部自审挡不住内部幻觉因为验证者和生成者是同一个认知框架。防泄漏协议的位置就卡在写作这一环研究材料简报 综述 参考文献表刚交接到写作代理的那一刻它自动接管约束后续所有动笔行为。核心思想一句话知识隔离写论文时优先使用本次会话提供的材料而不是 AI 的记忆。为什么这是治本的手段幻觉引用和虚构方法有一个共同源头模型在材料不足时默认用训练记忆去填空。协议做的事情就是把这个默认行为翻过来——只写手上有的。注意一个边界它不禁止使用学术写作能力行文规范、论证逻辑、学科惯例照常可以用被锁死的只有事实性内容——声明、引用、数据、方法描述必须来自会话材料。五条红线写作代理的硬约束协议激活时已提供实质性研究材料、处于 full 或 revision 模式写作代理会收到一组优先级规则。翻译成红线红线它拦的是什么一句话人话事实性声明优先取自会话材料隐式知识泄漏模型拿记忆里的过时、不准内容填空你给的数据说了算模型的常识靠边站每个论点必须能追溯到参考文献表或用户数据无源可溯的句子引不到出处这句就不许写材料没覆盖的话题标记为[MATERIAL GAP]悄悄脑补宁可留空不许圆未经你明确授权不得引入参考文献表之外的新文献新增幻觉引用想加新引用先申请Methods 章节只描述材料中记载的流程方法论虚构写出合理但没做过的实验步骤不许发明实验步骤 前四条管写什么第五条专门管怎么描述你做的事——这是最容易被忽视的一条因为编出来的方法看起来最专业。留白机制每一次自由发挥都留痕协议最妙的地方不是禁止而是显式化。当大纲需要的内容在你的材料里找不到时AI 不会默默圆过去而是在稿件里打一个[MATERIAL GAP]标记并在下一个检查点向你报出来。此时只有两条路你补材料——把缺失的资料喂进流水线让缺口用真实材料填上你授权 AI 补——补出来的段落会打上[LLM-SUPPLEMENTED]标签写入稿件元数据后续一致性审查时一目了然。也就是说留白是默认选项发挥是授权选项。AI 每一次动自由发挥的地方都有案可查无处遁形。标记词表在 shared/compliance_checkpoint_protocol.md 中有正式定义。写完还要过四道门纵深防御写作时不造假只是第一层。围绕参考文献真实性整条流水线布了四道门逐层加严。第一道存在性安检——四个学术索引交叉核对从 v3.11 起每一条被引用的文献都会被确定性脚本不是 AI交叉核对四个书目索引Semantic Scholar、OpenAlex、Crossref、arXiv。DOI 或 arXiv ID 被证明查无此物脚本直接判定不存在。这一步纯程序化编造的 DOI 逃不过去查过的结果还会进本地缓存同一篇论文不重复请求。实现见 scripts/verify_passport.py 与 scripts/verification_gate/。第二道一致性门禁——7 种失败模式逐一排除初稿和终稿各要过一道不可跳过的一致性检查Stage 2.5 与 Stage 4.5。检查时一致性审查代理必须逐一排除 7 种已知 AI 研究失败模式——其中 Mode 2 就是引用幻觉Mode 6 是方法论虚构。任何一项被判疑似流水线立即暂停等你确认、回修或带理由覆盖才能继续4.5 处仍未解决的疑似项终稿直接拒绝放行。完整清单见 academic-pipeline/references/ai_research_failure_modes.md。第三道论点-来源对齐——Phase E 五档判定引用存在还不够真实文献也可能被错误引用去支持它没说过的事。Phase E 会抽取文中的数值、因果、趋势、类别断言逐条回到原文比对抽样策略高影响声明标题级结论、数值、因果、方法关键、有争议100% 验证不设上限其余按风险分层抽检随机抽样加保底终检模式对已登记声明 100% 复核五档判定VERIFIED一致/ 轻微偏差MINOR_DISTORTION/ 重大扭曲MAJOR_DISTORTION/ 无法验证UNVERIFIABLE/ 来源受限无法核验UNVERIFIABLE_ACCESS门禁出现任何一条重大扭曲或无法验证一致性报告直接 FAIL。协议细节见 academic-pipeline/references/claim_verification_protocol.md。第四道数据分级——答案不许漏进答题者每个技能都在元数据里声明自己的数据访问级别raw未验证的原始材料默认不可信/redacted脱敏材料/verified_only只消费过闸的验证材料。材料在层级间只能单向晋升答案永远到不了答题者的上下文。设计原理见 shared/ground_truth_isolation_pattern.md。上手三步装好、喂料、盯标记第 1 步安装插件。需已安装 Claude Code在会话里执行两条命令/plugin marketplace add Imbad0202/academic-research-skills /plugin install academic-research-skills第 2 步喂研究材料。协议生效的前提是你提供了实质性材料研究问题简报RQ Brief 综述报告Synthesis Report 带注释的参考文献表实验日志、数据可一并附上论文处于 full 或 revision 模式时自动激活。想单独试也可以先说对这份材料做文献综述。第 3 步盯住两种标记逐一确认。看到[MATERIAL GAP]二选一补材料或授权 AI 补看到[LLM-SUPPLEMENTED]重点复核该段落。所有覆盖性决定都会被记录并进入论文最终的 AI 披露说明——带病放行会留痕。想深挖文件导航关键文件作用academic-paper/references/anti_leakage_protocol.md防泄漏协议全文知识隔离指令 标记处理规则academic-pipeline/references/ai_research_failure_modes.md7 种 AI 研究失败模式清单与检测问句academic-pipeline/references/claim_verification_protocol.mdPhase E 论点-来源对齐验证协议shared/ground_truth_isolation_pattern.mdraw / redacted / verified_only 数据分级设计docs/RISK_REGISTER.md风险 → 控制措施 → 证据状态对照登记academic-paper/SKILL.md写作技能总纲含协议引用与激活条件scripts/verify_passport.py引用存在性校验入口脚本收尾ARS 把AI 不许编从一句口号沉淀成了写作时知识隔离、缺口显式留痕、多索引确定性校验、人工门禁兜底的可执行机制——你论文里的每条引用、每段方法都要经得起对照原始材料的检查。【免费下载链接】academic-research-skillsAcademic Research Skills for Claude Code: research → write → review → revise → finalize项目地址: https://gitcode.com/GitHub_Trending/ac/academic-research-skills创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关推荐

Graylog DataNode 手动迁移指南:从 OpenSearch 2.x / 1.3.x 与 Elasticsearch 7.10 迁移到 DataNode 集群
Graylog DataNode 手动迁移指南:从 OpenSearch 2.x / 1.3.x 与 Elasticsearch 7.10 迁移到 DataNode 集群

日志分析运维观测 【免费下载链接】graylog2-server Free and open log management 项目地址: https://gitcode.com/gh_mirrors/gr/graylog2-server 点击查看 免费下载 本文基于 graylog2-server 仓库 data-node/migration/ 目录下的 Manual Migration Guide 及其配… · 2026/9/26 8:18:40

reconFTW v2(Go 重写)Beta 发布全解读:v5.0.0-beta.1 的能力边界、兼容性承诺与反馈路径
reconFTW v2(Go 重写)Beta 发布全解读:v5.0.0-beta.1 的能力边界、兼容性承诺与反馈路径

渗透测试网络安全应用安全 【免费下载链接】reconftw reconFTW is a tool designed to perform automated recon on a target domain by running the best set of tools to perform scanning and finding out vulnerabilities 项目地址: https://gitcode.com/gh_mir… · 2026/9/26 8:18:40

华为ICT大赛备赛全攻略:赛道选择、真题用法与官方书籍阅读指南
华为ICT大赛备赛全攻略:赛道选择、真题用法与官方书籍阅读指南

华为ICT大赛这几年在高校圈的热度肉眼可见地往上蹿,我身边不少学弟学妹从大二就开始盯着这个比赛,原因很实在——它不光是简历上能写的一行字,更是一次把课堂里零散的网络、云计算、AI知识串成体系的机会。但问题也来了:赛道到底怎… · 2026/9/26 8:18:34

AI出海实战:从算力调度到大模型部署与Agent开发全解析
AI出海实战:从算力调度到大模型部署与Agent开发全解析

1. 从"堆卡"到"拼生态":AI出海这盘棋的底层逻辑变了 2025年做AI出海,如果还停留在"买卡、训模型、发API"这条老三样路径上,大概率会发现自己陷入了一个尴尬的境地:算力成本压不下去,模型… · 2026/9/26 8:51:32

LLM Agent驱动的开源代码评审新范式
LLM Agent驱动的开源代码评审新范式

1. 项目概述:这不是一个工具,而是一套可落地的开源代码评审新范式“open-code-review”这个标题乍看像某个 GitHub 仓库名,但实际它指向的是一场正在 quietly 发生的工程实践变革——不是简单地把传统 Code Review 流程搬到线上,而… · 2026/9/26 8:51:32

Mycat2 install-template 实战:从安装到分库分表配置与避坑
Mycat2 install-template 实战:从安装到分库分表配置与避坑

简介:mycat2 install-template 是一份面向 MyCat 2 数据库中间件的安装模板包,主要帮助开发者和运维人员在部署分布式数据库时快速获得可复用的配置与启动环境。压缩包体积仅 1.19MB,共包含 52 个文件,类型以 SQL 脚本、JSON 配置… · 2026/9/26 8:51:32

深度残差收缩网络:软阈值化与注意力机制如何提升噪声鲁棒性
深度残差收缩网络:软阈值化与注意力机制如何提升噪声鲁棒性

1. 深度残差收缩网络到底在解决什么问题 第一次看到“深度残差收缩网络”这个名字,很多人会以为它只是把残差网络和某个叫“收缩”的模块拼在一起。实际上,它要解决的是一个非常具体、也非常普遍的问题: 当输入数据里混有噪声或冗余特征时&a… · 2026/9/26 8:51:32

深度残差收缩网络DRSN:软阈值化与注意力机制如何灵活删除冗余特征
深度残差收缩网络DRSN:软阈值化与注意力机制如何灵活删除冗余特征

深度残差收缩网络(Deep Residual Shrinkage Network,DRSN)这个结构,我第一次接触是在处理工业设备振动信号降噪的任务里。当时用常规的残差网络做故障分类,模型在训练集上表现很好,但一到现场数据就拉胯——… · 2026/9/26 8:51:32

通信客户流失预测:MLP建模与业务对齐的全流程实战
通信客户流失预测:MLP建模与业务对齐的全流程实战

简介:本资源是一份面向大数据与人工智能方向高校教学的Python机器学习实战教案,聚焦通信运营商客户流失预测这一典型业务场景,适用于大数据技术类专业本科生及初阶数据科学学习者。教案系统覆盖客户流失分析全流程:从数据去重、缺… · 2026/9/26 8:51:26

数据库课后习题答案别硬背:当测试用例集刷,效率翻倍
数据库课后习题答案别硬背:当测试用例集刷,效率翻倍

简介:万常选版《数据库原理与设计》课后习题答案资源,覆盖第2至6章及第9章,适合正在学习关系模型、数据库建模、关系数据理论与模式求精的本科生、自学者作为复习与自测材料。压缩包共7个文件,含3个doc参考答案、2个sql示例脚本、… · 2026/9/26 0:00:21

OpenClaw 替代品?Hermes Agent 踩坑实录:macOS 飞书接入 TaoToken 配置
OpenClaw 替代品?Hermes Agent 踩坑实录:macOS 飞书接入 TaoToken 配置

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/26 0:00:40

向下兼容与向上兼容:接口设计中的兼容性策略与工程实践
向下兼容与向上兼容:接口设计中的兼容性策略与工程实践

一次版本升级事故,是很多团队绕不过去的坎。线上环境里,服务端明明已经上线了新版接口,老的移动端还在照着旧文档传参数。请求一到网关,校验直接拒绝,用户操作失败,客服群炸了锅,开发群里开始互… · 2026/9/26 0:00:46

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码