首页/新闻资讯/正文详情

参考文献会凭空消失?Academic Research Skills 用 4 层校验拦住 AI 编造引用

发布时间:2026/9/26 2:15:46 来源:云帆数科 栏目:资讯中心
参考文献会凭空消失?Academic Research Skills 用 4 层校验拦住 AI 编造引用
参考文献会凭空消失Academic Research Skills 用 4 层校验拦住 AI 编造引用【免费下载链接】academic-research-skillsAcademic Research Skills for Claude Code: research → write → review → revise → finalize项目地址: https://gitcode.com/GitHub_Trending/ac/academic-research-skills投稿前一晚你逐条点开参考文献核对结果某一条的 DOI 在 Crossref 里查无结果arXiv 上也搜不到作者——这条看起来非常可信的引用其实是 AI 写稿时顺手编出来的。这类事比想象中常见一项覆盖 250 万篇论文的审计估算仅 2025 年就出现了约 14.6 万条幻觉引用。Academic Research Skills下称 ARS就是针对这个问题设计的一套 Claude Code 学术技能包覆盖研究 → 写作 → 评审 → 修订 → 定稿它的招牌能力是让每一条引用都能被查到、每一段方法描述都能对回你真实的实验材料。方案速览ARS 把引用造假拆成了可拦截的环节幻觉引用最难缠的地方在于它读起来和真引用没有区别。ARS 的思路不是写一句不许编的提示词而是把整条写作链路拆开在每个环节放一个具体机制——写作时限制信息来源、留痕标记自由发挥、初稿终稿各设一道强制门禁、再用确定性脚本对着学术索引逐条核验。团队自己的压力测试里引用错误率一度高达 31%其中 21 条问题引用甚至骗过了 3 轮一致性检查。这些数据就是后面这套机制的由来。核心机制让只用你给的材料成为默认行为写论文时最危险的输入是模型自己的训练记忆。ARS 的 **Knowledge Isolation知识隔离指令**干的事很直白只要流水线里已经放进了研究问题简报RQ Brief、综述报告和带注释的参考文献表写作代理就必须以这些会话材料为第一信源而不是靠我记得好像有篇文章这么说过来填内容。它并不禁止 AI 使用学术写作常识、文风与论证技巧——被管住的只有事实层面论点、数据、引用、方法描述。落到执行上代理会收到五条硬性约束事实性内容以本次会话提供的材料优先模型记忆让位文中的每个论点都要能回溯到参考来源里的某一条大纲需要、但材料没覆盖的内容不许自己补先标记出来参考文献表之外的新文献未经你明确点头不得入文Methods 章节只能描述材料里有据可查的流程实验步骤一个字都不许合理想象。这套规则专门堵住三类隐蔽问题方法论虚构凭训练数据写出你从没跑过的实验流程、隐式知识泄漏用记忆里的过时或不准确内容填空白、无意复述从训练语料里几乎逐字搬来别人的段落。协议原文见 academic-paper/references/anti_leakage_protocol.md值得通读一遍。缺口留痕[MATERIAL GAP] 与 [LLM-SUPPLEMENTED] 的记账方式写作约束得越紧越要有一个卡住了怎么办的出口。ARS 的做法是打标记材料覆盖不到的地方代理写下[MATERIAL GAP]并在下一个检查点把缺口摆到你面前你可以补料也可以明确授权 AI 来补这段内容——授权后该段会被打上[LLM-SUPPLEMENTED]标签写进草稿元数据一致性审查时一眼可见。换句话说AI 的每一次自由发挥都有一笔账。后续做 AI 使用披露说明时这些覆盖性决定会一并注入论文谁补的、补在哪、你批没批准全程可查。4 层校验按论文的时间线走一遍防造假不靠单点ARS 的四层校验沿写作 → 初稿 → 终稿 → 全局的时间线排开写作时知识隔离先于下笔上面讲的五条红线在动笔前就生效把编造拦在内容产生之前——这是成本最低的一层因为根本不需要事后追责。初稿Stage 2.5 门禁 7 种失败模式逐条排除初稿交出去之前一致性审查代理必须逐条排除 7 种已知 AI 研究失败模式其中第 2 种就是引用幻觉第 6 种是方法论虚构。任何一项被判疑似流水线立即暂停等你确认才能继续。这道门禁不可跳过清单全文在 academic-pipeline/references/ai_research_failure_modes.md。终稿Phase E 论点-来源对齐数字必须对得上原文引用存在不等于引用正确——真实文献也可能被拿去做它没说过的事。Phase E 会抽取文中的关键声明百分比、因果判断、趋势描述逐条回到原文比对高影响声明100% 全量验证其余按比例抽检每条判定落在 VERIFIED / 轻微偏差 / 重大扭曲 / 无法验证等档位只要出现一条重大扭曲或无法验证一致性报告直接判 FAIL。规则细节见 academic-pipeline/references/claim_verification_protocol.md。全局四索引存在性核验 数据访问分级贯穿全程的是两道确定性防线。第一道是引用存在性校验门自 v3.11 起每条引用都会被脚本交叉核对 Semantic Scholar、OpenAlex、Crossref、arXiv 四个学术索引DOI 或 arXiv ID 查无此条即判不存在——纯程序化比对不经过模型判断编出来的 DOI 没有解释空间入口在 scripts/verify_passport.py 与 scripts/verification_gate/。第二道是Ground-Truth Isolation数据访问分级每个技能都在元数据里声明自己的数据访问级别raw/redacted/verified_only未经核验的材料与已核验材料严格分层流动确保参考答案永远不会漏进答题者的上下文。设计原理见 shared/ground_truth_isolation_pattern.md。如何接入安装与日常配合安装前提是已装 Claude Code两条命令/plugin marketplace add Imbad0202/academic-research-skills /plugin install academic-research-skills跑流程直接说我要写一篇关于 X 的研究论文ARS 会按 研究 → 写作 → 评审 → 修订 推进也可以单独试对这份材料做文献综述。注意知识隔离的生效前提你得把材料简报 综述 参考文献表真正喂进流水线空手写作时协议不会激活。日常配合就两件事看到[MATERIAL GAP]就补料或显式授权补充看到[LLM-SUPPLEMENTED]就重点复核那一段。所有覆盖性决定都会被你确认并留痕不会悄悄放行。资料索引文件内容academic-paper/SKILL.md写作技能总纲含协议引用入口academic-paper/references/anti_leakage_protocol.md防泄漏协议全文核心必读academic-pipeline/references/ai_research_failure_modes.md7 种 AI 研究失败模式清单academic-pipeline/references/claim_verification_protocol.mdPhase E 论点验证协议shared/ground_truth_isolation_pattern.md数据分层隔离设计docs/RISK_REGISTER.md风险 → 控制措施 → 证据状态对照表收束ARS 没有承诺AI 绝不会编它做的是把每次编造的成本抬高到肉眼可见写作时被隔离、缺口被记账、引用被四个索引对质、每个论点被拉回原文核对。你无法阻止模型产生幻觉但可以确保任何一条幻觉都走不出这道流水线。【免费下载链接】academic-research-skillsAcademic Research Skills for Claude Code: research → write → review → revise → finalize项目地址: https://gitcode.com/GitHub_Trending/ac/academic-research-skills创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关推荐

BAML TypeScript 客户端集成测试全指南:环境搭建、用例编写与调试实战
BAML TypeScript 客户端集成测试全指南:环境搭建、用例编写与调试实战

编程语言AI Agent编译器CLI人工智能 【免费下载链接】baml The programming language for agents 项目地址: https://gitcode.com/gh_mirrors/ba/baml 点击查看 免费下载 导读 本文围绕 BAML 仓库中的 TypeScript 集成测试套件展开,完整讲解如何从零搭… · 2026/9/26 2:15:46

集装箱缺陷检测数据集详解:VOC/YOLO双格式与YOLOv8训练避坑
集装箱缺陷检测数据集详解:VOC/YOLO双格式与YOLOv8训练避坑

简介:面向集装箱表面缺陷检测任务,这份数据集包含1476张真实场景图片,覆盖Deframe、Dent、Hole、Rusty、Scratch五类常见缺陷,共计4227个矩形标注框。所有图片已使用labelImg工具完成Pascal VOC与YOLO两种格式的标注,可… · 2026/9/26 2:15:46

RocketRide 接入百度千帆:llm_baidu_qianfan 节点完整配置与源码解析
RocketRide 接入百度千帆:llm_baidu_qianfan 节点完整配置与源码解析

【免费下载链接】rocketride-server High-performance AI pipeline engine with a C core and 50 Python-extensible nodes. Build, debug, and scale LLM workflows with 13 model providers, 8 vector databases, and agent orchestration, all from your IDE. Includes VS C… · 2026/9/26 2:15:46

STM32理论体系全解析:从系统架构到项目实战的底层认知框架
STM32理论体系全解析:从系统架构到项目实战的底层认知框架

1. 从“点灯”到“系统”:STM32理论到底在讲什么很多人第一次接触STM32,都是从一块最小系统板加一个LED开始的。焊好板子,装好Keil,新建工程,写几行代码,编译下载,灯亮了,心里一阵激… · 2026/9/26 2:56:18

MySQLTuner-perl 发布回滚指南:删除 Tag、回退提交与远程同步的完整工作流
MySQLTuner-perl 发布回滚指南:删除 Tag、回退提交与远程同步的完整工作流

数据库运维 【免费下载链接】MySQLTuner-perl MySQLTuner is a script written in Perl that will assist you with your MySQL configuration and make recommendations for increased performance and stability. 项目地址: https://gitcode.com/gh_mirrors/my/My… · 2026/9/26 2:56:12

Mosquitto 1.6.8 发布解读:Broker、客户端库与命令行工具的关键修复
Mosquitto 1.6.8 发布解读:Broker、客户端库与命令行工具的关键修复

物联网消息队列后端网络/通信 【免费下载链接】mosquitto Eclipse Mosquitto - An open source MQTT broker 项目地址: https://gitcode.com/gh_mirrors/mo/mosquitto 点击查看 免费下载 导读 Mosquitto 1.6.8 是 Eclipse Mosquitto 在 2019 年 11 月 28 日发布的… · 2026/9/26 2:55:53

Plannotator 渲染器中的 Markdown 硬换行(Hard Line Break)支持:语法语义、源码实现与注解兼容性剖析
Plannotator 渲染器中的 Markdown 硬换行(Hard Line Break)支持:语法语义、源码实现与注解兼容性剖析

【免费下载链接】plannotator Annotate and review coding agent plans and code diffs visually, share with your team, send feedback to agents with one click. 项目地址: https://gitcode.com/gh_mirrors/pl/plannotator 点击查看 免费下载 Plannotator 是一… · 2026/9/26 2:55:53

Kata Containers 中的 Cloud Hypervisor 磁盘在线扩容:VmResizeDisk 模型与 /vm.resize-disk API 深度解析
Kata Containers 中的 Cloud Hypervisor 磁盘在线扩容:VmResizeDisk 模型与 /vm.resize-disk API 深度解析

云原生容器运行时 【免费下载链接】kata-containers Kata Containers is an open source project and community working to build a standard implementation of lightweight Virtual Machines (VMs) that feel and perform like containers, but provide the workload isolat… · 2026/9/26 2:55:47

Gemini CLI 工具映射实战:让 AI 编程超能力 Skills 在 Google Gemini CLI 上真正跑起来
Gemini CLI 工具映射实战:让 AI 编程超能力 Skills 在 Google Gemini CLI 上真正跑起来

AI 技能AI 插件人工智能开发工具 【免费下载链接】superpowers-zh 🦸 AI 编程超能力 中文增强版 — superpowers(250k ⭐)完整汉化 4 个中国原创 skills,让 Claude Code / Copilot CLI / Hermes Agent / Cursor / Windsurf / Ki… · 2026/9/26 2:55:47

数据库课后习题答案别硬背:当测试用例集刷,效率翻倍
数据库课后习题答案别硬背:当测试用例集刷,效率翻倍

简介:万常选版《数据库原理与设计》课后习题答案资源,覆盖第2至6章及第9章,适合正在学习关系模型、数据库建模、关系数据理论与模式求精的本科生、自学者作为复习与自测材料。压缩包共7个文件,含3个doc参考答案、2个sql示例脚本、… · 2026/9/26 0:00:21

OpenClaw 替代品?Hermes Agent 踩坑实录:macOS 飞书接入 TaoToken 配置
OpenClaw 替代品?Hermes Agent 踩坑实录:macOS 飞书接入 TaoToken 配置

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/26 0:00:40

向下兼容与向上兼容:接口设计中的兼容性策略与工程实践
向下兼容与向上兼容:接口设计中的兼容性策略与工程实践

一次版本升级事故,是很多团队绕不过去的坎。线上环境里,服务端明明已经上线了新版接口,老的移动端还在照着旧文档传参数。请求一到网关,校验直接拒绝,用户操作失败,客服群炸了锅,开发群里开始互… · 2026/9/26 0:00:46

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码