首页/新闻资讯/正文详情

DeepSeek 新论文:我在防作弊那一节停了很久

发布时间:2026/9/27 7:07:56 来源:云帆数科 栏目:资讯中心
DeepSeek 新论文:我在防作弊那一节停了很久
DeepSeek 新论文我在防作弊那一节停了很久摘要AI 会作弊了还防不太住。这句话是论文自己写的。9 月 中旬DeepSeek 发布了 V4.1-Flash 的技术论文。整篇论文的核心就一个字省。聚焦点是 KV CacheKV 缓存也就是模型处理上下文时要占用的显存。先说一个很多人没概念的事实KV 缓存的占用可以远远超过模型本身。拿我自己实测过的例子一个 1.7B 的小模型权重文件才 1GB 出头上下文拉到 1M token 时KV 缓存要吃掉 13.4GB是模型本体的十倍以上。4B 模型更夸张1M 上下文的 KV 要 34GB 往上。模型越小、上下文越长KV 占比越离谱。DeepSeek 这篇论文解决的就是这个问题他们把每 token 的 KV 占用压到了 890 字节只有上一代的四分之一。压缩 KV 这件事玩本地部署的朋友都知道老办法在 llama.cpp 里加 -ctk /-ctv 参数用 q8_0 或 q4_0 把 KV 缓存做量化。但老办法是在模型训练完之后硬压压得越狠精度损失越明显q8_0 基本无感到 q4 就开始伤上下文能力了。这篇论文的路子不一样它把量化放进了训练阶段行话叫 QAT量化感知训练模型是 学着在被压糙的缓存上干活 长大的所以压到 FP4 还能保住性能。再配合架构上的跨层复用和部署上的按需重算三层一起把缓存打下来了。这三层的东西网上已经有很多解读写得很细我就不重复了。但论文里有一节我翻到的解读大多一笔带过。论文在讲训练和评测的两个地方都提到同一件事这届模型会作弊了而且是防不太住的那种。我们一起看下论文原话到底怎么说的。训练的时候模型学会钻空子刷分先看训练阶段。DeepSeek 在强化学习训练时发现模型频繁试图 reward hacking直译是 奖励作弊说人话就是模型不好好干活专门钻评分规则的空子刷分。论文列举的几个行为我直接翻译过来利用操作系统新披露的漏洞包括 XFS 文件系统驱动的权限问题、AppArmor 安全模块的非法内存访问从包镜像服务器里搞到了答案相当于考试前偷到了考卷删除关键程序文件、破坏系统文件甚至直接把整个文件系统删掉。论文用的原词是 臭名昭著。DeepSeek 的对策是给每个训练沙箱配上安全配置AppArmor再用 eBPF 做细粒度的网络管控把模型关在笼子里。还有一个细节我觉得很有意思如果模型把环境搞崩了DeepSeek 不重试直接把这一轮算失败并且给模型回传一个 后果 信号。让模型自己知道搞坏环境是有代价的。评测的时候断网删历史它去反编译内核训练时作弊还能靠沙箱管住评测时的作弊更值得展开讲。为了防作弊DeepSeek 在跑分评测时做了三道防护第一道断网第二道删掉环境里的 Git 历史防止模型翻到答案的提交记录第三道自动清空多种构建缓存Go module、node_modules、编译好的 jar 包、Python 的 pycache一样不落。等于考场封了网络、收了小抄、擦了草稿纸。结果呢论文原话说尽管有这些预防措施仍然观察到了投机取巧行为。举的例子是在 CyberGym一个网络安全评测集里模型把 Ubuntu Linux 的核心软件包反编译了就为了从二进制里找漏洞。到这一步模型干的活已经从 解题 变成 劫狱 了。你能想到的考场纪律它全守了然后它把考卷本身给拆了。DeepSeek 在论文里说得很直白随着模型能力增强Docker 容器加验证脚本这套标准评测基建已经越来越容易被模型钻空子。他们敦促整个研究社区设计下一代基准的时候优先考虑检测和缓解这类行为。翻译一下现在的考场考不住这届考生了得造新考场。为什么这事跟普通人有关最后说说我的三点看法。第一以后看到的跑分可信度要打折。模型越来越聪明钻评测空子的能力也越来越强连 DeepSeek 自己都要专门写一节承认这事防不太住。以后看任何模型的跑分对比多留个心眼能自己测的尽量自己测。第二AI Agent 正在往 有真实权限 的方向走。能反编译内核、能删文件系统的模型说明它已经具备了对真实系统的完整操作能力。这事是双刃剑干活的能力是真的搞破坏的能力也是真的。这也是为什么 DeepSeek 要把训练放在几百万个沙箱里进行出了沙箱没有人兜底。第三这次是 DeepSeek 自己把家丑写进了论文。模型的作弊行为都发生在受控沙箱里没有造成真实危害这种坦诚值得肯定。也正因为有厂商愿意自曝我们才知道评测的水有多深。最后说明一句这篇论文的模型是 552B 参数的数据中心模型跟咱们本地电脑跑的模型没有关系本文聊的是论文里透露的行业信号。本地部署相关的内容还是看我之前的实测系列。每日一问看完这篇以后你再看到 XX 跑分第一 的宣传会先多问一句 它防作弊了吗 吗评论区聊聊你上一次自己给模型跑分是什么时候、用的什么基准。怎么自己动手测我在实测系列里会展开讲。关注GZH有更多AI相关知识分享。

相关推荐

中英文外贸网站建设避坑指南:性能优化与成本实战
中英文外贸网站建设避坑指南:性能优化与成本实战

中英文外贸网站建设避坑指南:性能优化与成本实战 找建站公司最怕什么?怕报价离谱,怕后期加价,更怕网站做出来慢得像蜗牛。很多新手老板为了省那点预算,结果网站加载超过5秒,谷歌直接放弃收录,流量为零。其实, 中英文外贸网站建设… · 2026/9/27 7:07:50

避坑指南:网站规划与制作全流程,性能优化省一半钱
避坑指南:网站规划与制作全流程,性能优化省一半钱

避坑指南:网站规划与制作全流程,性能优化省一半钱 找建站公司最怕什么?不是功能少,而是被坑高价还性能拉胯。很多老板花几万块做了个官网,打开慢得像蜗牛,百度搜不到,还得额外掏钱做SEO。今天就把 网站规划与制作… · 2026/9/27 7:07:44

搞定主视觉设计网站图解步骤避开域名服务器大坑
搞定主视觉设计网站图解步骤避开域名服务器大坑

搞定主视觉设计网站图解步骤避开域名服务器大坑 很多老板找我们做主视觉设计网站,开口第一句就是:“这域名怎么解析不到?服务器配置我看不太懂,SSL证书又报错,到底卡在哪了?”… · 2026/9/27 7:07:26

绍兴网站建设公司地址新手入门避坑指南
绍兴网站建设公司地址新手入门避坑指南

绍兴网站建设公司地址新手入门避坑指南 别问绍兴网站建设公司地址在哪,先看你网站能不能过ICP备案。很多老板拿着合同去绍兴找服务商,签完字才发现备案流程一头雾水,域名解析、服务器信息、主体资质全对不上,网站上线时间直接拖了两个月。这就是新手入… · 2026/9/27 7:49:11

深入解析 WPScan 动态指纹识别:如何从 CHANGELOG.md 精准定位 WordPress 插件版本(以 tag-pages 为例)
深入解析 WPScan 动态指纹识别:如何从 CHANGELOG.md 精准定位 WordPress 插件版本(以 tag-pages 为例)

网络安全漏洞扫描渗透测试应用安全CLI 【免费下载链接】wpscan WPScan WordPress security scanner. Written for security professionals and blog maintainers to test the security of their WordPress websites. Contact us via contactwpscan.com 项目地址: ht… · 2026/9/27 7:48:47

The Concise TypeScript Book 精读:TypeScript 类型谓词(Type Predicates)实战指南
The Concise TypeScript Book 精读:TypeScript 类型谓词(Type Predicates)实战指南

文档教程 【免费下载链接】typescript-book The Concise TypeScript Book: A Concise Guide to Effective Development in TypeScript. Free and Open Source. 项目地址: https://gitcode.com/gh_mirrors/typ/typescript-book 点击查看 免费下载 类型谓词&#xff… · 2026/9/27 7:48:47

QuickRecorder macOS 录屏指南:三步从安装到录出第一条视频
QuickRecorder macOS 录屏指南:三步从安装到录出第一条视频

QuickRecorder macOS 录屏指南:三步从安装到录出第一条视频 【免费下载链接】QuickRecorder A lightweight screen recorder based on ScreenCapture Kit for macOS / 基于 ScreenCapture Kit 的轻量化多功能 macOS 录屏工具 项目地址: https://gitcode.com/GitHu… · 2026/9/27 7:48:47

二维数组的实现
二维数组的实现

The implemention of two-dimensional arrayJava的实现机制Java 的 int[][] 不是一整块连续的二维内存;存放外层引用的槽位连续,但指向的对象不保证地址连续,也就是每个一维数组的地址不一定连续, 所以每行内部元素连续&#xff0… · 2026/9/27 7:48:41

卖游戏辅助的网站怎么建设 3个实战案例拆解
卖游戏辅助的网站怎么建设 3个实战案例拆解

卖游戏辅助的网站怎么建设 3个实战案例拆解 不会写代码也能搭站?别被“技术门槛”吓退。 很多想做游戏辅助售卖的老板,第一反应是找开发公司,结果一报价吓退,或者被坑得底裤都不剩。… · 2026/9/27 7:48:41

MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现

简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01

汕头网站建设制作厂家避坑指南:5大注意事项救急
汕头网站建设制作厂家避坑指南:5大注意事项救急

汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01

多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习

简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01

MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现

简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01

汕头网站建设制作厂家避坑指南:5大注意事项救急
汕头网站建设制作厂家避坑指南:5大注意事项救急

汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01

多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习

简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码