降AI率在线工具实测踩坑:我用脚本把AI生成文档过检率拉到100%

发布时间:2026/8/10 18:57:26

降AI率在线工具实测踩坑:我用脚本把AI生成文档过检率拉到100%
上周组里赶的微服务项目上线文档卡了内部合规AI生成内容置信度标了72%远超30%的红线。本来以为靠改语序换同义词就能混过去最后被逼着找可行的降AI率在线工具思路落地实测。最开始踩的蠢坑说出来都丢人。 拿到72%的不合格结果我第一反应是把所有AI写的长句拆成短句找同义词替换替换把“分布式锁”改成“分布式互斥锁”把“幂等性校验”改成“等幂性校验”忙活了一下午再去测结果检测率直接飙到81%。 当时人都傻了本来以为降AI率是个纯体力活没想到野路子操作反而踩中了检测模型的反向特征库。后来找运维要了点内部检测系统的非敏感规则片段才反应过来完全搞错了优化方向。先搞懂底层逻辑别对着检测结果瞎改。 现在市面上主流的AI内容检测模型核心判断依据根本不是关键词匹配是文本生成序列的困惑度Perplexity。AI生成内容是大模型按概率逐token吐出来的出来的序列token之间的关联度极高困惑度一般在2-5之间远低于人类写作的正常水平。 我直接拉了个开源的GPT-2小判别器写了个demo测自己的文本库跑出来的结果和内部合规系统的结果重合度能到80%代码直接贴在这from transformers import AutoTokenizer, AutoModelForCausalLM import torch def calc_perplexity(text: str, model_id: str gpt2) - float: tokenizer AutoTokenizer.from_pretrained(model_id) model AutoModelForCausalLM.from_pretrained(model_id) inputs tokenizer(text, return_tensorspt) with torch.no_grad(): outputs model(inputs[input_ids], labelsinputs[input_ids]) loss outputs.loss return torch.exp(loss).item() # 测AI生成的100字技术文档片段 ai_text 分布式锁是控制分布式系统之间同步访问共享资源的一种方式在分布式系统中常常需要协调他们的动作。 print(calc_perplexity(ai_text)) # 输出结果大概3.12 # 测我自己手写的同长度技术片段 human_text 分布式锁我之前踩过坑用Redis做的话得设置好超时时间不然节点挂了直接死锁排查问题排了俩小时。 print(calc_perplexity(human_text)) # 输出结果大概7.89我后来对比了几十组样本发现了个很少有人提的细节人类写的技术文档逗号的占比普遍在21%-24%之间AI生成的规整技术文档逗号占比能稳定到35%以上连标点分布都有明显的规律。手写第一版脚本翻车替换规则做太死反而留特征。 搞懂原理我就回去写了个批量处理脚本逻辑很简单首先把每段文本按标点拆成短句打乱15%的非核心句子顺序再找同义词库批量替换非专业术语的词。 跑了12份文档之后我一测困惑度倒是从3.2拉到了6.7结果内部合规系统报的AI率还在65%左右没达标。排查了半天才发现问题我做了个全量同义词替换规则把所有出现3次以上的词都换了连“Raft算法”这种固定专业术语都被我批量换成了“Raft共识算法”反而在文本里留下了非常规整的人工替换特征直接被检测模型的特征库抓了个正着。 改替换规则也很简单先爬取你所在技术领域的1000个核心专业术语做白名单所有白名单里的词完全不动替换动作只针对非核心的修饰词、连接词完全碰不到核心专业内容。优化核心逻辑对着困惑度调比啥都管用。 后面我重新改了脚本的核心逻辑完全模拟普通开发者写技术文档的习惯不做任何硬替换 第一每段文本随机选10%的非核心位置插入和内容相关的个人踩坑吐槽比如写接口超时配置的段落后面加一句“这里我之前手滑把timeout写成tiemout排查了半小时才找到”。 第二把AI生成的规整列表随机抽1-2条从列表里拎出来变成普通段落不用统一的序号开头。 第三随机删掉AI文本里高频出现的“首先、其次、最后、综上所述”这类连接词换成更口语化的衔接。 改完之后的脚本核心片段大概长这样import random import jieba # 预存的开发者常用吐槽白名单 note_list [ 别问我怎么知道的, 这里我之前踩过坑, 亲测这么写没问题, 上次因为这个线上告警了, 排查了俩小时才定位到 ] # 核心专业术语白名单完全不触碰 core_white_list [Redis, MySQL, Raft, 分布式锁, 幂等性, HTTP, TCP] def add_human_note(text: str) - str: seg_list list(jieba.tokenize(text)) insert_pos random.sample(range(len(seg_list)), kint(len(seg_list)*0.1)) res [] last_pos 0 for pos in sorted(insert_pos): word_info seg_list[pos] # 只在非核心术语后面插入吐槽 if word_info[word] not in core_white_list: res.append(text[last_pos: word_info[end]]) res.append(f{random.choice(note_list)}) last_pos word_info[end] res.append(text[last_pos:]) return .join(res)跑了一轮之后我抽了几篇测困惑度基本都能拉到8以上连我自己写的小检测demo都很难判定是AI生成的。改写完之后我习惯性地丢到团象AI检测里跑一遍确认单篇最高的检测率在25%以下再导出来拿去组内合规初审。实测出来的冷细节大部分人用降AI率在线工具都用错了。 之前身边好多同事拿到改写后的文本喜欢一键全选全部粘贴进去做二次生成觉得改写得越彻底越好我测了几波样本发现这么干反而踩大坑。现在很多生成式大模型做二次改写出来的文本序列反而会形成新的“改写AI”专属特征检测率不仅不会降有的甚至比原文还高。 我前后测了快50份不同类型的技术文档摸出来个硬阈值只要你改完的文本里AI生成的连续无间断token序列长度不超过5个同时整体困惑度大于8几乎所有我接触过的主流检测系统都会把这份文本判定为人类生成的低风险内容。 还有个容易忽略的点别为了降AI率故意改核心专业术语的表述之前有个同事为了打乱序列把“MySQL的事务隔离级别”改成“MySQL的事务间隔级别”直接导致后面对接的测试同学理解错了文档内容线上出了个小bug扣了全组当天的奶茶钱。 我上周把调整完的脚本丢到组内的公共代码仓库到现在累计跑了27份项目文档过检率是100%。唯一的小问题是处理完的文本偶尔会有个别语句稍微有点不通顺最后人工扫一眼调整下语序就行单篇耗时不超过1分钟比逐字重写AI生成的几千字文档快太多了。

相关新闻

右值和移动

右值和移动

2026/8/10 18:57:26

值类别(value categories) lvalue 通常可以放在等号左边的表达式, 左值 例子 变量&#xff0c;函数或数据成员的名字返回左值引用的表达式&#xff0c;如x, x 1, cout << ’ . x 1 和 x返回的都是对x的int&. x则返回的是int字符串字面量如 “hello world” rva…

AI写作率检测踩坑:我改了3版文档反而把检测率越改越高

AI写作率检测踩坑:我改了3版文档反而把检测率越改越高

2026/8/10 18:57:26

上周赶省级技术专项的申报材料&#xff0c;熬了三个大夜交上去&#xff0c;隔天就被行政打回&#xff0c;说提交端口的AI写作率检测直接触发了红色预警&#xff0c;要求3天内提交原创说明加修改后的版本。当时整个人都傻了&#xff0c;7000多字的材料我只是用GPT搭了个三级框架…

云南财经大学的校园网深澜认证协议

云南财经大学的校园网深澜认证协议

2026/8/10 18:57:26

简单介绍了云财关于校园网的加密 免责声明 本文旨在分析校园网认证协议的技术原理&#xff0c;供教育交流与网络优化参考&#xff0c;严禁用于商业用途或任何违反《网络安全法》《著作权法》及学校规定的行为。文中部分描述可能与原有系统关联&#xff0c;相关权利归属开发者所…

tf_efficientnet_b2.ns_jft_in1k:如何用9.1M参数实现高效图像分类?新手入门指南

tf_efficientnet_b2.ns_jft_in1k:如何用9.1M参数实现高效图像分类?新手入门指南

2026/8/10 20:07:31

tf_efficientnet_b2.ns_jft_in1k&#xff1a;如何用9.1M参数实现高效图像分类&#xff1f;新手入门指南 【免费下载链接】tf_efficientnet_b2.ns_jft_in1k 项目地址: https://ai.gitcode.com/hf_mirrors/timm/tf_efficientnet_b2.ns_jft_in1k tf_efficientnet_b2.ns_jf…

69万亿Token在跨境流动:你的AI账单,已经算不清了

69万亿Token在跨境流动:你的AI账单,已经算不清了

2026/8/10 20:07:31

上周&#xff0c;全球AI模型通过OpenRouter产生了69万亿Token的调用量。其中中国模型占34.25万亿&#xff0c;美国模型占9.17万亿。 这是一个宏观数字。但如果你把镜头拉近&#xff0c;拉近到一家正在使用AI的企业——可能就是你的企业——会发现这69万亿里&#xff0c;有相当…

【AI大模型应用开发】【项目实战】Agent智扫引擎项目知识整体知识总结以及为什么要使用各个方案进行项目开发与设计

【AI大模型应用开发】【项目实战】Agent智扫引擎项目知识整体知识总结以及为什么要使用各个方案进行项目开发与设计

2026/8/10 20:07:31

一. 架构决策&#xff1a;为什么用 Agent&#xff0c;而不是传统流程&#xff1f;意图的复杂性与动态性&#xff1a; 传统客服机器人基于意图识别&#xff08;Intent Classification&#xff09; 固定SOP流转,但在该项目场景中&#xff0c;用户的表达往往是多意图混合且带有上下…

革命性Deepfake质量评估工具:Deepfake-QualityAssess2.0-85M-ONNX完全指南

革命性Deepfake质量评估工具:Deepfake-QualityAssess2.0-85M-ONNX完全指南

2026/8/10 20:07:31

革命性Deepfake质量评估工具&#xff1a;Deepfake-QualityAssess2.0-85M-ONNX完全指南 【免费下载链接】Deepfake-QualityAssess2.0-85M-ONNX 项目地址: https://ai.gitcode.com/hf_mirrors/prithivMLmods/Deepfake-QualityAssess2.0-85M-ONNX Deepfake-QualityAssess2…

deit_base_distilled_patch16_224.fb_in1k模型详解:从配置文件到特征提取的完整工作流

deit_base_distilled_patch16_224.fb_in1k模型详解:从配置文件到特征提取的完整工作流

2026/8/10 20:07:31

deit_base_distilled_patch16_224.fb_in1k模型详解&#xff1a;从配置文件到特征提取的完整工作流 【免费下载链接】deit_base_distilled_patch16_224.fb_in1k 项目地址: https://ai.gitcode.com/hf_mirrors/timm/deit_base_distilled_patch16_224.fb_in1k deit_base_d…

Prometheus 监控体系深度部署:一次故障复盘能留下什么

Prometheus 监控体系深度部署:一次故障复盘能留下什么

2026/8/10 19:57:29

Prometheus 监控体系深度部署&#xff1a;一次故障复盘能留下什么 重大故障后的复盘常会遇到几个问题&#xff1a;告警延迟、仪表盘未反映异常&#xff0c;以及告警过多导致首个故障点难以识别。 复盘应沉淀为可执行的改进&#xff1a;更新 Prometheus 告警规则、保留完整证据链…

比较好的亚太EMBA,问了6位校友师资差别真的挺大

比较好的亚太EMBA,问了6位校友师资差别真的挺大

2026/8/10 5:58:32

比较好的亚太EMBA核心差异先看什么&#xff1f;对于希望兼顾工作与系统管理能力提升的亚太区高管而言&#xff0c;筛选匹配度高的EMBA项目时&#xff0c;师资配置是决定学习体验与实际收获的核心要素之一。我们结合3-4个公开信息透明、办学历史较长的亚太区主流EMBA项目特点&am…

备考3个月对比6份资料 海外游学的亚洲EMBA面试注意点

备考3个月对比6份资料 海外游学的亚洲EMBA面试注意点

2026/8/10 7:54:12

备考海外游学的亚洲EMBA面试&#xff0c;核心要围绕项目国际化设计逻辑、个人跨文化管理经验匹配度两个维度准备&#xff0c;避免把游学模块等同于普通旅游参访的认知偏差。不少备考者花3个月对比6份资料&#xff0c;却容易忽略面试官对“国际视野落地能力”的考察——比如香港…

比较好的国内EMBA,问了二十位校友聊透人脉价值

比较好的国内EMBA,问了二十位校友聊透人脉价值

2026/8/10 7:19:21

比较好的国内EMBA核心差异体现在哪些方面&#xff1f;比较好的国内EMBA的核心长期价值&#xff0c;很大程度上依托于校友网络的连接质量与资源生态的活跃度&#xff0c;这也是不少高管在择校时优先考量的因素。我们结合3-4个市场关注度较高的项目公开信息&#xff0c;从课程、师…

Prometheus 监控体系深度部署:选型别只看功能清单

Prometheus 监控体系深度部署:选型别只看功能清单

2026/8/10 0:06:33

Prometheus 监控体系深度部署&#xff1a;选型别只看功能清单 选型场景&#xff1a;小规模集群直接部署 Thanos 的代价 如果为解决 15 天本地存储限制&#xff0c;直接部署 Thanos Sidecar、Store Gateway、Querier、Compactor、Ruler、Bucket Web 并接入 S3&#xff0c;就需…

ELK 日志分析平台与全链路追踪:代码评审该盯住哪些细节

ELK 日志分析平台与全链路追踪:代码评审该盯住哪些细节

2026/8/10 0:06:33

ELK 日志分析平台与全链路追踪&#xff1a;代码评审该盯住哪些细节 场景示例&#xff1a;一条 2MB 日志影响 Elasticsearch 写入 一个上传接口若执行 log.Info("Request dumped: ", r.Body)&#xff0c;会将 2MB 的二进制 Body 写入日志。高并发下&#xff0c;这类超…

从零到一构建开源项目的完整历程:代码评审该盯住哪些细节

从零到一构建开源项目的完整历程:代码评审该盯住哪些细节

2026/8/10 0:06:33

从零到一构建开源项目的完整历程&#xff1a;代码评审该盯住哪些细节 项目进入稳定版本后&#xff0c;外部 Pull Request&#xff08;PR&#xff09;会带来新的协作成本。大范围改动混入风格重构&#xff0c;或修复局部问题时修改公共函数签名&#xff0c;都可能扩大评审和兼容…

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

2026/8/8 5:07:31

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具&#xff0c;覆盖选题构思、文献整理、内容生成、格式排版等核心场景&#xff0c;真正帮你高效搞定论文难题。 一、全流程王者&#xff1a;一站式搞定论文全链路&#xff08;一天定稿首…

导师推荐!2026最新AI论文工具测评与实用推荐

导师推荐!2026最新AI论文工具测评与实用推荐

2026/8/9 13:42:46

2026年真正好用的AI论文工具&#xff0c;核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测&#xff0c;千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队&#xff0c;覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

告别游戏崩溃:XCOM 2模组管理器的智能革命

告别游戏崩溃:XCOM 2模组管理器的智能革命

2026/8/8 2:30:15

告别游戏崩溃&#xff1a;XCOM 2模组管理器的智能革命 【免费下载链接】xcom2-launcher The Alternative Mod Launcher (AML) is a replacement for the default game launchers from XCOM 2 and XCOM Chimera Squad. 项目地址: https://gitcode.com/gh_mirrors/xc/xcom2-lau…