搭了个毕设一键生成skill,顺手测了下AIGC检测的底裤
最近毕业季嘛,偶尔有一些学弟学妹来问我毕设的问题。同时刷到不少关于AIGC率的讨论,一些官方账号也在发相关内容。

我作为25届毕业生,当时通知说会做AIGC率检测,就特地把论文写得比较口语化,避免AIGC率太高。最终查出来百分之十几,很幸运地躲过了反复修改的折磨。
但我就突然好奇一个事儿——如果一篇论文,从头到尾一个字都不改,全让AI写,知网到底能查出来多少?
为了搞明白,我没去折腾什么降AI技巧,干脆自己搭了个“计算机毕设全流程生成”的Skill。输入课题名和大纲,剩下的代码、论文、配图全交给AI。然后我挑了6个国产大模型,各跑了一遍,生成完直接送去知网检测。
结果怎么说呢……挺讽刺的。
先说说我搭的那个“计算机毕设全流程生成”的skill是啥
说白了就是一个自动化流程,用户只需要告诉我两个东西:
- 课题叫啥(比如“基于啥啥啥的啥啥系统”)
- 论文大纲想展示哪些模块
剩下的我就全扔给AI了,包括:
- 完整的项目代码,能跑的那种
- Word格式的毕业论文,摘要、目录、正文、致谢全齐,图表公式都给你安排好
- 系统截图、流程图之类的配图,AI直接出图
重点来了——整个过程没经过任何人工润色。生成啥样就啥样,一字不改。
skill 已开源:https://github.com/the-qian/thesis-forge-skill

测试标准以及我挑了哪六个国产模型来“作案”
用 Claude Code 作为代码和论文的生成工具,大模型均使用官方 API 直接调用,不用任何 Coding Plan 以及第三方 API 平台。因为全部走官方 API,所以这次测评不包含 GPT 等国外模型——一是太麻烦,二是太贵了,钱包有限。
具体参与评测的国产模型:
DeepSeek-V4-Pro、glm-5.1、doubao-seed-2-0-pro-260215、kimi-k2.6、qwen3.7-max、mimo-v2.5-pro,基本覆盖了国内主流的模型。
提示词统一为:
▼text复制代码帮我完成毕业设计及论文 课题:《基于SpringBoot的人事管理系统的设计与实现》 论文:中文字数8000–10000字,完整8章结构(摘要、绪论、相关技术、需求分析、系统设计、系统实现、系统测试、总结与展望、致谢、参考文献10篇以上)

检测结果
| 模型 | AIGC率 |
|---|---|
| DeepSeek-V4-Pro | 24.6% |
| glm-5.1 | 20% |
| doubao-seed-2-0-pro-260215 | 34.5% |
| kimi-k2.6 | 13.2% |
| qwen3.7-max | 29.7% |
| mimo-v2.5-pro | 20.2% |
我的大学要求AIGC率不高于30%,目前来看这帮AI写的论文大部分都压线过了这个标准。也许是工科的论文天然比较抗AIGC检测?搞不太懂……
AIGC检测的原理
我在专利检索网站上查到了知网申请的两个AIGC检测相关专利:


大概包含三个方面的检测:
- 看行文习惯:AI写的文字句式、长短、用词都特别规整顺滑,很少有起伏;人写的会忽长忽短、用词更随性,偶尔还有口语化、思维跳跃的痕迹。
- 算文字“陌生度”:AI产出的内容套路固定,机器很容易预判下一句话是什么;人写的想法多变,预判难度更高。
- 双重核对:先用简单特征快速筛出可疑内容,再用AI模型深度判断,最后还会把原文重新改写一遍来对比——AI文改写后变化很小,人写的内容改写后差别会更明显。
说了这么多,不是教大家怎么糊弄毕业,而是想说——AIGC检测这东西,真不能当成一个硬性标准来卡学生。比方说AIGC率超过某个阈值,完全可以结合答辩表现,看看这个学生是不是真的认真完成了毕设。
最后我要吐槽一下,知网的查重是真贵啊!

