#DeepSeek Harness 公测实践:一句指令,AI 从查论文到交付交互式网站全流程闭环

开头:先抛一个反常识的问题
一根 1 米长的针,能不能在面积几乎等于 0 的场地里转完 180°?
1917 年,日本数学家挂谷宗一提出这个问题时,全世界的数学家都觉得"不可能"——直到 1928 年 Besicovitch 证明:可以,而且面积可以任意小。更离谱的是,这样的场地还能包含每一个方向的单位线段。
这还不是高潮。这个叫"挂谷猜想"的问题,在三维空间中悬而未决了近一个世纪,直到 2025 年 2 月,华人数学家王虹与合作者 Joshua Zahl 宣告证明;2026 年 7 月,王虹因此捧回数学界的"诺贝尔奖"——菲尔兹奖,成为史上第三位获此殊荣的女性。
这段历史本身就足够精彩。但我今天想讲的,不是数学,而是我如何用一句话,让 AI 把这段历史变成了一座可以玩的网站——查资料、写代码、自测、截图检查,全部由 AI 独立完成。这是一次 DeepSeek Harness(公测版)的真实实践记录。
01|任务:一句话,当"三人团队"用
我给 AI 的任务只有一句:
帮我生成一个交互式动画讲解知识的网站,讲解的知识点是最新数学研究成果。先联网搜索技术细节,确保讲解内容准确,做完后自己验证效果。
注意最后四个字:自己验证效果。这是整个任务的灵魂——它把任务从"写个网页"升级成了"交付一个能用的产品",逼着 AI 走完调研、实现、测试、返工的完整闭环,就像同时雇了研究员、工程师和 QA。
02|联网查证:AI 的"交叉验证"
AI 先做了三组平行搜索(这是智能体惯用的打法,多路并行再汇总):
- "2025 latest mathematical breakthroughs"
- "Kakeya conjecture R3 proof Wang Zahl"
- "Fields Medals 2026 winners"
候选主题很快收敛到两个:几何朗兰兹纲领(数学界"大统一理论",2024 年被 Gaitsgory 团队证明)和三维挂谷猜想(Wang–Zahl,2025)。挂谷猜想显然更适合可视化——旋转的针、会重叠的薄片、能数盒子的维数实验,全是天然的动画素材。选题就此敲定。
但真正体现"严谨"的是这些核查细节:
- 核实论文编号:arXiv:2502.17655《Volume estimates for unions of convex sets, and the Kakeya set conjecture in three dimensions》,约 127 页,2025 年 2 月 25 日上传;
- 核实后续进展:2026 年 1 月,Larry Guth 与王虹又发表了简化证明(arXiv:2601.14411);
- 核实人物背景:王虹博士毕业于 UCLA(导师:陶哲轩),现为纽约大学库朗研究所教授;合作者 Joshua Zahl 现为南开大学讲席教授;
- 甄别噪音:搜索中混入一篇自称"证明 Hodge 猜想"的帖子,一看就是民科,AI 直接排除——这一点很关键,说明它不是"抓到什么信什么";
- 最惊险的一次纠错:初版内容写了"ICM 2026 在北京举行",但多源交叉验证后 AI 发现:2026 年国际数学家大会实际在美国费城举行(菲尔兹奖正是在费城颁发)。如果不是坚持多源核对,这篇文章会带着一个公开错误上线。
给读者的提示:让 AI 查资料时,一定要在指令里写明"多源交叉验证、标注不确定内容"。AI 会"自信地犯错",验证机制才是质量的底线。
03|选题为什么是挂谷猜想
- 故事性强:一根针、100 年、两位数学家、一座奖杯;
- 认知反差大:面积可以是 0,却"包含所有方向"——天然适合做爆点标题;
- 可视化完美适配:旋转动画、递归构造、维数滑块、细管堆叠,四类演示都有现成的交互范式。
04|网站实现:零依赖的"纯手工"工程
AI 最终交付的是一个零外部依赖的静态站点(HTML + CSS + 原生 JS,不引任何 CDN,双击就能打开):
- 9 个章节:Hero 封面 → 问题起源 → Besicovitch 反直觉构造 → 豪斯多夫维数 → 百年时间线 → 王虹×扎尔证明思路 → 为什么重要 → 仍未解之谜 → 参考资料;
- 5 个 Canvas 交互动画:
- Hero 旋转针背景(自动往复旋转 + 星点光晕);
- 旋转针问题:圆盘(面积 π/4)、Pál 正三角形(1/√3 ≈ 0.577)、挂谷式(面积趋近 0)三种场地实时切换;
- Besicovitch 薄片平移构造:滑块控制构造深度,总面积指数衰减 → 0;
- 盒子计数维数实验:Cantor 尘(维数 ≈ 0.63)、线段(1)、平面(2)、谢尔宾斯基地毯(≈1.89),δ 越切越细,实时估算维数;
- 细管堆"聚集 vs 分散":呼应证明中的二分法,并显示并集体积(示意);
- 工程细节:深色学术主题、
←→键切换章节、右侧章节圆点、全站自动播放、prefers-reduced-motion无障碍支持、手机响应式布局、截图验证模式(?shot=章节id)。
全部文案为中文,科普级准确,每个演示都标注了"示意",避免误导读者。
05|自己验证:AI 怎么"检查作业"
这是我最想展开的部分——AI 的验证不是嘴上说说,而是真实的四道关卡:
- 语法关卡:
node --check逐一检查三个 JS 文件,零报错; - 服务关卡:起本地服务器,逐一请求 index.html / css / js,全部 200;
- 浏览器关卡:用无头 Chrome 打开页面。这里踩到了公测期最真实的坑——沙箱权限:Chrome 的多进程架构依赖命名管道,默认沙箱直接拒绝(日志里满是 "Unable to create pipe"),AI 必须发起权限提升申请、经用户批准后才能继续。这个"申请-授权"机制本身就是 Harness 的亮点:工具不会无限放权,越界操作要过用户这一关;
- 协议关卡:AI 改走 Chrome DevTools Protocol(CDP):启动浏览器 → 连接 WebSocket → 监听 console 错误与 JS 异常 → 逐章节导航截图 → 模拟点击(切换 Pál 三角模式、切换"聚集/分散"、展开意义卡片)→ 断言界面状态变化。
最终结果:console 零错误、交互状态切换全部生效、9 个章节 + 整页截图全部产出。(诚实备注:验证中途被任务切换打断,部分截图未来得及人工复核,但程序化检查全部通过。)
06|收获与思考
- AI 已经能闭环"轻度全栈"任务:调研 → 选题 → 实现 → 自测,一条龙。对个人开发者来说,这意味着"点子 → 可体验的 Demo"的成本降到了原来的一成以下;
- 可验证的目标 = 质量的杠杆:同一句指令,加了"自己验证效果",产出质量完全不同。把验收标准写进任务,是驾驭 AI 最重要的一条心法;
- AI 的自信与人类的把关:北京/费城的纠错说明,交叉验证机制不可或缺;发布前请务必人工复核事实性内容;
- DeepSeek Harness 的差异化体验:联网搜索、后台任务、子代理、目标工具(Goal)、沙箱权限模型、可续会话——它不是一个"聊天框",而是一个可以托管长任务的工作台。
07|彩蛋:成品长什么样
站点一句话介绍:《挂谷猜想 · 一根针的百年传奇》——从 1917 年的旋转针,到 2025 年的世纪证明,再到 2026 年的菲尔兹奖。
- 本地运行:
node serve.js,打开http://127.0.0.1:8123; - 代码结构:
index.html/css/style.css/js/main.js/js/demos.js(全部零依赖); - 全程只改了 6 个文件:2 个 HTML/CSS、2 个 JS 交互脚本、1 个本地服务器、1 个验证脚本 + 1 份 README。
08 | 代码截图

09|运行结果:



如果你也想让 AI 当你的"三人团队"——关注我,后台回复「harness」,获取这次公测的完整站点源码与验证脚本;下期拆解"如何给 AI 写验收标准",让每一个任务都可验证、可交付。
觉得有用,点个 在看,转发给那个"总说自己不会编程"的朋友——他可能只是还没遇到 DeepSeek Harness。
本文为 DeepSeek Harness 公测实践记录,站点内容基于 arXiv 论文与权威媒体报道整理,科普示意部分以论文原文为准。
