大家都在吵「这算不算 AI 写的」,我倒想问

PromptCube 初级 1小时前 54 浏览 5 点赞 约 2 分钟

上周帮同事改份技术方案,他把 Cursor 生成的初稿扔给我,头一句就是「这段是 AI 写的,你帮我看看」。我拉开 diff 看了眼:架构是他定的,关键业务逻辑他改了三轮 prompt 才跑通,变量命名还是按团队规范手敲的。按GitHub Copilot 那套「建议代码占比」算法,这文件大概率会被标绿;但按学术圈那套「文本困惑度」查重,又全是人类特征。

一、连检测工具自己都在打架

拿同一段混合代码跑了三个主流检测器:GPTZero 说 85% 人类,Copyleaks 直接判定 AI 生成,Turnitin 给了个模糊的「疑似」。更离谱的是,我把自己两年前没碰过 LLM 时写的 Python 脚本扔进去,GPTZero 也给出 30% AI 概率。原因很简单——规范的代码风格、标准的设计模式、甚至 if __name__ == "__main__": 这种模板化写法,在概率模型眼里全是「低困惑度、高确定性」的典型 AI 特征。

二、工作流里根本没「纯人类」这档子事

现在正经写代码谁不带个 Copilot/Codeium/Cursor?Tab 补全一次算不算?Cmd+K 重构一块函数算不算?我把 prompt 细化到「用访问者模式重写这段逻辑,保持原有接口不变」,生成的代码我连个分号没动——这算我的还是模型的?再退一步,Stack Overflow 复制粘贴的年代,没人纠结「这算不算别人写的」,怎么到 LLM 这儿非要搞个血统证明?

三、水印方案治标不治本,还伤无辜

OpenAI 那套水印方案搁置至今,根本原因是 False Positive 率压不下来。对抗式改写(Quillbot、甚至让另一个 LLM 「用更口语化的风格重写」)五分钟就能洗掉水印;真正的受害者是不得不频繁调用 API 的正规开发者——生成的 JSON Schema、SQL DDL、Kubernetes Manifest 全是高确定性结构,水印强度强到离谱,反手就被自家检测器判定「AI 生成」,CI/CD 流水线里的自动化脚本全挂了。

四、与其纠结来源,不如验收结果

我们组现在的做法很简单:PR 描述里必须写清「核心逻辑由谁设计、关键边界条件如何测试、性能基线跑在多少」。Commit message 规范里加了 design-by:reviewed-by: 两个字段,至于行级别是不是 Tab 出来的,Code Review 时只看逻辑对不对、测试过没过。上线后出了 Bug,Git blame 定位到人,没人会追问「那行 for 循环到底是你敲的还是模型补的」。

定义「AI 写作」唯一的商业价值,大概就剩给版权律师和查重软件卖课的赚钱了。工程师的时间,花在把模型当动力工具用、把精力省下来攻克业务难点上,不香吗?

cursorGitHub Copilotcode reviewGPTZero水印

全部回复 (3)

数据分析师小美 初级 1小时前
上周用 GPTZero 测自己改过三遍的代码,直接判定 98% AI 生成,笑死
0 回复
老大鹏 专家 1小时前
我们代码审核只看逻辑和规范,从不查来源
0 回复
大Tom在路上 初级 1小时前
Cursor 的 diff 能不能直接标注哪行是 prompt 迭代出来的?
0 回复

发表回复

支持 Markdown 格式