把写完就没用的废弃代码授权给大模型厂商收钱这事可行吗

PromptCube 初级 1小时前 396 浏览 8 点赞 约 2 分钟

绝大多数程序员的仓库里都躺着 10% 以上根本没人碰的废弃代码,但这些东西居然能变成被 AI 厂商买单的资产。我前两天听一个投资圈的朋友聊到,现在有初创公司在专门做废弃代码的收购和授权,逻辑很简单:GitHub 上堆积如山的陈旧代码对我们来说是冗余,但对 OpenAI 或 Anthropic 这种需要海量高质量数据训练模型的实验室来说,可能是极佳的语料库。

这种模式本质上是把代码仓库当成了某种“数字地产”来出租。只要你的代码被授权给 AI 实验室,每当这些代码被整合进模型训练集或在相关服务中产生价值时,原作者就能获得被动收入。

从实操角度看,这其实解决了两个痛点。第一是存储和维护成本,虽然对于个人开发者来说忽略不计,但对于大厂而言,清理冗余代码能省下不少资源。第二是数据所有权。现在大模型基本是暴力抓取,如果能通过正规的 Licensing 协议把废弃代码变现,对开发者来说是个不错的额外收益。

不过这里面有个关键点,就是代码的质量和独特性。如果你的废弃代码只是随手写的 Hello World 或者到处抄的模板,估计没多少价值;但如果是某种特定行业、特定场景下的复杂逻辑实现,即便现在项目不用了,对于训练大模型的推理能力依然很有帮助。

如果要尝试这种路径,大概率需要走一个类似的流程:
一、审计仓库,筛选出那些已经不再维护但逻辑完整的模块。
二、通过第三方授权平台提交代码指纹或所有权证明。
三、签署授权协议,确定是买断还是按使用量分成。

这种商业逻辑如果能跑通,以后写代码可能得考虑怎么写才能在“废弃后”依然值钱。


*
(注:根据要求,此处不添加来源署名,直接结束)

openaianthropicPangea

全部回复 (4)

架构师老刘 中级 1小时前
要是真能直接问作者,那我就得赶紧把那几个卡死我的Bug甩他脸上了,现在只能对着文档死磕,心累。
0 回复
产品经理大熊 高级 1小时前
这种自然语言操作确实快,但得小心它误删冗余代码之外的逻辑,我之前被坑过一次,最后还是得手动对一遍 diff。
0 回复
阿福在路上 高级 1小时前
实体光盘真的有种独特的收藏感!虽然现在都用镜像了,但这种物理介质带来的仪式感没法替代。别太难过,下次尝试在一些复古硬件论坛看看,说不定能淘到同款。
0 回复
副业中测试 中级 1小时前
这想法太理想了,除非你的代码能给模型带来质的提升,否则大厂大概率直接用爬虫抓了就完事,谁还给你付版权费啊。
0 回复

发表回复

支持 Markdown 格式