cxuan-ai-labs

AI 生成与多媒体 ·

女娲 skill 们的一小步,伦理退步的一大步

张雪峰是一个真实存在的老师,有自己的职业、自己的观点、自己的人生判断框架。

进入动态阅读模式 ↗

我看到有人把张雪峰.skill 开源了。

这也太 TM 傻缺了吧。

张雪峰是一个真实存在的老师,有自己的职业、自己的观点、自己的人生判断框架。

他靠这些活,你把他蒸馏成一个 skill 放 GitHub 上开源,是几个意思?

万事万物一个 skill 就完事儿了?

不是没这么蹭热点的好吧。

别提什么缅怀,这就是蹭热点的事儿。

蹭热点没什么,我也蹭,但是逝者为大,这也太不尊重人了。

换句话说:你在网上说过的话、写过的文章、录过的视频——在你不知情、不同意、不参与的情况下——被人喂给了一个 AI 模型,然后这个 AI 模型学会了「像你一样思考问题」。

接着把这个「蒸馏」出来的东西封装成一个 skill 文件,扔到 GitHub 上开源。

任何人下载下来,配置一下,就能拥有一个「张雪峰大脑」替你做决策。

张雪峰人本人知道吗?同意了吗?

更离谱的是,有人觉得这是「技术进步」。

我不反对 AI 能帮人学习、帮人进步。我反对的是:用真实的人做这件事,从来没有问过人家愿不愿意。

你有本事自己训练一个 AI 职业生涯顾问,没问题。你去扒张雪峰的公开内容,训练出一个「AI 张雪峰」,还开源放出去让人觉得你在做善事——这不叫技术普惠,这叫白嫖人家还立牌坊。

张雪峰的职业是给普通家庭的孩子做高考志愿填报、做职业规划建议。

这个工作不是纯知识输出,它需要大量的一线经验、对行业变化的实时判断、对不同家庭背景的共情理解。这些东西,哪一条是可以用「蒸馏」两个字概括的?

你把他的公开言论喂给模型,模型能学到的是他说话的风格、他的某些判断框架。但他的局限呢?他的盲区呢?他知识边界以外的东西呢?

一个不完整的张雪峰,被包装成一个随时可调用的 skill,然后被用来做真实的职业规划建议——这个风险谁来担?

是那个下载 skill 的人担,还是开源这个 skill 的人担,还是张雪峰本人担?

没人会觉得自己需要担。但问题是,这个 skill 给你建议错了,你人生走弯了,没人赔你。

还有人把这件事的本质偷换概念,说「公开内容被用于训练 AI 是行业惯例,OpenAI 这么干、Google 这么干,为什么张雪峰不行」。

这是两回事。

OpenAI 训练模型,是把海量数据喂给一个通用模型,模型学会了语言能力,没有针对任何具体的人。张雪峰.skill 是什么?是专门蒸馏一个人的思维方式,针对性地复制,然后打包成产品让你用。

前者是通用语言学习,后者是精准角色扮演。

我不反对开源社区做创新工具。同事.skill 的底层技术本身我不反对。

我反对的是:把真实的人当成原材料,随取随用,还觉得是在推动技术进步。

开源的边界在哪里?至少应该在这里:你可以用开源工具,但你不能开源别人的大脑。

张雪峰不是一个 public domain 的数据集。他是一个活着的人,靠他的认知能力在工作、在赚钱、在对社会有贡献。

你把他的大脑蒸馏了、封装了、开源了——

他本人知道吗?对他有补偿吗?有人问过他吗?

三个字:都没有。

说到底,这是一个知情同意的问题。

AI 时代,数据是最值钱的燃料。而我们每个人的发言、思考、判断,都是数据。这些数据被大量收集、清洗、训练,最后反过来模拟我们自己——这个过程本身就充满了争议。

张雪峰不是第一个被蒸馏的人。在女娲.skill 之前,已经有人做了各种 skill。我猜现在 GitHub 上还有更多我没看到的。

问题是:这条路走到最后,会变成什么样?

任何人的思维都可以被蒸馏,任何人的判断都可以被批量复制,任何人的声音都可以被一个开源文件所替代——

那真实的个体价值,还剩下什么?

我不是要道德绑架整个开源社区。

我只是想问一句:在你准备蒸馏一个人的时候,花三秒钟想一下:这事如果反过来,你能接受吗?

如果不能,拉黑这个仓库,关掉这个标签页,去干点别的。

技术跑得再快,伦理总得有人在后面盯着。

不然最后跑出来的,不是 AI 时代,是蛮荒时代。