欧盟明天开始要标 AI 内容,我查了一下管不管我

cover

哈喽,我是飞飞。

欧盟《人工智能法》的透明度要求,明天正式生效。

规则里有一条是这么说的:AI 生成的内容要能被认出来。

我这个号的每一篇文章都是一条 AI 流水线产出的,这件事我公开讲过好几次。所以看到这条新闻,我没急着评论,先去查了条文,看这规矩到底管不管我。

查完的结果有点出乎我意料,而且我得先纠正自己一个想当然的判断。

先说清楚,这篇不聊欧盟该不该这么立法,也不聊哪家公司该不该签。我只关心一件事:这条线到底划在哪儿,我站在线的哪一边。

我先去查了管不管我

条文里管这件事的是第 50 条,它分成好几款,管的对象不一样。

其中一款管的是「提供者」,也就是造模型的那些公司。它要求凡是生成合成音频、图像、视频或文本的 AI 系统,输出必须带上机器可读的标记,让人能检测出这是 AI 生成的。

另一款管的是「部署者」,也就是拿它干活的人,比如我。这一款对文本的要求要窄得多。只有已经发布出去、并且目的是就公共利益事项告知公众的 AI 生成文本,才需要加清晰可感知的标注。

音频、图像、视频没有这个限定,文本单独设了这道门槛。

生效日期是 8 月 2 日。提供者那条标记义务有个宽限期,能拖到 12 月 2 日。8 月 2 日之前生成的内容不用回头补标。

那个标记不是我的活

这是我要纠正自己的头一件事。

我看到「机器可识别标记」这个词的时候,下意识以为这是压到内容创作者头上的活。得我自己想办法在文章里嵌点什么。

不是。那是模型厂商的义务。

要在输出里嵌机器可读标记的,是 Anthropic、OpenAI、Google 这些造模型的。而且条文里还给了一堆现实的余地。技术上做得到多少算多少,要考虑不同内容类型的特性和限制、实现成本、当下公认的技术水平。

这几句话看着像官腔,其实是在说一件很具体的事:给文本打水印,技术上是几种内容里最难的那个。图片和视频里藏点东西不影响观感,纯文字要藏个机器读得到又不改变意思的标记,难得多。

官方页面里还有一句挺关键。部署者不能简单地依赖提供者嵌进去的那个机器可读标记来满足自己的义务。

也就是说这是两件事,各管各的。上游嵌暗记,下游贴明标。

我删的是人能看见的那种

另一件要纠正的更要紧,也是这篇我最想说的。

我那本写作规则库现在 129 条,两年攒的。里面最核心的一批是干什么的?删破折号、限制对仗句、禁三联否定、把「当前」换成「现在」。

这些规则的目标,是让稿子读起来不像机器写的。

可我今天才想明白,我删的全是人眼能看见的那种指纹。

破折号是指纹,对仗是指纹,三联否定是指纹。读者说不出哪里怪,但本能觉得这是机器写的,我删的就是这个。

而条文要求的机器可读标记,是完全另一类东西。它跟句式和用词都没关系,是嵌在别处的一道暗记。

我那 129 条规则,一条都拦不住它,也一条都不构成它。

这两件事甚至没有交集。我以为自己在做「让 AI 写的东西看不出是 AI 写的」,实际上我只处理了其中一半,而且是将来未必最重要的那一半。

想清楚这层之后,我对自己那本规则库的定位反而更准了。它是用来把稿子写得像人写的,跟躲检测没关系。这两个说法听着差不多,其实差很远。

豁免线划在署名上

那部署者那一款,到底管不管我?

条文给了例外。经过人工审阅或编辑控制的文本,不需要标注。

但它把这个例外收得很紧,还专门排除了一种情况:拼写检查、语法纠正这类标准的编辑协助,不算人工审阅。

真正算数的条件写在后面:负编辑责任的那个人,必须对这篇发布物承担最终的法律责任

我读到这儿停了一下。

这条线划得比我预想的清楚得多。它不问你改了几个字,不问 AI 写了百分之多少,不问你用没用工具。它只问一件事:出了事,谁的名字在上面。

三周前我写过同一条线

然后我想起一件事,去翻了自己七月十号那篇。

那篇讲的是微信平台三月加的「非真人自动化创作行为」规则。跟欧盟这条完全不是一回事,一个是平台规范,一个是欧盟立法。

可我当时写的原话是这样的:

我的流水线跑得再自动,也焊死了两道人工闸:开头选题我自己拍板,结尾全文我自己过一遍。

署我名的东西,责任外包不出去。

两个八竿子打不着的监管者,画的是同一条线。

我当时那么做跟合规没关系,纯粹是怕出错。这条流水线跑得再顺,最后那句话是我说出去的,错了也是我的错。

现在回头看,那两道闸恰好就是欧盟写的豁免条件。选题拍板是编辑控制,全文过一遍是人工审阅,署名是承担最终法律责任。

这条线划的不在你改了多少字,在出了事谁的名字在上面。

那个七百五十万是错的

再纠正一个流传的数字,这条跟我自己没关系,但读到的人可能被误导。

好几个中文报道写「违反透明度义务最高可处 750 万欧元」。

我去核了罚则那一条,它分三档。违反禁止性条款是 3500 万欧元或全球营业额 7%。违反包括第 50 条透明度义务在内的一批义务,是 1500 万欧元或 3%。向主管机关提供不实、不完整或误导性信息,才是 750 万欧元或 1%。

750 万是最轻的那一档,对应的是「跟监管机构说假话」,不是「没标 AI 内容」。

数字翻了一倍,而且性质完全不一样。中小企业还有按比例从轻的余地。

顺带说一句适用范围。就算提供者不在欧盟,只要它那个系统的输出在欧盟被使用,也受约束。这条比我以为的宽。

你那篇文章谁签的字

诚实边界得摆在这儿。

我这个号在中国,读者主要也在国内,欧盟这条法规不直接约束我。这篇不是合规指南,我读的是官方问答和指南页面,没逐字啃过法条原文。「输出在欧盟被使用」这句话对一个个人博客到底怎么算,我没核到明确答案。

但这条规矩给了我一把尺子。我拿它量了自己一遍,量出两个原来没想清楚的东西:机器可读标记压根不归我管,我那本规则库处理的是另一类指纹。

如果你也用 AI 写东西发出去,今天可以做一件事:问自己一句,这篇要是出了事实错误、被人找上门,谁去回话。

答案是你,那你就该有一道自己过手的关口。跟合规没关系,是因为回话的是你。

答案不是你,那不管有没有法规要求,这事都值得再想想。

我自己那两道关口会继续焊在那儿。这三周里它从「我怕出错」变成了「顺便也踩在豁免线里」,位置一步没动。

最后想问问你:你发出去的那些 AI 参与写的东西,最后过手的那道关口设在哪儿?还是说压根就没设?评论区聊聊,我挺想知道大家把它焊在了什么位置。