1作者: alissa_v超过 1 年前原帖
我注意到越来越多的创作者和平台悄悄在他们的页面上添加类似于 `<meta name="robots" content="noai">` 的标签——这有点像 robots.txt,但针对的是大型语言模型(LLMs)。对于不熟悉的人来说,robots.txt 是网站用来告诉搜索引擎哪些页面不应被抓取的标准文件。这些新的 “noai” 标签具有类似的目的,但针对的是 AI 训练模型,而不是搜索爬虫。 一些实施这些选择退出机制的平台示例: - Sketchfab 现在为创作者提供了在账户设置中阻止 AI 训练的选项。 - DeviantArt 作为其内容保护方法的一部分,率先推出了这些标签。 - ArtStation 添加了元标签并更新了其服务条款。 - Shutterstock 为那些其图像被用于 AI 训练的贡献者创建了补偿模型。 但事情变得令人担忧的是,越来越多的证据表明这些标签被视为可选建议,而不是严格的界限: - 各种创作者报告了这些标签被忽视的问题。例如,在 DeviantArt 上的一次讨论(https://www.deviantart.com/lumaris/journal/NoAI-meta-tag-is-NOT-honored-by-DA-941468316)记录了标签未被尊重的案例,并引用了 GitHub 上的对话,显示了实施问题。 - 在一个图像数据集工具的 GitHub 拉取请求中(https://github.com/rom1504/img2dataset/pull/218),开发者将尊重这些标签设为可选而非默认,评论者形容这就像是“把它削弱了,以便我们可以洗手不干,而不真正尊重任何人的意愿”。 - 实施这些标签的公司 Raptive Support 承认它们“尚未成为行业标准,我们无法保证任何或所有机器人会尊重它们”(https://help.raptive.com/hc/en-us/articles/13764527993755-NoAI-Meta-Tag-FAQs)。 - 向 HTML 标准机构提出的提案(https://github.com/whatwg/html/issues/9334)承认这些标签并不强制执行同意,且“合规可能不会发生,除非有强有力的监管”。 一些创作者变得非常愤世嫉俗,著名艺术家 David Revoy 宣布他们将放弃像 #NoAI 这样的标签,因为“损害已经造成”,而且他们“无法逐一从数据库中删除自己的艺术作品。”(https://www.davidrevoy.com/article977/artificial-inteligence-why-i-ll-not-hashtag-my-art-humanart-humanmade-or-noai) 这引发了几个实际问题: - 在没有强制机制的情况下,这真的能有效吗? - 从法律上讲,未来能否强制执行? - 有没有人成功使用这些标签来防止未经授权的训练? 除了技术实施之外,我认为这指向了一个关于创作者在 AI 时代同意的更广泛对话。这是更具象征意义的——表明人们希望在开放网络上有某种形式的“AI 同意”?还是可能演变成一个真正有约束力的标准? 我很好奇这里的朋友们是否在自己的网站或内容中添加了类似的东西。您是否实施了任何技术措施来检测您的内容是否被用于训练?对于那些从事 AI 工作的人:您对尊重这些选择退出信号有什么看法? 期待听到大家的想法。