他曾为人工智能抓取了他们所有的艺术作品,现在正合作开发工具帮助他们 - AI News
他曾为人工智能抓取了他们所有的艺术作品,现在正合作开发工具帮助他们

他曾为人工智能抓取了他们所有的艺术作品,现在正合作开发工具帮助他们

2026-08-28

新闻要点

2023年8月13日起,艺术家平台Cara遭三次大规模数据 scraping,首次scraper发布12 TB / 1200万作品存档后后悔,与平台合作开发保护工具。Cara有150万艺术家,旨在防止AI未经授权使用作品,但scraping难避免;平台发起GoFundMe筹12万美元法律费用,已超10万。

- Cara平台(150万艺术家)8月遭三次大规模scraping

- 首次scraper后悔并合作开发艺术家保护工具

- Hugging Face拒绝删除Cara作品相关URL链接

- 平台GoFundMe筹12万法律费用,已超10万

- 法律滞后致scraping常被视为技术合法

主要内容

自2023年初,摄影师张静娜与志愿者团队运营图片分享平台Cara,吸引约150万创作者入驻,旨在反对AI模型未经授权使用艺术家作品训练,并提供防护功能(如Glaze工具)。但平台无法完全防止数据爬取,8月13日起连续遭遇三次大规模数据刮取,引发伦理争议。

首次刮取中,用户发现有人将Cara全平台约1200万件公开作品(含全部公开图像)上传至Reddit子版块,爬取者称“项目成本不足10美元”。张静娜表示,因对方在Reddit炫耀并拉人加入,才通过用户提醒得知此事,引发AI论坛热议。她指出,法律滞后导致刮取常被辩解为“技术合法”,其正参与针对AI公司的两起集体诉讼。

意外的是,该爬取者后悔并同意与张静娜合作开发开源保护工具。但其他爬取者受其煽动继续攻击:第二次刮取850万条链接及元数据至Hugging Face,平台称“链接指向原作品”无法移除;第三次刮取12.3万张图片及个人信息至Academic Torrents。

目前,因数据安全担忧,部分用户已删除作品离开平台。张静娜发起12万美元法律费用众筹,已筹超10万,正寻求更多法律援助。她强调“法律未跟上数据保护需求”,平台将持续应对恶意爬取。