AI常把创作者认错:Open Creator Graph让授权变成机器可读

|作者: QUASA 编辑团队|2 分钟阅读| 1
AI常把创作者认错:Open Creator Graph让授权变成机器可读

据Startup Rise的报道,总部位于新加坡的Sparkonomy于2026年9月29日推出Open Creator Graph;报道援引公司自有研究称,67%的受测创作者未被所测任何AI系统准确描述,并引述联合创始人Vipasha Joshi的话:“They want a simple way to be found, and to say what’s off-limits.” 这个比例包括回答含有错误细节或缺少可核查信息的情况,不能当作AI把不同创作者认成同一人的比例。

创作者现在可以认领跨平台身份记录,分别声明AI使用其姓名、图像、肖像、声音、动作和签名的条件。Open Creator Graph官方说明列出Allowed、Conditional和Prohibited三种选择,并指出签名和时间戳能记录声明,却不能像技术锁一样阻止外部系统滥用。想限制声音克隆或肖像仿制的人,因此得到了一份可供机器读取、争议发生时可供核对的声明,而非能关闭所有AI使用的开关。

认领的是身份记录,不只是一个账号

据Customer Engagement Network的上线报道,平台初期有超过100万条可供搜索、认领或更新的创作者记录,发布格式包括网页、JSON-LD、XML、TDMRep和纯文本;已认领记录的授权凭证带有数字签名,并在公开日志中留下时间记录。这个规模指平台预先建立的记录,不代表同样多的人已经认领身份或作出许可选择。

认领依靠创作者控制的社交平台账号,报道列出的入口包括Instagram、YouTube、TikTok和X。创作者通过相应账号登录后,可以确认账号归属、修正资料、关联其他平台身份并设置使用条件;认领免费,也没有粉丝数门槛。平台先用公开信息建立的记录可能尚未经本人确认,因此“已有记录”和“身份已由创作者确认”是两个不同状态。

同一人可能在不同平台使用不同名称,不同人也可能使用相似账号名。记录将平台登录后确认的资料、取自公开资料的信息和创作者自行陈述的内容分开标示;账号归属获得确认,并不意味着个人简介中的每句话都经过独立核实。若平台把两个不同的人合进一条记录,后续许可也可能被套用到错误对象。纠正这种关联错误,是机器准确读取授权条件的前提。

四种许可状态怎样影响声音和肖像

许可按身份要素分别设置,而不是给整个人打上一个通用标签。创作者可以允许AI如实介绍其姓名,同时要求系统在生成模仿其声音的新内容前取得许可;姓名、照片和声音的条件也可以彼此不同。读取方需要查看各要素的具体声明,不能只凭记录页面上的概括状态判断全部权限。

  • Allowed:声明允许AI使用相应身份要素,包括如实呈现、训练,以及生成新的声音或数字形象。这只表达该要素的AI使用意愿,不自动授予创作者作品中其他人的权利,也不能替代其他用途所需的许可。
  • Conditional:允许如实呈现创作者已有的姓名、照片或声音;合成其未曾说过的话、制作换脸画面或训练可生成其身份表现的模型,则须先取得许可。分界在于呈现真实资料还是创造新的身份表现,而非处理过程中是否使用了AI工具。
  • Prohibited:声明不允许AI使用相应要素,包括在AI回答中呈现、用于训练或生成仿制内容。公开身份记录仍可被搜索到;搜索页面存在,不等于创作者同意AI按其他方式使用其身份。
  • Unknown:尚无有效的许可声明,不能把沉默解释为同意。尤其是未经认领的记录,不会代创作者发布一份授权文件;记录可供查找与本人已经表态,是两回事。

这些状态决定了机器读到声明后应如何处理具体要素。以声音为例,Conditional允许呈现真实录音,却要求合成新的语音表现先取得许可;Prohibited则连相应要素在AI回答中的呈现也排除。记录如果混合使用不同状态,页面显示的概括词可能遮住某个要素的禁止条件,逐项声明才是判断依据。

机器可读文件传递条件,日志留存声明

几种格式承担不同任务。网页让人直接阅读记录;JSON-LD帮助搜索与AI系统识别人物、账号及资料来源;XML许可文件承载针对身份要素的具体条件;纯文本方便读取,TDMRep则传达与文本和数据挖掘有关的保留信号。看到这些格式并列,不能推断每一种文件都完整表达了声音、肖像等要素的全部许可细节。系统若要判断能否生成某人的声音,仍须读取对应的具体声明。

数字签名、时间戳与公开日志解决的是事后核对问题:一项条件曾以什么内容公开、何时留下,以及其后是否发生改变。如果有人争论创作者是否已禁止声音合成,这类记录可以提供当时声明的证据。它们不能单凭自身证明某个模型实际读过许可文件、在何时抓取了内容,或其训练数据里是否包含某段声音;具体法律效力仍取决于适用规则和争议事实。

机器能够读取条件,执行还要靠读取机器的机构。外部抓取者需要取得最新记录、正确解析各要素的状态,并按条件处理资料;先前保存的副本不会因为创作者修改声明而自动消失。平台可以更新自己发布的记录,却无法凭一份公开文件删除其他系统已经收集的数据,也无法从技术上拦住故意忽视声明的仿制者。

误识别数字尚未证明记录能改善AI回答

那项创作者描述研究解释了平台为何把身份识别和许可放在同一份记录里:如果系统不能准确确认自己正在描述谁,正确的许可条件也可能失去对象。研究比较的是受测AI对受测账号给出的描述,并未测出“把甲认成乙”的发生率;样本结果也不能直接外推到所有创作者。它更没有检验外部模型在读取Open Creator Graph记录前后,识别准确度是否发生变化。

对创作者而言,眼下可见的改变是有了能认领、修改并留下时间证据的公开声明。记录能否影响声音或肖像的实际使用,取决于外部搜索和AI系统是否读取它、是否遵守许可,以及如何处理声明更新前取得的数据。下一步有说服力的证据,将是对这些系统读取记录后的识别表现与遵从情况进行独立观察。

相关阅读:

分享:

订阅我们的新闻通讯

将最新 Web3、AI 和加密货币新闻直接发送到您的邮箱。

0