一边造AI一边清垃圾,硅谷开始为失控内容买单

凤凰网科技讯 北京时间8月18日,据《纽约时报》报道,劣质AI垃圾内容已经泛滥成灾:谷歌搜索里到处是“胶水披萨”食谱,亚马逊商品页充斥着虚假传记,脸书信息流里满是“虾仁耶稣”的图片。

随着聊天机器人和视频生成工具不断发展,这个“数字污水堆”已经蔓延至各大科技平台,不仅降低了有价值内容的质量,也污染了整个信息生态系统。

无法忍受了

如今,硅谷开始清理这些垃圾了。音乐流媒体平台Spotify表示,去年其删除了7500万条批量上传内容、重复歌曲以及其他“垃圾式”曲目,这一数量占其全部音乐库的相当大一部分。领英在7月表示,“AI垃圾内容是我们所有人的首要关注重点”,并开发了一个供用户举报此类内容的按钮。YouTube母公司谷歌的研究人员描述了该视频服务如何在六个月内清除了13万个低质量频道。

在整个互联网上,科技公司正在进行一场“生成式垃圾内容大扫除”。许多公司如今不堪重负,因为这些垃圾内容正是由它们自己的AI工具催生出来的。移动即时通讯应用、餐厅点评网站、学术档案库和婚恋服务平台都在清除或淡化AI生成的垃圾内容,其中许多依靠同一项技术来完成这次清理。

人们逐渐厌倦了AI对环境造成的影响,以及它对就业和心理健康带来的压力。内容创作者、卡内基国际和平基金会在线趋势研究员艾丹·沃克(Aidan Walker)表示,AI垃圾内容只是另一个“正在溃烂的伤口”。该基金会是一家研究全球事务的智库。

“用户对此已经越来越不满,”他表示,“舆论风向已经明显发生了变化,所以这些公司终于开始正视这些问题了。”

生成式AI如今可以制作越来越逼真的图像、音频和视频,但其中只有一部分可以被称为“垃圾内容”。

科技公司主要针对的是那些低质量的“标题党”内容,这类内容制作成本低、传播容易、消费速度快、很快被遗忘。它们就像是挤压高级定制服装市场的快时尚,又像是取代优质牛排的“粉红肉泥”。

欧洲研究人员去年写道,如果放任不管,这种网络上的合成内容沼泽可能“挤压人类创造力,腐蚀文化价值,破坏公共话语”。

AI垃圾内容(slop)已经泛滥到如此程度,以至于词典出版商梅里亚姆-韦伯斯特将其选为2025年的年度词汇。法国流媒体服务Deezer今年春天表示,每天更新到其系统的曲目中,近一半是人工生成的,其中许多从未被用户听过。AI生成的内容占Apple Music上传量的三分之一以上。

Instagram负责人亚当·莫塞里(Adam Mosseri)去年年底表示,追踪“真实媒体”很快将“比追踪虚假媒体更加实际”。在他发表这一观点前不久,Instagram的母公司Meta推出了一款完全由AI生成的视频信息流,结果被许多人嘲讽为垃圾内容的展示台。

先生成垃圾内容

如今,许多正在努力治理AI垃圾内容的科技公司,也正是那些一手制造了它的公司。今年7月,Meta承诺支持一项欧洲公约,通过检测、标记和标签等方式使AI生成的内容更易于识别。同月,该公司还发布了一款图像生成器,该工具自动将公开的Instagram账户纳入作为参考数据源。在遭遇用户连续三天的强烈反对后,Meta移除了这一功能。

“AI垃圾内容是一把双刃剑,因为很多平台确实因此获得了用户参与度的提升,”俄亥俄大学AI专家保罗·肖夫林(Paul Shovlin)表示,“但后来,它逐渐变成了一种负担,因为平台上充斥着太多‘漂浮物和废弃物’,用户现在很难找到自己真正想要的高质量内容。”

例如,谷歌已经全面拥抱AI,将其Gemini模型接入电子邮件、地图、旅行服务以及搜索业务。根据去年由AI驱动的在线视频编辑平台Kapwing进行的一项实验,YouTube向新用户推荐的最初短视频中,超过20%是AI生成的垃圾内容。

Kapwing估计,YouTube上一个最受欢迎的AI垃圾内容频道,年收入高达425万美元。该频道此后已被暂停参与YouTube的创收计划。YouTube CEO尼尔·莫汉(Neal Mohan)在一篇博文中写道,“管理AI垃圾内容”是今年的首要任务。

最近,谷歌研究人员也开始研究这一挑战。他们没有逐个评估视频,而是分析上传速度、重复性模板以及其他可能表明协同行为滥用的模式。研究人员发现了5万个账户集群,并将其移除。不过,一些数字媒体专家担心,这种方法可能会过度干预,同时误伤那些大量发布内容的合法创作者。

YouTube在一份声明中表示:“虽然学术研究有助于推动行业对这一问题的理解,但它并不能反映我们为执行平台政策而采取的多层次防护措施。其中包括强大的保护机制,以确保使用AI工具、且出于正当目的创作内容的创作者不会受到影响。”

其他公司也在尝试各种策略来应对AI垃圾内容,包括动员自家用户帮助识别。去年10月,社交平台Pinterest更新了系统,允许用户限制他们看到的AI生成帖子的数量。TikTok表示,它正在美国测试一项功能,让人们可以调节可见的AI内容数量。该公司还表示,它已自动标记了超过30亿条AI生成的视频。今年前3个月,TikTok因违反其AI政策删除了超过37.7万条视频。

根据AI检测创业公司Pangram的数据,在埃隆·马斯克(Elon Musk)旗下社交媒体平台X上,近一半超过50个字的帖子是由AI生成的。本月刚卸任X产品主管的尼基塔·比尔(Nikita Bier)写道,为了应对“海量的AI垃圾内容和回复垃圾信息”,该社交媒体平台今年封禁了那些通过付费鼓励机器人发布内容的应用程序。

“美版公众号”Substack CEO克里斯·贝斯特(Chris Best)上个月写道:“现在越来越难判断互联网上什么是真实的了。奖励虚假内容的平台将导致一场向低质量方向发展的竞争。”这家通讯平台随后宣布推出自己的AI检测工具,该工具由Pangram提供技术支持,旨在扫描回复、评论以及超过100个单词的帖子,并判断这些内容更可能是手写,还是借助AI生成。

不过,一些新闻通讯作者抱怨称,该工具将人类撰写的帖子误判为AI生成,没有考虑AI在创作过程中可能扮演的辅助角色,并且给作者带来了不必要的压力,迫使他们为一个不透明的指标自证清白。

今年春天,研究有害数字技术的哥伦比亚大学研究人员卡米尔·弗朗索瓦(Camille François)与近二十多位AI专家在加州门洛帕克举办了一场“垃圾内容沙龙”活动,讨论了识别和分类AI垃圾内容的困难,以及由此带来的治理挑战。

“这些杂乱无章的应对策略表明,我们面对的是信息环境中的系统性问题,而不仅仅是一类叫作AI垃圾的糟糕内容。我们不能简单地定义它,然后将其删除,”弗朗索瓦博士在接受采访时表示,“归根结底,AI是一种创造力工具,它具有多面性。那些处理不当的平台,将会看到用户流失,转向其他地方。”(作者/箫雨)

财经频道更多独家策划、专家专栏,免费查阅>>

责任编辑:栎树
AI智能分析该文,为您挖掘投资机会该AI功能处于试用阶段,内容仅供参考,请仔细甄别!
展开
精彩推荐
加载更多
全部评论
热榜
关闭 下载金融界app
金融界App
金融界微博
金融界公众号