Naver总部大楼。图片来源:Naver

Naver正同步收紧平台内容抓取和搜索API的外部使用范围,明确禁止将相关数据用于AI训练、生成式AI回答及转售牟利等用途。随着搜索与内容数据价值持续上升,Naver也在进一步强化对外部调用和使用边界的管理。

◆整治利用Cafe内容为外部网站引流

近期,部分外部网站被发现自动抓取Naver Cafe中的二手交易帖和信息类内容,并在自身服务中展示。

以相机交易类Cafe为例,用户发布买卖信息后,外部网站会抓取帖子标题和商品信息,整理成“相机二手交易汇总”等页面。用户点击后虽然仍会跳转至原Cafe帖子,但网站运营方无需自行沉淀用户和内容,也能借此获取搜索流量和访问量。

对此,Naver近日通过Cafe公告明确表示,未经成员和Cafe同意,不得批量抓取帖子和评论,也不得将相关内容搬运至外部网站使用。使用爬虫、机器人、脚本等方式自动抓取数据,以非官方方式获取数据,或绕过拦截措施的行为,均被列入禁止范围。

Naver还表示,不允许将抓取内容发布至外部服务,或经加工后再次提供给他人使用。对于已经使用Cafe数据的相关方,公司要求其立即停止采集并删除已获取数据;一旦确认存在侵权行为,将依法采取法律措施。

Naver解释称,此次公告并非直接针对AI训练。公司表示,自去年起已默认拦截针对用户生成内容的AI抓取,此次措施主要是为了应对近期确认的外部网站未经授权抓取案例。与此同时,Naver也将通过单独修订规则,限制官方搜索API所提供数据被外部AI使用的范围。

◆搜索API同步禁止用于AI训练和生成式AI回答

Naver开发者中心修订后的搜索API条款已于9月7日起生效。根据新规,搜索API仅可用于展示Naver搜索结果。

搜索API面向外部开发者开放,可将Naver在新闻、网页文档、博客、Cafe、知识iN等不同领域的搜索结果接入开发者自有网站或应用。

按照新条款,通过搜索API获取的数据不得输入AI模型,也不得用于模型训练、改进或评估;同时,不得将相关数据用于生成式AI回答或结果呈现。换言之,即便不直接训练AI模型,“每次接收用户提问时调用Naver搜索结果生成回答”的做法,同样被禁止。

新规还明确禁止将搜索数据提供或出售给第三方、在展示搜索结果的页面投放广告,以及借助搜索API另行获利。这意味着,除“展示搜索结果”这一基础用途外,相关数据不得再被用作其他服务或商业化资源。

与此同时,Naver也在调整搜索API的提供体系。公司已于今年7月暂停搜索API、搜索词趋势以及Shopping Insight API的新申请,并开始将相关服务迁移至Naver Cloud旗下的“Naver API Hub”。

其中,购物、图书、专业资料等搜索API不在迁移范围内,因此相关服务已经终止。自20日起,API Hub也将适用包含AI使用限制在内的修订条款。

◆搜索与内容数据成为AI竞争焦点

Naver于2006年开放搜索API,允许外部开发者将搜索结果接入自有服务。但随着生成式AI快速普及,搜索结果已不再只是信息展示工具,而是逐渐成为生成式AI回答和优化模型的重要资源。

Naver也将数据和内容视为自身AI竞争力的核心。公司最高数据与内容负责人(CDO)Kim Kwang-hyun曾在5月的一场媒体圆桌会上表示,AI平台竞争的重心正从模型性能转向数据质量和服务竞争力。

Naver的AI搜索服务“AI Tab”正是基于综合搜索、购物、地点、博客和Cafe等长期积累的数据来回答用户问题,并进一步衔接购买和预约场景。在此背景下,搜索与内容数据已经成为其自有AI服务的重要基础能力,这也被视为Naver收紧外部AI使用相关数据范围的重要原因之一。

不过,Naver并未全面停止对外提供搜索数据。公司仍保留“展示搜索结果”这一基本用途,但明确限制将相关数据用于AI训练或独立商业化业务。

有业内人士指出,随着生成式AI普及,搜索数据和用户内容正成为平台的核心资产,数据开放边界也在随之变化。在其看来,Naver并非停止提供数据,而是更倾向于直接管理外部机构将这些数据用于AI或其他盈利业务的具体范围。

关键词

#Naver #Naver Cafe #搜索API #开发者中心 #爬虫抓取 #AI训练限制 #生成式AI #API新规 #搜索结果展示
版权所有 © DigitalToday。未经授权禁止转载或传播。