品牌团队通常以较慢的方式发现假货:一位客户投诉了一件并非从你这里购买的产品,随后展开调查。而此时,该商品已经销售了几个月。之所以未被察觉,很少是因为没人搜索过,而是因为搜索只是从一个国家、用一种语言、在少数几个平台上进行的,而假货listing却存在于别处。
假货检测首先是一个覆盖面问题,而不是匹配问题。以下是如何建立覆盖面,以及如何将你发现的内容转化为平台会采取行动处理的东西。
为什么假货在总部看不见
有三个机制导致listing隐而不见。
平台的搜索结果是本地化的。 一个搜索词出现的结果取决于你所在的商店入口,也常常取决于系统推断出的你在其中的位置。一个在某个国家搜索结果中占据主导的listing,在另一个国家可能根本不会出现,因此从你办公室发出的搜索只能衡量一个市场,对其他市场毫无参考价值。
卖家会限制发货或展示的范围。 为某一地区配置的listing在其他地方可能实际上是不可见的,这对于想要让销售行为与品牌的本土市场保持距离的假货卖家来说非常方便。
语言使搜索碎片化。 假货listing是为当地买家用当地语言撰写的,通常故意拼错你的品牌名,型号也会以不同方式呈现。用英语搜索确切的品牌名,只能找到那些诚实的listing,而错过那些本就设计成不被发现的listing。
其结果是,覆盖面必须在多个市场和多种语言上有意识地建立,而不能想当然地假设已经存在。
先建立覆盖矩阵
在编写任何检测逻辑之前,先确定你要搜索什么内容以及在哪里搜索。这个矩阵有四个维度。
平台,包括主要的全球性平台,加上在你所在品类中重要的地区性平台,以及这类活动日益增多的社交电商场景。
市场,指你关心的国家商店入口,应包括你销售商品的地方,以及你产品的假货通常起源或转运的地方。
搜索词,这是大多数项目做得过于狭窄的地方。要包含你的品牌和产品名称、常见拼写错误和音译、型号和SKU编号,以及不知道你品牌名的买家会使用的描述性短语。要为每个市场添加本地语言变体,而不是机械翻译,因为卖家使用的措辞正是买家实际输入的措辞。
频率,按风险加权。新产品发布和高价值产品线应更频繁地扫查;长尾目录商品可以每月检查一次。
要明确说明该矩阵未覆盖的内容,因为在法律场景中,把抽样当作全面普查会造成虚假的信心。
像本地买家一样搜索
这部分需要基础设施,而不仅仅是流程。要看到某个市场的搜索结果,请求必须来自该市场,这意味着需要在你监控的每个国家使用住宅出口节点,并将语言和地区设置与之匹配。
数据中心连接在此处不够用的原因,与品牌保护监测中其他地方的原因相同:平台对来自主机托管IP段的流量处理方式不同,因此你很可能得到的是通用或降级的结果集,而不是本地购物者所看到的结果集。当平台的本地化精细到国家级别以下时,城市级定位也很重要,并且你呈现的语言、时区和地区设置应与出口国家保持一致,参见匹配地理位置、时区和地区设置。
实际操作上:每个市场配置一套扫查方案,将国家、语言和搜索词绑定在一起,使它们不会出现偏离。
区分假货与合法经销商的信号
并非每一个第三方listing都是假货,将它们等同对待会产生被忽视的报告。应该对listing打分,而不是简单地二元标记。
价格。 远低于你授权底价的价格是最强的单一信号,尽管大幅折扣本身也可能是灰色市场货源或清仓库存。
图片。 重复使用官方摄影图片很常见,包装、logo位置或所含配件上有细微差异的照片也很常见。将图片与你自己的素材库进行比对,在这方面能发挥很大作用。
listing文本。 机器翻译的描述、缺失或凭空捏造的型号、错误的规格,以及任何授权合作伙伴都不会使用的商标用法。
卖家资料。 近期创建的账户、涵盖互不相关的多个高端品牌的目录、与你的分销体系不符的所在地,以及listing的快速流转。
包装和变体说法。 你从未生产过的颜色、套装或版本是一个明确的破绽,也是审核人员最容易确认的事项。
将这些信息综合成一个分数,只将高置信度的发现转交人工审核。目标是让分析人员能够逐条处理的队列,而不是没人会去看的警报流。
在发现的那一刻捕获证据
平台上的listing会被编辑和删除,因此没有留档的发现只是一段记忆。每一个被标记的listing都应记录以下内容:完整页面截图、listing网址和平台商品标识符、卖家名称及资料、价格和货币、发货来源地及可发往的目的地、以文件形式而非链接形式保存的图片,以及包含检查所用市场的时间戳。
最后这一项看起来不起眼,但其实更为重要:如果之后涉及执法或诉讼,某个listing在特定日期对特定国家的买家可见这一事实,往往正是争议的关键点,而这一点只有在你记录了观察视角的情况下才能证明。
将原始捕获资料与得出的结论一并保存,并将保留期限设定为覆盖整个执法周期,同时不超过你的政策所允许的个人数据保留时长。
从检测到执法
检测只有在能够推动流程时才有价值。将发现结果分级路由:证据充分、明显是假货的直接转入平台下架流程;边界情况转入人工审核;涉及同一卖家在多个平台出现的模式则转交你的法务团队,因为对惯犯而言,值得进行协调一致的应对,而不是发出一系列单独的通知。
追踪结果而非数量。能证明该项目价值的数字是下架成功率、从listing出现到被移除所耗费的时间,以及惯犯的重复出现率,而不是你标记了多少listing。并将结果反馈回评分体系,因为成功被移除的listing类别能告诉你证据标准应该是什么样子。
相关的执法工作运行在同一套采集层之上:未授权卖家和MAP违规与商标滥用检测。
保持采集的干净
有几个操作要点,决定了这个项目能否持续运作。
要礼貌地控制节奏,将扫查分散在可用的时间窗口内,因为平台是防护较严的目标之一,激进的扫查会遭到限速,参见速率限制和请求节流。要验证返回的内容确实是真实的结果页面,而不是一个验证挑战或空结果集,因为某个市场出现的静默失败会被解读为该市场没有假货,而这正是此处最糟糕的假阴性,参见检测被屏蔽或虚假内容。此外要按市场监控覆盖情况,以便及时察觉某个国家不再返回结果。
只处理公开的listing数据,遵守每个平台的服务条款,不要在自动化监控中进行测试购买;购买样品是你的团队有意识采取的一项审慎的法律步骤,而不是爬虫该做的事。
结语
假货隐藏在地理和语言背后的程度,远超过隐藏在巧妙措辞背后的程度,因此检测应从跨平台、跨市场、以本地语言搜索词构建的覆盖矩阵开始,而不是从更好的匹配算法开始。要从每个市场内部去搜索该市场,因为本地化的结果从其他任何地方都无法看到。要根据价格、图片、文本、卖家资料和变体说法对listing打分,而不是简单地二元标记,这样分析人员才能得到一个可以处理的队列。要在发现的那一刻捕获完整证据,包括你搜索所用的市场,因为listing会消失,而观察视角往往是争议的事实焦点。然后将发现结果分级路由并配上执法路径,并衡量下架结果而非标记数量。
支撑这一切的市场覆盖,正是品牌保护监测所需要的,它运行在具备国家和城市定位能力的住宅代理之上,使每一次扫查都能看到本地买家所看到的内容,并按每GB计费,从而让扫查频率始终是一项项目决策。