Meta Business Agent 的目录训练和网站训练在底层究竟是怎么运作的、它到底从哪些数据来源取数,以及哪些设置失误会让它只能靠猜。
大多数 Meta Business Agent 设置指南都会让你”接入你的网站""关联你的目录”,然后就直接翻篇了,好像这两步都是不言自明的。它们其实不是同一类接入。一个是读取页面、并为页面上的内容建索引;另一个是读取一份由行和列构成的结构化数据源。搞清楚这个区别是有意义的,因为代理能答好目录问题却答不好政策问题、或者反过来,原因通常就在这里。
以下是你把 Meta Business Agent 指向自己的网站和产品目录时,实际会发生什么,以及在实践中它们各自最容易从哪里开始崩掉。
Meta Business Agent 会调用五类彼此独立的输入:过往对话、一个网站 URL、一份产品目录、你直接填写的企业信息和常见问题解答,以及你上传的文件。常见问题和品牌语气这一侧,我们已经在完整设置指南以及如何训练 Meta Business Agent 匹配你的品牌语气的拆解中讲过。这篇文章要谈的,是另外两个运作方式和”人工填写一条常见问题答案”完全不同的来源:网站和目录。
你给代理一个 URL,Meta 会抓取并索引这个地址下的页面,从中提取出之后可以用来作答的产品和服务细节。这和”代理实时读取你的网站”是一个有实质意义的区别。它并不是在客户每次提问时重新打开页面,而是基于对你指定的页面抓取后建立的索引来工作,背后大体上就是搜索引擎的那套机制,而不是对你 CMS 的一次实时查询。
由此可以推出两件事。
第一,你链接的页面上任何可以被公开访问到的内容,都有可能出现在给客户的回答里。如果你的站点上有一个测试页面、一份还挂在某个被遗忘 URL 上的旧价目表,或者一个本来只给内部看、却始终没加 noindex 标签的页面,把代理指向你的域名就可能把它们翻出来。请直接链接你真正希望客户读到的页面,而不是只给一个首页,然后指望抓取程序不会走出你设想的路径。
第二,因为它是一个索引而不是一条实时连接,你今天对网站做的改动,并不保证代理今天的回答就会反映出来。如果你更新了退货政策或者下架了某项服务,最稳妥的做法是拿那个具体页面重新核对一遍代理的测试回答,而不是默认更新已经自动同步过去了。这和大多数 AI 训练管线背后的抓取式模型是同一套逻辑,值得把网站链接当成提交站点地图那样对待:有用,但不是即时生效的。
目录接入完全是另一套机制。进入它的路径有两条。小企业可以直接在 WhatsApp Business 应用里手工搭一份目录,一件一件地添加商品,填上名称、价格和图片。已经在投广告或者管理着更大库存的企业,通常会改为通过 Commerce Manager 接入一份结构化数据源,格式就是 Meta 商务平台接受的那几种:CSV、TSV、RSS XML、ATOM XML,或者一份保持正确格式的 Google Sheet。
基于数据源的目录需要几个特定字段才能跑起来:商品 ID、商品名称、图片链接、描述、价格与币种、商品 URL,以及库存状态。最后这个字段只接受一小组固定值:“in stock”(有货)、“out of stock”(缺货)、“preorder”(预售)或”available for order”(可订购),而不是用一句自由描述来说明库存情况。
目录接通之后,“目录训练”这个说法相对”目录读取”才真正立得住。当客户问出”这个有蓝色的吗”这类问题时,代理并不是用一句话来描述你的库存,而是从数据源里把一条真实条目直接拉进聊天,连同图片、价格和购买链接,变成一张商品卡片。这就是 Meta 商品推荐功能背后的机制,是一项大多数普通常见问题机器人并不具备的 WhatsApp Business 目录 AI 能力,也是为什么在整套设置里,数据源的干净程度在这里比在其他任何环节都更重要:一张卡片要么准确,要么在聊天里明显是错的,不像文字回答那样还留有一片含糊的中间地带。
这份结构化数据源,同样是 AI 代理产品目录区别于一份普通商品清单的地方:它不是代理读一次就完事的东西,而是每次出现相关问题时都会反复调用的来源。
目录这边最常见的错误,是库存状态字段过期了。如果你上周就卖光的商品,数据源里还写着”in stock”,代理就会满怀信心地把它推荐出去,因为在它看来那依然是事实。这是同步问题,不是 AI 问题,值得去查一下你的数据源实际多久更新一次,而不是默认它天生就接近实时。
网站这边最常见的错误,恰好是一条好的常见问题答案的镜像:页面上全是营销话术,没有任何具体信息。一个只说产品”品质卓越”,却从不提实际价格、尺码或退货期限的网站页面,不能给代理提供任何可以据以作答的具体内容,于是它要么给出含糊的回答,要么更加依赖你手工写下的那些常见问题。如果你链接的页面里没有真实客户会问的那个问题的答案,代理也变不出一个来。
第三个错误没那么显眼:两个来源之间的信息互相冲突。如果你的网站上挂着一个好几个月没更新的价格,而目录数据源里是当前价格,或者反过来,代理没有办法判断哪一个才是权威的,因为两者都是它被告知要信任的合法输入。让这两者保持一致并不是 Meta Business Agent 特有的要求,它只是一个好习惯,只不过当一个 AI 同时在读两边、并且从它碰巧取到的那一边作答时,这个习惯的分量一下子重了很多。
在把代理切到正式使用之前,用内置的测试流程,拿你的客户真正会发过来的那类目录和产品问题去问它,而不是挑简单的问。确认返回的商品卡片图片能正常显示、价格也对得上,并且检查至少一件缺货商品是否会给出准确的回答,而不是一条信心十足的推荐。如果你刚给网站更新了新信息,就针对那个具体页面提一个问题,先看看回答有没有反映出改动,再去假定它已经反映了。至于代理碰到两个来源都答不了的问题时该怎么办,可以参考我们关于Meta Business Agent 如何处理人工转接与升级的指南。
Meta 还另外开放了一个 Business Agent Platform,用于比目录数据源或抓取网页更直接地接入 Shopify 或某个客服工具这类第三方系统。那是与本文所讲的设置不同的一层,更接近我们在Meta Business Agent 路线图一文中描述的企业级连接器层级,如果你的目录本来就存放在一个比 WhatsApp 自管数据源更有结构的地方,值得去了解一下。
以上所有内容,都只针对 Meta 如何用一份目录和一个网站来训练它自己的代理:被抓取的页面、一份结构化数据源、一个按它自己而非你的节奏更新的索引。对于一个能自主作答的代理来说,这是一个合理的取舍,但它也意味着,一条自动回复的准确度,取决于你最近一次刷新这两个来源是什么时候。
The Chat Quotient 的运作方式不同,因为它根本不是从索引里读取。它的AI 回复建议会在你提出请求的那一刻,基于你自己的知识库生成一份草稿;它的AI 代理则直接依据你在 WhatsApp Web 里给它的企业信息和目标来工作,不需要另外维护一份目录数据源,也没有一个需要保持同步的抓取环节。对于一家刚把目录接入 Meta Business Agent、又想要一层不依赖同一套抓取与索引时序的补充能力的企业来说,实际的差别就在这里:少一样需要在两个地方分别更新的东西。它的内置 CRM和可视化销售管道则会在产品问题被回答之后接手对话的后续走向,把这条线索继续推进到销售管道里,而不是止步于那一条回复。
Meta Business Agent 会实时读取我的网站吗? 不会。它会抓取并索引你提供的 URL 下的页面,然后基于那个索引作答,而不是为每一个客户问题去获取实时页面。网站有较大更新之后,请重新核对一遍测试回答,而不是默认改动会立刻体现出来。
Meta Business Agent 的目录支持哪些文件格式? 通过 Commerce Manager 接入的结构化数据源支持 CSV、TSV、RSS XML、ATOM XML,或一份格式正确的 Google Sheet。规模较小的企业也可以直接在 WhatsApp Business 应用里手工搭建目录,一次添加一件商品。
代理为什么推荐了一件其实已经缺货的商品? 代理信任你目录数据源里的库存状态字段。如果某件商品卖光之后,这个字段还写着”in stock”,那么在数据源更新之前,代理没有任何别的途径知道真实情况。
我可以阻止 Meta Business Agent 使用网站上的某些页面吗? 最稳妥的做法,是一开始就不要把你不希望它取用的页面链接进去,因为在你接入的那个 URL 下任何可被公开访问到的内容,都是抓取程序建索引的候选对象。
有了目录和网站训练,是不是就不用写常见问题解答了? 不是。你直接填写的常见问题和企业信息是一个独立的数据来源,而恰恰是它们覆盖了网站页面或产品数据源通常不会写明的那些具体政策和流程问题。我们的完整设置指南讲了两者是如何配合的。
Meta Business Agent 的目录训练和网站训练,是被同一个”接入你的数据”标签盖住的两套不同机制。网站接入是一次抓取加一个索引,对描述性内容和政策内容有用,但它不是你站点的实时镜像。目录接入是一份结构化数据源,它的可信程度不会超过里面那个库存状态字段。当你的业务发生变化时,这两者都不会自动修正自己,而这正是值得写进日常流程、而不是只当成一次性设置步骤的部分。
添加 Chrome 扩展程序,彻底改变您管理业务 WhatsApp 对话的方式。