跳到正文

Boily 引擎

从诊所到商品页面,同一个衡量引擎

Boily for Commerce 运行在 Boily 为衡量韩国医疗机构被 AI 助手推荐频率而打造的引擎之上。本页说明引擎衡量什么、如何计分、会在商品页面上改动什么,以及它不做哪些承诺。

覆盖 ChatGPT · Claude · Gemini · Perplexity

衡量

每两周,重复同一场测试

只有标尺不变,趋势才有意义。第一轮之后,衡量流程中的所有条件都会固定下来。

  1. 1

    冻结的买家问题

    第一轮会为每个商品和语言生成买家真正会问的问题(需求、使用场景、对比、品牌相关问题)并保存。此后每一轮都原样重新提问,不做任何改动。

  2. 2

    固定的模型

    每个助手都锁定在第一轮使用的模型上。服务商悄悄更换模型,不应被误读为你的商品曝光发生了变化。

  3. 3

    开启网页搜索的四个 AI 助手

    ChatGPT、Claude、Gemini 和 Perplexity 通过官方 API、在开启网页搜索的状态下作答。我们会保存每个回答引用的来源,以及服务商公开时它实际执行的搜索词。

  4. 4

    由模型读取商品名,而不是关键词搜索

    由语言模型阅读每个回答,并按顺序列出被推荐的商品。计分依据的是这份有顺序的清单,因此某个词只是顺带出现,并不算作推荐。

  5. 5

    需同时出现品牌的匹配

    只有当被推荐的名称与你商品的核心名称一致,并且同时出现你的品牌时,才算作你的商品。其他公司的通用“维生素 C 精华”不是你。

  6. 6

    双周一轮

    按固定日程每两周衡量一次。每一轮都会按助手、按问题列出结果,并与上一轮并排对照。

数字是怎么算出来的

每轮给出两个数字:你出现的频率(曝光率),以及你出现的位置有多靠前(AI 推荐分数)。

排在首位推荐
1.0
位列前三
0.7
在更后面被提及
0.3
未被提及
0
每个回答的推荐分数,按本轮全部调用取平均值。

出错的调用也计入分母

超时或 API 出错的调用按“未出现”计算。每一轮都除以相同的调用次数,因此 API 状况不佳的日子不会抬高你的分数。

部分衡量会单独标注

如果某个助手的调用中有超过 20% 失败,该轮会被标注为“部分衡量”,而不是作为正常结果展示。

文本回答与购物卡片分开统计

文本回答通过官方 API 衡量。消费者应用中的购物卡片无法通过这些 API 获取,因此在报告时会作为单独且明确标注的数字。

页面改进

引擎会写什么,以及它遵守的规则

在两轮衡量之间,引擎只依据你店铺的商品数据,为商品页面撰写改进内容。每一项在发布前都会经过检查并备份,随时可以回滚。

事实优先的导语

一句简短的开头,包含品牌、商品类别,以及助手会查找的两三个关键事实。如果生成的导语遗漏了这些事实,就改用简单的模板导语。

用未命中的问题生成 FAQ

在冻结的问题中,凡是至少一半助手没有提到你的商品的问题,都会按原文写入 FAQ。最多 8 条,不包括品牌相关问题。

事实核验

正文中的数字、单位、成分、材质和认证,必须都能在你的商品数据中找到才会通过。价格和评分只取自商品信息。

不写含糊其辞的内容

如果数据无法回答某个问题,就不收录这个问题。引擎不会发布“暂无相关信息”之类的凑数句子。

用语合规检查

共 83 条规则,涵盖韩国《标示广告法》、化妆品、食品与保健功能食品、医疗器械相关法规,美国 FTC 指南,以及日本《药机法》和《景品表示法》。违规句子会被删除,有风险的句子会改写一次并重新检查。

服务端渲染的结构化数据

AI 爬虫不执行 JavaScript,因此我们通过各平台在服务端输出的官方机制写入内容。我们会补充店铺已经输出的 Product 数据,而不是重复添加一份。

商品数据源

托管面向 Google Merchant Center、Microsoft Merchant Center 的数据源以及 OpenAI 格式的数据源,并用同样的导语和规格加以补充。商家只需登记一次。

IndexNow

改动上线后,在平台允许的范围内通知支持该协议的搜索引擎。平台不允许时,报告中会如实说明,而不会算作“已完成”。

品牌官方主页(sameAs)

在结构化数据中关联你品牌的官方主页,但只关联你确认过的那些。自动发现的候选在你确认之前,只作为建议保留。

结果因商品和类目而异。AI 助手由第三方运营,回答也在不断变化。引擎不承诺排名或销量;它每一轮都用同样的方法衡量,并改进你能掌控的页面部分。

从诊所到电商

同一个引擎,为商品而调整

这个引擎起步于 Boily(boily.co.kr)。Boily 用固定的问题集、双周一轮的衡量和同样的按排名加权分数,衡量患者提问时 ChatGPT、Claude、Gemini 和 Perplexity 推荐韩国医疗机构的频率。

Boily for Commerce 保留了这一衡量核心,并把其余部分改造为面向商品页面:衡量单位是一个商品 × 一种语言,匹配基于商品名和品牌名,用语检查覆盖消费品广告规则,页面改进通过你的店铺平台自动完成。

项目Boily(诊所)Boily for Commerce
衡量单位一家医疗机构的科室与地区组合一个商品 × 一种语言
问题患者问题,按组冻结买家问题,按商品和语言冻结
匹配对象医疗机构名称商品名称(必须同时出现品牌)
内容检查韩国医疗广告法消费品广告规则(韩国 · 美国 · 日本)
页面工作按机构需要代为执行自动执行,含备份与回滚

诊所实测结果(Boily)

同一引擎在诊所留下的记录

以下是 Boily 每两周测量的部分诊所的首轮与最近一轮数据。我们没有只挑上升的案例——下降和持平的诊所也一并列出。诊所名称已遮蔽,仅保留地区和科别。

按来源页面(数据截至 2026-10-07),在测量中的 23 组里,有两轮以上数据的 19 组中 17 组高于首轮,2 组低于首轮。

AI 回答曝光率(ChatGPT · Claude · Gemini · Perplexity)

  • 水原灵通 ○○牙科

    牙科

    26.3% → 49.6%

    2026 年 7/6 → 9/28 · 7 轮

  • 安山 ○○牙科

    牙科

    3.6% → 31.7%

    2026 年 7/25 → 10/2 · 6 轮

  • 忠州 ○○牙科

    牙科

    0.0% → 29.4%

    2026 年 8/23 → 10/4 · 4 轮

  • 光州 ○○医院

    综合医院

    0.6% → 15.6%

    2026 年 7/15 → 10/7 · 7 轮

  • 仁川黔丹 ○○皮肤科

    皮肤科

    0.7% → 11.6%

    2026 年 8/10 → 10/6 · 5 轮

  • 开浦 ○○牙科

    牙科

    25.0% → 25.4%

    2026 年 7/6 → 9/28 · 7 轮

  • 麻谷 ○○牙科

    牙科

    56.9% → 46.0%

    2026 年 8/29 → 9/28 · 3 轮

  • 昌原 ○○牙科

    牙科

    25.4% → 21.7%

    2026 年 9/17 → 10/1 · 2 轮

诊所结果由 Boily 测量;商品结果因情况而异,不作保证。

  • 曝光率指用每家诊所固定的问题集向四个 AI 提问时,回答中出现该诊所的比例。测量基于 API 查询。
  • 2026 年 8 月 19 日更换了其中一个 AI 的测量模型,该日期前后的数值难以直接比较(来源页面已注明)。
  • 以上为观察记录,不断定因果关系。各诊所的观察区间不同。

来源: boily.co.kr/research/cases

在你的商品上看看这个引擎

选择你使用的店铺平台,了解它如何接入;或打开示例报告,看看一轮衡量的结果。