From ff84f41c9c2e19f950e4e64f433d8813a410fe7b Mon Sep 17 00:00:00 2001 From: liuying Date: Sun, 20 Sep 2026 12:20:49 +0800 Subject: [PATCH] =?UTF-8?q?fix(L1-geo-html-screen-diff):=20=E9=81=BF?= =?UTF-8?q?=E5=85=8D=20Top10=20rank=20=E5=AF=B9=E8=B0=83=E4=B8=8E=E5=86=85?= =?UTF-8?q?=E5=AE=B9=E7=B1=BB=E5=9E=8B=200.1=20=E7=82=B9=E5=81=87=E5=A4=B1?= =?UTF-8?q?=E8=B4=A5?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit 第5项按露出率排序不用 rank;第7项已是百分比的 value 不再重算。 --- haoxian_kataichi/skills/L1-geo-html-screen-diff/SKILL.md | 6 +++--- .../skills/L1-geo-html-screen-diff/reference.md | 8 +++++--- 2 files changed, 8 insertions(+), 6 deletions(-) diff --git a/haoxian_kataichi/skills/L1-geo-html-screen-diff/SKILL.md b/haoxian_kataichi/skills/L1-geo-html-screen-diff/SKILL.md index f419bc7..eb25f26 100644 --- a/haoxian_kataichi/skills/L1-geo-html-screen-diff/SKILL.md +++ b/haoxian_kataichi/skills/L1-geo-html-screen-diff/SKILL.md @@ -87,15 +87,15 @@ HTML「综合」= 平台「全平台」。这是约定,不算第 2 项失败 4. 各选项上,趋势露出率 / 前三率 / 正面提及率是否等于平台分平台三项。 5. HTML「行业露出率排行榜」= 平台「露出排行 · 各平台明细」。平台这一张表同时列出各选项,不要切换平台选项。只比各自 Top 10。三步都要做,任一步不同则该项测试失败❌。 1. 综合的平均露出率 = 平台全平台列的平均露出率。 - 2. HTML 综合排名品牌 Top 10 = 平台全平台排名品牌 Top 10。名次和品牌名都要相同,名称逐字相同。第 11 名及以后不比。 + 2. HTML 综合排名品牌 Top 10 = 平台全平台排名品牌 Top 10。名次和品牌名都要相同,名称逐字相同。第 11 名及以后不比。**两边都按平均露出率从高到低取 Top 10,不要用接口 `rank` 当名次**(`rank` 可能是灌数防撞号,画面实际按露出率排)。 3. 这 10 个品牌在 HTML 的 DeepSeek、豆包、通义、元宝、文心、Kimi 上的平均露出率,等于平台同一张表里对应列。列对应为通义=通义千问,元宝=腾讯元宝,文心=百度文心。未露出时 HTML 为空、平台为「-」,不算不同。差超过 0.05 算不同。 6. 正面关键词、负面关键词。词云不随 AI 平台切换,七个选项同一套。下面三组文案是约定,写法不同不算失败: 1. HTML「AI 回答关键词」= 平台「AI 认知词云」 2. HTML「AI 回答正面关键词」= 平台「正面词」 3. HTML「未监测到负面词」= 平台「中正面率100%,暂无负面词」 正面词还要比图片素材:HTML 词云图画出来的词,和平台正面词图画出来的词,词条相同才算相同。不比词的大小、颜色和摆放位置。有负面词时比词条,不比空态文案。 -7. 各选项的信源内容类型是否相同。 -8. 各选项的信源发布时间是否相同。 +7. 各选项的信源内容类型是否相同。占比优先用接口/HTML 已印的百分数字段;仅当 `value` 明显是次数时才按正值之和重算。不要把已是百分比的 `value` 再除一次(会造 0.1 点假失败)。 +8. 各选项的信源发布时间是否相同。占比口径与第 7 项相同。 9. 各选项的媒体类型:占比和展示名称,只取前 10。 10. 各选项的媒体名称:占比和展示名称,只取前 10。 11. 各选项的关联信源:标题、渠道、被引次数,只取前 30。不比序号。 diff --git a/haoxian_kataichi/skills/L1-geo-html-screen-diff/reference.md b/haoxian_kataichi/skills/L1-geo-html-screen-diff/reference.md index 31dbdf6..cb6fd5d 100644 --- a/haoxian_kataichi/skills/L1-geo-html-screen-diff/reference.md +++ b/haoxian_kataichi/skills/L1-geo-html-screen-diff/reference.md @@ -21,7 +21,7 @@ HTML 从 `var DATA` 读。L1 报告用 `brand`(`mode=simple` 时没有品牌/ - 露出率、前三率、正面率、排行榜露出率:页面直接印的字段。HTML `fmt` 对非 0、非 100 印两位小数,平台印一位。比数值,不比小数位数。 - 分平台:HTML 趋势序列最后一个监测日的点,对平台该平台 snapshot 的 `exposure_rate`、`top3_rate`、`positive_rate`。综合要覆盖六个平台的这三个点。 -- 信源内容类型、信源发布时间:HTML 环图图例印 `value / 正值之和 × 100`,并去掉名为「无时间」的项。平台环图同样用 `value / 全部正值之和 × 100`,图例最多 8 条,按值从高到低。 +- 信源内容类型、信源发布时间:图例最多 8 条,按值从高到低;发布时间去掉名为「无时间」的项。**先看 `value` 是不是已经是百分比**:本组正值之和落在约 99~101.5(或每条都在 0~100 且之和≈100)时,**直接用 `value` 当画面占比**,不要再做 `value / 正值之和 × 100`。只有 `value` 明显是次数/频次(之和远大于 100,或单条远大于 100)时,才用 `value / 正值之和 × 100`。库里已是百分数时再除一次会造出 0.1 点假差异(如 52.1% vs 52%),那种差异不算失败。 - 媒体类型:HTML 方块去掉「其他」「未知」,再按剩余 `value` 之和重算。平台条形图按值从高到低取前 10;这 10 条 `value` 之和 ≤ 101.5 时直接印 `value`,否则 `value / 该和 × 100`。 - 媒体名称:HTML 没有占比字段,为 `value / 本组 value 之和 × 100`,去掉「其他」「未知」后取前 10。平台与媒体类型同一条形图规则。 @@ -31,12 +31,14 @@ HTML 从 `var DATA` 读。L1 报告用 `brand`(`mode=simple` 时没有品牌/ 平台全平台列是平均露出率。其余列是 DeepSeek、豆包、通义千问、腾讯元宝、百度文心、Kimi。某品牌在某选项没有露出时,HTML 为空,平台格子是「-」,这不算不同。 -HTML 综合榜用 `core_competitors`,本品用 `summary.avg_exposure_rate`。分平台用 `brand.platforms[key].industry_ranking`。画面名称截断后对不上(「车」对「车300」)算名称不同。 +HTML 综合榜 = 本品(`summary.avg_exposure_rate` + 本品名)与 `core_competitors` **合并后**按平均露出率降序,再取 Top 10。分平台用 `brand.platforms[key].industry_ranking`。画面名称截断后对不上(「车」对「车300」)算名称不同。 + +**排序口径(防假失败)**:两边 Top 10 顺序都按**平均露出率从高到低**对齐画面,再取前 10。不要用接口 `rank` 字段当画面名次——`rank` 可能是灌数防撞号,和露出排行画面不一致。露出率相同则按两边各自画面已印出的先后;若按露出率排完后名次与品牌名一致,第 5.2 步判相同,不要因 `rank` 对调判失败。 三步都要做,任一步不同则第 5 项测试失败❌: 1. 综合平均露出率对平台全平台列。差超过 0.05 算不同。 -2. 综合 Top 10 的名次和品牌名,对平台全平台 Top 10。名称逐字相同。 +2. 综合 Top 10 的名次和品牌名,对平台全平台 Top 10。名称逐字相同。两边名单都先按露出率降序再比。 3. 这 10 个品牌在 DeepSeek、豆包、通义、元宝、文心、Kimi 上的露出率,对平台对应列。通义对通义千问,元宝对腾讯元宝,文心对百度文心。 ## 词云