101 lines
6.5 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

---
name: l3-geo-html-screen-diff
description: >-
Compare an L3 enterprise GEO HTML report with the haoxian geo-monitor page
by on-screen names and percentages, then write a numbered test report. Use
when the user asks for an L3 or 企业级 diff of HTML vs 平台, geo-monitor,
露出率, 行业露出率排行榜, 信源内容类型, 信源发布时间, 媒体类型, 媒体名称,
画面值, or an enterprise two-URL numerical test report. Do not use for L1
项目级 pages.
---
# L3 HTML 与平台画面数值对照
这是 L3 企业级技能。对照历史 HTML 与监测页。只比映射板块上写出来的名称和百分比。不比位置、颜色、条形图还是方块。
## 必填参数
缺任一项就停下来问,不要沿用上次对话、示例或本文件里的地址和日期。
| 参数 | 用户传入 | 用途 |
|---|---|---|
| `platform_url` | 监测页完整 URL | 含 `batchDate``reportType`。企业级,不是 `level=project` |
| `html_url` | 历史 HTML 完整 URL | 含版本参数时原样使用 |
| `html_monitor_date` | HTML 监测日期,如 `2026-09-15` | 只用于核对页面日期文案 |
| `platform_period` | 平台监测周期,如 `9月W38` | 只用于核对页面日期文案 |
| `report_dir` | 测试报告保存目录的绝对路径 | 报告写在这个目录下,不写到别的位置 |
用户给定的日期对应关系不是差异。不要因为两边文案一个是日期、一个是周次就判失败。
`batchDate`、公司、批次号从本次 `platform_url` 和当次登录会话解析。不要写死批次号、公司号、手机号或密码,也不要把凭据写进报告。
## 板块对应
- HTML「综合」= 平台「全平台」
- HTML「品牌综合竞争格局」= 平台「露出情况概括」
- HTML「AI 引用信源分析」= 平台「引用信源分析」
- HTML「信源内容类型分布」= 平台「信源内容类型」
- HTML「信源发布时间分布」= 平台「信源发布时间」
- HTML「媒体类型」= 平台「媒体类型」
- HTML「媒体名称」= 平台「媒体名称」
平台选项综合、DeepSeek、豆包、通义、元宝、文心、Kimi。接口平台值`ALL``deepseek``doubao``qwen``yuanbao``baidu_wenxin``kimi`
## 测试范围
8 项都要做。每一项标题写成 `测试通过✅``测试失败❌`,不要只写相同或不同。
1. 确认两个 URL 页面能否正常打开展示,截图到测试报告
2. 覆盖综合、DeepSeek、豆包、通义、元宝、文心、Kimi。HTML 里面综合 = 全平台。
3. 各平台的露出率、前三率、正面率是否相同。
4. 各平台的行业露出率排行榜是否相同。
5. 各平台的信源内容类型是否相同。
6. 各平台的信源发布时间是否相同。
7. 各平台的媒体类型:两边都按画面占比从高到低只取前 10 条,再比这 10 条的占比是否相同、展示名称是否相同。第 11 条及以后不比。
8. 各平台的媒体名称:两边都按画面占比从高到低只取前 10 条,再比这 10 条的占比是否相同、展示名称是否相同。第 11 条及以后不比。
数据不同时给出平台和 HTML 的对比。每个平台都要输出同名但百分比不同的名称、HTML 画面值、平台画面值。
## 画面值
比的是图例、方块、条形图上印出的百分比,不是加总前的字段。字段相同而画面不同,记为不同。
平台多出来、且没有出现在本次对照画面里的字段,不报。媒体类型和媒体名称只在前 10 条里判缺失;第 11 条及以后不报,也不写进只在一边展示。
HTML 从 `var DATA` 读取。平台从 `resource-api.cemeta.cn``/api/geo-monitor/metrics/l3` 读取,`table``snapshot``competitor``tmc``batchIds` 用本次解析出的批次。
画面百分比按下面计算,保留 1 位小数。差超过 0.1 才算不同;差小于等于 0.1 判相同。0.1 是百分点,不是相对误差。例如 91.1% 和 91.2% 差是 0.1判相同。13.80% 和 13.8% 差是 0判相同。
- 露出率、前三率、正面率、排行榜露出率:页面直接印字段,两边直接比。
- 信源内容类型、信源发布时间HTML 图例印存储的 `pct`。平台环图印 `value / 全部正值之和 × 100`,图例最多 8 条。
- 媒体类型、媒体名称:先各自算出画面占比,再按占比从高到低只留前 10 条,只比这 10 条的名称和百分比。
- 媒体类型画面占比HTML 为 `pct / 全部 pct 之和 × 100`;平台为条形图印出的 `value`(这 10 条 `value` 之和 ≤ 101.5 时直接用 `value`,否则 `value / 该和 × 100`)。
- 媒体名称画面占比HTML 没有占比字段,为 `次数 / 本组次数之和 × 100`;平台与媒体类型同一条形图规则。
## 只在一边展示
不要写成两张互不对照的「仅 HTML / 仅平台」名单。改成对照表,写清原因。
- 同一条、只是名称写法不同、百分比相同:一行写 HTML 画面名、平台画面名、百分比。
- 名称进了前 10、把另一边的名称挤掉表里两边都写。被挤出的那一侧写名称和画面值另一侧写「前 10 之外,未印」。
- HTML 不展示、平台前 10 有的名称HTML 列写「不展示」,平台列写名称和画面值。并写明有没有把 HTML 的名称挤出前 10。
- 平台多出来、且没有出现在本次对照画面里的字段,不报。
## 报告
先给结论:一致,或不完全一致。然后按 8 项写结论表,每项一个结果:`测试通过✅``测试失败❌`
每个有差异的平台单独列出:
| 平台 | 名称 | HTML 画面值 | 平台画面值 |
|---|---|---|---|
| 用户本次的平台名 | 同名条目 | 画面百分比 | 画面百分比 |
没有同名百分比差异的平台写「画面上同名占比无差异」,不要省略该平台。露出率、排行榜若相同,写条数,不要把相同行展开成差异表。
`report_dir` 里找已有的 `测试报告.md``测试报告-N.md`。下一个编号是已有最大 N 加 1。都没有则从 1 开始。`测试报告.md` 不算已有编号。
写成 `{report_dir}/测试报告-{id}.md`。目录不存在就创建。截图放在 `{report_dir}/shots-{id}/`,报告里用相对路径 `shots-{id}/文件名`。不要覆盖已有报告,不要写到 `report_dir` 以外,也不要改用上次的目录。
写完后在回复里给出报告的绝对路径。对话里只保留结论和路径同名差异表以该文件为准。文件里的日期、URL、保存目录用本次参数不要留示例值。