101 lines
6.5 KiB
Markdown
Raw Normal View History

2026-09-20 03:47:41 +08:00
---
name: l3-geo-html-screen-diff
description: >-
Compare an L3 enterprise GEO HTML report with the haoxian geo-monitor page
by on-screen names and percentages, then write a numbered test report. Use
when the user asks for an L3 or 企业级 diff of HTML vs 平台, geo-monitor,
露出率, 行业露出率排行榜, 信源内容类型, 信源发布时间, 媒体类型, 媒体名称,
画面值, or an enterprise two-URL numerical test report. Do not use for L1
项目级 pages.
---
# L3 HTML 与平台画面数值对照
这是 L3 企业级技能。对照历史 HTML 与监测页。只比映射板块上写出来的名称和百分比。不比位置、颜色、条形图还是方块。
## 必填参数
缺任一项就停下来问,不要沿用上次对话、示例或本文件里的地址和日期。
| 参数 | 用户传入 | 用途 |
|---|---|---|
| `platform_url` | 监测页完整 URL | 含 `batchDate``reportType`。企业级,不是 `level=project` |
| `html_url` | 历史 HTML 完整 URL | 含版本参数时原样使用 |
| `html_monitor_date` | HTML 监测日期,如 `2026-09-15` | 只用于核对页面日期文案 |
| `platform_period` | 平台监测周期,如 `9月W38` | 只用于核对页面日期文案 |
| `report_dir` | 测试报告保存目录的绝对路径 | 报告写在这个目录下,不写到别的位置 |
用户给定的日期对应关系不是差异。不要因为两边文案一个是日期、一个是周次就判失败。
`batchDate`、公司、批次号从本次 `platform_url` 和当次登录会话解析。不要写死批次号、公司号、手机号或密码,也不要把凭据写进报告。
## 板块对应
- HTML「综合」= 平台「全平台」
- HTML「品牌综合竞争格局」= 平台「露出情况概括」
- HTML「AI 引用信源分析」= 平台「引用信源分析」
- HTML「信源内容类型分布」= 平台「信源内容类型」
- HTML「信源发布时间分布」= 平台「信源发布时间」
- HTML「媒体类型」= 平台「媒体类型」
- HTML「媒体名称」= 平台「媒体名称」
平台选项综合、DeepSeek、豆包、通义、元宝、文心、Kimi。接口平台值`ALL``deepseek``doubao``qwen``yuanbao``baidu_wenxin``kimi`
## 测试范围
8 项都要做。每一项标题写成 `测试通过✅``测试失败❌`,不要只写相同或不同。
1. 确认两个 URL 页面能否正常打开展示,截图到测试报告
2. 覆盖综合、DeepSeek、豆包、通义、元宝、文心、Kimi。HTML 里面综合 = 全平台。
3. 各平台的露出率、前三率、正面率是否相同。
4. 各平台的行业露出率排行榜是否相同。
5. 各平台的信源内容类型是否相同。
6. 各平台的信源发布时间是否相同。
7. 各平台的媒体类型:两边都按画面占比从高到低只取前 10 条,再比这 10 条的占比是否相同、展示名称是否相同。第 11 条及以后不比。
8. 各平台的媒体名称:两边都按画面占比从高到低只取前 10 条,再比这 10 条的占比是否相同、展示名称是否相同。第 11 条及以后不比。
数据不同时给出平台和 HTML 的对比。每个平台都要输出同名但百分比不同的名称、HTML 画面值、平台画面值。
## 画面值
比的是图例、方块、条形图上印出的百分比,不是加总前的字段。字段相同而画面不同,记为不同。
平台多出来、且没有出现在本次对照画面里的字段,不报。媒体类型和媒体名称只在前 10 条里判缺失;第 11 条及以后不报,也不写进只在一边展示。
HTML 从 `var DATA` 读取。平台从 `resource-api.cemeta.cn``/api/geo-monitor/metrics/l3` 读取,`table``snapshot``competitor``tmc``batchIds` 用本次解析出的批次。
画面百分比按下面计算,保留 1 位小数。差超过 0.05 才算不同。0.05 是百分点不是相对误差。1 位小数上能看出来的最小差别是 0.1。13.80% 和 13.8% 差是 0判相同。
- 露出率、前三率、正面率、排行榜露出率:页面直接印字段,两边直接比。
- 信源内容类型、信源发布时间HTML 图例印存储的 `pct`。平台环图印 `value / 全部正值之和 × 100`,图例最多 8 条。
- 媒体类型、媒体名称:先各自算出画面占比,再按占比从高到低只留前 10 条,只比这 10 条的名称和百分比。
- 媒体类型画面占比HTML 为 `pct / 全部 pct 之和 × 100`;平台为条形图印出的 `value`(这 10 条 `value` 之和 ≤ 101.5 时直接用 `value`,否则 `value / 该和 × 100`)。
- 媒体名称画面占比HTML 没有占比字段,为 `次数 / 本组次数之和 × 100`;平台与媒体类型同一条形图规则。
## 只在一边展示
不要写成两张互不对照的「仅 HTML / 仅平台」名单。改成对照表,写清原因。
- 同一条、只是名称写法不同、百分比相同:一行写 HTML 画面名、平台画面名、百分比。
- 名称进了前 10、把另一边的名称挤掉表里两边都写。被挤出的那一侧写名称和画面值另一侧写「前 10 之外,未印」。
- HTML 不展示、平台前 10 有的名称HTML 列写「不展示」,平台列写名称和画面值。并写明有没有把 HTML 的名称挤出前 10。
- 平台多出来、且没有出现在本次对照画面里的字段,不报。
## 报告
先给结论:一致,或不完全一致。然后按 8 项写结论表,每项一个结果:`测试通过✅``测试失败❌`
每个有差异的平台单独列出:
| 平台 | 名称 | HTML 画面值 | 平台画面值 |
|---|---|---|---|
| 用户本次的平台名 | 同名条目 | 画面百分比 | 画面百分比 |
没有同名百分比差异的平台写「画面上同名占比无差异」,不要省略该平台。露出率、排行榜若相同,写条数,不要把相同行展开成差异表。
`report_dir` 里找已有的 `测试报告.md``测试报告-N.md`。下一个编号是已有最大 N 加 1。都没有则从 1 开始。`测试报告.md` 不算已有编号。
写成 `{report_dir}/测试报告-{id}.md`。目录不存在就创建。截图放在 `{report_dir}/shots-{id}/`,报告里用相对路径 `shots-{id}/文件名`。不要覆盖已有报告,不要写到 `report_dir` 以外,也不要改用上次的目录。
写完后在回复里给出报告的绝对路径。对话里只保留结论和路径同名差异表以该文件为准。文件里的日期、URL、保存目录用本次参数不要留示例值。