跳转至

市场监测 · 双口径规则

建立日期:2026-07-26
依据:业务方新框架《市场监测招投标信息监测》+ 2026-07-26 用户决策「新旧并存分层」
地位:本文件定义市场监测模块两套并行统计口径的边界。任何产出引用数字前必须先确认口径。


一、为什么需要两套口径

业务方新框架与现有系统不是同一套逻辑,两者各自成立但不可混算

维度 新框架 现有系统
统计单位 项目数(明确「无金额权重」) 金额(万元)
分析单元 市场大盘 单个竞品
覆盖范围 全国中小学全品类(22 类,双口径并行输出) Tier ½ 竞品 + 学科网相关品类
数据要求 全量、可算占比 逐条证据链核实

强行合并会同时废掉两者:大盘统计掺入金额权重就算不出新框架要的结构占比;竞品追踪丢掉金额和证据等级就失去决策价值。

因此并存分层:A 口径做大盘,B 口径做竞品与商机。


二、A 口径 · 大盘结构(数量口径)

定义
计量单位 项目数(条)
覆盖范围 全国中小学教育采购,全部 22 类品类(含校舍维修改造、课桌椅、食堂设备、后勤服务等非信息化品类)。品类占比双口径并行输出:新框架原始 17 类口径 + 扩充 22 类口径,详见 品类词表.md 第 3.3 节
筛选规则 主体包含词 AND NOT 排除词,见 品类词表.md
公告类型 采购/资审公告 + 中标公告 + 采购合同(三类全收
数据来源 全国公共资源交易平台列表层(L1)
用途 品类占比、学段分布、省份分布、省份×品类交叉、学段×品类交叉、公告类型统计、赛道评级、区域梯队
明确不做 不含金额权重;不做单项目深度核实
落盘 数据集/YYYY-MM-DD-A口径.csv
产出 周数据报表、月度分析报告、季度分析报告

三、B 口径 · 竞品与商机(金额口径)

定义
计量单位 万元 + 证据等级 A/B/C/D
覆盖范围 Tier ½ 竞品 + 学科网相关品类(见品类词表「学科网相关」列)
公告类型 以中标公告、成交公告、采购合同为准;采购意向/预告仅作前置信号
数据来源 11 家 Tier 1 定向检索 + 政策专项区域扫描 + 商机预警扫描 + A 口径命中项的 L2 详情精读
用途 竞品中标追踪、商机线索分级、L9 联动、威胁等级评估
阈值 保留现有 ≥50 万元 P0 阈值
落盘 招投标数据/YYYY-MM-DD.csv
产出 市场监测周报(竞品与线索)、商机线索清单

三点五、采集范围:双轨(2026-07-26 用户确认)

P2 实测发现,A 口径全量数据中学科网相关品类仅占 11.3%(88/776),其中教学软件 2 条/周、人工智能 6 条/周。若只采相关品类,新框架五层模型的第二层(大盘校验)与第三层(品类占比)直接失效;若全量都做 L2 精读,90% 工作量花在无关品类上。

确认执行双轨

范围 深度 服务对象
大盘轨 全量 22 类、三种公告类型 仅 L1 列表层,不进详情页 新框架五层模型(资金流向结构)
深挖轨 学科网相关品类 ∩ L1 + L2 详情精读(中标企业、中标金额) 学科网经营决策、竞品追踪、L9 联动

两轨共用一次 L1 采集,不重复请求。L2 触发条件见 ../运行手册.md「L2 · 详情精读层」。

工作量实测:大盘轨约 63 次请求;深挖轨约 88 条记录中命中中标/合同类的部分,不到 1 分钟。合计远低于全量 L2 的 438 次请求。


四、强制规则

4.1 不得混算

  1. 两套口径的数字不得出现在同一张表里做加减、求和、算比例
  2. 任何报告引用数字时必须标注口径来源,格式:(A 口径) / (B 口径)
  3. 同一个项目可以同时存在于两套数据集中——A 口径记它一条,B 口径记它的金额和中标方。这不是重复,是两个视角。但不得把 A 口径的条数与 B 口径的金额并列成"N 个项目共 X 万元",因为 A 口径的 N 里绝大多数没有金额数据。

4.2 前置信号处理的口径差异(最容易出错的一条)

现有质量底线第 6 条规定「采购预告、采购意向和采购/资审公告只能作为采购前置信号;未出现中标公告前,不得计入竞品中标项目数和成交金额」。

这条仅适用于 B 口径。

A 口径下情况相反:招标公告是新框架第二层核心指标的分母——

项目落地确定性 = 中标公告数量 ÷(招标公告 + 招标预告数量)

把招标公告排除掉,这个公式分母为零,第二层「整体市场流转层」直接失效。

因此:

  • A 口径:采购/资审公告、中标公告、采购合同三类全部纳入统计,按 公告类型 字段区分
  • B 口径:维持原规则,前置信号不计入中标项目数和成交金额

在任何一份产出里引用「项目数」时,必须说清是 A 口径的全类型计数,还是 B 口径的已成交计数。

4.3 证据等级只适用于 B 口径

A 口径数据全部来自政务平台列表层,统一视为可用于结构统计,不逐条评证据等级。
B 口径维持 A/B/C/D 四级,见 ../招投标数据/字段口径.md。

注意术语撞车:证据等级的 A 级/B 级 与本文件的 A 口径/B 口径 是两套无关编码。引用时写全「证据 A 级」或「A 口径」,不得简写为裸露的 A


五、两套口径的衔接点

L2 详情精读是唯一的衔接点:

L1 全量列表(A 口径)
    │ 筛选:主品类 ∈ 学科网相关品类集
    │      AND 公告类型 ∈ {中标公告, 采购合同}
L2 详情精读 → 补中标企业、中标金额
并入 B 口径数据集,供竞品追踪与商机线索复用

衔接规则:

  1. 进入 L2 的记录同时存在于两个数据集,用平台记录 id 关联。
  2. L2 是 A 口径向 B 口径的单向补充——B 口径的数据不回流影响 A 口径的任何统计

六、历史数据处理

现有 24 条记录(基线 2 条 + 6-02 首轮 7 条 + 7-07 实测 10 条 + 7-13 周度 3 条 + 7-20 周度 2 条)全部属 B 口径,且:

  • 品类范围窄(仅信息化相关),无学段字段
  • 含新排除口径下应剔除的记录(如宣城职业技术学院 = 高职)

处理原则:不回溯改造。

  1. 现有 24 条原样保留,标注为 B 口径历史数据,继续服务竞品追踪。
  2. A 口径数据集从改造上线当周起算,基线-2026-06-01.csv 等历史文件不动。
  3. 月度分析报告在 A 口径积累满一个完整自然月前不产出——用不足一月的数据算占比会得出错误的赛道评级。
  4. 不得把现有 24 条塞进 A 口径充数:它们是定向检索命中的,不是全量采集的,混入会严重扭曲占比(信息化类品类会被高估数倍)。

七、相关文件

  • 品类、学段、包含/排除词:品类词表.md
  • 五层分析模型与计算公式:分析模型.md
  • 字段定义:../招投标数据/字段口径.md
  • 执行流程:../运行手册.md