业务链路 从请求缺口到上线回验 节点数字是可查看的案例数;点击展开,再次点击收起。 打开案例工作台 离 离线内容生产批量生产任务中产生的素材需求 2 个案例 ↓ 创 在线创作模型请求创作过程中即时发起的素材需求 2 个案例 ↓ 文 文本创作模型请求由 Topic 或脚本触发的素材需求 5 个案例 ↓ 请求汇流 外部业务合同缺口信号与归因 01搜索服务返回 no_hit仅表示本次未命中,不直接等于真缺素材9个案例展开 ↓ 02原始缺口事件落表固定 event_id、request_id、原 Topic、focus_text 与过滤条件9个案例展开 ↓ 03原因诊断确认是否真的缺素材;只有 F1 继续补采9个案例展开 ↓ 仅 F1真实缺素材补采主链 补采准备文档已定义,运行回执待接 04语言检测与混语过滤先去 emoji / 符号再用 lingua-py 检测,原 focus_text 永不覆盖5个案例展开 ↓ 05相似线索合并把表达不同、素材需求相同的线索合成一组5个案例展开 ↓ 06改写为逻辑 Query3–8 词的 entity + action + setting;线上缺口以 usable=true 放行5个案例展开 ↓ 交付代码Query 与平台 Seed 严格分层 07执行门禁与活跃 Seed 检查no_hit 看 usable;事实库看 approve/rewrite;跨批复用需 Hermit 回执5个案例展开 ↓ 08构建三平台搜索 Seed每个逻辑 Query 精确展开 yt / tk / ins,并在 extra 保留血缘5个案例展开 ↓ 09校验拆包,再投递运行代码到 498 拆包 + SHA256 manifest;Hermit submit / Run 取外部回执5个案例展开 ↓ 外部回执候选、资产、理解与上线 10筛选候选素材去重、过滤,并确认内容是否真的匹配需求5个案例展开 ↓ 11绑定正式素材通过验收的内容写入 AssetCenter 并获得 asset_id4个案例展开 ↓ 12理解素材内容生成片段描述,并判断素材是否可用3个案例展开 ↓ 13上线并可搜索完成入库和索引,确认线上可以搜到2个案例展开 ↓ 14回验并闭环用原请求再搜一次,确认缺口真的已解决1个案例展开 ↓ 当前环节 环节案例 0 个案例异常案例优先显示 收起↑ 环节边界关键产物待载入关键字段— 搜索本环节案例 已显示 0 / 0显示更多
共 0 个缺口簇 · 聚合 0 条线索事件样例数据1 / 1 缺口 / 原始 Topic来源链路诊断归因聚类改写投递 / 找回内容理解上线链路进度 没有匹配的缺口清除部分筛选,或检查搜索词是否过于具体。清除筛选
当前瓶颈按积压量 × SLA 超时排序 理解完成但未上线4Asset Center · 最老 31h · SLA 24h seed → asset 绑定缺失3Crawler 3.1 · 阻断端到端归因 F1 尚未生成可用 Query6内容采集 · 多为缺主体 / 禁用意图 诊断 dependency_failed2诊断服务 · X1 不能当素材缺口
数据质量守卫这些条件一旦破坏,老板看到的比例就不可信 EVENT ID必须按 event_id 去重快照中 request_id 有 24 条复用;按 request_id 会少算或覆盖真实搜索事件。 SAMPLE CAPTOP 2,000 不是全量原文件达到 2,000 行上限。未拿到全量前,只能看样本结构,不能报总体增长。 VERSION诊断版本必须分组judge standard、prompt、Select contract 或模型不同,归因占比不可直接合并。 X1 DENOMINATOR依赖失败不能静默删除X1 仍属于诊断覆盖分母;HTTP 200 也不等于业务归因成功。 LINEAGEseed → asset 是一级 SLA没有回执映射,就无法证明某条改写到底找回了什么,也无法评价 Query。 QUALITY互动量不等于理解质量ROI 可评估检索效率;caption、domain、content_role、rating 才评估语义可用性。
责任边界no_hit 代码应回到哪里 A1–A2Planner规划 B0–B4Search召回 C3Select终选 D1–D8Filter过滤 F1Content Ops补采 F2Request改需求
阶段时延p50 / p95 必须来自同一完整日窗口 诊断8m / 31m目标 < 45m 清洗聚类17m / 43m目标 < 60m Query 改写12m / 38m目标 < 45m 首次回采4.2h / 13h目标 < 18h 内容理解1.7h / 9h目标 < 12h 上线回链6.4h / 31h目标 < 24h
端到端实体链一对多关系必须保留,不能在 Excel 里压成单行文本 1. 缺口事件event_id一次线上搜索事实;request_id 只做辅助。 2. 诊断结果snapshot_idevent_id主归因、证据、覆盖、版本与耗时。 3. 线索聚类cluster_idmember_event_ids翻译后 embedding 聚类与代表线索。 4. 逻辑 Queryquery_idcluster_id主 Query、变体、意图和可用性。 5. 搜索种子seed_idquery_id三平台展开、优先级、cron 与投递状态。 6. 资产回执seed_idasset_id证明某条种子实际找回了什么。 7. 内容理解asset_idrun_idcaption、domain、role、rating 与版本。 8. 上线与回验asset_idevent_id可搜索上线,并用原条件复测是否真正补上。
老板指标定义每个比例都明确对象、分母与排除项 诊断覆盖率classified event / unique event_idX1 和未诊断保留在分母。只看 HTTP 200 会高估。 真实缺口率F1 event / classified event只回答 no_hit 中有多少真的是库缺素材,不等于补采规模。 找回率cluster with ≥1 asset receipt / dispatched cluster按簇,不按资产数量;否则重复资产会虚增成功率。 理解可用率usable asset / understood asset依据 domain、content_role、rating;互动量只能评价回采效率。 端到端闭环率verified-hit cluster / actionable F1 cluster至少一个可搜索在线资产,可沿 seed_id 回到原始 event_id,并且原条件复测已命中。 血缘完整度records with all required joins / eligible records缺任一 event→cluster→query→seed→asset→online 连接就不算完整。
接入时必须守住的 4 个协议口径已确认项按合同展示;未确认项继续显式标记,避免混入日常指标合同约束 PRIORITY / CRON业务优先级与调度策略已映射Crawler 合同使用 high / normal / low 与 cron;P1→high,一次性任务→cron=0。调度由确定性策略生成,不依赖模型自由输出。 POLICY VERSION不同业务路线不能共用禁词表no_hit 改写允许 interview / celebration;球星事实路线全局禁 interview / press conference。必须按 source_route 绑定 policy_version。 PROBE MODEV1 是否做平台 live 探测最终方案说首版不做,提示词备注却假设会探测。每次 run 必须落 probe_mode,指标按模式拆开。 TIMEZONE / COHORT完整日与时区必须成为合同当前样本只覆盖约 12.5 小时且达到 2,000 上限。应固定 cohort_window、timezone、declared_sample_size 和 truncation 标记。