Data Horizon 第二阶段产品能力线与管理工作空间
谁该读这里: 想知道"四项成果落到产品上分别是什么"的产品、工程与运营成员。
读完你会知道: 四条产品能力线各自负责什么、边界在哪,以及管理端按工作空间重构的概念图景。
本文不代表: 界面实施授权或任何对象 / 接口 / 存储结构的冻结。这里全部是产品与体验概念,工程动作按分阶段实施计划逐闸门授权。
1. 能力线一:覆盖与来源运营(支撑"看得更广")
负责什么:
- 全球金融领域与来源地图:显式维护"世界上有哪些值得看的信息领域和来源、我们已覆盖哪些、缺口在哪"。地图按地区、市场、信息领域(官方披露 / 宏观政策 / 事件冲击 / 新闻 / 私域观点等)组织,每个来源登记角色(原始发布主体还是发现渠道)、权利状态、新鲜度、可靠性和成本。
- 覆盖优先级判断:按重要性、权利、新鲜度、可靠性、成本对候选来源排序;三类 Owner 优先领域先行,同时不排除调查性与深度报道、研究与分析观点、另类数据、叙事与预期变化等"未必有定论但可能影响市场"的信息领域。
- 原始出处追溯:聚合渠道触发后回取原始发布主体或一手材料的机制与纪律;回溯失败要显式记录。追溯是异步的丰富动作,不是感知与交付的前置闸门(见目标、范围与非目标第 5 节)。
- 覆盖缺口运营:重要缺口有登记、有处置(接入 / 降级 / 明确放弃),来源健康劣化有观察和恢复路径。
边界: 来源接入永远受权利约束——技术上能抓不等于可以用;权利不清的来源宁缺勿滥。覆盖成绩看重要缺口闭合,不看来源条数。来源的历史行为可以影响优先级与路由,但不构成对某条信息真伪的裁决。
2. 能力线二:分类、关系与检索(支撑"看得更清楚")
负责什么:
- 多维分类体系:地区、市场、资产、实体、行业 / 板块、主题 / 事件类型、重要性、来源类别、生命周期 / 修订状态、语言、时间。这是一套面向使用者的分面(facet)语义,人和机器都用它发现信息。
- 关系组织:同一事件的多条信息、同一实体的历史信息、同一文件的版本链可以互相关联;证实、否认、修订、反转以追加方式表达为同一条线索的新进展,不覆盖、不删除早先记录。
- 检索与发现:按任意维度组合检索,从结果回到原始证据与版本历史。
- 不确定性与限制表达:来源身份确定性、陈述 / 报道性质、当前旁证状态、传播程度、可能的市场相关性、涉及主体与市场、后续证实 / 否认 / 修订,分维表达而不是压成一个可信度分数;处理方式与质量限制显式可见;"说不清"的地方明确写"说不清"。
边界: 分类与不确定性表达是组织与说明能力,不是真伪裁定;DH 不输出真伪结论。分类体系先在真实信息上验证表达力;它不预设也不冻结统一存储对象——存储与正式对象决策按证据另走独立提案。既有的身份、来源、时间、权利、质量、生命周期语义原则(第一阶段沉淀)是本能力线的约束,不是本阶段的叙事中心。
3. 能力线三:时效与经济性(支撑"看得更快")
负责什么:
- 六段测量:来源发布 → 发现 → 取得 → 处理 → 就绪 → 送达,每段耗时可观察、可统计。
- 先感知再丰富:可能实质影响市场的信息先交付(带明确的不确定性说明),追溯与上下文补充异步跟进,不因"还没查清"而滞留。
- 分层时效目标:按信息重要性与来源约束分层。高影响信息(如意外的政策决议、重大处罚、重大事件)走快路径并有更严格目标;普通信息接受宽松目标。不存在单一全局延迟承诺。
- 有界并发与背压:吞吐扩张有上限与降级路径,不以压垮下游或失控成本换速度。
- 成本—质量路线:规则 / 解析器、轻量模型、强模型、人工复核按信息价值与风险分层组合;每条路线的成本、失败与降级可观察。
边界: 时效目标是分层的运营目标,不是对外服务水平承诺(生产 SLA 未批准)。
4. 能力线四:使用体验与产品探索(支撑"更容易使用")
负责什么:
- 对内:管理工作空间概念(见下节)。
- 对外(原型 / 封闭验证):面向个人的金融信息使用体验与 Data Agent 原型——一个帮助使用者完成五类任务的智能助手:
- 检索:用自然语言找信息,结果带出处与当前不确定性说明;
- 监控:盯住某实体 / 主题 / 事件,有新进展时知道;
- 对比:把多来源、多版本的信息放在一起看差异;
- 证据导出:把一组信息连同来源链导出为可复查的材料;
- 提醒:按重要性分层的通知。
边界: 原型不提供投资建议,不做认知结论,不触发交易,不公开上线,不商业运营。它验证的是"DH 的信息产品对个人是否有独立使用价值",参与者与时间盒由对应闸门决定。
5. 管理工作空间概念(Owner 决定五)
管理端按使用者的工作重新构思,六个工作空间对应内部角色的六类日常任务。这是概念设计,不是界面实施授权;现有页面继续可用,迁移与否按证据另行决策。
| 工作空间 | 服务的日常任务 | 典型问题 |
|---|---|---|
| 覆盖地图 | 判断"我们看得够不够广" | 哪些领域 / 地区 / 来源已覆盖?重要缺口在哪?候选来源排到哪了? |
| 来源运营 | 管好每一个来源 | 这个来源的权利、健康、成本、最近产出如何?能不能安全暂停 / 恢复 / 隔离? |
| 实时台 | 盯住正在发生的事 | 现在有哪些高重要性信息在流入?快路径是否通畅?有哪些高影响但尚不确定的信号正在传播? |
| 分类与关系 | 维护"信息归到哪类" | 分类维度够不够用?错分怎么纠正?事件 / 实体 / 版本关系对不对? |
| 质量与复核 | 处理受限与需人工判断的信息 | 哪些信息因权利、涉密隐私安全、恶意内容或滥用被限制?哪些不确定性标注需要人工补正、哪些已出现后续修订?决定的理由与影响记录在哪?(这里做的是运营与权利把关,不是真伪审判) |
| 运营与交付 | 看全局运行与消费 | 任务、成本、时效分段、交付与消费证据是否健康?失败怎么恢复? |
与现有实现的关系:Ops Console、Source Health、Review、Provider Config、Cron、KOL 工作台等现有页面是实现素材与证据,按任务归入上述工作空间概念接受检验;工作空间不是把旧菜单换个名字分组,而是允许发现"某些页面应合并、某些任务缺工具、某些功能应退役"。
6. 能力线与既有消费者
四条能力线产出的都是消费者中立的信息产品能力。生态内机器(认知类与执行类)通过既有和候选接口消费;既有 AI Trading Matrix 链路按兼容义务维护,其反馈继续按已接受的边界回流(影响派生画像、路由、优先级、标签与时效策略,不改写原始事实、不覆盖权利)。未来匿名 B 类工作负载与个人向原型消费同一批产品的不同投影,差异只落在适配层。
Changelog / 演化记录
2026-08-31(第二次更新):按 Owner 决定 6 调整——追溯改述为面向原始发布主体 / 一手材料且为异步丰富动作;"可信度与限制表达"改为分维的"不确定性与限制表达",不使用综合可信度分数;关系组织增加追加式生命周期演进;时效能力线增加"先感知再丰富";Data Agent 检索与实时台、质量与复核工作空间口径同步为不做真伪裁决。
2026-08-31:创建。定义四条产品能力线(覆盖与来源运营、分类关系与检索、时效与经济性、使用体验与产品探索)与六个管理工作空间概念(覆盖地图、来源运营、实时台、分类与关系、质量与复核、运营与交付);登记 Data Agent 原型五类任务与封闭验证边界。