页面只负责让能力可见。真正需要长期沉淀的是采集、验证、处理、理解、挖掘、评测、决策与治理能力。每项能力都必须拥有状态、成熟度、首次 release 和实现/运行证据;planned 不能写成 supported,experimental 不能写成 production-ready。
v0.5 在 v0.4 基线之上沉淀了六项可复用能力资产:逐源恢复审计、隔离观察数据池、可逆信号分诊、人工事件收敛、发布就绪门禁和有界持续进化。来源可观测性已从 experimental 升为 operational;完整机器可读状态以 src/catalog/product.ts 和公开 product.json 为准。
<style scoped>.cap-title{text-align:center;font-size:22px;font-weight:700;color:#f1f5f9;margin-bottom:16px;letter-spacing:1px}.cap-catalog{display:grid;grid-template-columns:repeat(5,1fr);gap:10px}.cap-card{border:1px solid #334155;border-radius:8px;padding:14px;background:rgba(30,41,59,.72)}.cap-card-title{font-size:12px;font-weight:700;color:#94a3b8;text-align:center;text-transform:uppercase;letter-spacing:.8px;margin-bottom:10px;padding-bottom:7px;border-bottom:1px solid #334155}.cap-box{border-radius:6px;padding:8px;text-align:center;font-size:10px;font-weight:600;line-height:1.35;color:#e2e8f0;background:rgba(15,23,42,.7);border-left:2px solid #64748b;margin:5px 0}.cap-box.op{border-left-color:#22c55e}.cap-box.exp{border-left-color:#f59e0b}.cap-box.plan{opacity:.5}.cap-legend{display:flex;justify-content:center;gap:16px;margin-top:14px;color:#94a3b8;font-size:10px}.cap-legend i{display:inline-block;width:7px;height:7px;margin-right:5px;border-radius:50%}</style>
Agent Pulse Capability Map · v0.3.0
Sensing / 感知
Source Catalog
Upstream Discovery
Source Lifecycle
Resilient Fetch
Contract & Fixture
Coverage Map
Understanding / 理解
Normalize & Sanitize
URL / Content Dedupe
Event Clustering
Fact / Reason / Impact
Entity Resolution
Claim / Evidence Graph
Intelligence / 挖掘
Confidence Scoring
Cross-circle Heat
Impact & Value
Opportunity Scout
Trend / Contradiction
Forecast Calibration
Experience / 决策
Today Brief
Narrative Timeline
Industry Radar
Opportunity Inbox
Control Room
Static Release
Governance / 治理
Primary Source Gate
Security Guardrails
Provenance
Evaluation Scorecard
Capability Accounting
Audit / Replay / Rollback
operationalexperimentalplanned
<style scoped>.arch-wrapper{display:flex;gap:12px}.arch-sidebar{width:165px;flex-shrink:0}.arch-main{flex:1;min-width:0}.arch-title{text-align:center;font-size:22px;font-weight:700;color:#f1f5f9;margin-bottom:16px;letter-spacing:1px}.arch-layer{margin:8px 0;padding:14px;border-radius:8px}.arch-layer-title{font-size:13px;font-weight:700;margin-bottom:10px;text-align:center}.arch-grid{display:grid;gap:8px}.arch-grid-3{grid-template-columns:repeat(3,1fr)}.arch-grid-4{grid-template-columns:repeat(4,1fr)}.arch-box{border-radius:6px;padding:8px;text-align:center;font-size:11px;font-weight:600;line-height:1.35;color:#e2e8f0;background:rgba(30,41,59,.8);border:1px solid rgba(148,163,184,.2)}.arch-box.highlight{background:rgba(250,204,21,.15);border-color:#facc15;color:#fef08a}.arch-box small{display:block;margin-top:3px;color:#94a3b8;font-weight:400}.arch-layer.user{background:rgba(14,165,233,.1);border:1px solid #0ea5e9;box-shadow:0 0 12px rgba(14,165,233,.15)}.arch-layer.user .arch-layer-title{color:#7dd3fc}.arch-layer.application{background:rgba(245,158,11,.1);border:1px solid #f59e0b}.arch-layer.application .arch-layer-title{color:#fcd34d}.arch-layer.ai{background:rgba(16,185,129,.1);border:1px solid #10b981}.arch-layer.ai .arch-layer-title{color:#6ee7b7}.arch-layer.data{background:rgba(236,72,153,.1);border:1px solid #ec4899}.arch-layer.data .arch-layer-title{color:#f9a8d4}.arch-layer.infra{background:rgba(139,92,246,.1);border:1px solid #8b5cf6}.arch-layer.infra .arch-layer-title{color:#c4b5fd}.arch-layer.external{background:rgba(51,65,85,.3);border:1px dashed #475569}.arch-layer.external .arch-layer-title{color:#94a3b8}.arch-sidebar-panel{border-radius:8px;padding:10px;background:rgba(30,41,59,.6);border:1px solid #334155;margin-bottom:8px}.arch-sidebar-title{font-size:11px;font-weight:700;text-align:center;color:#94a3b8;margin-bottom:6px}.arch-sidebar-item{font-size:10px;text-align:center;color:#cbd5e1;background:rgba(15,23,42,.5);padding:5px;border-radius:4px;margin:3px 0;border:1px solid rgba(51,65,85,.5)}.arch-sidebar-item.metric{background:rgba(16,185,129,.15);border-color:rgba(16,185,129,.4);color:#6ee7b7}</style>
Agent Pulse Intelligence Architecture
Evaluation
Source Coverage
Confidence
Value / Effect
Realtime / Freshness
Operations
SourceRun
Health / SLO
Changelog
Release Evidence
Product Space
Today真正重要的变化
Timeline长期演进主线
Radar玩家与格局
Inbox机会与行动
Application & Workflow
Control Room审核与编排
Release Orchestrator评测 → 快照 → 静态发布
Public API / Exportprivacy allowlist
Intelligence & Analysis
Event UnderstandingFact / Reason / Impact
Scoringconfidence / heat / value
Trend Graphturning point / contradiction
Scouthypothesis / action / asset
Evidence & Knowledge
Source Registrycatalog / policy / lifecycle
Signal / Observationprovenance / metrics
Event / Claimunique fact node
Capability / Evaluationmaturity / scorecard
Runtime Foundation
Node / TypeScript
Kysely / SQLite / MySQL
Fastify / CLI
Vitest / CI / Pages
Knowledge Network
Official / Research
Open Source / Infra
Capital / Policy / Media
Expert / Community Heat
Governance
Evidence Gate
Human Publish Gate
Policy Version
Audit / Rollback
Safety
SSRF / Body Limit
Auth / CSP
Privacy Export
License Boundary
真实运行数据 / 人工反馈 / release evidence
│
▼
Evaluation dimensions + sample target + penalties
│
┌─────────┴─────────┐
▼ ▼
sufficient evidence insufficient data
按实测分计入总分 计入总分且单项硬封顶 <= 45
│ │
└─────────┬─────────┘
▼
加权分 × (0.65 + 充分证据覆盖率 × 0.35)
│
▼
capability maturity + next action
▼
next spec / implementation / release
当前评测维度包括有效来源覆盖、来源内容质量、一手来源归属、采集稳定性、事实置信度、认知与决策价值、端到端实时性、内容时效、机会行动效果、安全与治理。目录数量、目录预填质量分、单一来源重复成功运行、人工 confidence/value 自评分、字段完整度和 Scout 编辑状态不再单独构成高分。
重标定运行检查点:变更前最近一次公开评测记录是 69 分(195 个目录源、68 healthy、44 个公开事件、个位数多源事件);第一版新口径降至 27 分。完成 258 源扩张和 99 源隔离观察后,最终工作库为 30 分(维度加权 42,充分证据覆盖 20%)。来源覆盖只给 4 个 active 且健康的 E4 源计生产样本,131 个单轮 healthy 和 99 个 E3 observing 不会伪装成生产覆盖。分数降低不是产品变差,而是把“配置存在”“一次可用”“隔离观察”和“生产验证”分开。后续只有连续观测、多源事件、端到端延迟、用户行动反馈和回滚演练增加,分数才会增长。
硬约束如下:
insufficient_data 维度仍进入总分,统一上限 45;事实置信度、决策价值、实时性和行动效果可使用更严格的 42/35/30/20 上限。
- 有效来源覆盖以最新
source_checks=healthy 为核心样本,100 个健康来源是满量程目标;catalog、draft 和 manual 不算有效来源。
- 采集稳定性按每个来源的最新检查/运行去重,至少连续 7 个自然日且 100 个健康来源才视为充分证据。
- 事实置信度要求至少 20 个多源公开事件和 30 个就绪公开事件;人工置信分权重上限为 10%。
- 认知价值和 Scout 效果必须依赖真实保存、引用、行动、产物或付费反馈;编辑状态不算用户结果。
- 实时性必须记录 upstream publish → Signal → Event → Pages 的端到端延迟,collector 请求耗时不能替代。
后续增加聚类 F1、Claim 证据覆盖、预测 Brier score、用户节省时间、行动转化和产物完成率。