Skip to content

[map] Evidence Kernel 北极星 + PS1 巨石退役战役 #55

Description

@2233admin

北极星:Evidence Kernel

这个工具的长期定位不是「又一个代码扫描器」,而是 agentic 工程的证据内核——模型后训练解决不了、且模型越强需求越大的那一层。

为什么模型解决不了(产品论点,四条硬边界)

  1. 确定性与重放:同输入必同裁决、可 diff、可回归。采样式模型原理上给不了;更强的模型只是更常对,不是可证明地对。
  2. Attestation 是密码学问题,不是认知问题:发现项绑 snapshot identity + digest 链(in-toto/SLSA 范式)。模型无法为自己的断言出示可验证出处——这仓自己的 ai-safety-002(agent 自报 coverage 解锁满分)就是活证据。
  3. 全库全史 fact ≠ context window:attention 是有损检索,不是数据库。跨仓不变量、历史 churn、依赖环,要的是可查询的事实存储。
  4. Gate 的对抗鲁棒性:发布闸门不能被 prompt injection 说服。裁决权必须在确定性层,模型只当可选陪审(sealed / cached / attributable)。

验证不对称是根逻辑:生成代码变便宜了,验证没有。RLVR 时代 verifier 是训练燃料——模型越强,可验证信号越稀缺。这个工具站在需求上升侧;它甚至可以反过来给 agent 行为当 reward oracle(#14 v0.6.0 session intelligence 正好骑同一根 spine:agent trace 也是 fact)。

目标架构:三平面 + 一根 provenance spine

平面 职责 现状锚点
fact plane typed facts,content-addressed,增量 ast-grep 已内化(#42)、sentrux-native、toolchainDigests
policy plane 声明式 fail-closed gate rules.toml + sentrux_gate + audit validate
judgment plane sealed 可选 LLM 判断 model_channels + audit 科室(#31/#32 已加固)

provenance spine 贯穿三层:每个产物都是 attestation(subject digest + materials + builder),release 侧 attest-build-provenance 已开头(PR #43),向管线内每一步延伸。

为什么 PS1 巨石是第一战

子票

顺序

T1 先行,阻塞一切。T2 次之(launcher 是统一挂点)。T3/T4/T5 可并行。T6 在 T2 后独立推进。T7 等 T2-T5 大头。T8 收口。T9 二期(依赖 T6),不阻塞主线。frontier = T1(#46)。

顶层验收(战役 done 口径)

  • run-code-intel.ps1 与 Invoke-SentruxAgentTool.ps1 删除或 ≤50 行 shim
  • rules.toml 至少收紧两档,向 B/70/0 逼近,manifest 证据支撑
  • ubuntu/macos runner 全管线自扫 green
  • 无变更 warm 自扫 wall-clock ≥60% 降幅
  • 全程每个 PR:contract parity green,自扫 green,禁止靠放松 baseline 换绿

不做

关联

Metadata

Metadata

Assignees

No one assigned

    Labels

    enhancementNew feature or request

    Projects

    No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions