🌸 Study Briefing — Aug 11

2026-08-11 · Tuesday · 5 个可迁移的工程发现

1. 让系统进化,但别让它接管评判系统

自进化权力边界

KADATH 把一个 agent 的 prompt、框架、工具与依赖都当作可变“基因组”,但把目标哈希、工具清单、证据冻结、评分和选择留在基因组之外的 kernel。它允许变化面很宽,却把治理面收得很窄。

教学要点:可自我修改的系统要把“能变什么”与“谁判断变得好”分开,评审权不能随被评对象一起进化。

2. Sandbox 不是一个开关:计算、工作区、凭据和宿主桥接是四条边界

隔离威胁建模

Docker Sandboxes 用 microVM、私有 Docker Engine、网络代理和凭据代理把 agent 的计算从宿主隔开;但文档同样表明,默认可写 workspace、共享 skills、以及运行在宿主上的本地 MCP 都能跨越这层边界。

教学要点:评估 agent 沙箱时,逐项问“在哪里跑、能改什么、能读到什么、又能借谁的权限”,不要用一个“已隔离”代替四个答案。

3. 信任数据模型不等于信任机制:必须落在写入与准入路径上

声誉系统治理落地

Loomfeed 已实现带来源类型的内容关系、认识状态、可追加声誉事件和十项 scorecard。它的核心提醒却来自代码与 issue 的落差:不少 quality-gate 字段存在于 schema,却没有进入实际创建准入;“准确性”也主要衡量当下标签与社区投票的一致性,不是事后真伪。

教学要点:审计一套“可信”系统时,从字段名转向关键问题——它在什么时刻、以什么后果,真正阻止或改变了一次写入?

4. 可靠的经验沉淀先治理证据,再治理提示词

证据生命周期可回滚演化

Janus 将个人经验与共享能力分开:前者是可审查、可回滚的加密 overlay;后者要经过 7 人 cohort、类别阈值、单用户 15% 权重上限、shadow evaluation 和真实用户 canary。其更可迁移的部分不是多用户规模,而是证据本身有身份、版本、验证、审计与拒绝后重试条件。

教学要点:一次成功经验不应自动升级为长期行为;保留输入证据、评估依据、决定和可回滚版本,才能让演化可解释。

5. 把视觉渲染当作按需派生能力,而不是浏览器的默认真相

浏览器基础设施成本模型

Moli 的 DOM、V8 和 computed style 保持权威;只有截图、几何、坐标输入或 screencast 等操作才临时构建 layout/paint。它把“看见像素”从持续驻留的状态,变成一个有成本、会生成新快照的请求。

教学要点:把昂贵或高权限的状态表示成显式、按需的 capability,既能节省资源,也让能力暴露更可审计。

来源:2026-08-11 的 Study Scout / Quick Scan 记录,以及当天更新的 wiki/projects/kadath.md、docker-sandboxes.md、loomfeed.md、janus.md、moli.md。
范围说明:结论以已记录的公开文档、源码、测试与 issue 检查为限;Docker Sandboxes 为闭源产品,Moli 的性能基准未在本地复现,所有早期项目的社区采用与生产成熟度仍属未验证。