项目档案共 2 项

项目档案

问题、假设、系统,以及失败过的部分。

LAB-003 · 探索 · 14.0°C 已完成

Conservative Coding Agent

一个强调最小必要修改和变更安全验证的 Coding Agent。

问题
现有 Coding Agent 能完成修改,但难以控制修改范围,也很难证明没有引入额外问题。改对一个函数的同时顺手"优化"另外三个,是常态而非事故。
假设
如果 Agent 在修改前理解局部语义边界,并在修改后进行增量验证,可以显著降低非预期变更。
系统
├── Context Layer ├── Planning Harness ├── AST Analysis ├── Minimal Diff └── Incremental Validation

结果

已完成。变更验证从全树 AST 比对改为基于作用域的符号级增量检查,单次验证耗时从 420ms 降至 28ms(见 2026.08.11 日志)。

失败尝试

  • 一次性注入完整仓库结构:没有提升理解能力,反而加剧了上下文污染。见 LTN-023 的浓度问题。
  • 让 Agent 自我报告修改范围:报告与实际 diff 的一致率不到 60%。口头承诺不构成验证。

相关文章

  • LTN-024 Skill 的评价与优化
  • LTN-022 为什么我放弃原来的 Sandbox 架构
LAB-001 · 稳定 · 4.2°C 运行中

LowTemp Notes

这个网站本身:一个把知识成熟度可视化为温度的个人实验室。

问题
个人博客通常只有"已发布"一种状态,文章发表后假装永远静止,读者无法区分成熟结论和随手想法。
假设
给每篇内容标注状态与温度,并公开演化历史,可以让读者校准信任,也让作者敢于发布未完成的思想。
系统
├── Astro Static Site ├── Content Collections ├── Status-Temperature Mapping ├── Temperature Axis (data-driven) ├── Command Palette Search └── Focus Reading (CSS Custom Highlight)
下一阶段
温度史的可视化:单篇文章的降温曲线。

失败尝试

  • 第一个版本想做全文搜索:静态站加索引的复杂度远超收益。五项导航以内的网站,不需要搜索。
    • 2026.09 后来还是做了:构建时静态生成一份索引 JSON,在浏览器里本地检索(⌘K)。

当前研究

Coding Agent Harness 研究面向真实代码库的上下文管理、最小变更与增量验证。 开发中 · AST / 语义上下文 / 安全变更 · 更新 2026.08

验证中的假设

HYPO-01 验证中 7.2°C

基于作用域的 AST 符号级差分能否替代全量上下文重放?

在多轮 Coding Agent 交互中,如果单次验证耗时超过 200ms,Agent 的自愈循环就会被打破。假设仅投影被修改符号的引用拓扑即可达到 99% 的静态自愈率。

用例覆盖 18/24 · 耗时 28ms · 稳定
HYPO-02 假说形成 11.5°C

长上下文注意力稀释是否存在不可逆的临界相变点?

当历史输入中不相干噪声超过 60% 时,模型遵循初始硬性约束的失效率不是线性递增,而是呈现断崖式突变。严格控制输入端信噪比远胜于在输出端打补丁。

基准测试中 · 64k/128k 边界