◐ 测量工具与判据
共 67 个章节,分布在 5 份报告里。
- 1. 为什么不是 Transformer:两个结构差异
- 3. 四条不可让渡的需求,与"可打断"的三个层次
- 7. 当前未解的问题(按优先级)
- 10. 路线图
- 11. 实验纪律(从 §5 换来的人话版)
- 13. 交接:任务、猜想、教训(压缩上下文前的存档)
- 16. 判据 5 过线 + 「照抄屏幕」被治好(第 3 轮对照)
- 17. 自主学习:自监督预测头(--pred-coef)
- 18. 第 5 轮实测:预测头真的在学 + loss「规律起伏」的答案
- 19. 第 4/5 轮的最终读数:预测头有效,大模型(8.7M)训崩了
- 20. 定容量:8.71M 参数 / 6 GB 显存 / 4470 刻每秒(已定为默认)
- 22. 现在的瓶颈与下一步(含对其他 AI 路线的评估)
- 23. 2026-10-03 自主工作期(二):修尺子,以及一个被推翻的收口结论
- 24. 收口自检推翻了我自己的结论:她学到过 3 条和 4 条
- 25. 2026-10-03 自主工作期(三):测量工具被审计,而我的一个"发现"被撤回
- §27 2026-10-04 凌晨:根因是一条"曲线拟合直线",而修法有三个选项
- §26 2026-10-03 夜:病因锁定在【优化动力学】,而且是用"一个数"证明的
- §28 2026-10-04 凌晨:四个干预跑完后的判定 —— 一条记账修正、一条不成立、一条被削弱
- §29 2026-10-04 凌晨 03:10:"留住"这件事有解了 —— 两个零架构改动的修法
- §30 2026-10-04 凌晨 04:00:"她留不住"的疗法 —— 三个修法与第一个可用配置
- §31. 保持机制到打字通道(2026-10-04 晚)
- §32. 打字通道:保持成立、但发现【照拄】,而它可以被关掉(2026-10-04 深夜)
- §33. 打字通道的结论:保持成立、真会写、且没有规模崖壁(2026-10-04 深夜收口)
- §34. 阶段报告(journal/STAGE_REPORT.md)建立 —— 本阶段的唯一入口
- 九、最新(10-01 晚):那个基础 bug 修好了
- 十二、10-01 新增:给了她两个新的"身体感觉"(P2 / P3)
- 十三、10-01 收尾:三件事的最终状态
- 十七、10-01 下半场:一个贯穿性的模式(这比单个发现更重要)
- 十八、10-02:追查结案 —— 那不是"她退化了",是我们【量错了】
- 十九、10-02 深夜:工作记忆第一次测 —— 而我先测错了,然后自己抓出来
- 二十、目标交接(第 40/40 轮):只剩【一个】判据待读
- 二十一、接地线这条线的定案:"她读指令"是一个误会
- 二十二、 结论:她真的能学会"看字 → 知道该去哪"
- 二十四、 一个重要的更正:训练日志里那个"100%"是假的
- 二十五、 查清了:"训练好、评估差"的真正原因是【奖励与判据不是同一个条件】
- 二十六、 第二项能力:按顺序执行两个字(进展 + 真实数字)
- 二十七、 第二项能力的结果:顺序,她真的做到了
- 二十八、 三个种子把真相露出来了:她只学会了一对,而"亮着的目标格"一直在替她扛另一半
- 三十、 第二个"替她作弊的东西"也关掉之后:记忆这一项通过了
- 三十一、 第三项能力:数数(她会数了)
- 三十五、 下一步(我打算按这个顺序做)
- 三十六、 四条判据全部收口(本目标结束)
- 三十七、 下一个目标(已布署,跑前写死)
- 三十八、 尺子修好了 —— 而她这次守住了
- 三十九、 收口:五臂 + 八跑次跑完了 —— 而判据的形状错了
- §42 2026-10-03 深夜:病因锁定 = 优化动力学(用"一个数"证明)
- §43 2026-10-04 凌晨:根因是一条"曲线拟合直线",而修法有三个选项
- §45 2026-10-04 凌晨 00:15:填掉了契约里的"未测出"—— 末段大更新由 v(价值项)驱动
- §46 2026-10-04 凌晨 02:35:四个干预的判定,以及两处更正
- §47 2026-10-04 凌晨 03:10:"留住"有解了 —— 两个零架构改动的修法
- §49. 2026-10-04 晚:把保持机制接到打字(T5)
- §50. 2026-10-04 深夜:打字线的真问题(照拄)与它的解法
- §51. 2026-10-04 深夜:打字线的结论(真会写,且没有崖壁)
- §52. 2026-10-04 深夜:阶段报告建立了 —— 本阶段的收口与诚实界定
- §53. 2026-10-04 深夜:打字线的真短板是字体泛化,不是规模
- 1.3 需求汇总(用户确认过的)
- 2.2 两个任务
- 3.1 三条"反自欺"规则(写进 journal/PLAN.md)
- 3.4 工具化"科学纪律"(把规矩写成代码,而不是靠记性)
- 4.1 ✅ 接地任务「过线」已达成
- 4.2 崩溃的根因链(每一步都被数据否证过一次)
- 4.4 认字任务的读数(这是"真正的瓶颈"的证据)
- 4.5 记忆:一次重要的自我纠正
- 2. 已确认的环境事实
- 5. web 可视化现状
- 目录
- 踩坑提醒(详细版见 PROJECT.md §5)