2026-08-13
长任务中的子代理调度分布
冻结聚合显示,子线程创建记录分布在父线程观测跨度的三个区间;后台标记与时间区间重叠只能描述调度形态,不能证明语义任务阶段或真实并行计算。
这里把运行数据转成可以检查的结论,同时区分直接观察、机制推演与尚未验证的问题。
从这里开始
42 个超长会话的聚合研究显示,工具密度、上下文压缩、子代理派发与验证闭环共同塑造了长时间任务。
主题地图
观察超长会话、上下文压缩与子代理调度的共同形态。
代表文章已在页首展示 · 超长会话统计画像
2026-08-13
冻结聚合显示,子线程创建记录分布在父线程观测跨度的三个区间;后台标记与时间区间重叠只能描述调度形态,不能证明语义任务阶段或真实并行计算。
用调用数据衡量工具成本、浪费模式与修复后的变化。
2026-08-09
93,997 次真实工具调用的 token 消耗分析——Read/Grep/Bash 占出参 86.3%、26.2% 的浪费(重读与白搜)、写入类成本藏在入参、以及 ~100KB 截断的实证。
2026-08-09
基于 3,207 个主线程的运行数据,记录五类工具行为缺陷的修复实证——glob 搜索爆炸、大输出截断丢失、命令超时挂起、工具名调用失败、后台任务轮询等待。每类给出问题表现、架构设计与指标变化:>100KB 大输出每周 19~41 次降至 4~6 次、not found 调用 8 月归零、轮询等待从 91 次降至 3 次。
记录特定环境下的资源快照,并明确外推边界。
2026-08-12
50 个生产环境沙盒容器(debian-slim + peri,512 MiB 限制)的 docker stats 快照分析——22 个容器挤在 67~74 MiB 窄带、内存随负载呈阶梯分层、与 opencode 实测(7 进程均值 414~483 MiB)的对比。