研发效能
7 篇
从 Workflow Harness 到轻量 Prompt:Codex 5.6 之后我删掉了什么
当模型的原生流程已经够强,Harness 会从效率放大器变成上下文负担。这次重写保留了安全边界,同时大幅精简 Prompt 和运行时。
补丁提升:为一次代码修改自建的一套运输协议
PatchBundleV1 将隔离环境中的候选文件状态封装为可验证工件,再由可信 Host 按日志步骤写入、回读并出具不可变回执。
上下文加载:解释「怎样加载上下文」本身也在消耗上下文
用证据优先级、可重建句柄与新鲜度指纹控制每一轮推理真正需要看到的材料。
测试通过、CI 绿色、线上正常,是三件不同的事
从本地测试到线上回读,每一层证据都必须绑定明确的结论范围,不能互相替代。
写入授权与隔离工作区:能编辑文件,不等于被授权编辑这个文件
StageWriteGrantV1 将任务权限压缩为绑定版本、路径、操作与执行实例的一次性能力,并由隔离工作树和逐层回读共同实施。
顶层配置只留四条硬规则:Agent 在哪里必须停下来
模型可以越来越自主,但生产、持久化数据、成本和不可逆动作必须先经过明确授权。安全不是效率的对立面,而是自动化成立的前提。
我给自己的 AI 研发流程写过一套控制平面
拆解一套强调可追溯、可恢复和权限隔离的文件式 AI 研发控制平面。