JEV 玩贪吃蛇:每秒 3 步,模型到底判断了什么?
本文展示用JEV框架让模型玩贪吃蛇:每秒3步,将局面转为四向选择题,输出方向概率。本地Laya实现,不调远程API;程序预计算安全与路径特征,模型仅对标签化选项做判断。附JEV教学Skill供延伸实践。(239字)
从 Codex 反推优秀 Agent Harness 的七条设计原则
本文提炼Codex架构中Agent Harness的七大设计原则:模型为决策者而非控制者;状态按生命周期精准归属;命令与事件分离;事实与工作集解耦;无界输入必须有界化;失败需保留结构化语义;扩展须分层拆解。强调Harness是保障Agent可靠性的核心系统,而非简单胶水层。(239字)
Agent 自进化:从评测、记忆到 Skill 更新,工程闭环怎么搭
AI Agent自进化不是让模型“自学成才”,而是构建工程化闭环:评测发现问题→沉淀经验→更新Prompt/Skill→回归验证→灰度发布→反馈回流。核心在于Harness层(Prompt、Skill、Memory等)的持续优化,需借鉴CI/CD、自动化测试、Trace分析等软件工程实践,实现可验证、可回滚、可管控的真正持续改进。(239字)