Jev in production › Agent tool and action selection
Jev makes the step decisions in this Windows and Chrome GUI delegate for Codex, cutting main-model tokens 89.6 to 91.5% across the author's two benchmark runs (Jev GUI Delegate).
面向 Codex 的 Windows / Chrome GUI 委派原型。主模型交付任务与验收条件,本地控制器执行确定性步骤,需要语义判断时调用 TypeSafe Jev,并在每一步核对实际结果。
这是个人设计、借助 AI 实现并持续验收的工具项目。项目贡献包括任务契约、工具编排、低置信恢复、权限与状态检查、测试和反馈迭代;Jev 模型、TypeSafe SDK、Codex 和浏览器插件属于上游产品。
逐步操作网页会让主模型反复读取界面、选择控件和接收工具返回。这个项目把一段可明确验收的操作交给本地控制器,减少主模型在操作循环中的参与,同时保留状态检查、异常恢复和用户接管。
- 公开网页目标模式:自动发现控件和候选;排名不确定时逐项判断可接受动作,保留全部候选以及原有概率、置信度和身份检查。 - 真实页面适配:包含邻近作者信息、新标签接续、有限加载等待、正文与日期控件回传,以及重复导航和输出冲突恢复。 - 两条执行路径:Chrome 复用宿主提供的官方浏览器会话;Windows 使用 UI Automation。没有复制个人浏览器配置或提取 Cookie。 - 可检查的任务契约:目标、允许动作、范围、输入、步骤和成功条件显式定义。 - 按需使用模型:确定性匹配由本地代码执行;语义选择调用 Jev。零模型调用按实际记录,不当作 Jev 推理成功。 - 连续执行与恢复:保存进度,支持缺少输入的补充、局部选择修复、暂停、取消和用户接管;结果不明时不自动重放提交。 - 结果核验:操作前核对身份和范围,操作后检查实际值或页面状态;使用量与失败原因分开记录。
For the project's own README, linking back here: