浏览器的下一步,
交给 Jev 判断。
jev-ultrafast 读取页面中的控件,让 Jev 一次选出操作和目标;需要输入文字时,再交给文本模型。
航班搜索任务中位耗时
同任务 · 优化后 3 次运行
作者报告的单一任务结果,本站未复测;不能外推到所有浏览器任务。
搜索苏黎世到伦敦的航班
读取 DOM 控件
observe选择输入框或按钮
decide执行并检查页面状态
actTHE JEV CASEBOOK VOL. 02 / 2026
从浏览器的一次点击,到 Agent 的下一步。
从 60 个公开项目与演示中,寻找可复用的用法。
jev-ultrafast 读取页面中的控件,让 Jev 一次选出操作和目标;需要输入文字时,再交给文本模型。
航班搜索任务中位耗时
同任务 · 优化后 3 次运行
作者报告的单一任务结果,本站未复测;不能外推到所有浏览器任务。
搜索苏黎世到伦敦的航班
读取 DOM 控件
observe选择输入框或按钮
decide执行并检查页面状态
actEXPLORE THE COLLECTION
60 个不同项目与演示 · 10 类用途 · 55 个附源码入口,5 个仅有公开帖文
BROWSER & DEVICES
从网页控件到 Android 手机,判断与操作分工。
让 Jev 选择浏览器操作
输入 · 任务目标与 DOM 控件
作者在同一航班任务的 3 组对照中记录了优化后 7.092 秒中位耗时;初始导航不计入计时,不能外推为通用浏览器基准。
资料核对 2026-09-19 · 本站未进行运行复测
在桌面应用中选控件与动作
输入 · 原生无障碍树和操作目标
Jev 功能位于 agent-desktop 的独立 skill/scripts 中;快照采集也有成本,不能把推理延迟当作整体耗时。
资料核对 2026-09-19 · 本站未进行运行复测
在 Android 手机上完成界面操作
输入 · 手机状态、可操作控件与任务
作者的 Uber 视频到达付款选择,未展示订车完成;深色模式另有校验演示。本站未跑真机。
资料核对 2026-09-19 · 本站未进行运行复测
为网页元素分类并生成隐藏规则
输入 · 网页候选元素及上下文
隐藏同意弹窗不等于同意或拒绝;模型回答异常时保留旧规则。本站未验收浏览器效果。
资料核对 2026-09-19 · 本站未进行运行复测
边说话,边判断浏览器下一步
输入 · 实时部分转录与网页元素快照
语音转写和浏览器控制由其他组件完成;作者延迟与费用未由本站复测,语音确认不等同安全保证。
资料核对 2026-09-19 · 本站未进行运行复测
ROUTING & WORKFLOWS
先决定走哪条路径,再由代码执行。
为每轮 Codex 任务选择模型
输入 · 当前任务与此前对话
约 60% 的节省来自 237 轮历史回放的标价重算;固定 token 用量,未计跨模型缓存失效,不是已付账单下降。
资料核对 2026-09-19 · 本站未进行运行复测
把概率接到明确的应用策略
一轮判断完成客服分流
CONTEXT & SIGNAL
判断哪些信息值得保留或进一步分析。
给工具输出做可召回的筛选
输入 · Read、Bash、Grep 输出块
检测到错误时保留原输出;支持其他判断后端。筛选效果依赖任务和阈值,本站未复测。
资料核对 2026-09-19 · 本站未进行运行复测
压缩旧工具记录,保留原文
输入 · 对话、工具调用及结果引用
避免改写不等于完全无损;关键上下文仍可能被误删,需结合实际会话检查。
资料核对 2026-09-19 · 本站未进行运行复测
只加载当前任务相关的技能说明
保留日志,筛选值得深查的信号
输入 · OpenTelemetry 日志记录
项目为 preview;省下大模型分析不等于减少原始归档,本站未测实际业务收益。
资料核对 2026-09-19 · 本站未进行运行复测
探索减少记忆检索的上下文消耗
输入 · 自定义记忆系统;具体输入未公开
作者称 token 减少 94%、检索快 2–3 倍,同时强调只是快速测试。缺少公开实现和可比测试条件。
资料核对 2026-09-19 · 本站未进行运行复测
CODE & REVIEW
把代码、风险和验证证据联系起来。
沿风险信号展开代码审查
输入 · Git diff 或完整代码库
作者定位为实验;发现是审查线索,不能直接当作缺陷证明,尚未集成编译器和静态分析器。
资料核对 2026-09-19 · 本站未进行运行复测
给编码 Agent 分诊与复核能力
给编码工人加进度监督
输入 · Codex 工作状态和验证证据
必须通过程序员指定的验收命令;乐观评分或进程成功退出都不能替代验证。
资料核对 2026-09-19 · 本站未进行运行复测
SEARCH, DATA & GRAPHS
让查询从关键词延伸到语义判断。
用语义判断在目录树里找文件
一步一步选择知识图谱关系
输入 · 当前节点、邻接关系与目标
需有效 TypeSafe key 才能进行真实推理;无 key 的示例会使用注明的替代结果。未验证大规模图谱性能。
资料核对 2026-09-19 · 本站未进行运行复测
在 SQL 里按含义筛选数据库行
输入 · 数据库行与自然语言条件
是调用外部模型的扩展;无索引不等于查询无成本,本站未做规模或吞吐测试。
资料核对 2026-09-19 · 本站未进行运行复测
选择搜索来源,再排序结果
输入 · 用户查询与多个引擎的候选结果
搜索由 Search1API 和各引擎执行;Jev 的选择不代表覆盖全部来源,也不保证每条结果正确。
资料核对 2026-09-19 · 本站未进行运行复测
将大分类目录拆成逐层选择
改单元格时触发多项检查
输入 · 正在编辑的单元格;具体问题未公开
仅核对到作者演示帖文;未公开检查清单、误报率与完整源码,不能视为已验证的数据校验产品。
资料核对 2026-09-19 · 本站未进行运行复测
SAFETY & QUALITY
对内容、输入和动作加一层可配置判断。
核对引用、筛查内容、重排候选
输入 · 主张与证据、网页文本或候选列表
README 给出实际调用示例;screen 只返回建议,执行策略由调用方负责。本站未复测。
资料核对 2026-09-19 · 本站未进行运行复测
在请求转发前检查内容
在工具执行前后观察风险
在字段格式之外检查语义
为 AI SDK 工具调用选择处理路径
GAMES & CREATIVE
把离散选择组合成连续的游戏、音乐和界面。
在浏览器里与 Jev 对战
输入 · 结构化对局状态
约 9 Hz 是 README 描述的决策 tick,非本站实测吞吐;API 不可用时有确定性回退。
资料核对 2026-09-19 · 本站未进行运行复测
让模拟车从候选路线中选下一步
替 Flappy Bird 选择飞行路径
让判断驱动文字冒险的场景变化
在玩具机场里协调起降
通过连续选择组合多轨音乐
让 Jev 决定 Doom 战术动作
从组件库组合界面
观察模型的和声知识与选音行为
通过模拟器状态选择 Mario 按键
输入 · RAM、遥测、地形、敌人及延迟信息
模型读取结构化 JSON,不是截图;仓库不包含 ROM。视频能展示玩法,但不能单独证明稳定通关。
资料核对 2026-09-19 · 本站未进行运行复测
在无人机模拟中提供战术判断
输入 · 经典视觉转换出的障碍和目标状态
在 MuJoCo 中模拟,非真实无人机飞行;Jev 不是视觉或高频控制层,作者关键演示列为单次运行。
资料核对 2026-09-19 · 本站未进行运行复测
HOME, VOICE & INDUSTRY
观察判断模型进入具体应用的方式。
给流动性规则加一组旁路信号
输入 · 池状态、交易流与市场信号
源码明确为 shadow/advisory only,Jev 不驱动 ENTER/EXIT;不能称为由 Jev 自动交易或盈利验证。
资料核对 2026-09-19 · 本站未进行运行复测
把家里的状态变成可用判断
将判断题用于机械与电气工作
给简历与职位匹配做结构化检查
在计入成本的模拟器里测试交易判断
把家居语音指令分给合适入口
输入 · 用户的家居控制或聊天语句
当前 fast path 范围是灯光服务;不能外推到所有 Home Assistant 设备。
资料核对 2026-09-19 · 本站未进行运行复测
判断用户是否真的说完了
输入 · 语音转录和对话上下文
源码提供可配置 turn-end gate;没有据此验证所有语言与声学环境下的对话体验。
资料核对 2026-09-19 · 本站未进行运行复测
根据链上盘口选择买卖方向
输入 · Kuru MON-USDC 订单簿与价格状态
默认 MODEL=mock;无私钥时为 dry-run。公开演示部署注明模拟成交,不能将所有运行都称为真实 Jev 交易。
资料核对 2026-09-19 · 本站未进行运行复测
为附近的创作者提供相识推荐
输入 · 附近创作者信息;具体输入结构未公开
作者称推荐准确并展示结果;未核到公开源码,不能据一个匹配示例推断推荐准确率。
资料核对 2026-09-19 · 本站未进行运行复测
尝试批量处理收件箱分类
输入 · 邮件文本;样本与分类标签未公开
原帖声称数秒分类 500 封、花费 3.5 美分;缺少复现实验、准确率与完整输入,本站不背书这些数字。
资料核对 2026-09-19 · 本站未进行运行复测
按自定义过滤器整理私人邮箱
输入 · 邮箱消息及用户设定的过滤条件
作者公开帖文,未找到公开源码;不能核实分类准确率、客户端分发状态或其他 AI 功能的底层模型。
资料核对 2026-09-19 · 本站未进行运行复测
CLI, SDK & INTEGRATIONS
把同一类结构化判断接到现有工具链。
让编码助手直接调用判断题
把语义判断接进 Unix 管道
在终端试隐私与语气判断
从终端提交三类结构化问题
把判断封装成有版本的服务
用 AI SDK 接入批量判断
输入 · 共享状态与 Choice、Score、Boolean 问题
源文件显示可选 TypeSafe provider;evaluation 为实验接口,不表示框架所有用户默认采用 Jev。
资料核对 2026-09-19 · 本站未进行运行复测
在 Python 应用中配置 TypeSafe provider
输入 · 应用配置与 TypeSafe SDK 客户端
核对的是可选 provider 源码,不能据此宣称整个 Pydantic AI 都在使用 Jev。
资料核对 2026-09-19 · 本站未进行运行复测
EVALUATION & RELIABILITY
查看作者如何测量边界、错误和实际成本。
识别 HTTP 200 中的语义失败
为多 Agent 失败记录归因
输入 · 失败轨迹与候选 Agent、步骤、错误类型
作者使用注入错误的数据集;部分对照是论文结果,Who/When 的受限选择与自由生成任务并不等价。
资料核对 2026-09-19 · 本站未进行运行复测
测试 Jev 能否胜任搜索重排
检验注入识别与漏洞代码判断
输入 · 公开语料中的消息与成对代码
作者记录 662 条注入语料与 200 对代码;加入业务上下文会改变结果,不能外推为生产防护保证。
资料核对 2026-09-19 · 本站未进行运行复测
Choice从给定候选中选择,返回概率分布。
Score在你定义的有序刻度上做判断。
Noul用 0 到 1 的数值表达判断。
格式确定,判断仍可能出错。阈值、兜底与实际动作由应用代码控制。
BUILT WITH JEV?
做了一个使用 TypeSafe Jev 的项目,或发现了值得收录的演示?把链接和用法告诉我们。
提交不会立即公开。联系方式仅用于核对投稿,不在页面展示。请勿提交密钥、个人敏感信息或非公开资料。
ABOUT THE COLLECTION
本期结合公开社区资料、原始仓库与 X / 网页检索,按项目去重、按用途整理。收录 55 个可查看源码的项目与 5 个只有公开帖文的演示,不代表全网穷尽。
“文档 / 源码核对”只表示读过所链接的资料;作者测试、基准和视频均保留其原始验证范围。本站没有为这些项目运行 API、游戏对局或业务流程。OpenJev 等独立复刻模型不混入 TypeSafe Jev 案例。