社区案例精选

看看开发者如何 使用 Jev。

浏览来自 X 和 YouTube 的 Jev AI 产品功能、实验与教程。每个案例都聚焦一个可以借鉴到自己项目中的具体决策。

25 个精选案例2 个内容平台每张卡片均附原帖或原视频链接
案例列表

从具体决策开始。

按所解决的问题浏览演示和实际产品案例。每条 X 帖子和 YouTube 视频都附有我们的说明,解释 Jev 负责哪项具体决策。

正在显示 25/25 个精选案例

智能体与自动化 · 01
教程

把语音指令转换为浏览器操作

Moritz Kremb 在一段较长的教程中构建了语音控制浏览器。语音先被转成文字,再由 Jev 从当前页面元素中判断用户意图对应的操作和目标。

Jev 负责的决策这是一条操作指令吗?如果是,应该执行哪个可见操作?

Jev 只是整个循环中的一个环节。语音识别、浏览器状态、安全检查和实际点击都在模型之外处理。

智能体与自动化个人工具SDK 与示例ChoiceNoul
社区案例 · YouTube 视频
SDK 与示例 · 02
教程

在三个应用中比较 Choice、Score 和 Noul

Riley Brown 介绍了 Jev 的三种输出形式,并展示了几个小型应用,包括为请求选择模型和对邮件进行分流。

Jev 负责的决策应用所要做的决定适合哪一种回答形式?

先确定输出格式:选择一个选项、给出数值评分,或回答一个是非问题。如何根据结果采取行动,仍由应用程序负责。

SDK 与示例智能体与自动化客户支持ChoiceScoreNoul
社区案例 · YouTube 视频
SDK 与示例 · 03
教程

观看 TypeSafe 团队现场讲解 Jev

TypeSafe 开发者关系负责人 Allie Laabs 做客 ThursdAI,讲解 System One 模型以及 Choice、Score 和 Noul 三种能力。节目还包括帖子分类器和实时游戏演示。

Jev 负责的决策哪个结构化问题可以替代开放式生成步骤?

这段访谈提供了来自团队的背景说明、演示和待讨论问题。节目中提到的性能和价格数据属于发言者的说法。

SDK 与示例游戏ChoiceScoreNoul
社区案例 · YouTube 视频
智能体与自动化 · 04
原型

从动态操作列表中选择浏览器智能体的下一步

Gregor 展示了一个开源浏览器智能体:它读取 DOM 状态和不断变化的可用操作,由 Jev 选择每一步;只有需要输入文字时,才回退到一个小型语言模型。

Jev 负责的决策当前可用的浏览器操作中,下一步应该执行哪一个?

作者称机票搜索示例约耗时 7 秒、成本 0.0039 美元。这只是演示数据,不应视为基准;操作执行和安全防护仍由应用负责。

智能体与自动化个人工具Choice
社区案例 · X 帖子
正在加载 Gregor Zunic 的帖子…
安全防护 · 05
原型

压缩上下文时只保留相关的工具调用

Tamara 演示了逐条评估工具调用、丢弃无关步骤的做法,而不是用生成式摘要改写需要保留的上下文。

Jev 负责的决策这条工具调用是否足够相关,值得保留在智能体上下文中?

逐条筛选可以保留入选内容的原文,但步骤之间的依赖关系和审计要求仍需确定性检查。

安全防护工程智能体与自动化ScoreNoul
社区案例 · X 帖子
正在加载 Tamara Tran 的帖子…
智能体与自动化 · 06
原型

将 Box 事故报告分配到合适队列

Aaron Levie 演示了一个智能体:它读取 Box 中的事故报告,判断客户是否受到影响并评估严重程度,然后把文件移入升级、监控或人工复核文件夹。

Jev 负责的决策这起事故应该进入哪个队列,紧急程度有多高?

关键边界在于简短分类与执行分类结果的工作流之间。移动文件夹和更新元数据仍由应用代码负责。

智能体与自动化客户支持ChoiceScore
社区案例 · X 帖子
正在加载 Aaron Levie 的帖子…
搜索与排序 · 07
原型

出价前评估二手商品信息

在一段西班牙语演示中,Alan Daitch 将 Playwright 与 Jev 结合,用来审查二手商品信息。Jev 判断商品是否符合要求,外围工作流则负责放弃、出价或向卖家询问缺失信息。

Jev 负责的决策这件商品是否符合购买者对尺寸、预算及其他条件的要求?

作者在后续帖子中说明,系统会针对页面文字进行五项是非判断。页面导航、报价和联系卖家是另外的操作,需要独立的审核规则与保护措施。

搜索与排序智能体与自动化个人工具Noul
社区案例 · X 帖子 · 西班牙语
正在加载 Alan Daitch 的帖子…
个人工具 · 08
原型

根据讲话内容显示最相关的幻灯片

Rinte 的日语演示会根据当前谈论的主题选择匹配的演示幻灯片,演讲者无需操作翻页器或键盘。

Jev 负责的决策哪一张预先准备的幻灯片最符合当前讲话内容?

这是从现有幻灯片中进行选择的任务。语音采集和幻灯片展示属于 Jev 外围的应用功能;演示并没有让 Jev 生成幻灯片。

个人工具智能体与自动化Choice
社区案例 · X 帖子 · 日语
正在加载 Rinte 的帖子…
客户支持 · 09
原型

追踪对话进展状态

Kaneko 的日语原型会在每次发言后更新三组会议信号:探索或收敛、已解决或待处理、存在分歧或达成一致。

Jev 负责的决策当前对话在这三个维度上分别处于什么状态?

重复执行范围明确的判断,可以让实时讨论更容易理解。这个原型只是可视化工具,并不能证明这些标签准确反映了每位参与者的真实意图。

客户支持个人工具Choice
社区案例 · X 帖子 · 日语
正在加载 Tsuyoshi Kaneko 的帖子…
智能体与自动化 · 10
原型

用 Jev 引导电脑操作流程

在一段中文演示中,Sac 将 Codex 与 Jev 结合,在 Mac 日历中添加事件,并对比展示使用和不使用 Jev 辅助流程时的同一项任务。

Jev 负责的决策根据当前状态,下一步应该执行哪个可用的电脑操作?

并排视频直观呈现了响应速度,但这只是单个作者的对比,并非受控性能测试。实际操作及其结果验证仍由应用负责。

智能体与自动化工程个人工具Choice
社区案例 · X 帖子 · 中文
正在加载 Sac 的帖子…
搜索与排序 · 11
原型

把新闻匹配到相关品牌

一段中文演示让 Jev 处理涉及 15 个品牌的新闻流,为新闻分配结构化意图标签,并找出可能与各品牌相关的报道。

Jev 负责的决策这条新闻是否与某个品牌相关,适合哪个意图标签?

作者称批处理速度很快,但回复中也有人指出明显的分类错误。因此,在把结果用于公关决策前,仍需要编辑审核和可量化的准确率测试。

搜索与排序工程ChoiceNoul
社区案例 · X 帖子 · 中文
正在加载 梭哈.AI 的帖子…
智能体与自动化 · 13
原型

在发起高成本模型请求前选择合适的 AI 模型

Duncan 展示了一个路由器:先让 Jev 判断哪个模型适合当前请求,再把请求发送给该模型。Jev 负责路由判断,另一个模型负责生成开放式回答。

Jev 负责的决策哪个可用模型最适合处理这项请求?

范围明确的选择可以放在生成式模型之前。路由器仍需设置回退规则,并用真实请求进行评估。

智能体与自动化搜索与排序Choice
社区案例 · X 帖子
正在加载 Duncan 的帖子…
工程 · 14
已上线功能

一键匹配名称不同的数据字段

Bannerbear 介绍了一项已经上线的功能:即使字段名称不同,也能把来源字段匹配到模板字段,例如将 avatar 对应到 photo、将 full_name 对应到 name。

Jev 负责的决策每个模板位置应该对应哪个来源字段?

这是一个候选范围固定的简洁语义匹配任务。产品仍应允许用户检查并修正建议的匹配结果。

工程个人工具Choice
社区案例 · X 帖子
正在加载 Jon Yongfook / Bannerbear 的帖子…
工程 · 15
原型

按语义为电子表格各行评分

Nader Dabit 分享了一段预测型电子表格演示:输入“紧急程度”等列标题后,表格会判断每一行文字的含义,而不只是重新计算数字公式。

Jev 负责的决策结合这一行的内容和列的含义,它的紧急程度有多高?

当需要的信号来自语义时,评分可以扩展电子表格的能力。该演示仍是原型,其评分在投入实际业务前需要经过测试。

工程个人工具客户支持Score
社区案例 · X 帖子
正在加载 Nader Dabit 的帖子…
安全防护 · 16
原型

用自然语言规则过滤信息流

Marcel Pociot 演示了一款浏览器扩展:它会隐藏或折叠符合用户自然语言规则的 X 帖子,并在用户浏览时根据 Jev 返回的判断执行操作。

Jev 负责的决策这条帖子是否符合用户设定的过滤规则?

是非判断可以让个人内容过滤器及时响应。这里的误判影响很大,因此选择可撤销的“折叠”操作,比静默删除内容更安全。

安全防护个人工具Noul
社区案例 · X 帖子
正在加载 Marcel Pociot 的帖子…
个人工具 · 17
原型

按决策规则整理下载文件

Marcel Pociot 展示了一款监控 macOS“下载”文件夹的应用。它判断新文件是否为发票,再按照配置规则归档并重命名符合条件的文档。

Jev 负责的决策这个文件是否为应归入指定文件夹的发票?

作者表示,低置信度文件会留在原处等待人工检查。合理的阈值和重复文件检测,比让所有文件自动移动更重要。

个人工具工程NoulScore
社区案例 · X 帖子
正在加载 Marcel Pociot 的帖子…
安全防护 · 18
原型

升级处理不确定的邮件分类

Hassan 展示了一条处理流程:先由 Jev 分类一批邮件,再把不确定的案例交给另一个模型,将快速初筛与更细致的复核分开。

Jev 负责的决策这封邮件是否可疑到需要升级处理?

最重要的设计选择是不确定性阈值。作者报告的准确率只适用于演示中的那批邮件,不能直接代表所有收件箱或欺诈模式。

安全防护客户支持智能体与自动化NoulScore
社区案例 · X 帖子
正在加载 Hassan 的帖子…
客户支持 · 19
原型

把大批邮件分流到支持队列

Riley Brown 演示了 Jev 在数秒内对 500 封邮件进行分类:系统从有限类别中选择,而不是为每封邮件生成回复。

Jev 负责的决策这封邮件最适合进入哪个已配置的队列?

作者称该演示总成本约为 0.035 美元。用于生产环境时,仍需明确标签体系、处理低置信度结果,并对重要邮件进行人工复核。

客户支持智能体与自动化Choice
社区案例 · X 帖子
正在加载 Riley Brown 的帖子…
工程 · 20
原型

用结构化检查初筛 PR

Paolo Rosson 把代码差异交给 Jev,得到一组关于潜在密钥泄露、SQL 注入、身份验证改动、测试缺失及其他审查信号的判断。

Jev 负责的决策审查者应该重点检查这份代码差异中的哪些风险?

这些结果只是审查提示,并不能证明代码可以安全合并。对于影响重大的改动,仍应保留人工审查和确定性扫描工具。

工程安全防护NoulScore
社区案例 · X 帖子
正在加载 Paolo Rosson 的帖子…
工程 · 21
原型

用可重复的结构化评审器评估智能体运行结果

LangChain 从准确性、一致性、延迟和成本几个方面对比 Jev 与语言模型评审器,探索评估智能体行为的另一种方式。

Jev 负责的决策这次智能体运行结果是否符合评估标准?

只有当评分规则和标签能反映团队真正关心的行为时,更快的评审器才有价值。基准测试结论还应在各应用自己的数据上复现。

工程SDK 与示例智能体与自动化NoulScore
社区案例 · X 帖子
正在加载 LangChain 的帖子…
游戏 · 22
原型

实时选择结构化的游戏关卡参数

Hugo Duprez 演示了 Jev 输出结构化决策,再由游戏引擎在游玩过程中据此构建下一段关卡。

Jev 负责的决策下一段关卡应该采用哪些允许的参数?

Jev 只在游戏预设的结构中选择;有效几何形状、难度上限和可通过的衔接仍由引擎保证。速度数据属于作者自述。

游戏工程Choice
社区案例 · X 帖子
正在加载 Hugo Duprez 的帖子…
游戏 · 23
原型

为 Pac-Man 选择下一步移动方向

Duncan 将迷宫状态作为 JSON 发送,并让 Jev 在 Pac-Man 到达岔路口时选择方向,再由游戏引擎实时执行这个范围明确的决定。

Jev 负责的决策Pac-Man 下一步应该转向哪个可行方向?

游戏能直观展示重复且对时延敏感的决策。这个演示说明的是控制循环,并不表示 Jev 可以直接看懂原始游戏画面。

游戏Choice
社区案例 · X 帖子
正在加载 Duncan 的帖子…
搜索与排序 · 24
已上线功能

发布前评估帖子草稿

Rob Hallam 展示了一段 SuperX 演示:系统针对每条帖子提出多项固定问题,再用答案对草稿排序。这说明评分可以辅助编辑,而不是替用户生成帖子。

Jev 负责的决策哪份草稿对目标受众呈现出最强的有效信号?

只有当排名与后续实际效果相关时,它才有价值。在独立复现之前,应把作者公布的表现数据视为演示中的说法。

搜索与排序ScoreChoice
社区案例 · X 帖子
正在加载 Rob Hallam / SuperX 的帖子…
搜索与排序 · 25
原型

批量标记竞品广告库

Stav Zilbershtein 演示了如何按照客户旅程阶段和创意风格,对大型广告库进行分类,再用这些标签分析竞争对手的广告组合。

Jev 负责的决策每条广告属于哪个转化漏斗阶段和创意风格?

一致的标签让大型内容集合更容易比较。帖子中的耗时和成本均由作者报告;更深入的账户分析属于外围工作流,不一定是 Jev 的直接输出。

搜索与排序工程Choice
社区案例 · X 帖子
正在加载 Stav Zilbershtein 的帖子…
继续探索

把案例思路变成可以构建的项目

先在 Playground 中测试结构化决策,再到“项目”中查看开源集成与示例。