TypeDecide 首页

Jev 使用示例

语义熔断器

不只比较工具名称,而是判断 Agent 是否在围绕同一错误假设重复尝试,为运行时提供一个可审计的停止信号。

STATE 设计

Agent 最近的假设、动作与工具结果

只提供完成判断所需的上下文,避免提交密码、密钥、无授权个人数据或与问题无关的长文本。

OUTPUT 设计

继续、换路或中止,以及循环风险

每个问题都使用完整 instructions,ID 仅用于关联响应,不能承担问题语义。

可复现输入

示例 State

{
  "goal": "Find the invoice for order A-1042",
  "assumption": "the invoice must be in the email inbox",
  "recent_actions": ["search_email", "search_archive", "search_spam"],
  "results": ["not_found", "not_found", "not_found"]
}

问题设计

每个输出都有独立语义

Choice

control_action

在 continue、change_assumption 和 stop_and_escalate 中选择控制动作。

Noul

semantic_loop

判断近期动作是否基于同一未验证假设形成语义循环。

案例来源

来自社区实践,由 TypeDecide 重新编写

本页借鉴 Ashutosh (@ashutoshftw) 公开分享的场景。State、问题、候选项和执行边界均由 TypeDecide 重新设计;来源链接只用于溯源,不构成准确率或性能背书。

执行边界

概率交给策略层,而不是直接执行

熔断器应配合硬性步数、时间和费用上限;任何一项达到阈值都要停止,不应只依赖语义判断。

  • 保存候选概率、模型版本和问题配置,便于复核。
  • 输入缺失或候选概率接近时,补充信息或转人工。
  • 模板可用于本地 Mock;登录后也可主动真实运行,但任何结果都不代表业务准确率已经达标。
载入此模板