候选 logits
问题和候选被写入提示模板,模型读取每个答案槽位的隐藏状态,只对合法候选标签计算概率。
模型介绍 · 通用基线
Decider-2B 基于 Qwen3.5-2B-Base,在答案槽位读取候选 token logits,一次前向返回 Choice、Score 与 Noul 概率。本页说明其动态选项、批处理、Schema 缓存和 Jev 风格接口,以及 GPU 部署、精度折衷与语言覆盖限制。
Decider-2B 是基于 Qwen3.5-2B-Base 的开放决策模型。它在每个 Answer 槽位读取候选标签对应的 logits,再对合法候选做 softmax,因此不会生成选项之外的文本。
模型卡描述的 v8 支持字符串、对象或数组 State、2 到 255 个动态选项、批量请求,以及与 Jev System One 请求形状相近的 Choice、Score、Noul 输出。
它的主要价值是把较通用的 Qwen 底座包装成受限决策服务:调用方继续掌握问题结构和候选集合,模型只负责分配概率。32k 输入上限和 255 个候选是接口容量,不代表长上下文、大候选集或所有领域都能保持同等准确率。
推理路径
问题和候选被写入提示模板,模型读取每个答案槽位的隐藏状态,只对合法候选标签计算概率。
默认情况下每个问题使用独立行评分,避免同一次调用中的其他问题改变答案;也可选择更快的紧凑布局。
固定问题集合可以预计算问题前缀,再批量传入不同 State;模型卡同时提示这种布局会牺牲部分准确率。
采用判断
来源与边界
本页根据项目模型卡、仓库说明和其中公开的训练或评测设置整理。不同项目的硬件、数据集、版本、温度与样本量不同,公开数字不能直接组成排行榜;生产采用前仍需复核许可证并在目标数据上重测。
继续了解