TypeDecide 首页

Models · 独立模型目录

结构化决策竞品与开源模型

这里只收录提供推理能力的模型和决策引擎。项目指标来自各自模型卡或仓库,尚未经过 TypeDecide 统一环境复测。

“开源权重”“允许商用”和“允许平台代理”是三个独立判断;当前状态仅用于初筛,不构成法律意见或性能排名。

轻量模型

Laya 421M

许可初筛

Laya 以 ModernBERT 编码器和专用决策头直接计算 Choice、Score、Noul 的候选概率,不生成自由文本。421M 英文主检查点适合本地部署和动态候选实验,但多语言、较大候选集与业务置信度仍需单独验证。

本地部署轻量待平台实测
通用基线

Decider-2B

优先评估

Decider-2B 在答案槽位读取候选标签 logits,并只在合法选项内归一化概率,支持动态选项、批处理和 Jev 风格服务端。它更接近通用自托管基线,但 GPU 环境、Schema 缓存精度和英语之外的覆盖需要自行复测。

动态选项批处理可自托管
研究模型

NanoJev

仅研究

NanoJev 在 Qwen3-0.6B 骨干上增加结构化决策头,可批量处理多个 State、问题和动态候选,重点探索小模型与高吞吐路线。公开成果主要来自导航、游戏和校准专项检查点,许可证与跨领域能力仍需核验。

小模型CUDA许可待核验
Direct Logits

Reflex

技术评估

Reflex 在开放 Qwen 底座上直接读取候选 logits,可处理文本、JSON 和图像 State,并提供服务器与浏览器 WebGPU 两条演示路径。它适合验证多模态受限决策,但 0.8B 浏览器版与 4B 服务器版的能力、校准和许可必须分别判断。

多模态WebGPU温度校准
校准研究

System-One 4B

非商业

System-One 4B 在 Qwen3.5-4B-Base 上使用 LoRA 和标量评分头逐项计算候选概率,重点展示温度校准与 ECE、Brier 等评测流程。它适合作为非商业研究基线,但 384 token 输入、训练候选上限和 CC-BY-NC-4.0 限制了生产用途。

概率校准LoRA仅评测

不是排行榜

不同项目公开的 Accuracy、ECE 和延迟不能直接横向比较。只有在同一数据集、硬件、精度、输入格式和固定版本下复测后,结果才会进入统一比较。