Laya 421M
Laya 以 ModernBERT 编码器和专用决策头直接计算 Choice、Score、Noul 的候选概率,不生成自由文本。421M 英文主检查点适合本地部署和动态候选实验,但多语言、较大候选集与业务置信度仍需单独验证。
“开源权重”“允许商用”和“允许平台代理”是三个独立判断;当前状态仅用于初筛,不构成法律意见或性能排名。
Laya 以 ModernBERT 编码器和专用决策头直接计算 Choice、Score、Noul 的候选概率,不生成自由文本。421M 英文主检查点适合本地部署和动态候选实验,但多语言、较大候选集与业务置信度仍需单独验证。
Decider-2B 在答案槽位读取候选标签 logits,并只在合法选项内归一化概率,支持动态选项、批处理和 Jev 风格服务端。它更接近通用自托管基线,但 GPU 环境、Schema 缓存精度和英语之外的覆盖需要自行复测。
NanoJev 在 Qwen3-0.6B 骨干上增加结构化决策头,可批量处理多个 State、问题和动态候选,重点探索小模型与高吞吐路线。公开成果主要来自导航、游戏和校准专项检查点,许可证与跨领域能力仍需核验。
Reflex 在开放 Qwen 底座上直接读取候选 logits,可处理文本、JSON 和图像 State,并提供服务器与浏览器 WebGPU 两条演示路径。它适合验证多模态受限决策,但 0.8B 浏览器版与 4B 服务器版的能力、校准和许可必须分别判断。
System-One 4B 在 Qwen3.5-4B-Base 上使用 LoRA 和标量评分头逐项计算候选概率,重点展示温度校准与 ECE、Brier 等评测流程。它适合作为非商业研究基线,但 384 token 输入、训练候选上限和 CC-BY-NC-4.0 限制了生产用途。
不同项目公开的 Accuracy、ECE 和延迟不能直接横向比较。只有在同一数据集、硬件、精度、输入格式和固定版本下复测后,结果才会进入统一比较。