2026-10-10 17:41
AI123

vLLM开源发布6款决策模型,均基于Qwen后训练

2026年10月10日,开源推理平台vLLM一口气推出6款决策模型。与微软同日发布的Decision-1类似,这些模型均基于不同版本的Qwen模型进行后训练,面向Agent工作流中的高频、小规模判断场景。

决策模型不会聊天、写代码或总结文档,而是接收一段上下文和一组预定义候选答案,在单次前向中直接输出每个选项的校准概率,输出供程序调用而非给人阅读。这类模型被用于请求分类、模型路由、搜索结果相关性判断、给AI回复或Agent动作打分、安全拦截、数据校验、工单分流、从固定动作中选择下一步以及大规模文本标注等任务。

在vLLM的Decision 2.0首页,用户可以体验这些决策模型的运行方式。其Demo项目主要展示了LLM路由等功能,例如输入提示词“17 x 24的结果是什么”时,模型会针对6个决策维度输出结果,包括模型选择、复杂程度、是否尝试越狱、需要什么工具、是否需要事实核查以及延迟优先级。

vLLM此次发布的6款决策模型延续了当前决策模型赛道的趋势:大多数新出现的决策模型均以不同版本的千问模型为基座进行后训练,而OpenAI的Decisions API和TypeSafe的Jev则是例外。这类决策模型大概率会作为Agent基础设施的一层保留下来,但不会取代普通大模型。

来源
  1. 2026-10-10 17:11 | 爱范儿:24 天估值暴涨 37 倍,这就是 AI 圈年度爽文
    阅读原文

    Jev 火了,一个非文本的 AI 模型在今天拿到了由 a16Z 领投的 8.7 亿美元融资,其公司 TypeSafe 的估值直接来到了 75 亿美元。 在 9 月 15 号刚刚发布时,TypeSafe 种子轮才 4000 万美元、估值约 2 亿;24 天,估值翻了 37 倍。 根据 Jev 创始人在 X 晒出的成绩单,Jev 在几天内容就突破了 100 万用户,模型推出三周,单日处理了数万亿 Token,有大约三分之一的财富 500 强都在使用这款决策模型。 一时间,决策模型遍地开花。从 OpenAI 开发者大会上发布的 Decisions API,到开源平台 vLLM 一口气发布了 6 款...

其他新闻

查看全部