热点事件持续更新
vLLM Semantic Router发布Decision 3.0多模态决策模型
1 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年10月12日,vLLM Semantic Router团队发布了基于Qwen微调的开源多模态决策模型Decision 3.0。该系列包含从0.8B到27B共5种尺寸,支持文本、JSON和图像输入,并采用Apache-2.0许可。报道指出,其中9B参数的d3-flash版本在内部评估中得分超过上一代27B模型,且单请求文本延迟低至21.7毫秒。目前关于该模型的早期报道较少,主要信息集中于此次发布的性能指标与规格参数。
AI 根据报道生成 · 2 小时前更新
最新进展10月12日 05:43
vLLM发布Decision 3.0,9B版d3-flash性能超上代27B,延迟低至21.7ms报道时间线
沿着报道,了解事件的不同侧面。
10月12日
- MarkTechPostvLLM Semantic Router 发布 Decision 3.0 开源多模态决策模型
vLLM Semantic Router 团队发布 Decision 3.0,这是一套基于 Qwen 微调的开源多模态决策模型。该系列包含从 0.8B 到 27B 的 5 种尺寸,支持文本、JSON 和图像输入,采用 Apache-2.0 许可。其中 9B 的 d3-flash 在内部评估中得分超过上一代 27B 模型,单请求文本延迟低至 21.7 ms。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。