vLLM Semantic Router lança o Decision 2.0, modelos de decisão abertos de 0,6B a 27B
O time do vLLM Semantic Router anunciou o Decision 2.0 na noite de 2 de outubro de 2026 (horário de Brasília). O post de lançamento tinha cerca de 740 curtidas, 39 mil visualizações e 680 salvamentos na manhã seguinte. A família sucede o Decision 1.0 Lux e o Kai, com seis tamanhos: Kai-0.6B, Eos-0.8B, Sol-2B, Nox-4B, Lux-9B e um novo topo, o Vega-27B (adapter sobre o Qwen3.8-27B). Todos são Apache-2.0, usam a mesma chamada system_one() da 1.0 e devolvem uma probabilidade por opção sem gerar texto.
Os números (UnverifiedClaim). Segundo os model cards:
| Modelo | Parâmetros | JevArena | Transferência rotulada por humanos | Decision Index (1.0 → 2.0) | Latência mediana |
|---|---|---|---|---|---|
| Vega-27B (novo) | 29,37B | 74,0 (AutoJev-27B 72,1) | 58,7 | 56,5 | 71,4 ms |
| Lux-9B | 7,94B | 68,1 | 56,2 | 43,5 → 46,3 | 18,4 ms |
| Nox-4B | 4,21B | 63,6 (Decider 4B 61,9) | 52,3 (Decider 4B 55,5) | 34,4 → 43,8 | 12,9 ms |
| Sol-2B | 1,88B | 52,1 | 51,3 | 25,3 → 29,5 | 7,2 ms |
| Eos-0.8B | 0,75B | 53,9 | 50,3 | 18,4 → 20,1 | 6,0 ms |
| Kai-0.6B | 0,60B | 48,6 | 45,9 | 6,5 → 16,3 | 4,9 ms |
Os scores do Decision 2.0 no índice vêm marcados como “reprodução independente com o kit oficial 0.2.1”, mas foram rodados pelo próprio time; as linhas de comparação são o snapshot do board público de 28 de setembro. Nesses termos, o Vega ficaria logo abaixo do Jev (57,91). Os cards não batem entre si: o do Vega fala em “+11,2 sobre o Lux 2.0”, mas os dois scores publicados diferem em 10,2. O JevArena, em que cada card aparece “no topo do seu tamanho”, é uma comparação do próprio time entre modelos abertos do mesmo porte, e o Nox-4B fica atrás do Decider 4B na coluna de transferência rotulada por humanos. As latências são por requisição de uma pergunta, numa GPU não identificada.
O que muda aqui. A família ganhou ficha própria no catálogo, Decision 2.0 (4,9 de maturidade / 6,7 de capability / 7 de adoção), avaliada nos mesmos termos de outras releases com rodada própria: acurácia fica em 6 até a 2.0 entrar no índice público. As fichas do Decision 1.0 Lux e do Kai mantêm os scores do índice oficial e agora apontam para os sucessores. Cada modelo 2.0 tinha cerca de 70–130 downloads em 3 de outubro.
Atualização (4/10). As afirmações do lançamento chegaram a mais gente por um resumo do @TeksEdge (David Hendrickson, 3/10; cerca de 108 curtidas e 5,8 mil views) e pelo post do time no LinkedIn. Os dois trazem afirmações que não estão nos cards (UnverifiedClaim):
- “#1 do seu tamanho” no Decision Index, de 0.6B a 4B. É rodada própria comparada com o placar de 28/09, e as lideranças em 2B e 4B ficam abaixo de um ponto.
- “O 27B é o #3 geral”. Só vale entre os sistemas abertos; contando o Jev, o Vega seria #4.
- “64 perguntas em 63 ms” e “20× mais rápido que a API do Jev”. Nenhum dos dois diz qual tamanho de modelo nem qual GPU.
Detalhes na ficha do Decision 2.0. Sem mudança de nota.
