openjev-sglang
⚠️ Por que não é um modelo
Endpoint TypeSafe-compatível sobre Qwen via hack de prefill/logprob do SGLang — não é um modelo de decisão treinado.
Especificações técnicas
- LLMs base
- Qwen3.6-35B-A3B
- Tipos de decisão
- choice, score, boolean
- Features
- sglang, prefill-logprob, typesafe-compatible
- Licença
- MIT
Links
openjev-sglang fornece um endpoint /v1/systemone TypeSafe-compatível sobre Qwen3.6-35B-A3B usando as capacidades de prefill e logprob do SGLang.
Como funciona
O runtime usa features de inferência eficiente do SGLang:
- Prefill do contexto e pergunta
- Extrai logprobs para cada opção de decisão
- Retorna decisões estruturadas em formato TypeSafe
É um hack de inferência — não um modelo de decisão dedicado.
Por que não é um modelo
openjev-sglang é infraestrutura, não um modelo:
- Usa pesos congelados do Qwen3.6-35B-A3B
- Nenhum treino ou fine-tuning envolvido
- Probabilidades de decisão vêm de extração de logprob
Features principais
- API TypeSafe-compatível: Substituto drop-in para
/v1/systemone - Backend SGLang: KV caching e prefill eficientes
- Suporte a modelo grande: Usa Qwen3.6-35B-A3B (MoE)
