O Ollama 0.35 agora oferece suporte à API de modelos de decisão no estilo Jev. Com o novo endpoint /v1/systemone, é possível enviar um estado em texto e um conjunto de perguntas identificadas por nome, recebendo respostas estruturadas em uma única solicitação. Três modelos já estão disponíveis: Nimble 9B, Tev1 4B e Tev1 0.8B.
A execução local elimina a latência da rede; o Nimble 9B registra uma média de 91 ms por decisão em um MacBook M5 Max. Os modelos funcionam com o curl ou com o SDK Python da TypeSafe.
Por que importa
Modelos locais de decisão oferecem classificações instantâneas e de baixo custo para tarefas como encaminhamento de chamados ou moderação de conteúdo.