Ollama 0.35 ya es compatible con la API de modelos de decisión al estilo Jev. Los usuarios pueden llamar al nuevo endpoint /v1/systemone, enviar un estado en texto y un conjunto de preguntas con nombre, y recibir respuestas estructuradas en una sola solicitud. Desde el lanzamiento hay tres modelos disponibles: Nimble 9B, Tev1 4B y Tev1 0.8B.
Al ejecutarlos en local se elimina la latencia de red; Nimble 9B registra una media de 91 ms por decisión en un MacBook M5 Max. Los modelos funcionan con curl o con el SDK de Python de TypeSafe.
Por qué importa
Los modelos de decisión locales permiten hacer clasificaciones instantáneas y de bajo coste para tareas como asignar tickets o moderar contenido.