Empezar

Modelos · System One

Tu primera llamada a Jev, campo por campo

Un bloque de piedra carbón con una abertura redonda, una cuadrada y otra en forma de ranura, y tres tapones de marfil a juego a su lado, uno ámbar
Obra de arte editorial abstracta original inspirada en formas tipadas y conectores que les corresponden.

TypeSafe AI abrió Jev a todo el mundo el 20 de septiembre de 2026, sin lista de espera. La documentación se hizo pública al mismo tiempo, lo que significa que la pregunta interesante ya no es si puedes probarlo, sino cómo es realmente la llamada.

Este es un recorrido por esa llamada: qué envías, qué vuelve y los límites publicados que conviene conocer antes de construir un sistema en torno a ella. Ciyo no ejecuta Jev — no genera ninguna imagen ni ningún vídeo y no aparece en ninguno de nuestros registros de modelos —, así que nada de esto es un anuncio de producto. Es una lectura de una API recién pública hecha por quienes les importa lo que hay dentro de las herramientas creativas y de agentes.

La llamada es un solo POST

Todo va a un único endpoint: `POST https://api.typesafe.ai/v1/systemone`, con una clave bearer en la cabecera Authorization y JSON en el cuerpo.

El cuerpo tiene tres campos obligatorios. `state` es lo que se va a juzgar — una cadena, un objeto JSON o un array de valores de texto. `model` nombra al modelo, por ejemplo `jev-latest`. `questions` es un mapa de tus propios identificadores de pregunta a preguntas tipadas.

La respuesta lo refleja. `answers` es un mapa claveado por los mismos identificadores de pregunta, y `usage` informa del número de tokens de entrada y salida. Como los tokens de salida se facturan a cero, ese bloque de uso es sobre todo un registro de cuánto state enviaste.

Dos tarjetas que describen qué envía una petición de System One y qué devuelve la respuesta
Campos de la referencia HTTP de TypeSafe AI, leídos el 21 de septiembre de 2026. Diagrama de Ciyo.

Tres tipos de preguntas, y cómo distinguirlos

Un Choice elige una opción de una lista que declares. Aportas `instructions` y un mapa `criteria` de nombres de opción a sus descripciones, con un máximo documentado de 255 opciones. Devuelve la opción elegida, una probabilidad para cada opción y un valor de confianza.

Un Score coloca la state en una rúbrica de entre 2 y 10 niveles, aportada como un array. Devuelve una puntuación que puede caer entre niveles, las probabilidades, una leyenda y un valor de confianza.

Un Noul responde una afirmación verdadero-o-falso y devuelve un único número del 0 al 1. Un `criteria` opcional te deja describir cómo es el verdadero y cómo es el falso. Es lo más barato a lo que recurrir, y lo que más se usa en exceso.

La diferencia práctica entre Choice y Score no es evidente en la documentación, y merece la pena ejecutar ambos sobre la misma state antes de comprometerte — una puntuación más un umbral en tu propio código y una elección entre opciones explícitas no son la misma decisión, aunque produzcan la misma respuesta la mayor parte del tiempo.

Cada pregunta se juzga contra la misma state

Esta es la idea de diseño que hace que la forma de la API tenga sentido. Envías la state una vez, y cada pregunta del mapa se evalúa en paralelo y en aislamiento contra ella. Las preguntas no ven las respuestas unas de otras.

Eso tiene dos consecuencias. Añadir una pregunta es barato, porque el coste que domina una llamada es enviar la state, no responder. Y el encadenado lo haces tú: si la pregunta dos solo debe ejecutarse cuando la pregunta uno dice sí, esa lógica vive en tu código, sobre las respuestas que recibiste.

Los límites que conviene tener en cuenta

Cuatro de ellos los publica TypeSafe. El quinto procede de una evaluación independiente y es el que más probablemente te pasará factura en producción.

Una tabla de límites documentados: 255 opciones por choice, niveles de puntuación de 2 a 10, state solo texto, inglés como lengua principal, y una constatación fuera de alcance
Los cuatro primeros proceden de la documentación de TypeSafe, leída el 21 de septiembre de 2026. El quinto es una medición del preregistrado priorbench/jev del 20 de septiembre de 2026.

Una primera llamada que merece la pena hacer

No empieces con la decisión que de verdad quieres automatizar. Empieza con una decisión que ya hayas etiquetado a mano, porque el único número interesante el primer día es la coincidencia con tus propias etiquetas.

Coge cincuenta filas que hayas juzgado, envía cada una como state y pregunta la pregunta que ya respondiste. Conserva el valor de confianza con cada respuesta. Ya tienes una tasa de coincidencia y una curva de calibración para tus propios datos, que vale más que cualquier benchmark publicado.

La forma de una primera petición
POST https://api.typesafe.ai/v1/systemone
Authorization: Bearer $TYPESAFE_API_KEY

{
  "model": "jev-latest",
  "state": { "subject": "...", "body": "...", "sender": "..." },
  "questions": {
    "urgent": { "type": "noul", "instructions": "Este mensaje necesita una respuesta hoy." },
    "topic": { "type": "choice", "instructions": "¿A qué cola debería ir este?",
      "criteria": { "billing": "...", "bug": "...", "none_of_these": "Nada de lo anterior encaja." } }
  }
}

Lo que no hará

No escribe nada. Ni resumen, ni frase reescrita, ni código, ni texto alternativo, ni imagen. Si lo que necesitas como salida es prosa, esta es la herramienta equivocada y un modelo de lenguaje corriente es el correcto.

Solo acepta texto. La documentación dice que state debe ser una cadena, un objeto JSON o un array de valores de texto, y que las imágenes, el audio y el vídeo aún no están soportados.

Es más fuerte en inglés. La documentación dice que el inglés es la lengua de entrenamiento principal y que otras lenguas, incluidos los sistemas de escritura CJK, se aceptan con menor precisión — lo que importa si tu cola de soporte no es en inglés.

Y no te dirá que ninguna de tus opciones encaja. Declara esa opción tú mismo.

Preguntas de la primera llamada

¿Todavía necesito una invitación de la lista de espera?

No. TypeSafe anunció el 20 de septiembre de 2026 que Jev está disponible para todos sin lista de espera, a través de console.typesafe.ai.

¿Por qué tipo de pregunta debería empezar?

Un Noul, para una decisión que ya hayas etiquetado a mano. Devuelve un número, lo que hace el primer chequeo de coincidencia trivial de puntuar.

¿Cuántas preguntas puedo poner en una llamada?

La documentación no publica un tope. Sí dice que las preguntas se evalúan en paralelo contra la misma state, y una ejecución independiente puso 800 juicios en una sola llamada.

¿Puede Ciyo usar Jev?

No. Jev no produce ninguna imagen ni ningún vídeo, y no aparece en ninguno de los registros de modelos de Ciyo. Escribimos sobre él porque es parte de la maquinaria detrás de las herramientas de agentes, no porque lo ejecutemos.

Sigue leyendo

Ciyo escribe sobre los modelos detrás de las herramientas creativas y de agentes, y prueba los que puede ejecutar.