Empezar

Modelos · Para diseñadores

Lee cada comentario, no una muestra

Un expositor abanicado de color carbón que sostiene muchas finas tiras de papel marfil, con tres adelantadas y una tira de vidrio ámbar entre ellas
Obra editorial abstracta original inspirada en unas pocas tiras extraídas de muchas.

La publicación funciona bien. Doscientas respuestas llegan en un fin de semana. El lunes alguien se desplaza diez minutos, responde a las cuatro que le toca ver y cierra la pestaña. En el resto sin leer hay un cliente preguntando si estáis abiertos el festivo de los bancos, y una queja sobre un pedido que se convertirá en una reseña.

Nadie eligió ese desenlace. Simplemente ocurre cuando leerlo todo cuesta una hora y leer parte cuesta diez minutos. Un modelo publicado el 15 de septiembre de 2026 cambia el precio de la lectura, y eso cambia la elección. Ciyo no puede ejecutar Jev — no produce imagen ni vídeo y no aparece en ninguno de nuestros registros de modelos —, pero este es el trabajo de una semana de marketing que mejor le encaja.

Por qué los comentarios encajan exactamente en esta forma de herramienta

Un comentario es corto, es texto, y lo que necesitas de él es un puñado de hechos de sí o no, no un ensayo. Esas tres propiedades son toda la especificación.

Este tipo de modelo lee solo texto — la documentación de TypeSafe dice que la entrada debe ser una cadena, un objeto JSON o un array de valores de texto, y que las imágenes aún no son compatibles. En un hilo de comentarios ese límite te cuesta casi nada, a diferencia de casi cualquier otra tarea creativa.

Y las preguntas que quieres respondidas ya están decididas antes de leer: ¿es una queja, espera alguien una respuesta, es un abuso, de qué trata, cuán urgente es? No buscas una idea. Estás ordenando.

Las preguntas que vale la pena hacer a cada respuesta

Cinco preguntas estrechas vencen a una amplia, y se evalúan juntas contra el mismo comentario, así que preguntar cinco cuesta poco más que preguntar una.

Una tabla de cinco preguntas tipadas para hacer a cada comentario, su tipo y por qué importa cada una
Una llamada, un comentario como entrada, cinco respuestas a la salida. Diagrama de Ciyo.

Qué cambia cuando revisarlo todo es asequible

A un precio publicado de 0.042 $ por millón de tokens de entrada, con salida gratis, un comentario cuesta una fracción mínima de un céntimo para hacerle cinco preguntas. Un mes de respuestas para un pequeño negocio cuesta menos que un café.

El cambio que importa no es el dinero, es qué comentarios se ven. Una muestra del cinco por ciento leída por una persona cansada el lunes es el estado actual. Cada comentario ordenado antes de que alguien abra la pestaña es una operación distinta.

Y el orden también cambia. En lugar de leer de más reciente a primero, que es como presentan las plataformas las respuestas y no tiene nada que ver con la importancia, abres una cola donde las quejas y las preguntas sin respuesta están arriba.

Dos barras que comparan leer a mano una muestra del cinco por ciento con hacer a cada comentario las mismas cinco preguntas
El mismo presupuesto, gastado de dos formas. Diagrama de Ciyo.

No dejes que responda a nadie

Vale la pena decirlo claramente, porque es lo primero a lo que la gente recurre y es el uso equivocado.

Un modelo de decisión no puede escribir. Devuelve una categoría, una puntuación o un número, y nada más. No hay frase que enviar. Si quieres respuestas automatizadas estás pidiendo otro tipo de modelo, y deberías pensar bien si las quieres en absoluto.

Lo que hace es decidir quién merece una respuesta humana y en qué orden. Esa es una promesa menor y mucho mejor: el cliente sigue oyendo a una persona, y la persona emplea su tiempo en los cuarenta comentarios que lo necesitaban en lugar de en los ciento sesenta que no.

Cómo se ve la cola ordenada el lunes
CategoríaQué entra en élQuién lo gestiona
Responder hoyQuejas sobre un pedido, y preguntas que alguien esperaUna persona, primero
Responder esta semanaPreguntas generales, horario, curiosidad por el productoUna persona, cuando hay tiempo
OcultarAbuso y spamAutomático, por encima de una confianza alta
ReconocerElogios y amigos etiquetadosUn me gusta, o nada, y está bien
Que alguien mire estoCualquier cosa de la que el modelo no estaba seguroUna persona, porque la confianza era baja

Las dos reglas que lo mantienen honesto

Declara una opción de escape en cada elección. Una evaluación independiente prerregistrada publicada el 20 de septiembre de 2026 encontró que cuando no existía la opción “ninguna de estas”, ninguna de treinta entradas fuera de alcance fueron marcadas: el modelo eligió la categoría declarada más cercana y le adjuntó una confianza. Un comentario en otro idioma, o un bot, o algo que ninguno de tus cubos previó, aterrizará en un lugar equivocado y parecerá decidido.

Y enruta por confianza, no solo por la respuesta. Ocultar un comentario es destructivo e irreversible a ojos del cliente, así que merece un umbral alto; añadirlo a una cola no. El patrón de enrutamiento publicado pone cualquier cosa por debajo de 0.6 ante una persona y reserva la acción automática en decisiones costosas para 0.85 y más.

Lee lo que ocultó. Una vez por semana, diez minutos. Un verificador que se equivoca sistemáticamente ahora se equivoca sistemáticamente en todo, y la pila oculta es donde ese fallo se vuelve invisible.

Por dónde empezar

Toma los últimos doscientos comentarios de tu propia cuenta y ordénalos a mano en tus cubos. Tarda media hora y es el único benchmark que significa algo.

Escribe las definiciones de los cubos mientras lo haces. Encontrarás casos límite de inmediato: ¿es “esto es caro” una queja o una opinión, y cuenta un amigo etiquetado sin palabras como algo?

Luego pasa las preguntas por los mismos doscientos y compara. Si coincide contigo en las quejas y las preguntas sin respuesta, está haciendo el trabajo. Si discrepa, la causa habitual es que tus definiciones no eran tan claras como creías, lo cual es útil saber antes de automatizar nada.

Preguntas de triaje de comentarios

¿Puede escribir las respuestas también?

No. Un modelo de decisión produce una categoría, una puntuación o un número y nada más. Decide quién necesita una respuesta humana y en qué orden; una persona sigue escribiéndola.

¿Puede leer comentarios en otros idiomas?

Con menor precisión. La documentación de TypeSafe dice que el inglés es el idioma de entrenamiento principal y que otros idiomas, incluidos los scripts CJK, se aceptan pero actualmente con menor precisión.

¿Es seguro ocultar abusos automáticamente?

Solo por encima de una confianza alta, y solo si alguien revisa lo ocultado. Ocultar es irreversible desde el punto de vista del cliente, así que merece el mismo umbral que cualquier acción costosa.

¿Hace Ciyo el triaje de comentarios?

No. Ciyo es un lienzo para crear el trabajo, no una bandeja de entrada social, y no ejecuta Jev. Este es un trabajo que vale la pena entender, no una función de Ciyo.

Sigue leyendo

Ciyo escribe sobre los modelos detrás de las herramientas creativas y de agentes, y prueba los que puede ejecutar.