Modelos · Para diseñadores
Texto alternativo a gran escala, y la comprobación que no puede hacer

El texto alternativo es el trabajo de accesibilidad con el que todos están de acuerdo y que casi nadie audita. Se escribe al final, por quien suba la imagen, y después nadie lo vuelve a mirar.
También es, de forma poco habitual, un trabajo cercano a lo creativo que un modelo solo de texto puede asumir casi entero — porque el texto alternativo es texto. Un modelo publicado el 15 de septiembre de 2026 responde preguntas declaradas sobre texto en unos un tercio de segundo por una fracción de céntimo. Ciyo no puede ejecutar Jev: no produce imagen ni vídeo y no está en ninguno de nuestros registros de modelos. Pero la división entre lo que un verificador así puede decirte y lo que no es lo más útil de este artículo, sea cual sea la herramienta que acabes usando.
Qué hace bueno al texto alternativo, escrito como preguntas
La mayoría de las guías de texto alternativo son una lista de principios. Convierte los principios en preguntas con respuestas declaradas y tienes algo que puedes ejecutar en cada imagen que hayas publicado.
Cuatro de ellas son mecánicas: longitud, fraseo, estructura, y si simplemente repite la leyenda. Una es un juicio, y esa es la que conviene puntuar en lugar de responder sí o no.

La comprobación que no puede hacer, y por qué importa más que las demás
Un modelo solo de texto lee tu texto alternativo. Nunca ve tu imagen. La documentación de TypeSafe indica que la entrada debe ser una cadena, un objeto JSON o un array de valores de texto, y que las imágenes aún no son compatibles.
Así que puede confirmar que tu texto alternativo es una descripción bien formada, apropiadamente corta y no repetitiva. No puede confirmar que la descripción sea verdadera.
“Un retriever dorado dormido en un sofá azul” supera cada comprobación mecánica a la perfección. Si la fotografía es de un gato en el suelo de una cocina, el modelo no tiene forma de saberlo, y a un usuario de lector de pantalla se le dice algo falso con total confianza. Ese fallo es peor que la ausencia de texto alternativo, porque el texto alternativo ausente es al menos honesto sobre la brecha.
Este es el límite único más importante a retener, y se aplica a cada verificador solo de texto, no solo a este.

Así que hazlo en pareja, no confíes solo en él
El diseño que de verdad funciona usa dos herramientas distintas para dos mitades distintas de la pregunta.
Deja que el modelo de decisión maneje las reglas mecánicas a gran escala: ejecútalas sobre cada imagen del sitio, cada semana, por unos pocos céntimos. Ese barrido encuentra las cadenas vacías, los nombres de archivo pegados como descripciones, las cuarenta imágenes cuyo texto alternativo repite la leyenda, y las que abren con “imagen de”.
Luego deja que algo con ojos — un modelo de visión, o una persona — confirme que las palabras coinciden con la imagen, en una muestra y en todo lo que la puntuación marcó como vago. Esa es una pila mucho más pequeña que el total, que es el punto.
| La pregunta | Quién la responde | Con qué frecuencia |
|---|---|---|
| ¿Hay texto alternativo siquiera? | Cualquier verificador de texto | Cada imagen, cada semana |
| ¿Tiene la longitud y la forma correctas? | Un modelo de decisión | Cada imagen, cada semana |
| ¿Solo repite la leyenda? | Un modelo de decisión | Cada imagen, cada semana |
| ¿Es útil para quien no ve? | Un modelo de decisión, como puntuación | Cada imagen; lee las puntuaciones bajas |
| ¿Es verdad de esta imagen? | Un modelo de visión, o una persona | Una muestra, más todo lo marcado |
Escribir la rúbrica para que la puntuación signifique algo
La pregunta de utilidad es una puntuación, no un sí o no, y una puntuación necesita niveles con definiciones. Una rúbrica de dos a diez niveles es lo que este tipo de modelo espera, y los niveles los escribes tú.
Cuatro funciona bien aquí: useless, vague, adequate, good. Useless es un nombre de archivo o una cadena vacía. Vague es “foto de producto”. Adequate nombra el sujeto y el contexto. Good le da al lector lo que habría tomado de mirarla, incluido el detalle que importa para el texto circundante.
Escribe las definiciones antes de ejecutar nada, y etiqueta treinta ejemplos reales contra ellas a mano. Ese conjunto etiquetado es lo que te dice si la puntuación sigue tu juicio, y vale la pena tenerlo aunque nunca automatices nada.
state: { "alt": "...", "caption": "...", "page_title": "..." }
questions: {
"describes": { "type": "noul", "instructions": "El texto alternativo describe lo que se puede ver, en lugar de nombrar un archivo o una categoría." },
"redundant_open": { "type": "noul", "instructions": "El texto alternativo empieza por 'imagen de', 'foto de' o 'cuadro de'." },
"length_ok": { "type": "noul", "instructions": "El texto alternativo tiene menos de 125 caracteres." },
"repeats_caption": { "type": "noul", "instructions": "El texto alternativo repite la leyenda casi palabra por palabra." },
"usefulness": { "type": "score", "instructions": "¿Cuán útil sería esto para alguien que no ve la imagen?",
"criteria": ["useless", "vague", "adequate", "good"] }
}Lo que suele encontrar un primer barrido
Espera que los resultados sean peores de lo que asumiste y más fáciles de arreglar de lo que temiste.
Los hallazgos comunes son los mismos en todas partes: un bloque de imágenes de un mes ajetreado sin texto alternativo, un tramo donde alguien pegó el nombre del archivo, y una cola larga donde el texto alternativo es la leyenda otra vez. Ninguno necesita juicio para arreglarse. Necesita una lista.
Las vagas son donde la puntuación gana su lugar. “Nuestra nueva gama” es técnicamente una descripción y no le dice nada a un usuario de lector de pantalla, y una regla mecánica nunca la detectará porque tiene la longitud correcta y no repite nada.
Y declara una opción de escape en cualquier elección que escribas. Una evaluación independiente prerregistrada publicada el 20 de septiembre de 2026 encontró que sin “ninguna de estas” disponible, ninguna de treinta entradas fuera de alcance fue marcada — la respuesta declarada más cercana volvió pareciendo decidida.
El resumen honesto
Puedes automatizar cuatro quintos del control de calidad del texto alternativo por unos pocos céntimos por barrido, y deberías, porque la alternativa es que nadie comprueba ninguno.
No puedes automatizar el quinto que pregunta si las palabras son verdad de la imagen, y es el que más duele a un lector cuando se equivoca. Mantén a una persona o a un modelo de visión sobre eso, en una muestra, de forma permanente.
Cualquiera que te venda una herramienta solo de texto que afirma verificar el texto alternativo contra imágenes está describiendo algo que su documentación dice que el modelo no puede hacer.
Preguntas de texto alternativo
¿Puede un modelo solo de texto comprobar mi texto alternativo?
Puede comprobar todo sobre las palabras: longitud, fraseo, estructura, y si repite la leyenda. No puede comprobar si la descripción es verdad de la imagen, porque nunca ve la imagen.
¿Qué longitud debe tener el texto alternativo?
Tener menos de unos 125 caracteres es una regla razonable, y es una comprobación mecánica que puedes ejecutar en cada imagen. Las descripciones más largas suelen pertenecer al texto circundante en su lugar.
¿Debe empezar el texto alternativo por “imagen de”?
No. Un lector de pantalla ya anuncia que es una imagen, así que esas palabras gastan tus caracteres en nada. Esta es una de las comprobaciones más fáciles de automatizar.
¿Ejecuta Ciyo esta comprobación?
No. Ciyo no ejecuta Jev. El agente de Ciyo puede redactar texto alternativo para las imágenes que generas, que es un trabajo distinto: escribirlo en lugar de auditarlo a gran escala.
Sigue leyendo
Ciyo escribe sobre los modelos detrás de las herramientas creativas y de agentes, y prueba los que puede ejecutar.