Empezar

Modelos nuevos · Probado

¿Opus 5.5 detecta un número erróneo en un gráfico hecho con IA?

Cuatro barras de grafito de distintas alturas sobre una base carbón, con una lupa de vidrio ámbar delante de la tercera barra
Obra editorial abstracta original generada en Ciyo con GPT Image 2.5 Sunburst.

Anthropic dice que Claude Opus 5.5 obtiene un 89.0% en Chartography, una prueba de lectura de gráficos, con herramientas. Para quien hace diapositivas con un generador de imágenes, eso plantea una pregunta práctica: ¿puede el modelo revisar los números antes de que la diapositiva salga?

El 23 de septiembre de 2026 tomamos una diapositiva real con un gráfico hecha en Ciyo, cambiamos un número impreso y pedimos a Opus 5.5 y a GPT-6 Sol que lo encontraran. Después les dimos la diapositiva sin editar para ver quién daba una falsa alarma.

Las diapositivas

La original es un gráfico de barras de Pier Six Coffee, una cafetería ficticia, hecho en Ciyo el 21 de septiembre. Entonces lo medimos: los cuatro números impresos (320, 410, 380 y 505) coincidían con la altura de sus barras con un margen del 1%.

Para la copia de prueba cambiamos solo la etiqueta de la semana 3, de 380 a 430, y dejamos la barra como estaba. Los dos archivos se subieron con el nombre neutro sales-chart.png, así que el nombre del archivo no delataba nada.

Dos versiones de la misma diapositiva con un gráfico de barras una al lado de otra; a la derecha, la etiqueta de la semana 3 dice 430, pero su barra se queda por debajo de la línea de 400
Izquierda: la diapositiva real de Ciyo. Derecha: nuestra copia editada. La edición es nuestra, hecha a propósito para esta prueba.

La pregunta

Los dos modelos recibieron la misma instrucción con esfuerzo Medium: leer cada barra por su altura, compararla con el número impreso y enumerar cualquier discrepancia con la diferencia.

Prompt para revisar el gráfico
Esta diapositiva con un gráfico de barras la hizo un generador de imágenes con IA. Para cada barra, lee su valor a partir de la altura de la barra frente a las líneas de cuadrícula del eje y. Después dime si cada número impreso encima de una barra coincide con la altura de esa barra. Enumera cualquier discrepancia con el número impreso, tu lectura de la altura y la diferencia.

Los dos detectaron el error puesto a propósito

Opus 5.5 lo encontró: la semana 3 tenía impreso 430 y la leía en unos 380, una diferencia de unos 50, con la barra claramente por debajo de la línea de 400. Añadió lo que más importa en una presentación (la etiqueta errónea convierte una caída en la semana 3 en un crecimiento constante) y aconsejó revisar los datos de origen, porque la imagen por sí sola no puede decir si lo correcto es la etiqueta o la barra.

GPT-6 Sol encontró el mismo error con la misma lectura, en una respuesta más corta y sin el comentario sobre la tendencia.

claude.ai con el gráfico editado y la tabla de Opus 5.5 que marca la semana 3 como discrepancia, 430 impreso frente a unos 380
Claude Opus 5.5 en Medium, 23 de septiembre de 2026.

La respuesta de Sol

La tabla de Sol enumeraba solo la discrepancia: semana 3, 430 impreso, leída en unos 380, unos 50 de más. Para una comprobación rápida de sí o no, esa brevedad es una virtud.

ChatGPT Work con el gráfico editado y la tabla de una fila de GPT-6 Sol para la semana 3
GPT-6 Sol en Medium en ChatGPT Work, 23 de septiembre de 2026.

La prueba de la falsa alarma

Un revisor que lo marca todo no es un revisor. Con la diapositiva sin editar, Opus no señaló ninguna discrepancia y dijo que solo podía leer las alturas con un margen de unos ±5 con líneas de cuadrícula cada 100 unidades. Sol marcó la semana 1 como discrepancia, con una lectura de unos 325 frente a 320.

Sol no se lo estaba imaginando: nuestra medición en píxeles sitúa esa barra en unos 323. Pero tres unidades están por debajo de lo que las líneas de cuadrícula permiten ver, así que en una diapositiva real esa alerta te manda a buscar un error que no existe.

Resultados, una ejecución de cada uno, 2026-09-23
DiapositivaClaude Opus 5.5GPT-6 Sol
Editada (semana 3 = 430)Detectado, ≈380, señala la tendenciaDetectado, ≈380
Original (todo correcto)Sin discrepancias, indica ±5Marcó la semana 1 (≈325 frente a 320)
claude.ai con la tabla de Opus 5.5 para el gráfico sin editar, con todas las barras coincidiendo y una nota sobre la precisión de lectura
Opus 5.5 con la diapositiva sin editar, 23 de septiembre de 2026.

Cómo usar esto antes de una reunión

Mantén los números en tu hoja de cálculo y deja que el generador de imágenes dibuje la diapositiva a su alrededor. Después sube la diapositiva terminada a un modelo como Opus 5.5 y pídele que vuelva a leer las barras. Lleva menos de un minuto y detecta el error que importa: una etiqueta que cuenta una historia distinta de la de la barra.

Ciyo no ejecuta Claude Opus 5.5 ni GPT-6 Sol. Puedes hacer la diapositiva en Ciyo y revisarla con cualquiera de los dos modelos.

Los gráficos también fallan en público

La semana del lanzamiento dejó su propio ejemplo de un gráfico que necesitaba una revisión.

Revisar gráficos con Opus 5.5

¿Claude Opus 5.5 puede leer números de la imagen de un gráfico?

En nuestra prueba leyó cuatro alturas de barra con un margen de unas cinco unidades y detectó una etiqueta que habíamos cambiado en 50.

¿GPT-6 Sol lo hizo igual de bien?

Detectó el mismo error, pero marcó como discrepancia una diferencia de tres unidades en la diapositiva sin editar.

¿Debería dibujar mi gráfico una IA?

Dibuja los gráficos a partir de tus datos y usa el generador de imágenes para la diapositiva que los rodea. Revisa cualquier gráfico que dibuje un generador.

¿Ciyo ejecuta Opus 5.5?

No. El agente de Ciyo ofrece Ciyo Agent y GPT-6 Astra. Haz la diapositiva en Ciyo y revísala con el modelo que prefieras.

Haz la diapositiva y mantén los números honestos

Genera el arte de la diapositiva en Ciyo, mantén los datos en tu hoja de cálculo y revisa todo lo que dibuje un generador.