¿Puede la IA de tu ordenador diseñar un informe?
· Toni Martir, arquitecto de software
Un informe no admite el aprobado general. Una carta o un resumen pueden salir regulares y seguir sirviendo; un informe de ventas, o se ejecuta y cuadra, o no sirve para nada. Eso lo convierte en una buena vara para medir hasta dónde llega hoy la inteligencia artificial: no hay margen para que parezca correcto.
Así que hice la prueba en serio. Un mismo encargo escrito en un párrafo, cinco modelos distintos, una veintena de ejecuciones y las mismas cinco comprobaciones para todos. Tres de los modelos corrían en una tarjeta gráfica doméstica; dos eran servicios de pago. Esperaba que los de pago ganaran de calle. No fue así.
La prueba
El encargo era el mismo para todos, uno solo, y nada cortito. Éste, entero:
Quiero que diseñes un informe profesional de ventas por cliente, agrupado por cliente: el nombre y el código del cliente en la cabecera, y el total de ventas del cliente en el pie de grupo. El detalle tiene que listar los artículos vendidos a ese cliente, pero sólo una línea por artículo, es decir, los datos tienen que venir agrupados en el SQL por cliente y artículo. Al final del todo, un gráfico de barras de ventas por artículo (de todos los clientes); en el pie de cada cliente, un gráfico de barras de sus artículos también. Tiene que ser un informe profesional; la cabecera de página debe mostrar el título del informe (invéntatelo) y «Página X de TOTAL».
El original está en inglés y es el que la documentación del servidor publica como ejemplo; va literal en «Fuentes».
Un informe así se juzga solo. Estas son las cinco preguntas, y ninguna es de gusto:
- ¿Imprime el total de páginas?
- ¿Ajusta la altura de las bandas al contenido?
- ¿Aparece la lista de artículos?
- ¿Llevan formato los importes?
- ¿Se ejecuta a la primera, sin tocarle nada?
Un encargo, cinco modelos
El tiempo es el de un informe hecho desde cero. El más lento de los cinco es el que mejor lo hizo, y corría en una tarjeta gráfica de casa.
Arriba hay empate
Dos modelos pasaron las cinco comprobaciones: Gemma 4 31B en una tarjeta gráfica de casa y Gemini 3.8 Flash en modo de razonamiento, de pago. Y esa es la noticia, porque esperaba que esa casilla la llenara sólo el de pago.
El de pago hizo el informe más bonito, sin discusión: puso cabeceras a las columnas, un subtítulo y una columna de unidades que nadie le había pedido. El de casa salió más sobrio, pero acertó en lo que decide si un informe sirve — ajustó la altura de las bandas, veinte páginas donde otros gastaban cuarenta y siete, e imprimió el total de páginas—. Tardó once minutos contra dos.
Abajo está la sorpresa. El servicio de pago más rápido despachó el mismo encargo en cuarenta segundos, tres veces seguidas, y las tres veces salió un informe peor que el de la tarjeta doméstica: una vez se dejó entera la lista de artículos, que era el cuerpo del encargo, y ninguna de las tres puso el total de páginas.
Conviene decir qué significa ese «no» de la última columna, porque no es un desastre: significa a la primera. Los que fallaron acaban funcionando con un retoque —señalarle el error al copiloto, o cambiar una expresión a mano—, y entonces imprimen sus datos y cuadran. La diferencia no está en si sale un informe: está en si sale terminado. Sólo dos de los cinco entregaron un informe con sus etiquetas, sus columnas rotuladas y sus bandas a la medida sin que nadie lo tocara, y son los dos de arriba. Los demás dan algo que se parece a un informe y hay que acabárselo.
Así quedó el diseño del mejor de los cinco, tal cual salió del encargo de arriba y sin un solo retoque:

Cada franja gris es una banda del informe. La de «Detail» —la que se repite por cada artículo— ocupa una línea: eso es lo que separa un informe de veinte páginas de uno de cuarenta y siete.
Cuánto se le pide de una vez
Ese párrafo del encargo parece uno, pero lleva ocho exigencias dentro: agrupar en el SQL, una línea por artículo, el nombre y el código arriba, el total abajo, dos gráficos distintos, el título, la numeración con su total y que todo quede presentable. Y no se resuelven de una sentada: el modelo pide los datos, los describe, y sólo entonces monta el informe. Hay que llegar al final acordándose de todo lo del principio.
Ahí está la diferencia, y la vi en directo. Pedí al modelo de doce mil millones que arreglara un fallo concreto, uno solo, y lo arregló — incluido activar la doble pasada, que es lo que hace que se imprima el total de páginas, y que nadie le había mencionado. Ese mismo modelo, con el encargo entero, se había dejado la lista de artículos.
La regla la conoce; lo que le falta es aguante para sostenerla hasta el final. En otro intento lo escribió él mismo en su razonamiento —«esto necesita la doble pasada, lo haré en el paso siguiente»— y cuando llegó el paso siguiente ya no se acordaba.
De ahí sale el consejo práctico, que además es como trabaja cualquiera con el diseñador: si el informe se construye por partes, un modelo pequeño llega mucho más lejos. Primero los datos. Luego la cabecera. Luego el detalle. Luego los totales. Cada petición es pequeña, se ve el resultado y se corrige antes de seguir. Con un modelo grande te puedes permitir el párrafo de golpe; con uno pequeño, el párrafo de golpe es justo lo que no conviene pedirle.
Entonces, ¿puede?
Sí, y la condición no es la que yo esperaba. Si quieres el informe entero de un párrafo, hace falta un modelo que quepa en unos veinticuatro gigabytes de memoria de tarjeta. Con doce hay otro camino: construirlo por partes. El modelo pequeño avanza bien así, y escribe al triple de velocidad que el ganador.
Y el tamaño engaña. El que peor quedó de los dos de pago es el más grande de todos sobre el papel —ciento diecisiete mil millones de parámetros—, pero sólo pone a trabajar cinco mil cien millones en cada palabra que escribe, y es de una generación anterior. El que empató arriba desde una tarjeta de casa tiene treinta y un mil millones y los usa todos, y es de este año. Mediano y moderno le gana a grande y anticuado.
La frontera de la IA local no está donde yo creía. No es el dinero, ni la velocidad, ni siquiera el tamaño: está en la relación entre lo que le pides de una vez y lo que el modelo da de sí.
En Report Manager el copiloto que diseña el informe es opcional, y cuando se usa puede atenderlo un modelo que corra en la máquina del propio cliente, servido por el Reportman Agent: sin cuota mensual, poniendo el cliente su tarjeta gráfica. Los datos del informe no salen de la empresa, que es la otra cara del mismo asunto y la traté aparte en ¿cuánto vale la privacidad de tus datos?. El diseñador y el servidor son gratuitos, en el sentido de que no hay nada que pagar por usarlos.
Toni Martir, arquitecto de software — 9 de octubre de 2026
Entorno de las pruebas
- Máquina: Intel Core i5-14600K, 32 GB de memoria y una NVIDIA GeForce RTX 3090 con 24 GB de memoria de vídeo.
- Modelos locales: Gemma 4 en sus tres tamaños, todos cuantizados a Q4_XS y servidos por el Reportman Agent.
Fuentes
- El encargo, en su inglés original, y el informe que produjo, en la documentación del servidor: reportman.es/serveres.html — «I want you to design a professional sales-by-customer report, grouped by customer: the customer name and code in the header, the customer's total sales in the group footer. The detail must list the items sold to that customer, but only one line per item, that is, the data must be grouped in the SQL by customer and item. At the very end, a bar chart of sales by item (all customers); in each customer's footer, a bar chart of their items too. It must be a professional report; the page header must show the report title (make one up) and Page X of TOTAL.»
- El Reportman Agent, que es quien sirve el modelo local: ai.reportman.es
- Ficha técnica de gpt-oss-120b, de donde salen los 116.800 millones de parámetros totales y los 5.100 millones activos por token: gpt-oss-120b & gpt-oss-20b Model Card
Toni Martir, arquitecto de software · · fuentes comprobadas el