
Chisme 68 del lince: IA imágenes, el pintor del Lince
Esa noche, en Sierra Bermeja, el Lince de la Noche preparaba un cartel para la Cámara de la Verdad. Llevaba tres horas con el pincel y el resultado parecía una patata con orejas.
—Es un retrato mío —explicó, muy digno—. Pero me ha salido… abstracto.
—Es una patata —dijo la Gata Montesa—. Pídele el retrato a una IA imágenes.
—Ya lo hice. Escribí «un lince en Sierra Bermeja» y me salió un gato naranja en una playa.
—Porque tu prompt era demasiado corto y la IA imágenes tuvo que rellenar lo que no dijiste. Tienes que contárselo todo: la hora, la luz, las rocas, el estilo…
—¿Y cómo sabe una IA imágenes convertir mis palabras en un dibujo?
—Esa es la pregunta buena. Vamos a construir una pequeñita para verlo por dentro. Solo sabrá dibujar formas y colores, pero lo hará igual que las grandes.
El Lince miró su patata con orejas. Después, con cierta tristeza, la guardó en un cajón.
—Empiezo por el ruido.
Esta IA imágenes en miniatura funciona como las grandes: parte de una imagen de puntos al azar (ruido) y la va limpiando poco a poco, guiada por tu texto. Solo sabe dibujar cuatro formas en cuatro colores, pero puedes ver cada paso del proceso. Todo ocurre en tu navegador: no hay servidor, cuenta ni envío de datos.
Prueba la IA imágenes del Lince
Escribe un prompt, por ejemplo «cruz verde abajo a la derecha», y pulsa «Generar». Si prefieres verla a pantalla completa, puedes abrir la IA imágenes a pantalla completa.
Del prompt a la imagen: cómo lo hace una IA imágenes
El proceso tiene cuatro pasos y la página los muestra uno a uno:
- Texto a números. El ordenador no entiende palabras. Tu prompt se convierte en 18 números (un «código» para la forma, otro para el color y otros para la posición). Las IA imágenes grandes hacen lo mismo con miles de números.
- Ruido de partida. Se crea una imagen de puntos al azar. La semilla decide qué ruido sale: misma semilla y mismo prompt, misma imagen.
- Quitar ruido. Una red neuronal mira la imagen con ruido y el texto, y adivina qué dibujo hay debajo. Quita un poco de ruido y repite. A esto se le llama modelo de difusión.
- Imagen final. Después de varios pasos, el ruido se ha convertido en un dibujo.
Durante el entrenamiento, la red hizo lo contrario: tomó miles de dibujos, les fue echando ruido y aprendió a deshacerlo. Nadie le explicó qué es un círculo.

Semilla, pasos y fuerza del prompt en una IA imágenes
- Semilla. Con el prompt «círculo» a secas, cada semilla da un círculo de otro color y en otro sitio: lo que no dices, lo elige el modelo al azar.
- Pasos. Con 1 paso la imagen sale borrosa. A partir de unos 10 o 20 apenas cambia. Los modelos grandes usan entre 20 y 50.
- Fuerza del prompt. Dice cuánto caso hace al texto. Con 0 lo ignora; con valores medios lo cumple; con valores muy altos lo exagera y aparecen colores y bordes raros.
El botón «¿Obedece?» mide esto con 16 semillas y 5 fuerzas. Con «cruz verde abajo a la derecha», nuestra prueba dio un 13 % de acierto con fuerza 0, un 100 % con fuerzas entre 1 y 6, y un 63 % con fuerza 10. Subir la fuerza ayuda… hasta que deja de ayudar.
Ficha del prompt: lo que pido, lo que espero y lo que sale
Un prompt es una petición, no una garantía. Para evaluar una IA imágenes conviene hacer una ficha: qué pedí, qué esperaba y qué obtuve. Primero, la de nuestro pintor:
| Prompt | Lo esperado | Lo que sale |
|---|---|---|
| cruz verde abajo a la derecha | Una cruz de color verde en la esquina inferior derecha | Con fuerza entre 1 y 6, el color y la posición son correctos en las 16 semillas. Con fuerza 0 la ignora (13 %). |
Ahora probamos con tres IA imágenes grandes. Usamos este prompt en tres generadores distintos (ChatGPT, Gemini y Copilot):
Ilustración digital de un lince ibérico adulto sentado en un claro de Sierra Bermeja al atardecer, con pinos al fondo, rocas rojizas de peridotita y un cielo naranja con nubes finas. El lince mira a cámara con expresión serena, luz cálida lateral, estilo ilustración de libro de naturaleza, colores suaves, formato horizontal.
Estos son los tres resultados. Comparamos cada elemento del prompt con lo que salió:
| Elemento del prompt | ChatGPT y Copilot | Gemini |
|---|---|---|
| Lince ibérico adulto, sentado | Sí: orejas con pinceles, «barba» y pelaje moteado | Sí: mismos rasgos |
| Claro de Sierra Bermeja | Más bien un mirador rocoso con montañas al fondo | Un pequeño claro con hierba entre los pinos: más fiel a «claro» |
| Pinos al fondo | Sí | Sí |
| Rocas rojizas de peridotita | Rocas rojas muy intensas con líquenes verdes | Rocas pardo-rojizas más discretas |
| Cielo naranja con nubes finas | Naranja intenso con sol y nubes finas | Naranja, rosa y morado con nubes más grandes |
| Mira a cámara, expresión serena | Sí | Sí |
| Luz cálida lateral | Luz dorada de lado sobre el pelaje | Más bien contraluz suave |
| Estilo de libro de naturaleza, colores suaves | Casi una fotografía, con colores muy saturados | Estilo de ilustración, colores más apagados: lo que pedía el prompt |
| Formato horizontal | Sí (3:2) | Sí (casi 16:9) |
Ninguna es «la buena». Cada una cumple unas partes del prompt mejor que otras. La IA no sabe de geología: «peridotita» no significa nada para ella, pero «rojizas» sí, y por eso pinta rocas rojas. Y «ilustración suave» es una instrucción difícil de medir: la de Gemini se parece más a un libro de naturaleza; las otras dos, a una fotografía espectacular.
¿Por qué dos IA imágenes (ChatGPT y Copilot) dan casi la misma imagen?
Las dos imágenes son tan parecidas que parecen hermanas. Tiene explicación:
- Comparten modelo. Microsoft incorporó a Copilot la generación de imágenes de GPT-4o, la misma tecnología de OpenAI que usa ChatGPT. Es como dos pintores que hubieran aprendido con los mismos maestros y los mismos libros.
- Mismo tamaño. Las dos salen en 1536×1024 píxeles, un formato que ofrece el modelo de imágenes de OpenAI. Gemini genera con un modelo de Google, que tiene otros datos de entrenamiento, otro tamaño y otro «estilo de la casa».
- El prompt es muy detallado. Con un prompt largo y concreto casi todo queda dicho (lince, atardecer, pinos, rocas, cielo). Queda poco margen para la semilla, que solo cambia los detalles. Es lo que ves en nuestro pintor con un prompt completo: las imágenes se parecen y solo varían el tamaño o la posición exacta.
- Lo más típico. Al ser el mismo modelo, ante estas palabras tiende a dibujar lo más habitual que vio al entrenar: un lince bonito, atardecer anaranjado, rocas rojas. Cuando las palabras son poco concretas, el modelo rellena con lo más común.
Y una advertencia: Copilot no siempre usa el mismo modelo (Microsoft puede cambiarlo), así que esto es una explicación razonable, no una prueba. Para comprobarla puedes repetir el mismo prompt varias veces en una misma IA: si dos resultados de la misma herramienta se parecen tanto como estos, la diferencia estaba en el modelo, no en la herramienta.
Para el aula
- En la página, genera «círculo» con 8 semillas. ¿Qué es lo que cambia y qué no? ¿Por qué?
- Prueba la fuerza del prompt de 0 a 10. ¿Con qué valor te parece mejor la imagen? ¿Y con 10?
- Escribe «lince en Sierra Bermeja». ¿Qué ignora esta IA imágenes y por qué?
- Escribe un prompt cada vez más largo para una IA imágenes grande y observa cómo cambian las imágenes.
- Haz la ficha del prompt con tres IA imágenes distintas: ¿qué cumple cada una?
- Pide la misma imagen dos veces en la misma IA imágenes. ¿Se parecen tanto como las de ChatGPT y Copilot?
- ¿Quién es el autor de una imagen generada? ¿Y si la IA aprendió de dibujos de otras personas?
Retos
- Reto 1: genera una imagen con cada forma y cada color.
- Reto 2: encuentra el número mínimo de pasos para que la imagen quede limpia.
- Reto 3: haz el experimento «¿Obedece?» con tres prompts distintos y apunta los resultados.
- Reto 4: escribe un prompt para una IA imágenes grande y haz su ficha: pedí, esperaba, obtuve.
- Reto 5: en el código, añade un color nuevo y piensa qué tendrías que cambiar para que la red lo aprenda.
- Reto 6: ¿cuántos dibujos necesitaría la red para aprender 50 formas y 20 colores?
Qué hemos aprendido
Una IA imágenes no es magia: parte de ruido y lo limpia paso a paso, guiada por números que salen de tu texto. La semilla cambia lo que no dijiste; los pasos, la nitidez; la fuerza del prompt, cuánto caso hace al texto. Y dos IA imágenes distintas pueden dar resultados casi iguales si comparten modelo. Si quieres seguir con el arte, mira el arte generativo del Lince, el oído del Lince o la IA musical.



