Recreación digital de recurso
Grok actualiza su motor de generación visual para competir en el diseño profesional con herramientas de edición directa.
Por A. Lagar | 10 de agosto de 2026
¿Qué cambia con la llegada de la versión 2.0?
Si llevas un tiempo trasteando con generadores de imágenes por inteligencia artificial, seguro que te has roto la cabeza más de una vez.
Le pides una manzana verde a un motor de primera generación y te devuelve un campo entero de árboles con frutas de colores extraños.
O peor aún: intentas que ponga una palabra sencilla en un cartel y te genera un idioma inventado que parece alienígena.
La gente de xAI quiere atajar ese problema de raíz con el lanzamiento de Imagine Image 2.0, su nuevo modelo de creación y edición gráfica integrado en Grok.
Esta actualización sustituye al modo de calidad anterior y ya se puede probar tanto en la web de Grok como en las aplicaciones oficiales para dispositivos iOS y Android.
El enfoque principal de los desarrolladores no ha sido sacar imágenes más vistosas sin control, sino conseguir que el sistema entienda las instrucciones extensas de forma literal.
Si le pides cinco elementos en posiciones concretas, el modelo distribuye el espacio para que los cinco aparezcan en pantalla sin solaparse ni alterar el estilo visual de la composición.
La tipografía por fin se entiende: texto legible sin errores extraños
Uno de los mayores dolores de cabeza en el diseño generado por software siempre ha sido la renderización de texto.
La mayoría de los modelos tienden a deformar las tipografías pequeñas, convirtiendo cualquier rótulo, etiqueta o cartel en un borrón ilegible.
Imagine Image 2.0 aborda este problema tratando la maquetación y las fuentes con un sistema de planificación similar al que aplicaría un diseñador humano antes de pintar el lienzo.
Esto significa que cuando solicitas una imagen que incluye cartelería, portadas de libros ficticios o empaquetado de productos, el motor reserva el espacio necesario para las letras y aplica los trazos de forma limpia.
El texto pequeño mantiene la nitidez en lugar de disolverse en artefactos extraños, lo que permite generar recursos publicitarios o esquemas conceptuales con mensajes claros desde el primer intento.
Modificar solo una parte de la foto sin romper el trabajo previo
El flujo de trabajo habitual en diseño no consiste en acertar a la primera, sino en hacer retoques constantes.
Hasta ahora, cuando querías cambiar un pequeño detalle en una imagen generada por IA, tenías que volver a pedir la foto completa y cruzar los dedos para que el resto no cambiara por completo.
La versión 2.0 introduce herramientas de edición precisa para intervenir únicamente en la zona que tú decidas.
- Pincel de selección localizado: Permite marcar una región específica con una herramienta tipo varita mágica para alterar únicamente ese fragmento, manteniendo el fondo y los personajes intactos.
- Segmentación de objetos: Identifica áreas concretas de la composición para aplicar cambios de color, iluminación o textura sin afectar al resto del encuadre.
- Aislamiento de elementos: Extrae al sujeto principal y elimina el fondo en un solo paso, dejando la figura con transparencia para exportarla directamente a otros proyectos gráficos.
Cómo funciona la edición multirreferencia con cinco fuentes a la vez
Juntar varios elementos en un mismo estilo visual suele requerir horas de montaje en programas tradicionales.
Para agilizar este proceso, el nuevo motor de Grok admite hasta cinco imágenes de entrada en una única petición.
Puedes subir la fotografía de un producto, la cara de un personaje, un fondo específico y dos objetos de atrezzo para que el sistema combine todo en una escena cohesiva.
El sistema analiza la iluminación, los ángulos de cámara y la paleta de colores de cada archivo subido para unificarlos bajo una misma estética, evitando que los elementos parezcan pegados a la fuerza.
Esta función busca solucionar la falta de consistencia cuando se intentan crear secuencias de imágenes para vídeos, historietas o catálogos. Al mantener la apariencia de un personaje y sus accesorios a través de diferentes peticiones, se reduce la necesidad de hacer ajustes manuales en editores externos.
Redimensionamiento automático y flujos de trabajo con plantillas
Adaptar un mismo diseño a diferentes formatos de pantalla suele implicar recortar la imagen o rehacerla desde cero.
El modelo incorpora un sistema de redimensionamiento que extiende o completa los bordes del lienzo según la proporción que elijas, rellenando el espacio nuevo con elementos coherentes con el contexto original.
Para acelerar la producción en entornos de trabajo habituales, la plataforma ha añadido un catálogo de plantillas preconfiguradas.
Estas opciones integran los parámetros necesarios para tareas específicas como retratos profesionales, recursos para videojuegos, iconos de interfaz, fotografía de producto o edición fotográfica comercial.
En lugar de escribir instrucciones complejas desde cero, solo hay que seleccionar la plantilla e introducir los datos clave del proyecto.
Así reconoce ingredientes y capas según su posición
Para ver de lo que es capaz Imagine Image 2.0 en situaciones reales, nada mejor que ponerlo a prueba con la fotografía de una hamburguesa.
En este tipo de imágenes con alimentos, las capas se amontonan y los brillos o salsas suelen confundir a los editores automáticos.
Sin embargo, el resultado de la prueba muestra una precisión que facilita el trabajo de retoque sin necesidad de seleccionar áreas a mano.
El sistema identifica de forma independiente cada uno de los componentes de la foto: reconoce la hoja de lechuga, las tiras de bacon, las lonchas de queso fundido o el pan.
Lo interesante no es solo que sepa qué es cada cosa, sino que entiende la posición exacta que ocupa cada ingrediente dentro del plato.
- Reconocimiento por capas: Si hay queso cerca del pan superior y otra loncha pegada a la carne en la parte inferior, puedes pedirle que modifique únicamente una de las dos. El algoritmo no toca la otra capa ni altera el resto de la estructura.
- Respeto a la perspectiva y sombras: Al editar o cambiar un ingrediente concreto, la inteligencia artificial rehace las sombras y los reflejos sobre los alimentos colindantes para que la luz siga siendo coherente.
- Varias propuestas con un solo comando: Con dar una única orden de modificación, el motor genera de forma simultánea distintas composiciones con variaciones de encuadre o ingrediente para que elijas la que mejor encaja.
Además te incluye varios escenarios de la imagen.



