Generación de imágenes con IA para anuncios
El modelo no es la habilidad. El briefing sí. Hoy aprenderá a dirigir un generador de imágenes como un director creativo dirige una sesión de fotos: para que el resultado sea acorde a la marca, esté listo para anuncios y sirva para alimentar el bucle, en lugar de producir basura de IA.
Las imágenes de IA acordes a la marca las crea el briefing, no el modelo. Seis insumos que usted controla — sujeto y fidelidad del producto, referencia de estilo, composición, iluminación, texto exacto, persona y ángulo — deciden si obtiene su anuncio o el promedio de internet.
1El modelo es un producto básico; el briefing es el oficio
Ayer (día 12) activó las mejoras gratuitas e integradas en la plataforma de Meta — generación de fondos, expansión de imagen, retoques — que reformatean y recombinan los recursos que usted sube. Hoy crea los recursos en sí desde un lienzo en blanco. Es un trabajo distinto y un perfil de riesgo distinto, por eso tiene su propio día.
Aquí está la trampa que hay que desactivar primero. Los fundadores leen sobre «el mejor modelo de imágenes con IA» y tratan la selección de la herramienta como la decisión. Apenas importa. Usted mapeó el conjunto de herramientas el día 11 — el recordatorio de una línea para imágenes es una clara división del trabajo, y usará varias en un mismo pipeline:
- Midjourney — la toma hero de mayor calidad estética.
- El modelo FLUX actual — fotografía de producto y de estilo de vida fotorrealista.
- Ideogram o la última versión de Recraft — cuando hay mucho texto o un logotipo.
- ByteDance Seedream — variantes en masa y baratas.
- El modelo de imágenes de Gemini actual de Google — el predeterminado a mediados de 2026 para ediciones, variantes y para fijar la coherencia de marca a lo largo de una serie.
Elija según el trabajo que tenga delante, no según el ranking. Los nombres cambiarán — la división del trabajo (toma hero estética / fotorrealista / renderizado de texto / masa barata / ediciones coherentes) es el mapa duradero.
La razón por la que esto es liberador: significa que la habilidad duradera no es «qué modelo». Es cómo redacta el briefing. Dos operadores con acceso idéntico al mismo modelo producen resultados radicalmente distintos — uno publica un bodrio genérico con aspecto de foto de stock, el otro publica un anuncio que convierte — porque uno escribió un briefing y el otro escribió un deseo. Cada imagen genérica que ha visto pasar alguna vez era un prompt de una sola línea. Cada imagen acorde a la marca era un briefing estructurado.
Y recuerde por qué estamos aquí. Allá en el día 1 establecimos que la creatividad es la última palanca que usted controla y que se desgasta — todo ganador decae a medida que escala. El objetivo de generar imágenes con IA no es hacer una sola foto bonita; es alimentar el volumen que el bucle necesita (el explore/exploit del día 5, la matriz del día 10) sin un presupuesto de estudio por cada recurso. El volumen barato solo se acumula si es acorde a la marca y está etiquetado, así que el briefing es donde se protegen a la vez la calidad y la capacidad de aprender.
2Los seis insumos que hacen que una imagen sea acorde a la marca
Un deseo es «un frasco de sérum sobre una encimera de mármol, con luz de sol». Un briefing especifica seis insumos que el modelo no puede adivinar. Si falta cualquiera, el modelo rellena el hueco con el promedio de sus datos de entrenamiento — que es exactamente lo que es la «basura de IA»: la media estadística de todas las imágenes como la suya que han existido. Insulsa por construcción.
Los seis insumos:
- Sujeto y fidelidad del producto — qué hay exactamente en el encuadre, y si es el producto real. Este es el innegociable (sección 3).
- Referencia de estilo — el aspecto: una paleta de marca, un ambiente, 2 a 4 imágenes de referencia de creatividades anteriores acordes a la marca. El --sref y el Style Weight de Midjourney, o darle al modelo de imágenes de Gemini actual su logotipo, sus colores de marca y sus visuales previos, existen precisamente para fijar esto.
- Composición y formato — el encuadre, dónde se sitúa el producto, el espacio negativo para el texto y la proporción de aspecto en la que va a publicar (9:16 Reels, 4:5 Feed, 1:1 — sus formatos del día 10).
- Iluminación y tratamiento — y aquí toma una decisión deliberada del día 9: hi-fi (estudio, pulido, luz controlada) o lo-fi (tomado con el móvil, sobre una encimera de cocina, «un amigo publicó esto»). La IA hace ambas; el briefing decide cuál.
- Texto dentro de la imagen — si hay un titular o una insignia incrustados en los píxeles, usted especifica las palabras exactas. En 2026, los especialistas en renderizado de texto (Ideogram, Recraft) y el modelo de imágenes de Gemini actual renderizan texto legible y correcto; los modelos más antiguos todavía producen glifos confusos. Dirija el trabajo con mucho texto a un modelo que sepa deletrear.
- Indicaciones de persona y ángulo — el ser humano que la imagen sugiere (día 7) y el mensaje que transmite (día 8). Un encuadre de «padre que cuida el presupuesto, alivio antes/después» no se parece en nada a un encuadre de «profesional que busca estatus, aspiracional», incluso para el mismo producto.
Un ejemplo trabajado. Supongamos que una marca de cuidado de la piel quiere creatividades de Feed para un concepto en dos personas. El deseo — «sérum sobre mármol, luz de sol» — le da una foto de stock olvidable en el primer intento y tres reintentos casi idénticos después. El briefing le da una matriz de generación. Mantenga fijos el concepto, el producto y la paleta; varíe la persona, el tratamiento y el formato: 2 personas × 2 tratamientos (hi-fi / lo-fi) × 2 proporciones (4:5 / 9:16) = 8 frames etiquetados a partir de un solo briefing estructurado en una tarde. En una sesión de fotos de estudio eso es media jornada y una cifra de cuatro dígitos; aquí son unos pocos euros de créditos. Esa es la palanca — pero solo porque cada frame es un punto deliberado y etiquetado de la matriz, no ocho tiradas del mismo dado.
3Fidelidad del producto: componga, no alucine
Aquí está el error más caro en imágenes publicitarias con IA, y la única regla que separa el resultado aficionado del profesional: nunca deje que el modelo invente su producto.
Si describe su producto con palabras y deja que el generador lo dibuje, obtendrá un frasco, una zapatilla, un panel — plausible, bonito y equivocado. La etiqueta es ininteligible, el logotipo es una aproximación derretida, la tapa tiene la forma equivocada, el dispositivo tiene seis botones en lugar de cuatro. Para usted es evidente que no es su producto. Para un cliente que hace clic y ve la cosa real, es un cambio engañoso — y la confianza, eso de lo que depende todo su embudo, se resiente. Para las categorías reguladas o premium es peor: un producto alucinado puede insinuar una característica que usted no vende.
La solución es la composición. Genere la escena con IA — el mármol, la luz, el contexto de estilo de vida, las manos del modelo — y coloque dentro la fotografía real de su producto. Los editores modernos hacen de esto un solo paso: usted incrusta (inpaint) el producto real sobre un fondo generado por IA (inpainting = regenerar solo un área seleccionada, de modo que el resto de la imagen queda intacto; la máscara es esa selección), o lo enmascara dentro y deja que el modelo de imágenes de Gemini actual iguale el color de la iluminación para que encaje con naturalidad. La IA hace aquello en lo que es genuinamente buena (entornos baratos, infinitos y plausibles); la cámara hace lo que debe (un registro honesto de aquello que va a enviar). La misma lógica protege los rostros y cualquier texto en el que el cliente deba confiar — genere el mundo, ancle la verdad.
Esta misma disciplina escala hi-fi y lo-fi (día 9) por igual. Una composición hi-fi coloca el frasco real en un set de IA con iluminación de estudio. Una composición lo-fi coloca el mismo frasco real en un «estante de baño desordenado, flash del móvil, ligeramente descentrado» generado por IA — y ahora tiene una imagen fija UGC de aspecto nativo que no necesitó un creador, una cocina ni media jornada. Ambas son acordes a la marca porque en ambas el producto es real.
El generador es un fotógrafo de talla mundial que lo ha fotografiado todo y fotografiará cualquier cosa — pero no conoce su marca y nunca ha visto su producto. Déle un deseo de una línea («una foto bonita de sérum») y disparará la imagen de stock genérica que ya ha disparado mil veces. Déle un briefing — moodboards, la paleta, el encuadre, la iluminación y el producto real sobre la mesa — y disparará su anuncio. No está pulsando un botón. Está en el set, dirigiendo. El prompt es solo cómo le habla al equipo.
Esto no es un prompt aislado que escribe y pierde. Es una plantilla guardada en su documento creativo — una fila por generación, seis columnas de insumos, para que cualquiera (o usted mismo en el futuro) pueda producir frames acordes a la marca sin volver a deducir la receta. Se conecta directamente con las etiquetas del genoma del día 4: los campos de persona/ángulo/tratamiento/formato del briefing son los ejes del genoma, capturados en el momento de la creación y no adivinados más tarde.
Fíjese en el control de calidad. Sepa cómo funciona realmente la divulgación antes de dar por hecho que recae en usted. Para los anuncios de producto corrientes, Meta no le exige autodeclarar el uso de IA — cuando su sistema de detección identifica contenido creado o editado de forma significativa con IA generativa, Meta aplica automáticamente una etiqueta de «información de IA», sin que usted tenga que hacer nada (las ediciones menores, como redimensionar o corregir el color, no se etiquetan en absoluto). La casilla obligatoria de divulgación del anunciante solo aparece para los anuncios registrados en la categoría de Temas Sociales, Elecciones o Política de Meta, y solo cuando contienen contenido fotorrealista, de estilo deepfake, creado o alterado — ahí, no divulgarlo puede suponer la retirada del anuncio o sanciones a la cuenta. Por separado, las obligaciones de transparencia del artículo 50 del Reglamento de IA de la UE entran en vigor el 2 de agosto de 2026 y obligan a los proveedores de IA generativa (marcar los resultados) y a los responsables del despliegue (divulgar los deepfakes y el texto de IA de interés público) — de modo que un anunciante de la UE que publique creatividades sintéticas realistas o deepfakes puede tener una obligación de etiquetado conforme a la legislación de la UE, aunque no se trata de una regla general de «etiquetar todo anuncio que haya pasado por IA». Control práctico: si un frame contiene una persona sintética realista, contenido de estilo deepfake, o se publica en la categoría de política/temas sociales, divúlguelo y consulte las reglas vigentes. Un producto real compuesto sobre un fondo de IA es una creatividad de producto corriente — no se requiere autodivulgación, pero tenga en cuenta que Meta puede autoetiquetar el fondo sintético. Incorpore esa comprobación al control ahora; lo formalizaremos como la etapa de calidad de la línea de producción el día 15, cuando construyamos la línea de producción completa. Datos de la política de la plataforma comprobados en junio de 2026 — verifique las reglas vigentes antes de basarse en ellos.
Escriben un deseo de una línea, aceptan el primer resultado con aspecto fotorrealista y lo publican — orgullosos de haber «usado IA». El resultado es basura genérica de IA (la media de los datos de entrenamiento, reconocible como anuncio desde el espacio) o, peor, un producto alucinado que no coincide con lo que llega en la caja. Ambos queman la confianza y el CTR en silencio. El replanteamiento, y su ventaja: la generación de imágenes con IA no es una máquina expendedora, es una habilidad de dirección. El operador que redacta un briefing de seis insumos y compone el producto real publica creatividades indistinguibles de una sesión de estudio a una fracción del coste — y, como cada frame se redacta contra el genoma, publica el volumen del que el bucle puede de verdad aprender. Cualquiera puede pulsar generar. Casi nadie redacta un briefing.
Ya ha leído el marco — ahora genere contra él. No termine el día 13 con cero imágenes.
- Copie la plantilla de briefing en su documento creativo como una fila (el formato img-b07-v03 — seis columnas de insumos).
- Rellene los seis insumos para su producto: sujeto + fidelidad del producto, referencia de estilo, composición + formato, iluminación + tratamiento, texto dentro de la imagen, persona + ángulo.
- Genere 4 frames en una sola herramienta — 2 tratamientos (hi-fi / lo-fi) × 2 proporciones (4:5 / 9:16).
- Pase cada uno por el control de calidad y rechace cualquier cosa con un producto deformado, texto confuso o color fuera de paleta.
Hecho = 1 fila de briefing guardada + 4 frames etiquetados que pasaron el control.
Resumen de hoy — 30 segundos
- El modelo es un producto básico (Midjourney / FLUX / Ideogram / el modelo de imágenes de Gemini actual — elija según el trabajo, mapeado el día 11); el briefing es el oficio.
- Seis insumos hacen que una imagen sea acorde a la marca: sujeto+fidelidad, referencia de estilo, composición+formato, iluminación+tratamiento, texto dentro de la imagen, persona+ángulo — si falta uno, el modelo lo rellena con la media insulsa.
- Componga, no alucine: genere la escena, coloque dentro la foto del producto real. Nunca deje que el modelo invente lo que el cliente va a recibir.
- La IA hace ambas, hi-fi y lo-fi (día 9) — el briefing decide cuál; ambas siguen siendo acordes a la marca porque el producto es real.
- Los campos del briefing son las etiquetas del genoma (día 4); añada una comprobación de divulgación en el control de calidad — Meta autoetiqueta los medios de IA generativa en los anuncios corrientes, mientras que las creatividades de estilo deepfake o de categoría política conllevan un deber real de divulgación (y el artículo 50 del Reglamento de IA de la UE desde agosto de 2026).