La IA puede generar un anuncio atractivo a partir de un prompt. El problema más difícil es producir un creativo que siga siendo utilizable cuando el producto cambia, el titular se localiza, la ubicación varía, la marca impone reglas estrictas o la plataforma ensambla múltiples activos en el momento de la publicación.

Eso hace que los datos de entrenamiento publicitario sean distintos a los de una carpeta con imágenes de anuncios finales. Un conjunto de datos útil puede necesitar conectar productos, activos fuente, texto, maquetación, tipografía, intención de la campaña, reglas de la marca, contexto de la plataforma, historial creativo y la salida final renderizada. Los sistemas de clasificación u optimización también pueden requerir datos de preferencia o de rendimiento.

Por tanto, el conjunto de datos adecuado depende de la decisión que debe tomar el sistema de IA. Un modelo que genera una imagen final tiene requisitos de datos diferentes a los de un sistema que compone maquetaciones editables, adapta una campaña a distintos formatos, ordena creativos candidatos, predice resultados o recupera los activos fuente adecuados.

¿Qué es un conjunto de datos publicitarios para IA?

Un conjunto de datos publicitarios para IA es una colección de registros relacionados con la publicidad que se utilizan para entrenar, ajustar, evaluar, recuperar, clasificar o, de otro modo, mejorar sistemas de aprendizaje automático aplicados a la publicidad. Los registros pueden incluir conjuntos de datos de imágenes o conjuntos de datos de vídeo, textos publicitarios, información de producto, estructura de diseño, contexto de campaña, metadatos de la plataforma, relaciones creativas, anotaciones, procedencia y, cuando proceda, señales de comportamiento o de rendimiento.

Para la generación de creatividades publicitarias con IA, la característica definitoria no es la presencia de anuncios, sino si la representación expone la información que el modelo necesita aprender y las relaciones entre esas piezas de información.

¿Qué datos necesita un generador de anuncios de IA?

Equipo creativo revisando los materiales de la campaña de calzado, las guías de marca, las fotos del producto y las maquetas para plataformas sobre una mesa de trabajo del estudio.

No existe un esquema universal para conjuntos de datos publicitarios. Los campos útiles dependen del objetivo del modelo, del formato de salida y del grado de control requerido.

Tarea de IA

Datos útiles de entrenamiento/evaluación

Qué suele faltar en los datos solo de imagen

Generación de imágenes publicitarias

Imágenes creativas, activos del producto, contexto de la campaña o del producto, y texto o indicaciones

Estructura editable, roles semánticos y linaje

Generación de diseño

Tipos de elementos, posiciones, jerarquía, relaciones espaciales y activos de origen

Intención de la campaña y contexto de la plataforma

Generación creativa editable

Capas, activos, roles del texto, tipografía, grupos, reglas de diseño y salidas renderizadas

Estructura del diseño fuente cuando el creativo está aplanado

Adaptación creativa / redimensionamiento

Creativo original, ubicación objetivo, geometría cambiada, reflujo de texto, recorte y jerarquía

Linaje de la variante

Localización

Texto original y traducido, configuración regional, adaptaciones de diseño correspondientes y texto legal

Relaciones entre el texto y el diseño

Clasificación creativa

Creativos emparejados o clasificados, contexto de comparación y etiquetas de preferencia

Por qué se prefirió una opción

Predicción de rendimiento

Definición creativa más audiencia, ubicación, oferta, momento y contexto de resultados

Contexto de entrega e historial de exposición

Evaluación de cumplimiento

Salida más reglas estructuradas y etiquetas validadas

Motivo de la etiqueta y versión de la regla

La pregunta de adquisición más útil, por tanto, no es “¿Cuántos anuncios se incluyen?” Es “¿Contiene el conjunto de datos la información requerida por la tarea específica del modelo?”

Por qué las imágenes finales de los anuncios a menudo no son suficientes

Un JPG o un PNG aplanado muestra el resultado, pero puede ocultar cómo se ensambló ese resultado. Si el sistema debe reemplazar un producto, cambiar un titular, preservar una CTA, traducir una campaña, redimensionar el diseño o devolver una composición editable, el modelo se beneficia de saber qué elementos son activos, qué texto cumple qué función, cómo se agrupan los elementos y cómo está organizada la jerarquía visual.

El OCR es útil para recuperar el texto visible, pero no es anotación semántica. El OCR puede decirte que una frase aparece en una imagen; una etiqueta semántica puede decirte si esa frase es un titular, una CTA, un precio, una oferta, un aviso legal, el nombre de un producto o texto complementario.

Las imágenes aplanadas siguen siendo útiles para el aprendizaje visual, la recuperación y la evaluación del resultado renderizado. La cuestión es si son suficientes para la tarea objetivo. A medida que aumentan los requisitos de control, las representaciones estructuradas o editables se vuelven más valiosas.

El modelo de datos central: Asset, Creative, Variant, Family y Impression

Equipo creativo desarrollando una campaña de marca en un estudio, con personas que revisan formatos de campaña, tipografías, paletas de colores, fotografía de producto y directrices de marca mostradas en paneles y mesas.

Un conjunto de datos publicitario práctico debería distinguir las unidades existentes en el flujo de trabajo de producción. Un archivo de imagen puede formar parte de varias de ellas, pero las unidades no deben fusionarse.

Unidad de datos

Lo que representa
Por qué importa

Recurso

Una imagen de producto, logotipo, titular, fondo, clip de vídeo u otro componente.

Permite la recombinación controlada y el aprendizaje a nivel de componentes.

Pieza creativa

Una composición diseñada completa o un resultado creativo definido.

Representa el anuncio ensamblado real.

Variante creativa

Una pieza creativa modificada derivada de una original.

Captura la adaptación, las pruebas o la sustitución controlada.

Familia creativa

Creativos que comparten un concepto subyacente, una plantilla o un sistema de diseño.

Permite el modelado del linaje y particiones de evaluación que tengan en cuenta la familia.

Paquete de activos

Un conjunto de componentes suministrados a un sistema publicitario basado en activos.

Representa entradas que pueden ser recombinadas por una plataforma.

Impresión servida

La configuración específica realmente entregada en una impresión.

Relaciona una configuración creativa mostrada con el contexto de entrega y su rendimiento.

Una jerarquía de producción útil es:

Campaña → Familia creativa → Variante creativa → Versión de plataforma o de ubicación → Activos y componentes → Salida renderizada

La jerarquía puede entonces vincularse a registros de producto, oferta, titular, CTA, plantilla, mercado, idioma, marca y resultados. Esta vista relacional suele ser más útil para la generación y la evaluación que tratar cada imagen renderizada como una muestra independiente.

Los anuncios de diseño fijo y la publicidad basada en activos son problemas de datos distintos

Un anuncio de maquetación fija almacena la composición directamente: diseño + texto + imagen + logo → anuncio renderizado. Un anuncio basado en activos almacena conjuntos de componentes y la configuración para que un sistema de entrega pueda ensamblar múltiples versiones o variantes. La documentación actual de Responsive Display Ads de Google es un ejemplo concreto. Los anunciantes proporcionan diversos tipos de activos, incluidos titulares, descripciones, imágenes y logotipos, y los sistemas de Google los combinan para ajustarse al espacio publicitario disponible. Google también documenta especificaciones separadas para los propios activos. Para la ingeniería de conjuntos de datos, esto significa que el conjunto de activos de origen y el creativo servido pueden requerir registros separados. Si un sistema puede ensamblar Headline B + Image C + Logo A + Description D para una impresión, el rendimiento observado en esa configuración servida no debería considerarse automáticamente como igualmente atribuible a cada activo de ese grupo original. Esta distinción también es importante para las estructuras de campaña más recientes. La orientación actual de Google indica que las campañas Display se están orientando hacia Demand Gen, lo cual es otra razón para almacenar el entorno de producción como metadatos versionados en lugar de codificar de forma rígida supuestos sobre un único formato de plataforma.

Los metadatos de Platform deben versionarse.

Almacenar únicamente 'plataforma = “Google”' o 'plataforma = “Meta”' rara vez resulta suficiente para un conjunto de datos de producción. El contexto útil puede incluir la plataforma, el tipo de campaña, la ubicación, el formato, la versión de la especificación, la relación de aspecto, las limitaciones de texto, la orientación, el idioma, la configuración regional y las reglas de área segura aplicables a ese emplazamiento.

Las áreas seguras son propiedades contextuales, no propiedades universales de un creativo original. Una anotación de área segura debería identificar la ubicación y la especificación a las que pertenece. Lo mismo se aplica a los límites de texto, a los tipos de activos compatibles y a otras reglas de la plataforma que pueden cambiar con el tiempo.

El principio general es simple: los metadatos de la plataforma deberían describir el entorno de producción que se aplicó al creativo, no limitarse a nombrar la plataforma.


Modelar el texto como contenido y como estructura de diseño

Los textos publicitarios deberían almacenarse como texto estructurado siempre que sea posible. Roles útiles incluyen: titular, subtítulo, cuerpo del texto, nombre del producto, precio, oferta, CTA, aviso legal, afirmación de respaldo y texto legal.

El texto y el diseño no siempre deben tratarse como campos independientes. La longitud del titular puede cambiar el número de líneas, el tamaño de la fuente, la altura del cuadro de texto, la posición de la imagen y los espacios en blanco. Un CTA localizado también puede ser más ancho que su versión en el idioma de origen. Para la generación automática de creatividades, parejas como “titular corto → diseño A” y “titular largo traducido → diseño B” ponen de manifiesto una relación que el texto y las coordenadas en bruto pasarían por alto.

Esta es una de las razones por las que los datos creativos estructurados pueden ser más útiles que la pareja imagen y pie de foto cuando el sistema de destino debe producir resultados controlados y editables.

El diseño necesita algo más que cajas delimitadoras

Las anotaciones de diseño útiles pueden incluir cajas delimitadoras, coordenadas, ancho y alto, alineación, márgenes, relleno (padding), posición en la cuadrícula, orden Z, superposición, agrupación y jerarquía. Pero muchos sistemas de generación de anuncios también necesitan relaciones semánticas.

Supongamos que un producto está posicionado en el lado derecho de una imagen fuente y el lado izquierdo contiene espacio negativo. Un modelo que solo tiene coordenadas absolutas puede aprender dónde se colocó el titular en un ejemplo. Una representación más útil puede captar el motivo de esa colocación: colocar el titular en el espacio negativo disponible para evitar cubrir el producto.

Eso sugiere tres representaciones complementarias del diseño:

• Geometría absoluta: coordenadas, dimensiones y alineación.

• Relaciones de contenido: evitar, alinear, solapar, primer plano/fondo y agrupación.

• Roles semánticos: producto, titular, CTA, logotipo, oferta y otros componentes.

Trabajos recientes respaldan esta dirección. AnyLayout - 120K trata la generación de layouts como un problema multimodal dirigido por instrucciones con anotaciones espaciales y descripciones estructuradas de diseños compuestos. Un preprint de 2025 sobre la generación de diseños de banners publicitarios conscientes del contenido utiliza de forma similar un modelo visión-lenguaje para reconocer objetos y sus relaciones espaciales antes de planificar la colocación del texto y del logotipo. 

La tipografía y la jerarquía forman parte de la estructura creativa

Un registro estructurado puede conservar la familia o categoría tipográfica, el tamaño, el peso, el estilo, el interlineado, el espaciado entre letras, la alineación, el color y las dimensiones del cuadro de texto. También puede preservar la jerarquía funcional del texto y de los elementos.

Esta distinción importa porque, de lo contrario, un modelo puede aprender que “hay algún texto cerca de la parte inferior” sin aprender que el elemento inferior es una CTA, un aviso legal o un precio. Los datos sensibles al rol permiten transformaciones y ediciones más controladas.

La fidelidad del producto es un problema de control independiente.

La publicidad en el comercio electrónico añade una restricción que los conjuntos de datos genéricos de generación de imágenes pueden subrepresentar: el producto debe seguir siendo identificable y consistente cuando se coloca en una escena y en un diseño adecuados.

El emparejamiento de productos, la generación de fondos y la generación del diseño pueden tratarse como problemas controlables y separados. CreativeAds, un sistema de investigación de 2026 para la generación de anuncios multiobjetos, separa explícitamente esas etapas en su flujo de trabajo. La implicación para la ingeniería es útil incluso fuera de ese sistema específico: no agrupes la identidad del producto, la generación de la escena y el diseño en una única etiqueta indiferenciada de calidad de imagen si el modelo necesita control independiente sobre cada uno de ellos.

El contexto de la marca y de la campaña debe ser específico, no genérico.

Los datos de la marca son importantes cuando el sistema debe preservar la identidad. Para la publicidad, los campos más relevantes suelen ser un ID de marca y su versión, el conjunto de reglas aplicables, los activos aprobados, las reglas específicas del producto, el estilo de la campaña y los tratamientos prohibidos. Hay poco beneficio en repetir un marco completo de gobernanza de la marca cuando el problema principal del artículo es el tratamiento de los datos publicitarios.

El contexto de la campaña puede incluir objetivo, producto, oferta, segmento de audiencia previsto, etapa del embudo, mercado, temporada, tema de la campaña, argumento de venta y CTA. Defina los campos de audiencia con cuidado. “Target audience” podría significar un segmento definido por la campaña, una buyer persona, una configuración de segmentación de la plataforma o una característica inferida del usuario. Esos son distintos tipos de datos y no deberían agruparse en un único campo ambiguo.

Las familias creativas y el linaje de variantes cambian la forma en que debería funcionar la deduplicación.

Los conjuntos de datos publicitarios a menudo contienen registros visualmente similares porque las campañas se modifican intencionalmente. El cambio de titular, CTA, precio, producto, fondo o formato puede formar parte del experimento en lugar de constituir ruido duplicado.

Relación

Interpretación                                            

Archivo duplicado exacto
Usualmente redundante.
Mismo anuncio copiado dos veces
Duplicado.
Variante A/B de titular o CTA
Relación experimental.
Copia localizada
Par de localización.
Creativo redimensionado
Adaptación de formato.
Sustitución de producto
Variante controlada.
Misma plantilla con nuevos activos
Familia de plantillas.
Anuncio visualmente similar pero independiente
Solo similitud.

Los campos de linaje que pueden resultar útiles incluyen creative_family_id, parent_creative_id, template_id, variant_type, source_asset_ids, platform_variant_of, localized_from, campaign_version y relationship_ids. Los nombres exactos de los campos pueden variar, pero las relaciones deben conservarse.

Jen Togonon

Jen Togonon