El modelo escribe mal las palabras
Los generadores dibujan el texto dentro de la imagen y salen letras de más o un borrón donde iba el titular. Te das cuenta cuando ya está en la cuenta publicitaria.
Dale al estudio la URL de tu página o un briefing breve y montará los banners con los tamaños exactos de Meta, Google, TikTok, Telegram y YouTube. Después un modelo de visión mira los píxeles finales: texto, defectos y seguridad publicitaria.
Los generadores dibujan el texto dentro de la imagen y salen letras de más o un borrón donde iba el titular. Te das cuenta cuando ya está en la cuenta publicitaria.
Un cuadrado en lugar de 1080×1350, el logo cortado, el texto fuera de la zona segura. La plataforma recorta el diseño y las impresiones van a una creatividad destrozada.
Un texto en inglés sobre un banner dirigido al mercado árabe o hebreo rompe el sentido y la maqueta: la dirección de escritura es la contraria, el diseño no.
El estudio lee la web y el contexto de mercado del cliente, y extrae la oferta y la audiencia. Un briefing escrito funciona igual cuando todavía no hay web.
El modelo genera una imagen sin letras, el copy se escribe en el idioma de la campaña y el compositor lo coloca sobre la maqueta, de derecha a izquierda en hebreo y árabe.
Un modelo de visión inspecciona los píxeles mientras la auditoría compara la maqueta con la especificación de la plataforma. Lo aprobado se exporta o se convierte en MP4.
Catálogo de tamaños de Meta, Google, TikTok, Telegram y YouTube: de 1080×1080 y 1080×1920 a 728×90 y 300×250, con los recomendados señalados.
El texto se escribe de forma nativa en ruso, ucraniano, inglés, español, hebreo o árabe y se revisa por alfabeto, longitud y promesas no sostenibles.
El modelo de visión lee el texto que quedó en la imagen y busca defectos de anatomía, marcas de agua y artefactos. Sin clave de proveedor la revisión se marca «no disponible», nunca «superada».
Zona segura, proporción de texto visible y comprobaciones obligatorias dan a cada creatividad un estado: lista para lanzar, requiere revisión o bloqueada.
ffmpeg convierte un banner terminado en un movimiento Ken Burns —zoom o panorámica— al tamaño exacto del emplazamiento. No interviene ningún proveedor de pago.
Los paquetes de Gemini y ChatGPT con slots de imagen y vídeo y regeneraciones incluidas son opcionales: el modo base funciona sin ellos.
Sí, es el camino principal del modo Lite: das una URL, el estudio lee la página, extrae la oferta, el tono y la audiencia y monta un juego de banners para las plataformas que elijas. Un briefing escrito sirve igual si todavía no hay web.
La imagen se genera sin ninguna letra y el copy se añade como capa aparte en el navegador, así que las palabras siempre salen correctas. Además, un modelo de visión revisa los píxeles finales y avisa si el generador pintó algún texto suelto.
En ruso, ucraniano, inglés, español, hebreo y árabe. Para hebreo y árabe la maqueta se compone de derecha a izquierda, y Noto Sans Hebrew y Noto Sans Arabic están en la pila de fuentes para que las letras no se rompan.
Para el movimiento Ken Burns no: ese clip lo renderiza ffmpeg en tu propio servidor y cuesta cero. El vídeo generativo de Veo o Sora pasa por los paquetes premium de Gemini y ChatGPT, donde los slots se compran aparte.
Recibe el estado «requiere revisión» o «bloqueada» con la lista concreta de problemas, desde texto fuera de la zona segura hasta artefactos en la imagen. Puedes regenerar el banner sin volver a escribir el briefing.
Basta con la URL de tu página: los formatos, el copy en el idioma del mercado y la revisión de píxeles vienen activados desde el primer intento.