Image Prompt Director
Tu idea + tu marca se convierten en un prompt de imagen preciso y consciente del modelo – la sintaxis correcta por generador, series coherentes, un control de derechos. No genera.
SKILL.md en el estándar abierto agentskills.io — funciona directamente en Claude, ChatGPT/Codex, Cursor, Copilot y más.
Image Prompt Director es un skill de IA que convierte tu idea + tu marca en un prompt de imagen preciso y consciente del modelo. Pregunta tu modelo objetivo (Midjourney, GPT Image/DALL·E, Gemini, FLUX, Stable Diffusion, Ideogram, Firefly) y emite la sintaxis correcta en vez de adjetivos floridos, rellena todos los pilares, construye una biblia de estilo/personaje para series coherentes y señala derechos/etiquetado. No genera — verificación en vivo.
Qué hace este skill
- **El modelo + el trabajo primero:** pregunta el generador/versión + el uso, cambia el dialecto de sintaxis y la relación de aspecto
- **Rellena todos los pilares:** sujeto, acción, entorno, composición, cámara, luz, color, estilo, calidad — y traduce las vibras en descriptores concretos
- **Kit de coherencia para series:** bloque de estilo fijo + biblia de personaje + disciplina de seed/referencia (`--oref`/`--sref`/Kontext/Nano Banana) — el problema n.º 1
- **Prompts negativos bien hechos:** reales solo en la familia SD; en otros, formula las exclusiones en positivo, nunca sobrecargues
- **Texto y logos bien dirigidos:** texto legible a Ideogram/GPT Image; logos/hex exactos incrustados en una herramienta de diseño
- **Relación de aspecto + zonas seguras** por plataforma; **resolución de problemas** (manos, texto, sangrado, «look de IA») con el arreglo exacto
- **Control de derechos:** licencia por modelo, copyright, marca/derecho de imagen, etiquetado → traspaso a KI-Transparenz
- **Dos scripts de Node:** prompt-forge (construye un prompt correcto por modelo) y prompt-lint (QA contra vaguedad/dialecto erróneo/artistas vivos)
Descripción
Image Prompt Director es un skill que convierte una idea y tu marca en un prompt de imagen preciso y **consciente del modelo** — uno que pegas en tu generador (Midjourney, GPT Image/DALL·E, Gemini/Nano Banana, FLUX, Stable Diffusion, Ideogram, Firefly). Es el director de arte, no el generador: escribe el mejor prompt posible (más el prompt negativo, los parámetros y un kit de estilo reutilizable) y explica cada decisión. Regla fundacional: **consciente del modelo, no florido.** La sintaxis de los prompts no es transferible — `(word:1.3)` es exclusivo de Stable Diffusion, Midjourney usa `--no`/`--sref`, GPT/Gemini/FLUX quieren lenguaje natural; los bots genéricos que pegan adjetivos a una idea son la razón de que las imágenes de IA se parezcan todas. Por eso pregunta el modelo **y la versión** primero, y luego emite el dialecto correcto. Rellena **todos los pilares** (sujeto → acción → entorno → composición → cámara → luz → color → estilo → calidad — un pilar que falta significa algo genérico), traduce las vibras en descriptores físicos («premium» → metal mate, luz de estudio suave, espacio negativo), dirige la cámara (encuadre/ángulo/focal/profundidad de campo) y **nombra la luz** (golden hour, Rembrandt). Para las **series** resuelve el problema n.º 1 — la coherencia — con un bloque de estilo fijo más una **biblia de personaje**, disciplina de seed y la técnica de referencia adecuada por modelo (`--oref`/`--sref`, FLUX Kontext, Gemini/Nano Banana, IP-Adapter). Trata los **prompts negativos** con honestidad (reales solo en la familia SD; en otros, formula en positivo), **dirige el texto legible** a los modelos que pueden renderizarlo (Ideogram/GPT Image/Recraft, no Midjourney), fija la **relación de aspecto** al destino (9:16 story, 4:5 feed, 16:9 miniatura) y depura **una variable a la vez** (manos, caras, texto ilegible, sangrado de prompt, el «look de IA»). Y señala **derechos y etiquetado** con honestidad: la licencia comercial difiere por modelo, un prompt por sí solo no confiere copyright, no clona artistas vivos, incrusta logos/colores exactos — y las imágenes de IA publicadas pueden necesitar una etiqueta (traspaso al skill **KI-Transparenz**). Todo con verificación en vivo, porque los modelos cambian cada mes.
Ejemplos
Probado con Claude Code
Qué no hace
- **No genera** y no hace upscale/inpaint ni revisa la imagen — escribe el prompt; tú generas en tu propia herramienta
- **No garantiza** logos exactos, texto exacto, hex de marca exacto ni identidad de personaje al píxel — da la vía fiable (incrustación/referencia) en su lugar
- **No es asesoramiento jurídico** — señala licencia/copyright/marca/etiquetado; verifica las condiciones actuales del modelo; etiquetado → KI-Transparenz
- **Verificación en vivo** — los modelos cambian cada mes; fecha sus afirmaciones en vez de fijar «el último es vX»
Compatibilidad y técnica
- Probado (interno)
- 3 escenarios
- Runtime recomendado
- Claude Opus o Sonnet; con acceso web para verificar en vivo las versiones/parámetros actuales de los modelos y el «mejor modelo para X». Los dos scripts necesitan Node (sin paquetes adicionales); sin Node, el skill produce el prompt y el lint a mano a partir de las referencias.
- Modos
- Escribir un prompt de imagen (consciente del modelo) · Kit de coherencia para series (biblia de estilo/personaje) · Resolución de problemas / iteración · Control de derechos y etiquetado
- Entradas
- idea/sujeto + modelo objetivo + uso · marca (colores, ambiente, estilo) + imagen única o serie · un prompt existente (para mejorar) o un resultado fallido (para arreglar)
- Formato de salida
- Un entregable Markdown por modo — el prompt correcto para el modelo (más prompt negativo/parámetros) en bloques limpios para copiar, opcionalmente la biblia de estilo/personaje reutilizable, más un breve porqué, un aviso de derechos y una siguiente iteración.
- Subcategoría
- Generación de imágenes con IA, dirección de prompts y coherencia de imagen
- Licencia
- Proprietär
Perfil de seguridad
Se ejecuta por completo en tu equipo con tu propia IA — sin runtime externo, sin costes recurrentes.
Contiene código ejecutable o ejecuta acciones/herramientas — échale un vistazo antes de usar.
Accede a fuentes externas / la red en uso normal (páginas en vivo, APIs de búsqueda/datos).
Qué incluye
- image-prompt-director-1.0.0/10 archivos
- .claude-plugin/marketplace.json
plugins/image-prompt-director/skills/image-prompt-director/10 archivos
- SKILL.md
- manifest.json
references/6 archivos
- image-prompt-director-anatomy.md
- image-prompt-director-consistency.md
- image-prompt-director-models.md
- image-prompt-director-rights.md
- image-prompt-director-troubleshooting.md
- image-prompt-director-usecases.md
scripts/2 archivos
- prompt-forge.mjs
- prompt-lint.mjs
- .agents/skills/image-prompt-director/→ universal — mismo contenido (Codex, Cursor, Copilot, Gemini, Windsurf, Cline)
- LICENSE.txt
Instalación
También como prompt de chat
¿Sin herramienta de IA? Pégalo en Claude, ChatGPT o Gemini y usa el método al instante.
Obtienes el método completo. Solo 2 script(s) de ayuda que automatizan partes funcionan una vez instalado.
Funciona mejor cuando tu chat tiene acceso web.
Instalarlo es la versión completa — se activa solo, ejecuta sus scripts y carga referencias cuando hacen falta. Como prompt de chat, tú conduces el método.
Desbloquéalo para copiar el prompt listo para pegar — luego en «Mis skills».
Reseñas
Aún no hay reseñas: sé el primero.
Nota
Image Prompt Director escribe prompts — no genera, no hace upscale ni inpaint, y no revisa la imagen terminada; tú generas en tu propia herramienta. Los modelos de imagen con IA cambian cada mes. Con acceso web, el skill verifica versiones/parámetros actuales en vivo y fecha sus afirmaciones. Es una primera orientación, no asesoramiento jurídico — verifica la licencia comercial, el copyright, la marca y el derecho de imagen por modelo; no clona artistas vivos y no puede garantizar logos/textos/colores de marca exactos (incrustación en su lugar). Para la obligación de etiquetado de imágenes de IA publicadas (EU AI Act Art. 50), el skill KI-Transparenz es el competente. Los scripts incluidos necesitan Node (sin paquetes adicionales).
Historial de cambios
- v1.0.021.08.2026Primera versión — convierte una idea + una marca en un prompt de imagen preciso y consciente del modelo. Pregunta el modelo objetivo (Midjourney, GPT Image/DALL·E, Gemini/Nano Banana, FLUX, Stable Diffusion, Ideogram, Firefly) y emite la sintaxis correcta (--ar/--sref/--no vs (word:1.3)+campo negativo vs lenguaje natural), rellena todos los pilares (sujeto, composición, cámara, luz, color, estilo), construye una biblia de estilo/personaje reutilizable para series coherentes (el problema n.º 1), dirige el texto legible al modelo adecuado, da orientación de prompt negativo/relación de aspecto/iteración, y señala derechos/etiquetado (licencia, copyright, marca, EU AI Act → traspaso a KI-Transparenz). Dos scripts de Node (prompt-forge, prompt-lint), 6 referencias. No genera — verificación en vivo.
Preguntas frecuentes
¿Qué hace Image Prompt Director?
Image Prompt Director es un skill de IA que convierte tu idea + tu marca en un prompt de imagen preciso y consciente del modelo. Pregunta tu modelo objetivo (Midjourney, GPT Image/DALL·E, Gemini, FLUX, Stable Diffusion, Ideogram, Firefly) y emite la sintaxis correcta en vez de adjetivos floridos, rellena todos los pilares, construye una biblia de estilo/personaje para series coherentes y señala derechos/etiquetado. No genera — verificación en vivo.
¿Para qué IA de imagen escribe prompts el Image Prompt Director?
Para todas las principales — y ese es el punto. El Image Prompt Director pregunta tu modelo objetivo (Midjourney, GPT Image/DALL·E, Gemini/Nano Banana, FLUX, Stable Diffusion, Ideogram, Firefly) y emite la sintaxis correcta, porque no es transferible — (word:1.3) es exclusivo de Stable Diffusion, Midjourney usa --no y --sref, GPT/Gemini/FLUX quieren lenguaje natural. Como estos modelos cambian cada mes, verifica la versión actual en vivo.
¿Por qué es mejor el Image Prompt Director que un generador de prompts genérico?
Los bots genéricos solo pegan adjetivos floridos a tu idea — por eso las imágenes de IA se parecen todas. El Image Prompt Director es consciente del modelo (sintaxis correcta por generador), consciente de la marca (construye una biblia de estilo/personaje reutilizable contra el problema n.º 1, la coherencia), transparente (ves y posees el prompt) y enseña a iterar. Y es portátil — corre en tu propia IA, sin suscripción ni bloqueo.
¿Cómo mantengo mi personaje o estilo coherente entre varias imágenes?
La coherencia es el mayor problema de la generación de imágenes con IA, y el Image Prompt Director te da el kit para ello — un bloque de estilo reutilizable y fijo más una biblia de personaje, la técnica adecuada por modelo (Midjourney --oref/--sref, FLUX Kontext, Gemini/Nano Banana, IP-Adapter) y disciplina de seed. Con honestidad, ningún modelo garantiza identidad al píxel — los detalles exactos se incrustan después.
¿Puede el Image Prompt Director poner logos, texto y colores de marca exactos en la imagen?
No de forma fiable directamente en la imagen — y el Image Prompt Director te lo dice con honestidad en vez de prometerlo. Los logos exactos y los hex de marca se incrustan mejor en una herramienta de diseño; el texto legible lo dirige a los modelos que pueden hacerlo (Ideogram, GPT Image, Recraft). Así obtienes un resultado fiable en lugar de galimatías.
¿El Image Prompt Director genera las imágenes él mismo?
No. El Image Prompt Director escribe el prompt (más prompt negativo, parámetros y un kit de estilo) — no genera, no hace upscale ni inpaint, y no revisa la imagen terminada. Tú generas en tu propia herramienta. Eso te mantiene al mando y hace el skill portátil entre todos los generadores.
¿Con qué herramientas de IA funciona Image Prompt Director?
Claude · ChatGPT/Codex · Cursor · Copilot · Gemini CLI · Windsurf · Cline
¿Cómo uso Image Prompt Director?
Image Prompt Director es un SKILL.md en el estándar abierto agentskills.io: instálalo con un comando (npx) o descárgalo y añádelo a tu herramienta de IA — Claude (Projects), ChatGPT (Custom GPT), Cursor, Copilot, Gemini CLI y más. Sin código.