Siete días metiendo prompts a Midjourney v6 dan para bastante más que un puñado de wallpapers bonitos. Dan para entender qué hace excepcionalmente bien, dónde se rompe de forma cansina y para qué perfil de usuario tiene sentido pagar la suscripción. Este análisis va de eso: de la experiencia real, no del showcase pulido que circula por Twitter.
Qué es Midjourney v6 y cómo funciona
Midjourney v6 es la sexta iteración del modelo de generación de imágenes por IA de Midjourney Inc., accesible principalmente a través de Discord y, desde hace meses, de una web propia (midjourney.com). No hay app móvil oficial. Se paga por suscripción mensual y las imágenes se generan escribiendo prompts en lenguaje natural — con v6, mucho más natural que en versiones anteriores.
La versión 6 aterrizó en diciembre de 2023 en modo alpha y ha ido recibiendo ajustes (v6.1 incluida) durante 2024. Sigue conviviendo con v5.2 y con Niji para estética anime; el usuario elige cuál usar con parámetros como --v 6 o desde los ajustes.
A quién va dirigido
Está pensado para diseñadores, creativos publicitarios, ilustradores de conceptos, autores de contenido visual para redes y curiosos con paciencia para iterar. No es una herramienta para quien busque un botón mágico: exige tiempo aprendiendo cómo redacta prompts la comunidad, cómo pesan los --ar, los --stylize, las referencias de imagen. Quien quiera enchufar y obtener resultados “correctos” a la primera se frustrará.
Tampoco es para uso serio en producción con personajes humanos precisos. Ni para quien necesite control milimétrico tipo ControlNet: eso sigue viviendo en el ecosistema de Stable Diffusion.
Precio y planes en España
Los planes se facturan en dólares y se cobran en euros al cambio, con IVA aplicable. Desde 10 $/mes (Basic, alrededor de 10 €) con unas 3,3 horas de GPU rápida al mes, subiendo por Standard (30 $/mes), Pro (60 $/mes) y Mega (120 $/mes). El plan gratuito ya no existe de forma general desde 2023. Sin suscripción activa, no hay generación posible.
Lo mejor tras una semana de uso
- Calidad fotorrealista de referencia. En retratos con luz natural, bodegones y escenas cinematográficas, v6 saca resultados que DALL-E 3 no alcanza en textura de piel ni en tratamiento del grano. Aquí no hay debate.
- Comprensión de prompts largos en inglés. Frases de 40-50 palabras con múltiples sujetos, materiales y condiciones lumínicas se respetan mejor que en v5.2. La diferencia se nota sobre todo en composiciones con dos personajes interactuando.
- Coherencia de estilo entre generaciones. Con
--sref(referencia de estilo) se pueden encadenar imágenes con lenguaje visual homogéneo, algo muy útil para portadas de serie, storyboards o catálogos.
Lo peor: dónde se rompe
- Anatomía humana en planos completos. Manos con seis dedos, muñecas imposibles, pies fundidos con el suelo. En primeros planos de cara aguanta bien; en cuerpo entero, sigue siendo lotería. Una hora de prompts sobre bailarines me devolvió cerca de un tercio de imágenes descartables por deformidades.
- Sesgo cultural evidente. Pedir “una familia española cenando en Nochebuena” devuelve estampas más cercanas a Italia o al sur de Francia, con vino tinto en decantador y estética de revista americana. Los referentes visuales de entrenamiento pesan y se nota.
- Español como idioma de prompt. Funciona, pero los resultados son notablemente peores que con el mismo prompt traducido al inglés. Palabras como “sobrio”, “castizo” o “verbena” se interpretan de forma literal o simplemente se ignoran.
Midjourney v6 vs DALL-E 3 y Stable Diffusion
DALL-E 3, integrado en ChatGPT Plus, entiende el prompt mejor que nadie — sobre todo texto dentro de la imagen y peticiones abstractas — pero sus resultados fotorrealistas se ven plásticos, casi de render. Stable Diffusion XL, por su parte, es la única opción real si necesitas control fino, modelos locales, LoRAs propios o generar sin filtros comerciales; a cambio, exige GPU y curva de aprendizaje considerable.
Midjourney v6 se queda en un punto intermedio incómodo para algunos y perfecto para otros: no es tan controlable como SDXL, no entiende el prompt tan literalmente como DALL-E 3, pero produce las imágenes más bonitas de los tres por defecto. Si el criterio de compra es "que salga guapo sin pelearme con nodos", gana. Para leer más sobre criterios de elección entre modelos generativos, tenemos una guía específica sobre cómo elegir IA generativa que complementa este análisis.
Limitaciones y letra pequeña
Requiere cuenta de Discord (o cuenta propia de Midjourney con Google), y las imágenes son públicas por defecto en planes inferiores: solo el plan Pro y Mega ofrecen modo Stealth. Punto sensible para trabajo cliente. Derechos comerciales incluidos con cualquier plan de pago, aunque los términos cambian cada pocos meses — conviene revisar antes de facturar. No hay API oficial pública a día de hoy; lo que circula son ingenierías inversas no autorizadas.
Ficha técnica
| Especificación | Midjourney v6 |
|---|---|
| Tipo | Modelo de generación de imágenes por IA (SaaS) |
| Acceso | Discord + web propia (sin app móvil oficial) |
| Resolución máxima nativa | 2048×2048 px con Upscale |
| Idioma de prompt óptimo | Inglés (español funcional, peor resultado) |
| Privacidad de imágenes | Públicas salvo plan Pro/Mega (Stealth) |
| Uso comercial | Permitido en todos los planes de pago |
| Precio desde | desde ~10 €/mes (plan Basic, facturado en USD) |
Tabla comparativa: los tres modelos frente a frente
| Modelo | Fotorrealismo | Fidelidad al prompt | Control avanzado | Prompt en español | Precio desde | Nota global |
|---|---|---|---|---|---|---|
| Midjourney v6 | 9/10 | 7,5/10 | 6/10 | 6/10 | ~10 €/mes | 8/10 |
| DALL-E 3 (vía ChatGPT Plus) | 7/10 | 9/10 | 5/10 | 8/10 | ~23 €/mes | 7,5/10 |
| Stable Diffusion XL | 7,5/10 | 6,5/10 | 10/10 | 5/10 | Gratis (requiere GPU) | 7,5/10 |
Veredicto por perfil de uso
Diseñador o director de arte con presupuesto: cómpralo. La calidad estética por defecto ahorra horas de retoque y el modo Stealth del plan Pro cubre el trabajo con clientes.
Creador de contenido en redes o blogger: el plan Basic da de sobra si no necesitas privacidad. Eso sí, asume que vas a escribir prompts en inglés si quieres el mejor resultado.
Usuario ocasional que quiere probar IA: no es tu herramienta. DALL-E 3 dentro de ChatGPT Plus resulta más amable y aprovechas la suscripción para más cosas.
Desarrollador o técnico que necesita integrar generación en un producto: descartado hoy. Sin API oficial, cualquier integración es frágil. Stable Diffusion vía Replicate o self-hosting es el camino sensato.
Preguntas frecuentes
¿Se puede usar Midjourney v6 gratis en 2026?
No. El plan gratuito quedó eliminado a mediados de 2023 tras un uso masivo abusivo. Cualquier generación requiere suscripción activa, desde el plan Basic (~10 €/mes al cambio) en adelante.
¿Funciona bien con prompts escritos en español?
Funciona, pero los resultados son claramente inferiores a los mismos prompts traducidos al inglés. Términos culturales españoles (“castizo”, “verbena”, “sobremesa”) se interpretan mal o se ignoran. La recomendación práctica es redactar en inglés o usar un traductor previo.
¿Las imágenes generadas se pueden usar comercialmente?
Sí en cualquier plan de pago, según los términos de servicio vigentes de Midjourney. Los planes gratuitos, cuando existían, no lo permitían. Los términos se han modificado varias veces; conviene revisar la versión vigente antes de un uso profesional.
¿Midjourney v6 supera a DALL-E 3?
Depende del criterio. En calidad fotorrealista y estética general, sí. En fidelidad literal al prompt, generación de texto dentro de la imagen y comprensión de peticiones abstractas, DALL-E 3 rinde mejor. Para foto y arte comercial, Midjourney; para infografías y peticiones descriptivas, DALL-E 3.
