La versión 6 de Midjourney, conocida habitualmente como Midjourney V6, marcó un salto importante en la comprensión de instrucciones, la coherencia de las escenas y la generación de texto dentro de las imágenes. Aunque hoy existen modelos más recientes, sigue siendo útil para comparar resultados, recuperar estilos y trabajar con prompts detallados. Aquí explico qué aportó, cómo activarla, qué parámetros funcionan mejor, cuánto cuesta utilizar el servicio y cuáles son sus límites reales.
Lo esencial para aprovechar esta versión sin perder tiempo
- V6 ya no es el modelo predeterminado, pero todavía puede seleccionarse manualmente.
- Mejoró especialmente la comprensión de prompts largos, las manos, las escenas complejas y el texto integrado.
- Para obtener un resultado más controlado conviene combinar --v 6.1, --style raw y --ar.
- Los planes de pago parten de 10 dólares al mes, antes de impuestos y posibles cambios de divisa.
- La herramienta crea imágenes originales con rapidez, pero no garantiza rostros idénticos ni textos perfectos.

Qué cambió realmente con Midjourney V6
V6 apareció a finales de 2023 con una mejora visible en la manera de interpretar las instrucciones. Ya no bastaba con acumular adjetivos; el modelo empezó a respetar mejor las relaciones entre objetos, la composición y detalles concretos como materiales, iluminación o posición de los personajes.
El avance más práctico fue la mayor fidelidad al prompt. Una escena descrita como “una bicicleta roja apoyada contra una pared azul, bajo lluvia nocturna” tenía más probabilidades de conservar esos elementos sin mezclarlos de forma arbitraria. Aun así, Midjourney sigue siendo un sistema creativo, no un programa de diseño asistido por coordenadas exactas.
También mejoró la generación de palabras dentro de la imagen. Para letreros, portadas o carteles funciona mejor escribir el texto entre comillas, aunque mi recomendación sigue siendo revisar cada letra y corregirla después en un editor gráfico cuando el resultado tenga uso profesional.
V6 frente a V6.1
V6.1 refinó la misma base con más coherencia anatómica, mejores texturas y una generación aproximadamente un 25 % más rápida. También incorporó nuevos reescaladores de 2x y una mejora en la precisión del texto, aunque algunas funciones de edición podían recurrir internamente al modelo V6 original.
| Aspecto | V6 | V6.1 |
|---|---|---|
| Comprensión de prompts | Gran mejora frente a versiones anteriores | Más precisa y estable |
| Detalles pequeños | Buenos, pero irregulares | Mejoras en ojos, manos y texturas |
| Velocidad | Estándar | Aproximadamente un 25 % superior |
| Reescalado | Correcto | Nuevas opciones 2x de mayor calidad |
| Uso actual | Modelo heredado | Alternativa heredada más pulida |
En 2026, Midjourney utiliza versiones posteriores como opción principal, pero la documentación oficial de Midjourney todavía contempla el acceso a modelos anteriores. Eso resulta útil cuando una imagen depende de un estilo concreto, de una referencia antigua o de un flujo de trabajo que funcionaba mejor con V6.
Cómo activar V6 y empezar con un prompt eficaz
En la web basta con abrir el selector de modelo y elegir V6 o V6.1. En Discord también se puede indicar la versión al final de la instrucción mediante --v 6 o --v 6.1. Si no se especifica, la plataforma empleará el modelo configurado por defecto en la cuenta.
Yo suelo construir los prompts en este orden porque reduce bastante los resultados confusos:
- Sujeto principal, por ejemplo, una librería independiente en Madrid.
- Acción o contexto, como una lectora junto a una ventana durante una tarde lluviosa.
- Composición, por ejemplo, plano general, perspectiva a la altura de los ojos o composición editorial.
- Luz y ambiente, como luz natural suave, tonos cálidos y atmósfera íntima.
- Formato y parámetros, como --ar 4:5 o --style raw.
Un ejemplo práctico sería:
librería independiente en Madrid, lectora junto a una ventana, tarde lluviosa, estanterías de madera, fotografía editorial, luz natural suave, ambiente acogedor --v 6.1 --ar 4:5 --style raw
El modo Raw reduce parte de la estética automática del modelo y deja más peso a la descripción. Para imágenes comerciales o composiciones con una dirección visual clara, --style raw suele ofrecer una base más manejable, aunque puede parecer menos espectacular en la primera generación.
Parámetros que sí merecen atención
- --ar cambia la proporción, por ejemplo 1:1, 4:5, 16:9 o 9:16.
- --stylize o --s controla cuánto se impone el estilo propio de Midjourney sobre el prompt.
- --chaos aumenta la variedad entre las cuatro propuestas iniciales.
- --no permite excluir elementos, aunque no siempre interpreta las negaciones de manera perfecta.
- --q 2 en V6.1 puede añadir textura, pero consume más tiempo y puede reducir la coherencia.
El error más común consiste en añadir todos los parámetros a la vez. Para aprender qué está funcionando, es mejor cambiar una sola variable por generación. De ese modo se entiende si la mejora procede del formato, del nivel de estilización o de la redacción del prompt.
Qué aplicaciones prácticas tiene para un proyecto real
La versión 6 sigue siendo especialmente útil para crear conceptos visuales, portadas, moodboards y campañas preliminares. No la trataría como sustituta de un fotógrafo, un ilustrador o un diseñador cuando el encargo exige control total, pero sí como una herramienta excelente para pasar de una idea abstracta a varias direcciones visuales en pocos minutos.
Contenido editorial y redes sociales
Para un artículo sobre tecnología, por ejemplo, puede generar una escena de una oficina con pantallas, servidores y una iluminación concreta. El resultado sirve como imagen de acompañamiento o como punto de partida, siempre que se comprueben los detalles y se evite presentar una recreación como si fuera una fotografía documental.
Identidad visual y publicidad
Con --sref es posible orientar el resultado hacia el lenguaje visual de una imagen de referencia. La referencia de estilo influye en colores, textura y ambiente, pero no convierte automáticamente el modelo en un sistema de identidad de marca. Para mantener logotipos, tipografías y proporciones exactas, hace falta trabajo posterior.
Personajes y series de imágenes
La referencia de personaje mediante --cref ayuda a conservar rasgos generales, vestuario y apariencia. Funciona mejor con personajes creados dentro de Midjourney que con fotografías de personas reales, y no garantiza una reproducción exacta de pecas, rasgos faciales o pequeños elementos de la ropa.
Para mí, esta es una de sus mejores aplicaciones, pero también una de las que más expectativas falsas genera. Mantener un personaje reconocible entre escenas es posible, mientras que conseguir una continuidad cinematográfica perfecta requiere muchas pruebas, selección manual y retoque.
Qué limita a este modelo y qué errores conviene evitar
V6 entiende mejor las instrucciones, pero no “comprende” una imagen como lo haría una persona. Puede alterar el número de dedos, cambiar un objeto entre variaciones o inventar detalles cuando el prompt contiene demasiadas condiciones. Por eso no conviene aceptar la primera imagen válida sin una revisión visual completa.
El texto continúa siendo un punto delicado. Las palabras cortas entre comillas suelen funcionar mejor que los párrafos, pero un cartel con información legal, un precio o una dirección debe corregirse manualmente. En trabajos publicados, la revisión tipográfica no es opcional.
También hay riesgos relacionados con derechos de imagen, privacidad y propiedad intelectual. No subiría fotografías de clientes, menores o documentos personales sin autorización, y evitaría pedir una copia demasiado cercana del estilo reconocible de un artista vivo cuando el objetivo sea comercial.Lee también: Pegasus en el móvil - cómo espía y cómo protegerte
Fallos habituales al escribir prompts
- Introducir una lista interminable de adjetivos sin explicar la composición.
- Mezclar varios estilos incompatibles, como realismo documental y dibujo infantil.
- Usar negaciones complejas esperando que el modelo las respete como reglas absolutas.
- Intentar resolver el texto, el logotipo y la maquetación final dentro de una sola generación.
- Confundir una imagen visualmente atractiva con una imagen técnicamente correcta.
La solución suele ser sencilla: describir primero la escena, generar varias alternativas y después corregir el elemento que falla. La iteración controlada supera al prompt gigantesco en casi todos los proyectos que he trabajado.
Cuánto cuesta utilizarlo desde España
Midjourney funciona mediante suscripción. Las tarifas mensuales de referencia publicadas por el servicio son de 10, 30, 60 y 120 dólares para los planes Basic, Standard, Pro y Mega, respectivamente. El importe final en España puede cambiar por impuestos, conversión de divisa y modalidad de facturación, así que conviene comprobar el precio mostrado antes de pagar en la tabla oficial de planes.
| Plan | Precio mensual de referencia | Para quién tiene sentido |
|---|---|---|
| Basic | 10 dólares | Pruebas ocasionales y proyectos pequeños |
| Standard | 30 dólares | Uso frecuente y más tiempo de generación |
| Pro | 60 dólares | Creadores que necesitan más capacidad y privacidad |
| Mega | 120 dólares | Producción intensiva y equipos con alto volumen |
Para probar el sistema, normalmente empezaría por el plan más económico y mediría cuántas imágenes útiles obtengo al mes. El plan Standard puede ser más razonable si se generan muchas variaciones, pero pagar más no elimina la necesidad de revisar prompts ni garantiza resultados profesionales.
La mejor forma de decidir si todavía te conviene V6
Elegiría V6 o V6.1 si necesitas recuperar una estética concreta, comparar modelos o trabajar con un flujo basado en referencias de estilo y personaje. Para un proyecto nuevo, probaría primero el modelo actual de Midjourney y solo volvería a V6 si ofrece una ventaja clara en coherencia, textura o dirección artística.
La conclusión práctica es sencilla. V6 sigue siendo una herramienta capaz, pero ya no representa el estado más avanzado del servicio. Su valor actual está en el control creativo, la compatibilidad con trabajos anteriores y la posibilidad de obtener una imagen muy sólida a partir de una descripción bien construida, siempre con revisión humana antes de publicarla o utilizarla con fines comerciales.