Etiqueta: generación de imágenes

  • Qwen-Image 3.0 apuesta por un mayor realismo en las imágenes generadas con IA

    Qwen-Image 3.0 apuesta por un mayor realismo en las imágenes generadas con IA

    Alibaba presentó este martes Qwen-Image 3.0, la más reciente versión de su modelo de inteligencia artificial para la generación de imágenes, una actualización que apuesta por producir resultados más realistas, detallados y útiles para distintos tipos de contenido visual.

    La empresa explicó que esta nueva versión representa un avance respecto a Qwen-Image 2.0, ya que no solo busca generar imágenes atractivas, sino también ofrecer representaciones más fieles a la realidad y con un mayor nivel de comprensión del contexto solicitado por los usuarios.

    Para lograrlo, Alibaba centró el desarrollo del modelo en tres pilares principales. El primero corresponde al contenido enriquecido, que permite crear ilustraciones complejas capaces de integrar múltiples conceptos en una sola imagen de forma ordenada y sin interferencias entre los distintos elementos.

    Como ejemplo de esta capacidad, la compañía señaló que el sistema puede elaborar materiales como un cómic sobre seguridad en túneles o una lección de geometría espacial. Para procesar este tipo de solicitudes, el modelo admite instrucciones de hasta 4,500 tokens, lo que le permite interpretar descripciones extensas y generar imágenes acordes con todos los detalles proporcionados.

    El segundo aspecto destacado por Alibaba es la precisión en los detalles. Según la empresa, Qwen-Image 3.0 puede reproducir texto con un tamaño de apenas 10 píxeles y representar elementos con un alto nivel de fidelidad, incluidos los poros de la piel o las fibras de un bordado.

    La tercera mejora se centra en la versatilidad del sistema. El modelo ofrece capacidades de renderizado en 12 idiomas, admite múltiples tipografías y es compatible con más de 100 estilos artísticos, además de generar interfaces para páginas web, videojuegos y transmisiones en directo.

    Alibaba aseguró que estas capacidades están respaldadas por un conocimiento más profundo del mundo, lo que permite al modelo comprender mejor las solicitudes de los usuarios y producir imágenes más coherentes, detalladas y funcionales para diferentes aplicaciones.

    Con esta actualización, la empresa fortalece su apuesta por la inteligencia artificial generativa en un mercado cada vez más competitivo, donde las compañías tecnológicas buscan desarrollar modelos capaces de producir contenido visual de mayor calidad y utilidad para usuarios, empresas y desarrolladores.

  • Google prueba generación de imágenes con IA usando modelo Nano Banana

    Google prueba generación de imágenes con IA usando modelo Nano Banana

    Google avanza en el desarrollo de funciones de inteligencia artificial para su buscador y, según pruebas detectadas en la versión beta de su aplicación para Android, trabaja en integrar capacidades de generación de imágenes utilizando el modelo Gemini 2.5 Flash Image, también conocido como Nano Banana.

    De acuerdo con el portal especializado Android Authority, la app de Google (v16.38.62) está experimentando con un rediseño en su interfaz, donde ahora el ícono del micrófono aparece en la parte derecha y el botón para subir imágenes ha sido reemplazado por un nuevo menú que incluye la opción “crear imagen”.

    Esta nueva función, aún en fase de pruebas, abriría un compositor en el cual los usuarios podrán escribir descripciones para que la inteligencia artificial genere imágenes personalizadas como parte de la experiencia de búsqueda con el modo IA.

    El motor detrás de esta capacidad es Nano Banana, un modelo de generación y edición de imágenes que debutó a finales de agosto y ganó notoriedad en redes sociales por la calidad y realismo de sus resultados visuales.

    Según el análisis del código de la aplicación, Nano Banana no solo permite crear imágenes desde cero, sino que también ofrece funciones avanzadas como la fusión de múltiples imágenes con coherencia entre los personajes, y la posibilidad de aplicar transformaciones mediante lenguaje natural.

    Aunque Google no ha confirmado oficialmente su lanzamiento, esta integración representaría un paso más en la evolución de los buscadores tradicionales hacia experiencias visuales impulsadas por inteligencia artificial.