Etiqueta: Gemini

  • Meta lleva a Mac una IA que controla apps por voz y pantalla

    Meta lleva a Mac una IA que controla apps por voz y pantalla

    Meta lanzó una nueva aplicación para Mac centrada en interacción por voz con el sistema y las aplicaciones. La función principal combina dictado global, lectura de contenido en pantalla e integración con software del equipo para ejecutar tareas sin cambiar de ventana. El objetivo es trasladar la asistencia generativa desde el navegador o el móvil al flujo de trabajo diario del ordenador.

    La novedad sitúa al Mac como un entorno donde la IA no solo responde preguntas, sino que también interpreta contexto local. Eso incluye datos visibles en pantalla y acciones dentro de aplicaciones abiertas. En términos prácticos, el enfoque apunta a reducir pasos en tareas de oficina, consulta de documentos y navegación entre herramientas de productividad.

    Competencia creciente en productividad asistida

    El anuncio llega en una semana con más presión competitiva en software de escritorio. Google también amplió Search y Gemini con nuevas funciones de estudio, incluida la carga de archivos, trabajo con PDFs y recursos visuales interactivos. Aunque su foco está en educación, la dirección es la misma: convertir el ordenador en una plataforma donde el usuario consulta, resume, compara y genera contenido dentro del mismo flujo.

    La diferencia de Meta está en la capa de sistema. Mientras otras propuestas operan como asistentes dentro de servicios web, la app para Mac intenta convertirse en una interfaz transversal para el equipo. Ese diseño puede resultar clave en un mercado donde la utilidad real depende menos del modelo base y más de la integración con aplicaciones, permisos y contexto local.

    El ordenador se redefine alrededor de la interfaz natural

    La tendencia confirma un cambio en la informática personal: el valor ya no está solo en abrir programas más rápido, sino en coordinar acciones entre herramientas mediante lenguaje natural. Para desarrolladores y fabricantes, el reto técnico pasa por fiabilidad, privacidad de pantalla y baja latencia. Para el usuario, la promesa es un escritorio más accesible y con menos fricción operativa.

    Si la integración funciona con precisión, este tipo de software puede alterar la forma en que se usan portátiles y sobremesas, especialmente en tareas repetitivas, revisión documental y asistencia contextual en tiempo real.

  • La inteligencia artificial Gemini de Google supera los mil millones de usuarios mensuales

    La inteligencia artificial Gemini de Google supera los mil millones de usuarios mensuales

    La herramienta de inteligencia artificial Gemini, de Google, superó los mil millones de usuarios activos mensuales y se convirtió en el producto con el crecimiento más rápido en la historia de la compañía, informó este martes su director ejecutivo, Sundar Pichai.

    Pichai anunció el nuevo récord a través de una publicación en la red social X, donde destacó el alcance que consiguió la plataforma de inteligencia artificial entre usuarios de todo el mundo.

    El ejecutivo señaló que más de mil millones de personas utilizan cada mes la aplicación Gemini «para despertar nuevas ideas y realizar tareas».

    Con esta cifra, Gemini se convirtió en el decimocuarto producto de Google que alcanza la barrera de los mil millones de usuarios, una marca que anteriormente consiguieron otros de sus principales servicios y plataformas.

    Entre los productos de la tecnológica que también superaron ese nivel de usuarios se encuentran su buscador, Gmail, Drive, Android, YouTube y Chrome, que forman parte de los servicios más utilizados de la compañía.

    El anuncio se conoció en vísperas del evento anual ‘Made by Google’, programado para este miércoles en Nueva York, donde la empresa tecnológica presentará una nueva generación de dispositivos.

    Durante el evento, Google prevé mostrar la serie de teléfonos inteligentes Pixel 11 y el reloj inteligente Pixel Watch 5, entre las novedades de su catálogo de productos.

    El crecimiento de Gemini ocurre en medio de la competencia por liderar el mercado de la inteligencia artificial. OpenAI alcanzó en junio los mil millones de usuarios activos mensuales, de acuerdo con estimaciones de la firma de inteligencia de mercado Sensor Tower.

  • ChatGPT lidera descargas de IA mientras Gemini gana terreno

    ChatGPT lidera descargas de IA mientras Gemini gana terreno

    Las descargas de aplicaciones de inteligencia artificial en la plataforma Softonic superaron por primera vez los tres millones durante el primer semestre de 2026, impulsadas por el creciente interés de los usuarios en este tipo de herramientas. El volumen representa un aumento del 42 % respecto al mismo período de 2025.

    De acuerdo con el más reciente informe de Softonic, entre enero y junio de este año se contabilizaron más de tres millones de descargas de aplicaciones basadas en IA, frente a las 2,173,501 registradas en el primer semestre de 2025.

    El mayor volumen de actividad se alcanzó en mayo, cuando la plataforma registró 659,168 descargas, un incremento del 85.2 % en comparación con el mismo mes del año pasado. En junio también se mantuvo una alta demanda, con 562,026 descargas.

    Softonic destacó que actualmente se realizan más de 17,000 descargas diarias de aplicaciones de inteligencia artificial. Además, señaló que desde enero de 2025 hasta junio de 2026 el número acumulado de descargas de este tipo de herramientas ya supera los 8.4 millones.

    ChatGPT se mantiene como la aplicación de IA más descargada de la plataforma, con 677,720 descargas durante la primera mitad de 2026, equivalente al 21.9 % del total. Sin embargo, su participación disminuyó frente al 40.3 % que registraba en el mismo período de 2025 y también sufrió una caída del 23 % en el número absoluto de descargas.

    El principal competidor de ChatGPT fue Gemini, el asistente de inteligencia artificial de Google, que registró un crecimiento del 1,559 % al pasar de 39,771 descargas en el primer semestre de 2025 a 659,807 durante los primeros seis meses de este año. En tercer lugar se ubicó Remini, dedicada a la edición fotográfica con IA, con 624,039 descargas. Más atrás aparecen Vmake Video Enhancer, con 146,770, y Topaz Video AI, con 106,515.

    El informe también reveló un fuerte crecimiento en las aplicaciones orientadas a la programación, impulsadas por Codeium, cuyas descargas aumentaron de 1,865 a 75,635. Asimismo, las herramientas de generación de texto y productividad crecieron un 162 % gracias a plataformas como NotebookLM, ahora denominada Gemini Notebook, y AutoDraft. En contraste, las aplicaciones relacionadas con video y audio registraron caídas del 32.9 % y del 12.6 %, respectivamente.

    Por otra parte, las aplicaciones enfocadas en la conversación y compañía mediante personajes de inteligencia artificial también mostraron un importante crecimiento. Las distintas versiones de Talkie triplicaron sus descargas al pasar de 40,589 en el primer semestre de 2025 a 126,249 en el mismo período de 2026, lo que representa un incremento del 211 %.

  • Google Maps suma funciones de Gemini para evitar congestionamientos y responder consultas de los usuarios

    Google Maps suma funciones de Gemini para evitar congestionamientos y responder consultas de los usuarios

    Google integró oficialmente las capacidades de Gemini en Google Maps para los usuarios de España, una actualización que incorpora inteligencia artificial a la experiencia de navegación y permite mantener conversaciones con el asistente para obtener información en tiempo real sobre el tráfico, rutas alternativas y otros aspectos útiles durante los viajes por carretera.

    La nueva función llega en plena operación salida de verano y busca facilitar los desplazamientos mediante respuestas personalizadas. Los usuarios pueden activar Gemini desde el panel superior de Google Maps o mediante el comando de voz «Hey Google», lo que permite realizar consultas utilizando lenguaje natural sin necesidad de introducir comandos específicos.

    Gracias a la tecnología Immersive Navigation, presentada por Google este año, la aplicación analiza imágenes actualizadas de Street View, fotografías aéreas y otros datos para comprender el entorno de la ruta y ofrecer indicaciones más precisas al conductor.

    Entre sus nuevas funciones, Gemini puede informar sobre el estado del tráfico en carreteras concretas, calcular retrasos por congestión y proponer rutas alternativas cuando detecta retenciones. Además, ofrece instrucciones más detalladas durante maniobras complejas, utilizando referencias visuales del entorno para facilitar la conducción.

    La inteligencia artificial también puede responder preguntas como «¿Cómo está el tráfico en la A-4 saliendo de Madrid ahora mismo?» o «¿Hay mucha retención llegando a Despeñaperros?», procesando la información disponible para recomendar el trayecto más rápido según las condiciones del momento.

    Otra de las novedades es la posibilidad de localizar áreas de servicio durante el recorrido. Gemini puede recomendar gasolineras con cafeterías menos concurridas, identificar lugares adecuados para hacer una pausa e incluso considerar factores como la disponibilidad de estacionamiento cubierto o zonas con sombra para descansar.

    La herramienta también ayuda a los conductores a decidir si conviene utilizar una autopista de peaje o una ruta alternativa. Ante consultas como «¿Merece la pena pagar el peaje o mejor evito la AP-7?», el sistema compara el tiempo estimado de cada recorrido y explica las ventajas y desventajas de ambas opciones para facilitar la decisión.

    Asimismo, Google incorporó mejoras para anticipar cambios de carril antes de una salida. Gemini puede indicar con suficiente anticipación cuándo es necesario cambiar de carril para tomar un desvío, una función pensada para incrementar la seguridad en vías de alta velocidad y durante periodos de intenso tráfico.

    No obstante, la inteligencia artificial mantiene algunas limitaciones. Google confirmó que Gemini no informa sobre la ubicación exacta de radares móviles en España. En estos casos, la aplicación continúa dependiendo de los reportes realizados por los propios usuarios en tiempo real dentro de Google Maps.

  • Google limita el acceso de Meta a Gemini por falta de capacidad de computación

    Google limita el acceso de Meta a Gemini por falta de capacidad de computación

    Google limitó el acceso de Meta a los modelos de inteligencia artificial Gemini luego de que la demanda de capacidad de procesamiento por parte de la empresa superara los recursos de computación disponibles. La decisión, tomada en marzo, afectó varios proyectos internos de la compañía de Mark Zuckerberg.

    De acuerdo con información publicada por el diario Financial Times, Google comunicó a Meta que no podría suministrar toda la capacidad de Gemini que había solicitado. Como consecuencia, algunos desarrollos relacionados con inteligencia artificial fueron suspendidos temporalmente o experimentaron retrasos.

    La empresa propietaria de Facebook, Instagram y WhatsApp también pidió a sus empleados optimizar el uso de los tokens de inteligencia artificial, las unidades que miden el consumo de estos modelos, con el objetivo de administrar de manera más eficiente los recursos disponibles.

    Meta utiliza los modelos Gemini principalmente para reforzar sistemas internos de seguridad, atención al cliente, publicidad, programación y automatización de procesos. Según el informe, el rendimiento de Gemini supera al de Llama, la familia de modelos de código abierto desarrollada por la propia Meta.

    La situación refleja el creciente problema de capacidad que enfrenta la industria tecnológica ante el auge de la inteligencia artificial. La fuerte demanda de infraestructura especializada ha generado un cuello de botella que afecta incluso a las compañías con mayores recursos del mundo.

    El incremento en la necesidad de centros de datos y memoria de alto rendimiento también ha impactado a otros sectores tecnológicos. Fabricantes de chips priorizan la producción de componentes destinados a inteligencia artificial, lo que ha elevado el costo de memorias RAM utilizadas en productos de consumo y dispositivos electrónicos.

    La presión sobre la infraestructura también alcanzó a otros clientes de Google Cloud, aunque Meta ha sido una de las compañías más afectadas debido al elevado volumen de recursos que requiere para desarrollar y operar sus sistemas de inteligencia artificial. El propio director ejecutivo de Google, Sundar Pichai, reconoció recientemente que la empresa enfrenta limitaciones temporales para satisfacer toda la demanda de sus clientes.

    Frente a este panorama, Meta aceleró sus planes para reducir la dependencia de proveedores externos. Según estimaciones del sector financiero, la compañía proyecta invertir hasta $600,000 millones antes de 2028 para construir sus propios centros de datos, fortalecer su capacidad de entrenamiento e inferencia de modelos de IA y responder al crecimiento sostenido de esta tecnología.

  • Agentes especializados programan, prueban y dan mantenimiento a servicios

    Agentes especializados programan, prueban y dan mantenimiento a servicios

    Por un lado, Antigravity 2.0 evoluciona de demo experimental a entorno de trabajo donde múltiples agentes colaboran para generar, refactorizar y probar código, orquestados sobre la familia de modelos Gemini. La plataforma permite descomponer una tarea de desarrollo en subtareas (diseño, implementación, documentación, pruebas) que distintos agentes abordan de forma coordinada.

    En paralelo, Gemini Spark se posiciona como un agente de IA de larga duración con memoria y contexto, capaz de mantener sesiones activas, recordar decisiones anteriores y actuar sobre servicios y aplicaciones conectadas. Estas capacidades incluyen lectura y escritura en documentos, interacción con herramientas en la nube y ejecución de flujos automatizados, siempre bajo permisos configurables por el usuario o el equipo técnico.

    La combinación de ambas apuestas apunta a un escenario en el que gran parte del ciclo de vida del software —desde la generación de prototipos hasta el mantenimiento— puede estar parcialmente automatizado. Los desarrolladores pasan a supervisar, ajustar y validar resultados, mientras delegan en los agentes tareas repetitivas o de exploración intensiva.

    Seguridad, gobernanza y control humano como eje del diseño

    Este avance se produce en un contexto en el que la industria entera afronta la seguridad en IA en tiempo real. Empresas como Google promueven arquitecturas donde los agentes operan dentro de límites técnicos claros: sandboxes de ejecución, control granular de accesos, registro exhaustivo de acciones y políticas de gobernanza de datos. El objetivo es que las automatizaciones sobre código y documentos sean auditables y reversibles.

    En lugar de plantear a la IA como sustituto total, estas plataformas se orientan a ampliar capacidad productiva. Para los equipos de software, el valor está en reducir tiempos de desarrollo y pruebas; para áreas de negocio, en disponer de asistentes capaces de ejecutar flujos operativos sobre ecosistemas complejos sin necesidad de intervención manual constante. El desafío inmediato es técnico: diseñar agentes robustos, predecibles y alineados con las reglas de seguridad y cumplimiento de cada organización.

    Si estas herramientas se estabilizan y escalan, el modelo de trabajo se desplaza hacia una relación continua entre personas y agentes: los humanos fijan objetivos, restricciones y criterios de calidad; los agentes ejecutan, monitorizan y proponen iteraciones rápidas. La competencia entre plataformas se jugará tanto en la potencia de los modelos como en la fineza del control, la trazabilidad y la integración con infraestructuras existentes.

  • Google lanza una herramienta de IA que genera musica mediante un texto o una imagen

    Google lanza una herramienta de IA que genera musica mediante un texto o una imagen

    Google anunció este miércoles que su inteligencia artificial Gemini ya puede generar pistas musicales de hasta 30 segundos, descritas como “realistas y musicalmente complejas”, a partir de una simple descripción escrita o incluso de una imagen como referencia.

    La nueva función, denominada Lyria 3, estará disponible dentro de la aplicación Gemini en varios idiomas —entre ellos español, inglés, alemán, francés, hindi, japonés, coreano y portugués— y también para creadores de contenido en YouTube Shorts. Según explicó Myriam Hamed Torres, gerente senior de producto de Google DeepMind, el sistema traduce en segundos una idea creativa en una pista musical completa.

    “Simplemente describe una idea o sube una foto, como: ‘un lento de R&B cómico sobre un calcetín que encuentra a su pareja’ y, en cuestión de segundos, Gemini lo traducirá en una pista pegadiza y de alta calidad”, señaló la ejecutiva en un comunicado oficial. Además de la música, la herramienta puede generar carátulas personalizadas basadas en la letra y el estilo seleccionado.

    Google detalló que todas las pistas creadas en la aplicación incluyen SynthID, una marca de agua digital imperceptible que identifica el contenido generado por inteligencia artificial. La compañía subrayó que Lyria 3 busca fomentar la creatividad original y no replicar voces o estilos específicos de artistas existentes.

    “Si tu indicación nombra a un artista específico, Gemini lo tomará como una amplia inspiración creativa y creará una pista que comparta un estilo o estado de ánimo similar”, indicó Hamed Torres.

    El anuncio se produce en un contexto de debate sobre los derechos de autor y el uso de IA en la industria musical. En 2024, más de 200 artistas, entre ellos Billie Eilish, Pearl Jam y Katy Perry, solicitaron a las empresas tecnológicas frenar el uso de inteligencia artificial que pudiera “infringir y devaluar los derechos de los artistas humanos”.

    Google no es la única compañía que ofrece este tipo de servicios. Plataformas como Suno y Udio también permiten crear canciones en distintos estilos y lenguas, ampliando la competencia en el mercado de generación musical con inteligencia artificial.

  • Google lanza Project Genie, su prototipo de IA para generar mundos interactivos

    Google lanza Project Genie, su prototipo de IA para generar mundos interactivos

    Google lanzó oficialmente Project Genie, un prototipo que permite a los usuarios generar mundos interactivos mediante inteligencia artificial, utilizando una combinación de tecnologías desarrolladas por DeepMind: Genie 3, Nano Banana y Gemini.

    En agosto, la compañía presentó Genie 3, un modelo de IA que permite crear entornos dinámicos en tiempo real con resolución de 720p. A diferencia de su versión anterior, que solo generaba imágenes estáticas en 3D, Genie 3 ofrece experiencias más realistas y prolongadas.

    Ahora, Google permite que el público experimente directamente estas funciones a través de Project Genie, tras haber limitado su uso inicial únicamente a desarrolladores. El prototipo integra capacidades de imagen con Nano Banana y asistencia mediante Gemini, y busca ofrecer experiencias inmersivas que respondan a las indicaciones de los usuarios.

    Shlomi Frutcher, director de Investigación en DeepMind, destacó en una entrevista con TechCrunch que resulta “emocionante estar en un momento donde más personas pueden acceder y dar su opinión”.

    Project Genie ofrece tres funcionalidades principales: boceto, exploración y combinación de mundos. Con Nano Banana Pro, los usuarios pueden diseñar un borrador del mundo según sus instrucciones, definiendo el entorno, personajes y métodos de exploración. Después, pueden recorrer estos mundos en tiempo real, ya que el sistema genera los escenarios dinámicamente según sus acciones. También tienen la opción de reeditar y mezclar mundos previamente creados.

    Por ahora, Google habilitó el acceso a Project Genie solo para suscriptores del plan Google AI Ultra en Estados Unidos. La herramienta permite generar y explorar los mundos durante un máximo de 60 segundos por sesión. “Limitamos el uso a 60 segundos porque queremos que más personas puedan acceder”, explicó Frutcher, quien añadió que cada sesión funciona con un chip dedicado exclusivamente al usuario.

    Google advirtió que, al tratarse de un prototipo, los mundos generados podrían no parecer del todo realistas ni cumplir con exactitud todas las instrucciones del usuario. También reconoció que el control de personajes podría fallar y que podría presentarse cierta latencia durante la experiencia.

  • Google incorpora datos de Gmail y Fotos al Modo IA para búsquedas personalizadas

    Google incorpora datos de Gmail y Fotos al Modo IA para búsquedas personalizadas

    Google está integrando su nueva función de Inteligencia Personal en el Modo IA de su buscador, lo que permitirá ofrecer resultados personalizados a partir de la información almacenada en los correos electrónicos de Gmail y la galería de Google Fotos de cada usuario.

    Esta herramienta forma parte de los avances impulsados por Gemini, el modelo de inteligencia artificial más avanzado de la compañía, y busca hacer la experiencia de búsqueda más útil al combinar el conocimiento global con información específica y contextual de cada persona.

    La compañía explicó que esta función, ya presente en el asistente Gemini, ahora se aplicará también al buscador. Gracias a su capacidad de razonamiento entre múltiples fuentes, la IA puede interpretar y combinar datos provenientes de distintos formatos como textos, imágenes o videos para brindar respuestas más precisas y adaptadas.

    Entre los ejemplos mencionados, Google detalló que, si un usuario busca actividades para un próximo viaje, la IA podrá tener en cuenta reservas de hotel encontradas en Gmail y recuerdos similares almacenados en Google Fotos para sugerir actividades relacionadas.

    El objetivo es que los usuarios no tengan que repetir constantemente sus preferencias o planes, sino que el buscador anticipe sus necesidades con base en sus propios contenidos.

    Google recalcó que la Inteligencia Personal ha sido diseñada bajo principios de transparencia y control, y aseguró que los usuarios decidirán cuándo conectar Gmail y Fotos con el Modo IA. Además, aclaró que ni los correos ni las imágenes se usarán para entrenar los modelos de IA.

    Por ahora, esta experiencia se está implementando de forma limitada a través del programa Google Labs y está disponible únicamente para los suscriptores de los planes Google AI Pro y AI Ultra en Estados Unidos.

    Aunque Google advierte que podrían presentarse errores contextuales mientras la herramienta aprende, la compañía aseguró que continuará optimizando su funcionamiento a medida que más usuarios accedan a esta función.

  • Google prepara una nueva herramienta de generación de música a partir de texto para Gemini

    Google prepara una nueva herramienta de generación de música a partir de texto para Gemini

    Google está trabajando en una nueva herramienta de generación de música a partir de indicaciones de texto impulsada por la inteligencia artificial (IA) de Gemini, de manera que los usuarios puedan generar creaciones musicales de forma sencilla desde la aplicación.

    La tecnológica continúa desarrollando nuevas opciones para enriquecer la experiencia de los usuarios a la hora de utilizar su IA Gemini, en este caso, para cuestiones creativas como es el caso de generar música, al igual que ya ocurre con las imágenes y su modelo Nano Banana.

    En este sentido, Google está desarrollando una nueva herramienta que permitirá crear nueva música y canciones a partir de indicaciones de texto, pensada para agregarse a las opciones de la aplicación de Gemini, de cara a ofrecer una experiencia de interfaz sencilla para generar este contenido, acercándolo a cualquier persona.

    Así lo ha dado a conocer Android Authority tras llevar a cabo un análisis de APK de la versión 17.2.51.sa.arm64 de la aplicación de Gemini para Android, donde han encontrado partes del código de desarrollo en los que se hace referencia a una nueva herramienta de música ‘MUSIC_GENERATION_AS_TOOL’.

    Se ha de tener en cuenta que Gemini ya cuenta con modelos específicos para la creación de música, como es el caso de Lyria, que está disponible desde la API de Gemini y que permite a los desarrolladores crear aplicaciones en las que los usuarios puedan crear, dirigir y ejecutar música instrumental de forma interactiva en tiempo real.

    Sin embargo, se prevé que la nueva herramienta de creación música en la que está trabajando Google ponga estas capacidades a disposición de los usuarios de forma mucho más accesible, directamente desde la ‘app’ de Gemini.

    Con todo ello, por el momento se trata de una función en desarrollo, por lo que se desconoce cómo se implementará finalmente y las opciones que ofrecerá a los usuarios, así como cuándo llegará a la aplicación, en caso de lanzarse.