Etiqueta: Gemini

  • Modelos de IA suman una nueva capa de control industrial

    Modelos de IA suman una nueva capa de control industrial

    Google, OpenAI y Anthropic han puesto en marcha un organismo compartido para vigilar la seguridad de sus modelos de IA, según Infobae. La iniciativa añade una capa de coordinación entre desarrolladores que hoy comparten retos similares: evaluación de capacidades, pruebas previas al despliegue y protocolos de respuesta cuando aparecen comportamientos emergentes fuera de los parámetros previstos.

    La novedad importa por una razón concreta: la industria está pasando de controles internos aislados a mecanismos de seguimiento más estructurados. En paralelo, Xataka reportó que OpenAI ha frenado el entrenamiento de algunos de sus sistemas más potentes tras detectar desajustes en agentes avanzados. En términos técnicos, no se trata de una narrativa apocalíptica, sino de una fase de validación adicional en modelos cada vez más complejos.

    Más regulación y más despliegue

    El endurecimiento de controles no está frenando la expansión de la IA. TechCrunch informó que Google prueba compras asistidas mediante Gemini y AI Mode en India, integrando capacidades conversacionales en comercio digital. Infobae, por su parte, señaló que la compañía también adelanta el uso de chips de IA en infraestructura espacial. La señal es clara: el sector sigue ampliando aplicaciones mientras mejora sus sistemas de verificación.

    En el plano geopolítico, Xataka indicó que China estudia límites para modelos de pesos abiertos. Esa discusión se suma a un patrón global: mayor supervisión sobre modelos de uso general, especialmente cuando pueden reutilizarse en gran escala. Al mismo tiempo, herramientas más especializadas avanzan con rapidez. Hipertextual destacó una IA de código abierto orientada a detectar vulnerabilidades de seguridad sin enviar datos a internet, un enfoque que combina automatización con procesamiento local.

    La siguiente etapa del mercado

    La convergencia entre seguridad, gobernanza y despliegue comercial define la nueva etapa de la IA. Los laboratorios ya no compiten solo por tamaño de modelo o potencia de cómputo. Compiten también por demostrar trazabilidad, fiabilidad operativa y capacidad de corrección. Ese cambio convierte la seguridad en parte del producto, no en una capa externa.

    Para empresas y usuarios, la consecuencia es directa: llegarán más servicios basados en IA, pero con evaluaciones más formales, límites de uso mejor definidos y supervisión técnica continua. La transición ya está en marcha.

  • Google estrena computadora portátil con cursor impulsado por inteligencia artificial

    Google estrena computadora portátil con cursor impulsado por inteligencia artificial

    Google presentó este lunes los Googlebook, su nueva categoría de computadoras portátiles que incorpora un cursor con inteligencia artificial (IA) capaz de activar Gemini directamente sobre el contenido que aparece en pantalla y ejecutar diferentes tareas solicitadas por el usuario.

    Una de las principales novedades de los equipos es “Magic Pointer”, una herramienta que integra IA multimodal en el cursor y el ratón. Con un movimiento o sacudida sobre la pantalla, el usuario puede activar Gemini sin necesidad de ingresar a menús secundarios.

    La función permite que la IA interactúe con el contenido que el usuario observa en ese momento. Por ejemplo, Gemini puede tomar un plan de entrenamiento encontrado en una página web y organizarlo en el calendario, revisar correos electrónicos sospechosos de fraude o procesar y combinar imágenes.

    Alexander Kuscher, director sénior de Portátiles y Tabletas de Google, explicó que “Magic Pointer” únicamente se activa cuando el usuario lo solicita, por lo que la herramienta no permanece operando de manera automática sobre el contenido mostrado en pantalla.

    La incorporación de IA forma parte de una estrategia más amplia con la que Google busca replantear la relación entre el teléfono y la computadora. Sameer Samat, presidente del ecosistema Android de Google, señaló durante la presentación en Nueva York que los portátiles tradicionales fueron diseñados hace décadas y necesitan adaptarse a usuarios que alternan constantemente entre ambos dispositivos.

    Los Googlebook utilizan una arquitectura compartida entre Android y ChromeOS e incorporan funciones como “Continue On”, que permite iniciar una actividad en un teléfono Android y retomarla desde el mismo punto en la computadora. Esto incluye la edición de música, documentos y otras tareas, mientras que una aplicación unificada permite consultar directamente archivos y fotografías almacenados en el teléfono.

    Google desarrolló el hardware de los nuevos equipos junto con fabricantes como Acer, ASUS, Dell, HP y Lenovo. Los portátiles incorporan procesadores Intel Core Ultra Serie 3 y Qualcomm Snapdragon X Elite, además de chips neuronales (NPU) con una capacidad superior a 40 TOPS para procesar funciones relacionadas con inteligencia artificial.

    Los dispositivos también ofrecen pantallas OLED táctiles de hasta 2.8K, acabados en aluminio, aleaciones de magnesio y fibra de carbono, además de la barra luminosa interactiva Glowbar. Los Googlebook tendrán un precio inicial de $899, mientras que los primeros equipos estarán disponibles en tiendas de Estados Unidos a partir del 4 de octubre, después de que las reservas comenzaron este lunes.

  • Las plataformas de IA ChatGPT, Gemini, Claude y Grok sufren una caída a nivel global

    Las plataformas de IA ChatGPT, Gemini, Claude y Grok sufren una caída a nivel global

    Las plataformas de inteligencia artificial ChatGPT, Gemini, Claude y Grok registran este jueves una caída a nivel mundial que afecta a miles de usuarios, según los reportes recopilados por el portal especializado DownDetector.

    Las interrupciones afectan simultáneamente a ChatGPT, desarrollada por OpenAI; Gemini, de Google; Claude, de Anthropic; y Grok, plataforma de inteligencia artificial vinculada a xAI.

    DownDetector, servicio especializado en monitorear fallas e interrupciones de plataformas digitales, registra miles de reportes de usuarios relacionados con problemas para utilizar estos servicios de inteligencia artificial.

    Las incidencias fueron notificadas desde más de 70 países, lo que refleja el alcance global de los problemas experimentados por los usuarios durante este jueves.

    Los reportes se concentran en cuatro de las principales plataformas de inteligencia artificial generativa disponibles actualmente, cuyos servicios incluyen herramientas basadas en chatbots para responder consultas y generar contenido.

    La información disponible hasta el momento no precisa una causa común que explique las interrupciones registradas simultáneamente en ChatGPT, Gemini, Claude y Grok.

    Tampoco se detalla en la información proporcionada cuánto tiempo podrían prolongarse las fallas ni cuándo se restablecerá completamente el funcionamiento de las cuatro plataformas afectadas.

    Los reportes de DownDetector permiten conocer la magnitud de las incidencias a partir de las notificaciones realizadas por los propios usuarios mientras experimentan problemas para acceder o utilizar los diferentes servicios digitales.

  • Google amplía Gemini 3.5 Transcribe a más de 85 idiomas

    Google amplía Gemini 3.5 Transcribe a más de 85 idiomas

    Google lanzó Gemini 3.5 Transcribe, una herramienta de conversión de voz a texto que trabaja con más de 85 idiomas y apunta a mejorar la captura de audio con acentos, palabras difíciles y habla espontánea. El foco del producto está en resolver un problema técnico concreto: obtener transcripciones más limpias y utilizables en reuniones, clases, entrevistas y flujos de trabajo profesionales.

    Entre las mejoras destacadas figura la capacidad de identificar expresiones dudosas del habla y reducir la fricción que generan en el texto final. Algunas coberturas señalan que el sistema también puede editar muletillas como “eh” o “ah”, lo que acerca la salida a un formato listo para lectura, resumen o archivo. Esto reduce tiempo de corrección manual y facilita la integración con herramientas de productividad.

    Aplicación directa en trabajo y accesibilidad

    El valor principal no está solo en pasar audio a texto, sino en hacerlo con un nivel de comprensión más alto en contextos reales. La diversidad lingüística, los acentos regionales y el vocabulario técnico suelen degradar la calidad de los sistemas convencionales. Con este lanzamiento, Google busca ampliar la utilidad práctica de la transcripción asistida por modelos de IA en educación, empresas, medios y atención al cliente.

    El movimiento también confirma una tendencia más amplia del sector: la IA ya no se limita a generar texto, sino que se consolida como capa de infraestructura para organizar información hablada, indexarla y volverla consultable. En ese marco, la transcripción multilingüe gana peso como herramienta de accesibilidad y como base para búsqueda, análisis y automatización documental.

    Competencia creciente en IA aplicada

    La novedad llega en un momento de alta actividad en herramientas de IA de consumo y empresa. Mientras otras plataformas ajustan precios, publicidad o capacidad de cómputo, Google refuerza un caso de uso concreto y masivo. La conclusión técnica es clara: los modelos multimodales avanzan hacia productos más precisos, especializados y medibles en ahorro de tiempo.

  • Meta lleva a Mac una IA que controla apps por voz y pantalla

    Meta lleva a Mac una IA que controla apps por voz y pantalla

    Meta lanzó una nueva aplicación para Mac centrada en interacción por voz con el sistema y las aplicaciones. La función principal combina dictado global, lectura de contenido en pantalla e integración con software del equipo para ejecutar tareas sin cambiar de ventana. El objetivo es trasladar la asistencia generativa desde el navegador o el móvil al flujo de trabajo diario del ordenador.

    La novedad sitúa al Mac como un entorno donde la IA no solo responde preguntas, sino que también interpreta contexto local. Eso incluye datos visibles en pantalla y acciones dentro de aplicaciones abiertas. En términos prácticos, el enfoque apunta a reducir pasos en tareas de oficina, consulta de documentos y navegación entre herramientas de productividad.

    Competencia creciente en productividad asistida

    El anuncio llega en una semana con más presión competitiva en software de escritorio. Google también amplió Search y Gemini con nuevas funciones de estudio, incluida la carga de archivos, trabajo con PDFs y recursos visuales interactivos. Aunque su foco está en educación, la dirección es la misma: convertir el ordenador en una plataforma donde el usuario consulta, resume, compara y genera contenido dentro del mismo flujo.

    La diferencia de Meta está en la capa de sistema. Mientras otras propuestas operan como asistentes dentro de servicios web, la app para Mac intenta convertirse en una interfaz transversal para el equipo. Ese diseño puede resultar clave en un mercado donde la utilidad real depende menos del modelo base y más de la integración con aplicaciones, permisos y contexto local.

    El ordenador se redefine alrededor de la interfaz natural

    La tendencia confirma un cambio en la informática personal: el valor ya no está solo en abrir programas más rápido, sino en coordinar acciones entre herramientas mediante lenguaje natural. Para desarrolladores y fabricantes, el reto técnico pasa por fiabilidad, privacidad de pantalla y baja latencia. Para el usuario, la promesa es un escritorio más accesible y con menos fricción operativa.

    Si la integración funciona con precisión, este tipo de software puede alterar la forma en que se usan portátiles y sobremesas, especialmente en tareas repetitivas, revisión documental y asistencia contextual en tiempo real.

  • La inteligencia artificial Gemini de Google supera los mil millones de usuarios mensuales

    La inteligencia artificial Gemini de Google supera los mil millones de usuarios mensuales

    La herramienta de inteligencia artificial Gemini, de Google, superó los mil millones de usuarios activos mensuales y se convirtió en el producto con el crecimiento más rápido en la historia de la compañía, informó este martes su director ejecutivo, Sundar Pichai.

    Pichai anunció el nuevo récord a través de una publicación en la red social X, donde destacó el alcance que consiguió la plataforma de inteligencia artificial entre usuarios de todo el mundo.

    El ejecutivo señaló que más de mil millones de personas utilizan cada mes la aplicación Gemini «para despertar nuevas ideas y realizar tareas».

    Con esta cifra, Gemini se convirtió en el decimocuarto producto de Google que alcanza la barrera de los mil millones de usuarios, una marca que anteriormente consiguieron otros de sus principales servicios y plataformas.

    Entre los productos de la tecnológica que también superaron ese nivel de usuarios se encuentran su buscador, Gmail, Drive, Android, YouTube y Chrome, que forman parte de los servicios más utilizados de la compañía.

    El anuncio se conoció en vísperas del evento anual ‘Made by Google’, programado para este miércoles en Nueva York, donde la empresa tecnológica presentará una nueva generación de dispositivos.

    Durante el evento, Google prevé mostrar la serie de teléfonos inteligentes Pixel 11 y el reloj inteligente Pixel Watch 5, entre las novedades de su catálogo de productos.

    El crecimiento de Gemini ocurre en medio de la competencia por liderar el mercado de la inteligencia artificial. OpenAI alcanzó en junio los mil millones de usuarios activos mensuales, de acuerdo con estimaciones de la firma de inteligencia de mercado Sensor Tower.

  • ChatGPT lidera descargas de IA mientras Gemini gana terreno

    ChatGPT lidera descargas de IA mientras Gemini gana terreno

    Las descargas de aplicaciones de inteligencia artificial en la plataforma Softonic superaron por primera vez los tres millones durante el primer semestre de 2026, impulsadas por el creciente interés de los usuarios en este tipo de herramientas. El volumen representa un aumento del 42 % respecto al mismo período de 2025.

    De acuerdo con el más reciente informe de Softonic, entre enero y junio de este año se contabilizaron más de tres millones de descargas de aplicaciones basadas en IA, frente a las 2,173,501 registradas en el primer semestre de 2025.

    El mayor volumen de actividad se alcanzó en mayo, cuando la plataforma registró 659,168 descargas, un incremento del 85.2 % en comparación con el mismo mes del año pasado. En junio también se mantuvo una alta demanda, con 562,026 descargas.

    Softonic destacó que actualmente se realizan más de 17,000 descargas diarias de aplicaciones de inteligencia artificial. Además, señaló que desde enero de 2025 hasta junio de 2026 el número acumulado de descargas de este tipo de herramientas ya supera los 8.4 millones.

    ChatGPT se mantiene como la aplicación de IA más descargada de la plataforma, con 677,720 descargas durante la primera mitad de 2026, equivalente al 21.9 % del total. Sin embargo, su participación disminuyó frente al 40.3 % que registraba en el mismo período de 2025 y también sufrió una caída del 23 % en el número absoluto de descargas.

    El principal competidor de ChatGPT fue Gemini, el asistente de inteligencia artificial de Google, que registró un crecimiento del 1,559 % al pasar de 39,771 descargas en el primer semestre de 2025 a 659,807 durante los primeros seis meses de este año. En tercer lugar se ubicó Remini, dedicada a la edición fotográfica con IA, con 624,039 descargas. Más atrás aparecen Vmake Video Enhancer, con 146,770, y Topaz Video AI, con 106,515.

    El informe también reveló un fuerte crecimiento en las aplicaciones orientadas a la programación, impulsadas por Codeium, cuyas descargas aumentaron de 1,865 a 75,635. Asimismo, las herramientas de generación de texto y productividad crecieron un 162 % gracias a plataformas como NotebookLM, ahora denominada Gemini Notebook, y AutoDraft. En contraste, las aplicaciones relacionadas con video y audio registraron caídas del 32.9 % y del 12.6 %, respectivamente.

    Por otra parte, las aplicaciones enfocadas en la conversación y compañía mediante personajes de inteligencia artificial también mostraron un importante crecimiento. Las distintas versiones de Talkie triplicaron sus descargas al pasar de 40,589 en el primer semestre de 2025 a 126,249 en el mismo período de 2026, lo que representa un incremento del 211 %.

  • Google Maps suma funciones de Gemini para evitar congestionamientos y responder consultas de los usuarios

    Google Maps suma funciones de Gemini para evitar congestionamientos y responder consultas de los usuarios

    Google integró oficialmente las capacidades de Gemini en Google Maps para los usuarios de España, una actualización que incorpora inteligencia artificial a la experiencia de navegación y permite mantener conversaciones con el asistente para obtener información en tiempo real sobre el tráfico, rutas alternativas y otros aspectos útiles durante los viajes por carretera.

    La nueva función llega en plena operación salida de verano y busca facilitar los desplazamientos mediante respuestas personalizadas. Los usuarios pueden activar Gemini desde el panel superior de Google Maps o mediante el comando de voz «Hey Google», lo que permite realizar consultas utilizando lenguaje natural sin necesidad de introducir comandos específicos.

    Gracias a la tecnología Immersive Navigation, presentada por Google este año, la aplicación analiza imágenes actualizadas de Street View, fotografías aéreas y otros datos para comprender el entorno de la ruta y ofrecer indicaciones más precisas al conductor.

    Entre sus nuevas funciones, Gemini puede informar sobre el estado del tráfico en carreteras concretas, calcular retrasos por congestión y proponer rutas alternativas cuando detecta retenciones. Además, ofrece instrucciones más detalladas durante maniobras complejas, utilizando referencias visuales del entorno para facilitar la conducción.

    La inteligencia artificial también puede responder preguntas como «¿Cómo está el tráfico en la A-4 saliendo de Madrid ahora mismo?» o «¿Hay mucha retención llegando a Despeñaperros?», procesando la información disponible para recomendar el trayecto más rápido según las condiciones del momento.

    Otra de las novedades es la posibilidad de localizar áreas de servicio durante el recorrido. Gemini puede recomendar gasolineras con cafeterías menos concurridas, identificar lugares adecuados para hacer una pausa e incluso considerar factores como la disponibilidad de estacionamiento cubierto o zonas con sombra para descansar.

    La herramienta también ayuda a los conductores a decidir si conviene utilizar una autopista de peaje o una ruta alternativa. Ante consultas como «¿Merece la pena pagar el peaje o mejor evito la AP-7?», el sistema compara el tiempo estimado de cada recorrido y explica las ventajas y desventajas de ambas opciones para facilitar la decisión.

    Asimismo, Google incorporó mejoras para anticipar cambios de carril antes de una salida. Gemini puede indicar con suficiente anticipación cuándo es necesario cambiar de carril para tomar un desvío, una función pensada para incrementar la seguridad en vías de alta velocidad y durante periodos de intenso tráfico.

    No obstante, la inteligencia artificial mantiene algunas limitaciones. Google confirmó que Gemini no informa sobre la ubicación exacta de radares móviles en España. En estos casos, la aplicación continúa dependiendo de los reportes realizados por los propios usuarios en tiempo real dentro de Google Maps.

  • Google limita el acceso de Meta a Gemini por falta de capacidad de computación

    Google limita el acceso de Meta a Gemini por falta de capacidad de computación

    Google limitó el acceso de Meta a los modelos de inteligencia artificial Gemini luego de que la demanda de capacidad de procesamiento por parte de la empresa superara los recursos de computación disponibles. La decisión, tomada en marzo, afectó varios proyectos internos de la compañía de Mark Zuckerberg.

    De acuerdo con información publicada por el diario Financial Times, Google comunicó a Meta que no podría suministrar toda la capacidad de Gemini que había solicitado. Como consecuencia, algunos desarrollos relacionados con inteligencia artificial fueron suspendidos temporalmente o experimentaron retrasos.

    La empresa propietaria de Facebook, Instagram y WhatsApp también pidió a sus empleados optimizar el uso de los tokens de inteligencia artificial, las unidades que miden el consumo de estos modelos, con el objetivo de administrar de manera más eficiente los recursos disponibles.

    Meta utiliza los modelos Gemini principalmente para reforzar sistemas internos de seguridad, atención al cliente, publicidad, programación y automatización de procesos. Según el informe, el rendimiento de Gemini supera al de Llama, la familia de modelos de código abierto desarrollada por la propia Meta.

    La situación refleja el creciente problema de capacidad que enfrenta la industria tecnológica ante el auge de la inteligencia artificial. La fuerte demanda de infraestructura especializada ha generado un cuello de botella que afecta incluso a las compañías con mayores recursos del mundo.

    El incremento en la necesidad de centros de datos y memoria de alto rendimiento también ha impactado a otros sectores tecnológicos. Fabricantes de chips priorizan la producción de componentes destinados a inteligencia artificial, lo que ha elevado el costo de memorias RAM utilizadas en productos de consumo y dispositivos electrónicos.

    La presión sobre la infraestructura también alcanzó a otros clientes de Google Cloud, aunque Meta ha sido una de las compañías más afectadas debido al elevado volumen de recursos que requiere para desarrollar y operar sus sistemas de inteligencia artificial. El propio director ejecutivo de Google, Sundar Pichai, reconoció recientemente que la empresa enfrenta limitaciones temporales para satisfacer toda la demanda de sus clientes.

    Frente a este panorama, Meta aceleró sus planes para reducir la dependencia de proveedores externos. Según estimaciones del sector financiero, la compañía proyecta invertir hasta $600,000 millones antes de 2028 para construir sus propios centros de datos, fortalecer su capacidad de entrenamiento e inferencia de modelos de IA y responder al crecimiento sostenido de esta tecnología.

  • Agentes especializados programan, prueban y dan mantenimiento a servicios

    Agentes especializados programan, prueban y dan mantenimiento a servicios

    Por un lado, Antigravity 2.0 evoluciona de demo experimental a entorno de trabajo donde múltiples agentes colaboran para generar, refactorizar y probar código, orquestados sobre la familia de modelos Gemini. La plataforma permite descomponer una tarea de desarrollo en subtareas (diseño, implementación, documentación, pruebas) que distintos agentes abordan de forma coordinada.

    En paralelo, Gemini Spark se posiciona como un agente de IA de larga duración con memoria y contexto, capaz de mantener sesiones activas, recordar decisiones anteriores y actuar sobre servicios y aplicaciones conectadas. Estas capacidades incluyen lectura y escritura en documentos, interacción con herramientas en la nube y ejecución de flujos automatizados, siempre bajo permisos configurables por el usuario o el equipo técnico.

    La combinación de ambas apuestas apunta a un escenario en el que gran parte del ciclo de vida del software —desde la generación de prototipos hasta el mantenimiento— puede estar parcialmente automatizado. Los desarrolladores pasan a supervisar, ajustar y validar resultados, mientras delegan en los agentes tareas repetitivas o de exploración intensiva.

    Seguridad, gobernanza y control humano como eje del diseño

    Este avance se produce en un contexto en el que la industria entera afronta la seguridad en IA en tiempo real. Empresas como Google promueven arquitecturas donde los agentes operan dentro de límites técnicos claros: sandboxes de ejecución, control granular de accesos, registro exhaustivo de acciones y políticas de gobernanza de datos. El objetivo es que las automatizaciones sobre código y documentos sean auditables y reversibles.

    En lugar de plantear a la IA como sustituto total, estas plataformas se orientan a ampliar capacidad productiva. Para los equipos de software, el valor está en reducir tiempos de desarrollo y pruebas; para áreas de negocio, en disponer de asistentes capaces de ejecutar flujos operativos sobre ecosistemas complejos sin necesidad de intervención manual constante. El desafío inmediato es técnico: diseñar agentes robustos, predecibles y alineados con las reglas de seguridad y cumplimiento de cada organización.

    Si estas herramientas se estabilizan y escalan, el modelo de trabajo se desplaza hacia una relación continua entre personas y agentes: los humanos fijan objetivos, restricciones y criterios de calidad; los agentes ejecutan, monitorizan y proponen iteraciones rápidas. La competencia entre plataformas se jugará tanto en la potencia de los modelos como en la fineza del control, la trazabilidad y la integración con infraestructuras existentes.