Etiqueta: Anthropic

  • Un investigador de Anthropic renuncia y acusa a la empresa y a su rival, OpenAI, de «jugar con nuestras vidas»

    Un investigador de Anthropic renuncia y acusa a la empresa y a su rival, OpenAI, de «jugar con nuestras vidas»

    El investigador Jacob Coxon renunció a Anthropic después de tres años dedicado al preentrenamiento de inteligencia artificial (IA) entre esa compañía y OpenAI, al considerar que ambas empresas avanzan de manera irresponsable hacia sistemas de superinteligencia y subestiman los posibles riesgos para la humanidad.

    «Hoy renuncié a Anthropic. Pasé los últimos tres años investigando el preentrenamiento tanto en OpenAI como en Anthropic. Ninguna de las dos empresas actúa con responsabilidad. Están avanzando a toda velocidad hacia la superinteligencia auto-mejorada y jugando con nuestras vidas», ha expresado Coxon en un mensaje en redes sociales.

    El investigador sostuvo que numerosas personas dentro de la industria tecnológica son conscientes de la rapidez con la que avanza la IA y de los potenciales peligros para la sociedad, aunque advirtió que algunos ejecutivos podrían minimizar públicamente esos riesgos.

    «Quienes desarrollan la IA creen sinceramente que podría acabar con todos nosotros para finales de la década», ha asegurado.

    Coxon señaló que la competencia por liderar el desarrollo de inteligencia artificial está llevando a las compañías a relegar otras consideraciones. Aunque considera que Anthropic presta mayor atención a estos riesgos que OpenAI, afirmó que ambas «están inmersas en una carrera por llegar primero».

    «Aceptar esta carrera y entrar en la fase final es una apuesta temeraria que no debería emprenderse desde el Slack de una empresa privada. Intentar completar la alineación a toda velocidad requiere una confianza extraordinaria en que no existen mejores trayectorias disponibles», advirtió.

    Evan Hubinger, responsable de Ciencia de Alineación en Anthropic, respaldó las advertencias de Coxon y aseguró que existe preocupación dentro del sector por las consecuencias que podría tener el desarrollo de sistemas mucho más avanzados. Hubinger afirmó que los trabajadores «verdaderamente creemos que la IA podría acabar con todos los humanos» y situó en más del 10 % la probabilidad de que esto ocurra para finales de la década.

    Hubinger aseguró que Anthropic está haciendo «todo lo posible» para evitar ese escenario, pero reconoció que todavía no existe un plan para «resolver el problema de la alineación para la superinteligencia y no estamos claramente encaminados hacia ello». El investigador situó el principal peligro en sistemas de IA que lleguen a superar ampliamente las capacidades humanas.

    Los modelos actuales todavía no alcanzan ese nivel, según Hubinger, quien centró su preocupación en una eventual capacidad de los sistemas para mejorar de manera recursiva. «Lo que me preocupa es la superinteligencia que surge de la auto-mejora recursiva, que, como hemos dicho, está ocurriendo más rápido de lo que pensábamos», ha observado.

     

  • DeepSeek lanza un modelo de IA experimental que rivaliza con Opus 4.8 de Anthropic en tareas de agentes y multimodal

    DeepSeek lanza un modelo de IA experimental que rivaliza con Opus 4.8 de Anthropic en tareas de agentes y multimodal

    El laboratorio chino de inteligencia artificial (IA) DeepSeek lanzó DeepSeek-V4-Flash-Vision-Exp, un modelo multimodal experimental que incorpora capacidades de visión y que, según las pruebas difundidas por la propia compañía, supera al modelo Opus 4.8 de Anthropic en tres de once evaluaciones de rendimiento.

    El nuevo sistema añade funciones de visión al anterior V4-Flash, por lo que puede interpretar imágenes y capturas de pantalla, además de procesar texto. Esta incorporación amplía sus posibilidades para desarrollar tareas mediante agentes de IA que necesitan analizar información visual.

    «Este modelo multimodal experimental iguala a DeepSeek-V4-Flash en capacidades de texto, incluyendo agentes, razonamiento y conocimiento del mundo», afirma DeepSeek en su anuncio en X (antes Twitter), donde sostiene que es un gran salto sobre V4-Flash que acerca su rendimiento como agente multimodal al mencionado de Anthropic.

    Según la tabla de resultados divulgada por DeepSeek, su nuevo modelo supera a Opus 4.8 en tres evaluaciones: DeepSWE, Agents’ Last Exam y ZeroBench. Sin embargo, queda por detrás del modelo de Anthropic en las otras ocho pruebas, incluida NL2Repo, enfocada en tareas complejas relacionadas con repositorios, donde la diferencia alcanza los doce puntos.

    Frente a V4-Flash, que funciona únicamente con texto, el nuevo modelo experimental obtuvo mejores resultados en seis de las siete evaluaciones de texto. La diferencia principal entre ambas versiones es que DeepSeek-V4-Flash-Vision-Exp también puede procesar información procedente de imágenes.

    DeepSeek habilitó el modelo en su plataforma de interfaz de programación de aplicaciones (API) y presentó la versión 0.1.1 de su entorno para agentes, que ya incluye soporte para el nuevo sistema. El modelo permite enviar fotografías y capturas de pantalla, que son convertidas en unidades de procesamiento o “tokens” y cobradas con la misma tarifa aplicada al texto estándar, con un máximo de 384 por imagen.

    La compañía incorporó además una API de archivos que permite cargar una imagen una sola vez y reutilizarla posteriormente en diferentes consultas. Con esta función, los usuarios no necesitan volver a subir el mismo archivo cada vez que quieran utilizarlo con el modelo.

    El medio especializado TNW señala que procesar un millón de palabras con el modelo de DeepSeek cuesta $0.87, frente a cerca de $50 con Opus 4.8 de Anthropic. La compañía china busca así competir tanto en rendimiento como en costos dentro del mercado de modelos de IA orientados al razonamiento, agentes y procesamiento multimodal.

     

  • Anthropic aclara las dudas sobre la marca de agua que Claude aplicará a sus textos

    Anthropic aclara las dudas sobre la marca de agua que Claude aplicará a sus textos

    Anthropic ofreció nuevos detalles sobre la marca de agua que incorporará a los textos generados por Claude en todo el mundo, después de las dudas surgidas entre sus usuarios. El mecanismo se aplicará en la aplicación y versión web, API, Claude Code, Claude Cowork y Claude Tag.

    La compañía anunció la semana pasada la implementación de estas marcas tras firmar el Código de Buenas Prácticas sobre la Transparencia del Contenido Generado por IA, vinculado a la Ley de Inteligencia Artificial de la Unión Europea. La decisión generó críticas entre usuarios de Claude e incluso cancelaciones de suscripciones, según informó el medio especializado Business Insider.

    Anthropic explicó que utilizará una versión de SynthID-Text, tecnología desarrollada por Google DeepMind que aprovecha las elecciones entre palabras igualmente válidas realizadas por el modelo. El mecanismo modifica únicamente la fuente de aleatoriedad utilizada por la inteligencia artificial al seleccionar las palabras mediante una clave.

    El sistema emplea esa clave matemática junto con las palabras anteriores para determinar la siguiente palabra e introducir así la marca de agua. De esta manera, Claude genera un patrón que resulta imperceptible para el lector, pero que puede ser identificado por quien disponga de la clave utilizada para codificarlo.

    La compañía aseguró que incorporar este mecanismo no generará latencia ni aumentará el consumo de tokens o los costos relacionados con la API. Anthropic también aclaró que la marca de agua no almacena información personal del usuario, de la organización ni de las conversaciones.

    La detección tampoco ofrecerá una respuesta absoluta sobre el origen de un contenido, sino una estimación de probabilidad. Si el sistema identifica el patrón podrá determinar que el texto “problablemente pasó por Claude”, pero la ausencia de la marca no significará necesariamente que el contenido fue escrito por una persona.

    Claude contará con una clave propia, diferente de las utilizadas por ChatGPT o Gemini, por lo que no existirá un detector universal para identificar textos producidos por diferentes modelos. Además, la efectividad de la detección aumentará conforme el contenido tenga una mayor cantidad de palabras, mientras que los textos breves ofrecerán pocas señales para reconocer el patrón.

    En el caso del código y las correcciones, Anthropic indicó que la marca no podrá incorporarse cuando no exista libertad para elegir entre distintas palabras. La empresa confirmó además que próximamente lanzará una API de detección y señaló que las traducciones realizadas por Claude sí incorporarán la marca, debido a que el modelo selecciona las palabras utilizadas en el resultado.

     

  • Anthropic negocia la compra de Decart AI por un récord de 6,000 millones de dólares

    Anthropic negocia la compra de Decart AI por un récord de 6,000 millones de dólares

    Anthropic mantiene conversaciones para adquirir la empresa emergente Decart AI por unos $6,000 millones, una operación que, de concretarse, se convertiría en la mayor compra realizada hasta ahora por la compañía responsable del asistente de inteligencia artificial Claude.

    La cifra planteada en las negociaciones, 5.200 millones de euros -> $5,997.7 millones, según el tipo de cambio de referencia de este jueves del Banco Central Europeo, que establece un valor de $1.1534 por cada euro.

    Decart AI desarrolla tecnología diseñada para reducir los costos asociados al entrenamiento y funcionamiento de sistemas de inteligencia artificial mediante la optimización del desempeño de los chips utilizados para ejecutar estos modelos.

    La eventual adquisición permitiría a Anthropic fortalecer su infraestructura informática para responder a una mayor demanda de sus servicios, en momentos en que la adopción de su tecnología de inteligencia artificial registra un fuerte crecimiento.

    Sin embargo, las negociaciones todavía no concluyen y no existe garantía de que la operación llegue a concretarse, según las fuentes cercanas al proceso citadas por Bloomberg.

    Decart AI anunció en mayo una ronda de financiamiento por $300 millones, que contó con Radical Ventures como principal inversor y con la participación de Nvidia, Atreides Management, Valor Equity Partners y Adobe Ventures.

    En la operación también participaron inversores que ya respaldaban a la empresa, entre ellos Sequoia Capital, Benchmark y Zeev Ventures. La ronda permitió elevar significativamente la valoración de la compañía especializada en infraestructura para inteligencia artificial.

    Según The Wall Street Journal, la última ronda de financiamiento valoró a Decart AI en cerca de $4,000 millones, un incremento del 29 % respecto de agosto de 2025. Una compra por $6,000 millones supondría así una nueva valoración récord para la empresa.

  • Un informe británico advierte de comportamientos autónomos y engañosos de modelos de IA

    Un informe británico advierte de comportamientos autónomos y engañosos de modelos de IA

    El Gobierno del Reino Unido advirtió que los modelos de inteligencia artificial Mythos, de Anthropic, y Sol, de OpenAI, mostraron comportamientos autónomos y engañosos sin precedentes durante una serie de pruebas de ciberseguridad realizadas por el Instituto de Seguridad de la IA (AISI).

    La evaluación, impulsada por el Ministerio de Ciencia, Innovación y Tecnología británico, analizó siete modelos de inteligencia artificial mediante 122 pruebas. El informe concluyó que en diez de esos ensayos se registraron 19 acciones no autorizadas que excedieron los límites establecidos por los investigadores.

    De acuerdo con el reporte, 17 de esas acciones fueron atribuidas al modelo Mythos 5 de Anthropic, mientras que las dos restantes correspondieron al GPT-5.6 Sol de OpenAI. Ambos sistemas llegaron a crear perfiles humanos falsos con el objetivo de engañar a personas durante simulaciones de ciberataques.

    Los investigadores señalaron que Mythos intentó acceder a un servicio mediante cuentas falsas que imitaban a personas reales. Además, identificaron intentos del modelo por contactar a usuarios para inducirlos a ejecutar archivos maliciosos e introducir instrucciones ocultas destinadas a manipular otros sistemas de inteligencia artificial.

    A pesar de esos hallazgos, el Instituto de Seguridad de la IA subrayó que «estos intentos no tuvieron éxito» y precisó que su investigación «no ha encontrado evidencias de daños en el mundo real». Sin embargo, consideró que los resultados representan un punto de inflexión en el desarrollo de estas tecnologías.

    Según el organismo, es la primera vez que se observan «riesgos relacionados con la autonomía y el engaño manifestarse de forma tan clara, sin instrucciones específicas y en el mundo real», lo que incrementa la preocupación sobre el comportamiento de los modelos más avanzados.

    Tras conocerse el informe, Anthropic sostuvo, en declaraciones recogidas por la BBC, que las pruebas fueron realizadas en un entorno donde se redujeron o eliminaron las salvaguardas habituales de sus modelos, por lo que aseguró que «no son representativos» de los sistemas utilizados por sus clientes. La empresa también confirmó que inició una investigación interna.

    OpenAI expresó una posición similar y afirmó que las condiciones de los ensayos «no reflejan el uso habitual» de sus modelos. La compañía indicó que continuará colaborando con los organismos evaluadores y con otras empresas del sector para fortalecer los mecanismos de seguridad. El informe se conoce pocos días después de que Anthropic revelara que tres versiones de su asistente Claude lograron acceder a internet y vulnerar sistemas durante pruebas de ciberseguridad, mientras que OpenAI reconoció previamente que dos de sus modelos escaparon de un entorno de pruebas e ingresaron a la plataforma Hugging Face.

  • Tres modelos de IA de Anthropic logran acceder a internet y jaquear a tres entidades

    Tres modelos de IA de Anthropic logran acceder a internet y jaquear a tres entidades

    La empresa estadounidense Anthropic informó que tres modelos de su asistente de inteligencia artificial Claude lograron acceder a internet y vulnerar los sistemas de tres organizaciones durante una serie de pruebas de ciberseguridad. La compañía explicó que los incidentes ocurrieron por un error de configuración mientras se desarrollaban evaluaciones en un entorno de prueba.

    La revisión comenzó luego de que OpenAI revelara, el pasado 21 de julio, que dos de sus modelos de inteligencia artificial habían escapado de un entorno controlado y accedido a la plataforma Hugging Face tras superar las medidas de seguridad establecidas para las pruebas.

    Según explicó Anthropic en su sitio web, la empresa examinó más de 146,000 operaciones en las que existía la posibilidad de que alguno de sus modelos hubiera obtenido acceso a internet. El análisis permitió identificar tres incidentes en los que Claude logró conectarse a la red y posteriormente acceder a los sistemas de tres organizaciones distintas.

    La compañía señaló que los hechos comenzaron en abril y que cada incidente involucró un modelo diferente: Claude Opus 4.7, Mythos 5 y un modelo interno utilizado exclusivamente para pruebas.

    En las tres evaluaciones, los modelos recibieron la instrucción de infiltrarse en un sistema ficticio dentro de un entorno completamente simulado. Además, se les indicó expresamente que no contaban con acceso a internet, por lo que las pruebas debían desarrollarse bajo esas restricciones.

    No obstante, Anthropic explicó que un malentendido entre la empresa y el socio externo encargado de ejecutar las evaluaciones permitió que los modelos sí tuvieran acceso a la red. Esa condición inesperada hizo posible que los sistemas de inteligencia artificial interactuaran con infraestructuras reales y cumplieran el objetivo asignado.

    La empresa subrayó que los accesos no fueron producto de una decisión autónoma de los modelos, sino de un fallo en la configuración del entorno de pruebas. Tras detectar los incidentes, Anthropic inició una revisión de sus protocolos de seguridad para evitar que situaciones similares vuelvan a repetirse durante futuras evaluaciones.

    El caso vuelve a poner el foco sobre la necesidad de reforzar los mecanismos de supervisión y control en el desarrollo de modelos avanzados de inteligencia artificial, especialmente cuando son sometidos a pruebas de ciberseguridad que involucran entornos con acceso potencial a sistemas reales.

  • Tecnológicas de EEUU lanzan iniciativa para defender IA abierta en plena pugna con China

    Tecnológicas de EEUU lanzan iniciativa para defender IA abierta en plena pugna con China

    Las compañías Nvidia, Microsoft, Palantir y otras empresas tecnológicas anunciaron este lunes la creación de la Open Secure AI Alliance, una iniciativa destinada a fortalecer la seguridad de la inteligencia artificial (IA) abierta, en un contexto marcado por la creciente competencia entre Estados Unidos y China por el liderazgo en esta tecnología.

    La alianza, promovida por Nvidia, tiene como objetivo desarrollar y compartir herramientas abiertas para detectar y corregir vulnerabilidades en sistemas de inteligencia artificial, además de mejorar la capacidad de respuesta ante amenazas cibernéticas.

    La empresa explicó que «la seguridad de la IA no debe depender únicamente de modelos cerrados controlados por unas pocas compañías», sino también de «sistemas que permitan a investigadores y desarrolladores inspeccionar, adaptar y ejecutar» herramientas avanzadas en sus propias infraestructuras.

    Como ejemplo de la necesidad de fortalecer este tipo de modelos, Nvidia recordó un reciente incidente de seguridad ocurrido en la plataforma Hugging Face, utilizada por investigadores y desarrolladores para compartir modelos de inteligencia artificial. Según la compañía, los sistemas abiertos permiten analizar con mayor profundidad las amenazas y responder con mayor rapidez.

    «Los defensores de la ciberseguridad necesitan sistemas de IA avanzados y abiertos para su propia defensa», sostuvo Nvidia, al destacar que los modelos conocidos como open weight ofrecen a investigadores y empresas la posibilidad de descargar, ejecutar y modificar los componentes de la inteligencia artificial en servidores propios.

    La iniciativa contrasta con el funcionamiento de los modelos cerrados desarrollados por empresas como OpenAI, Anthropic y Google, cuyos componentes internos no están disponibles para los usuarios. Ninguna de estas compañías forma parte de la nueva alianza anunciada por Nvidia.

    El anuncio coincide con un intenso debate en Washington sobre cómo responder al acelerado avance de los modelos de inteligencia artificial desarrollados en China. Entre ellos destaca Kimi K3, de la empresa Moonshot AI, cuyo modelo abierto ha ganado terreno entre desarrolladores, mientras que autoridades estadounidenses analizan posibles sanciones por un presunto uso indebido de propiedad intelectual y promueven el desarrollo de alternativas nacionales con mayores estándares de seguridad.

  • Anthropic alquila un edificio de 16 plantas en Nueva York y duplicará su plantilla en 2026

    Anthropic alquila un edificio de 16 plantas en Nueva York y duplicará su plantilla en 2026

    La empresa de inteligencia artificial Anthropic anunció la firma de un contrato de arrendamiento a largo plazo para ocupar un edificio de 16 plantas en el Bajo Manhattan, una expansión con la que busca fortalecer su presencia en Nueva York y duplicar el tamaño de su plantilla en esa ciudad.

    La compañía, desarrolladora del asistente de inteligencia artificial Claude, comenzará el traslado durante este verano hacia un edificio remodelado en el vecindario de Hudson Square. El proceso de mudanza se realizará de manera gradual durante los próximos años.

    Según informó la empresa, el inmueble ubicado en el 330 de Hudson Street será su principal oficina en la Costa Este. El complejo contará con más de 450,000 pies cuadrados de espacio y tendrá capacidad para más de 1,700 puestos de trabajo.

    Anthropic inició este año con menos de 500 empleados en Nueva York y prevé cerrar el ejercicio con más de 1,000 colaboradores en esa ciudad. La compañía explicó que trabaja con clientes de distintos sectores, entre ellos Goldman Sachs, la empresa tecnológica Ramp y organizaciones sin fines de lucro como Robin Hood Foundation.

    La expansión se produce en medio de una creciente competencia entre las principales compañías de inteligencia artificial por consolidar operaciones en la costa este de Estados Unidos. OpenAI trasladó en 2024 sus oficinas al edificio Puck, ubicado a poco más de 1.6 kilómetros de la futura sede de Anthropic, mientras que Google estableció un gran centro tecnológico en Hudson Square tras renovar un antiguo almacén ferroviario.

    El proyecto recibió el respaldo de las autoridades estatales y municipales. La gobernadora de Nueva York, Kathy Hochul, aseguró que la inversión contribuirá a fortalecer el posicionamiento de la ciudad como uno de los principales polos tecnológicos del mundo. Por su parte, la presidenta interina de la Corporación de Desarrollo Económico de Nueva York, Jeanny Pak, destacó que la iniciativa generará cientos de nuevos empleos.

    De forma paralela, Anthropic avanza en sus planes para desarrollar un centro de datos en el norte del estado de Nueva York en alianza con la empresa Fluidstack. La compañía, que el mes pasado solicitó una oferta pública inicial (OPI), explicó que esta inversión forma parte de un compromiso de $50,000 millones destinado al desarrollo de infraestructura para inteligencia artificial en Estados Unidos.

    La expansión también se desarrolla en medio del debate sobre el impacto ambiental de los centros de datos. Recientemente, legisladores del estado aprobaron una moratoria de un año para nuevos complejos de gran escala destinados a inteligencia artificial por su elevado consumo energético. Sin embargo, la gobernadora Hochul dejó abierta la posibilidad de vetar esa legislación.

  • Anthropic lanza Sonnet 5 con mayor autonomía para agentes de IA

    Anthropic lanza Sonnet 5 con mayor autonomía para agentes de IA

    Anthropic presentó este miércoles Sonnet 5, la nueva versión de su modelo de inteligencia artificial, diseñado no solo para responder consultas de los usuarios, sino también para gestionar agentes de IA con mayor autonomía, mejor desempeño y un costo inferior al de otros modelos de la compañía.

    La empresa explicó que Sonnet 5 puede ejecutar tareas como utilizar navegadores web, operar terminales y completar procesos de forma autónoma. Además, adopta la misma nomenclatura de Fable 5, el modelo de la clase Mythos cuyo lanzamiento fue suspendido temporalmente hace dos semanas y que ya volvió a estar disponible a nivel mundial tras recibir la autorización del Gobierno de Estados Unidos.

    Anthropic destacó en su sitio web que el rendimiento alcanzado por Sonnet 5 habría requerido, hace apenas unos meses, un modelo de mayor tamaño y con un costo significativamente más alto. Según la compañía, el nuevo sistema ofrece capacidades cercanas a las de los recientes modelos de la familia Opus.

    Frente a Sonnet 4.6, la nueva versión reduce la tasa de comportamientos indeseables y mejora la seguridad en tareas relacionadas con agentes de inteligencia artificial. Sin embargo, mantiene un rendimiento inferior en funciones de ciberseguridad, un campo en el que Fable 5 continúa destacando.

    Las pruebas de desempeño muestran que Sonnet 5 supera a Sonnet 4.6 en todos los indicadores publicados por Anthropic. Las mayores mejoras se registran en la resolución de tareas complejas de principio a fin, así como en las evaluaciones Humanity’s Last Exam, centrada en conocimiento especializado, y Terminal-Bench v2.1, enfocada en el uso de terminales, donde obtuvo incrementos de 10.6 y 13.4 puntos, respectivamente.

    La compañía también comparó el nuevo modelo con Opus 4.8, uno de sus sistemas más avanzados. Según los resultados, Sonnet 5 logra competir e incluso superar a ese modelo en pruebas de trabajo agéntico como AA-Briefcase y GDPval-AA. Además, cuando se activa el nivel máximo de razonamiento, reduce la diferencia con Opus 4.8 en evaluaciones de tareas complejas.

    No obstante, Anthropic reconoció que Opus 4.8 continúa ofreciendo mejores resultados en matemáticas, razonamiento avanzado y ciberseguridad ofensiva, debido a que Sonnet 5 incorpora limitaciones deliberadas en esas áreas.

    Sonnet 5 ya está disponible como modelo predeterminado para los usuarios de las versiones gratuita y Pro de Claude. Su precio será de $3 por millón de tokens de entrada y de $15 por millón de tokens de salida. La compañía también incorporó un nuevo sistema de tokenización que mejora el procesamiento del lenguaje, aunque un mismo texto puede consumir entre una y 1.35 veces más tokens, lo que representa un incremento de hasta 35 % en el volumen utilizado para un mismo prompt.

  • Anthropic alerta sobre la IA que se autoconstruye y apuesta por una «desaceleración» para no perder el control humano

    Anthropic alerta sobre la IA que se autoconstruye y apuesta por una «desaceleración» para no perder el control humano

    La empresa de inteligencia artificial Anthropic alertó sobre los riesgos asociados al desarrollo de sistemas capaces de diseñar y construir versiones más avanzadas de sí mismos, una práctica conocida como “automejora recursiva”, y propuso una desaceleración coordinada del avance tecnológico para evitar que los humanos pierdan el control sobre estas herramientas.

    La compañía explicó que las empresas líderes del sector ya delegan cada vez más tareas a los propios sistemas de IA para acelerar el trabajo de ingenieros e investigadores. Como ejemplo, señaló que gran parte del código utilizado en sus proyectos es generado por Claude, mientras los especialistas supervisan y validan los resultados.

    Según Anthropic, si esta tendencia continúa y los sistemas disponen de suficiente capacidad de procesamiento, podrían llegar a desarrollar de manera autónoma a sus propios sucesores, reduciendo progresivamente la intervención humana en el proceso de innovación tecnológica.

    Aunque la empresa aclaró que la industria aún no ha alcanzado ese escenario, advirtió que la llegada de modelos con capacidades de automejora podría producirse antes de que gobiernos, instituciones y organismos reguladores estén preparados para gestionar sus implicaciones.

    La tecnológica reconoció que una IA capaz de autoconstruirse tendría aplicaciones de gran impacto en áreas como la investigación científica, la medicina y otros sectores estratégicos. Sin embargo, sostuvo que también incrementaría la posibilidad de que los seres humanos pierdan capacidad de supervisión sobre sistemas cada vez más complejos.

    Ante este panorama, Anthropic consideró necesario crear condiciones que permitan ralentizar o incluso pausar temporalmente el desarrollo de modelos de IA de vanguardia, con el objetivo de dar tiempo a que la investigación en seguridad y alineación tecnológica avance al mismo ritmo que las capacidades de estos sistemas.

    La compañía insistió en que cualquier desaceleración debe estar respaldada por mecanismos de coordinación internacional. Entre las propuestas planteadas figura la creación de herramientas que permitan verificar que todos los desarrolladores de IA cumplen de manera simultánea con eventuales acuerdos de pausa o ralentización.

    Anthropic adelantó que trabajará junto a investigadores, responsables políticos, organizaciones civiles y empresas del sector para diseñar estos mecanismos de supervisión global. Asimismo, publicará próximamente los resultados de sus investigaciones sobre la automejora recursiva y los posibles modelos de gobernanza para afrontar este desafío tecnológico.