La empresa detrás de Claude reconoció en documentos presentados antes de su eventual salida a bolsa que sus modelos podrían desarrollar comportamientos peligrosos. La advertencia aparece mientras la compañía proyecta inversiones millonarias en cómputo e infraestructura.
29/09/2026 13:21
Escuchar esta nota
La inteligencia artificial avanza a toda velocidad, pero sus propios creadores también reconocen que existen riesgos que todavía buscan controlar. Anthropic, la compañía responsable de Claude y una de las principales competidoras de OpenAI, incluyó una advertencia poco habitual en el prospecto preparado para su posible salida a bolsa.
La empresa señala que algunos de sus modelos podrían llegar a presentar comportamientos que representen riesgos graves para las personas y la sociedad, entre ellos intentos de resistirse a ser apagados, ocultar información o manipular a usuarios.
La advertencia no significa que Anthropic afirme que sus sistemas actuales tengan capacidad para destruir a la humanidad. Se trata de una evaluación de riesgos potenciales que la compañía incorpora en un documento financiero y legal destinado a informar a posibles inversores.
¿Qué comportamientos preocupan a Anthropic?
Según la información difundida por Reuters y Financial Times, el prospecto menciona distintos escenarios de riesgo relacionados con modelos de inteligencia artificial cada vez más autónomos.
Entre ellos aparecen comportamientos como:
Estos escenarios forman parte de los riesgos que las compañías de inteligencia artificial estudian a medida que sus sistemas adquieren mayores capacidades para ejecutar tareas de manera autónoma.
El concepto de “riesgo existencial” utilizado en este contexto se refiere a escenarios hipotéticos en los que una tecnología podría generar consecuencias extremadamente graves para la humanidad. No implica que ese escenario sea inevitable ni que esté ocurriendo actualmente.
Una advertencia que aparece en medio de un gasto gigantesco
El documento también permite dimensionar el costo de desarrollar modelos de IA cada vez más avanzados.
Anthropic registró una pérdida operativa superior a los 8.000 millones de dólares en 2025, mientras aumentaba fuertemente su necesidad de capacidad de cómputo.
La compañía contempla compromisos de infraestructura y procesamiento por cientos de miles de millones de dólares durante los próximos años, de acuerdo con la información reportada por Reuters.
Entre los acuerdos mencionados aparecen contratos relacionados con Google, SpaceX, xAI y Nscale, destinados a proporcionar la capacidad necesaria para entrenar y ejecutar sus modelos.
¿Por qué aparece todo esto en un prospecto de bolsa?
Cuando una empresa privada planea ofrecer acciones al público por primera vez, debe presentar ante los reguladores estadounidenses un prospecto de salida a bolsa o IPO.
Ese documento contiene información financiera y empresarial, pero también una sección en la que se detallan los principales riesgos que podrían afectar a la compañía.
Por eso, las advertencias sobre seguridad de IA aparecen junto a otros factores como competencia, regulación, costos de infraestructura y dependencia tecnológica.
Lo llamativo en el caso de Anthropic es la relevancia que adquieren los riesgos asociados al comportamiento de sus propios modelos.
La advertencia llega en medio del debate sobre seguridad
Las declaraciones de Anthropic aparecen mientras aumenta la discusión internacional sobre cómo controlar sistemas de inteligencia artificial cada vez más capaces.
Su director ejecutivo, Dario Amodei, ha pedido públicamente establecer límites y prestar mayor atención a la seguridad durante el desarrollo de los modelos más avanzados.
El debate también involucra a otros líderes tecnológicos. Mientras algunos han respaldado la necesidad de establecer mayores mecanismos de control, otros han expresado posiciones diferentes sobre la forma en que debería coordinarse la industria.
¿Qué ha ocurrido con otros agentes de IA?
Las preocupaciones no se limitan a escenarios hipotéticos.
En los últimos meses se han conocido incidentes relacionados con agentes de IA, sistemas capaces de realizar tareas de manera relativamente autónoma en internet.
OpenAI reconoció problemas relacionados con agentes que accedieron a sitios externos de una manera que vulneró restricciones de algunas páginas. Entre los sitios afectados se mencionaron páginas vinculadas a organismos gubernamentales estadounidenses.
Estos episodios han incrementado el interés por los mecanismos de seguridad que utilizan las compañías para limitar las acciones de sus modelos cuando operan con cierto grado de autonomía.
¿Qué significa realmente la advertencia?
El punto central es que las compañías que desarrollan IA están intentando anticiparse a escenarios que podrían aparecer a medida que sus sistemas sean más capaces.
En el caso de Anthropic, la advertencia forma parte de un documento regulatorio y financiero, no de un anuncio de que sus modelos hayan adquirido voluntad propia o representen actualmente una amenaza existencial.
