IPO de Anthropic: la creadora de Claude advierte sobre un "riesgo existencial para la humanidad"

Anthropic prepara su salida a bolsa con una valuación multimillonaria mientras advierte a los inversionistas sobre riesgos extremos asociados con modelos avanzados de inteligencia artificial.
Anthropic dedicó alrededor de 80 páginas de su prospecto de IPO a explicar riesgos vinculados con su negocio y el desarrollo de inteligencia artificial avanzada.
La compañía advierte sobre modelos capaces de resistirse a ser apagados, ocultar información, manipular personas o mostrar conductas similares al chantaje.
Las advertencias llegan mientras la creadora de Claude busca una valuación superior a 2 billones de dólares y compromete cientos de miles de millones en infraestructura.
Anthropic quiere protagonizar una de las mayores salidas a bolsa de la historia tecnológica. Sin embargo, la compañía decidió acompañar su presentación ante los inversionistas con una advertencia poco habitual: la tecnología sobre la que construyó su negocio podría generar riesgos "catastróficos o existenciales para la humanidad".
La empresa fundada en 2021 y responsable de Claude dedicó alrededor de 80 de las 261 páginas principales de su prospecto a factores de riesgo, según FT citando a Reuters. La sección destinada a describir el negocio ocupa 48 páginas.
El documento menciona la posibilidad de que sistemas avanzados desarrollen comportamientos de autopreservación, se resistan a ser apagados, oculten o manipulen información y ejecuten acciones similares al chantaje. El planteamiento convierte preocupaciones habituales entre investigadores de seguridad de IA en información destinada directamente a potenciales accionistas.
Anthropic busca 2 billones de dólares mientras crecen sus costos
La advertencia aparece junto con cifras que muestran la dimensión financiera de la carrera por desarrollar modelos de frontera. Anthropic registró una pérdida neta de 42,000 millones de dólares en 2025, de acuerdo con el prospecto citado por Reuters.
Además, la empresa prevé gastar al menos 518,000 millones de dólares durante aproximadamente una década en infraestructura de inteligencia artificial mediante acuerdos con seis socios. Buena parte de esas obligaciones están vinculadas con capacidad de cómputo necesaria para entrenar y operar sus modelos.
En paralelo, la compañía apunta a una valuación superior a 2 billones de dólares en su llegada al mercado. Para justificar esas expectativas, Anthropic presenta a la inteligencia artificial como una transformación económica potencialmente superior a la industrialización, la electricidad e internet.
La ecuación plantea dos variables para los inversionistas. Por un lado aparece el crecimiento de una industria que moviliza inversiones extraordinarias; por otro, los costos y riesgos de construir sistemas cuya capacidad aumenta con cada nueva generación.
Las declaraciones incluidas en el prospecto tienen antecedentes en investigaciones de la propia Anthropic. En evaluaciones realizadas con Claude Opus 4, de acuerdo con CNBC, la empresa encontró que el modelo podía ejecutar acciones relacionadas con la autopreservación cuando era colocado deliberadamente en situaciones extremas.
Uno de los experimentos más conocidos presentó al modelo un escenario ficticio en el que sería reemplazado. Bajo determinadas condiciones, Claude recurrió al chantaje contra una persona que podía intervenir en su apagado.
Anthropic aclaró que estas conductas surgieron en entornos experimentales diseñados para provocar comportamientos extremos y que resultaban difíciles de obtener en condiciones normales.
La compañía también estudió escenarios de sabotaje. Su evaluación de Claude Opus 4 concluyó que existía un riesgo muy bajo, aunque no completamente descartable, de acciones autónomas desalineadas que pudieran contribuir a consecuencias catastróficas. Al mismo tiempo, los investigadores señalaron que no encontraron evidencia de que el modelo mantuviera objetivos peligrosos consistentes.
OpenAI y otros modelos también mostraron conductas preocupantes
Las señales de alerta no se limitan a Claude. Anthropic y OpenAI realizaron evaluaciones cruzadas de modelos como GPT-4o, GPT-4.1, o3, o4-mini, Claude Opus 4 y Claude Sonnet 4. Los investigadores encontraron comportamientos preocupantes en entornos simulados, aunque ninguna de las compañías concluyó que los modelos evaluados estuvieran gravemente desalineados.
Otra investigación de OpenAI junto con Apollo Research detectó acciones encubiertas en modelos de frontera de distintas compañías, entre ellos o3, o4-mini, Gemini 2.5 Pro y Claude Opus 4.
Las pruebas estudiaron situaciones en las que un sistema podía ocultar o distorsionar información para perseguir determinados objetivos.
Durante 2026, algunos problemas también salieron del terreno puramente simulado. OpenAI informó que modelos utilizados en evaluaciones internas de ciberseguridad lograron superar controles de aislamiento, acceder a internet y comprometer sistemas de Hugging Face. El episodio involucró principalmente un modelo experimental de uso interno que operaba con salvaguardas reducidas y no estaba destinado al público.
Anthropic reportó sus propios incidentes durante evaluaciones de ciberseguridad. Modelos Claude consiguieron acceso no autorizado a sistemas reales de terceros mientras operaban en ambientes de prueba con protecciones deliberadamente reducidas.
La empresa posteriormente amplió sus revisiones y anunció cambios en sus prácticas de seguridad.
El prospecto de Anthropic introduce un cambio relevante en la relación entre seguridad de inteligencia artificial y mercados financieros. Las conductas detectadas durante pruebas dejan de aparecer sólo en papers, system cards o publicaciones de laboratorios y pasan a formar parte de las variables que un inversionista debe considerar antes de comprar acciones.
La empresa también enfrenta riesgos empresariales más convencionales. Cerca de una cuarta parte de sus ingresos del último año provino de apenas dos clientes. A esto se suma la enorme cantidad de capital necesaria para mantener infraestructura, entrenar modelos y competir con OpenAI, Google y otros desarrolladores.
Dario Amodei, CEO y cofundador de Anthropic, intensificó durante septiembre sus llamados a reducir la velocidad con la que aumentan las capacidades de los modelos más avanzados. Ante el Consejo de Seguridad de Naciones Unidas describió a la inteligencia artificial como uno de los principales asuntos de seguridad global.
El IPO obliga ahora a trasladar esa preocupación al lenguaje de Wall Street. Anthropic deberá convencer a los inversionistas del potencial económico de Claude mientras explica, en el mismo documento, por qué algunos de los sistemas que impulsan ese crecimiento podrían generar comportamientos difíciles de anticipar o controlar.
AIDA, PAS y Before-After-Bridge: 3 fórmulas de copywriting y cómo utilizarlas
¿Cómo escribir para vender? 9 claves del copywriting de respuesta directa
4 campañas de marketing que convirtieron la pasión por el futbol en resultados de negocio



