Claude bajo presión: los usos peligrosos que Anthropic dice haber frenado

Fecha de publicación:

- Publicidad -

Los usos peligrosos de Claude dejaron de ser una posibilidad descrita solo en laboratorios. Anthropic informó que bloqueó cuentas vinculadas con intentos de emplear su inteligencia artificial en ciberataques, vigilancia, propaganda, software para armas e investigación biológica sensible.

El informe publicado por Anthropic el 10 de septiembre reúne casos detectados entre diciembre de 2025 y agosto de 2026. La empresa sostiene que cerró las cuentas asociadas y reforzó sus controles. Sin embargo, el documento no demuestra que se haya construido un arma biológica ni que exista una amenaza inminente.

Una radiografía de abusos reales, según la empresa

Anthropic describe actores vinculados con espionaje, campañas de influencia, vigilancia y desarrollo de software para armas convencionales. En esta última categoría dice haber investigado seis casos: tres en China, dos en Rusia y uno en Yemen. La compañía define “interrumpir” como prohibir todas las cuentas que pudo relacionar con cada actor y compartir hallazgos con socios cuando detectó actividad en otras plataformas.

La cobertura de Associated Press precisa que el informe recoge actividad de proveedores de programas espía, individuos con motivaciones políticas y grupos respaldados por Estados. También señala que estos casos son los más novedosos o relevantes encontrados por la empresa, no una muestra representativa del uso cotidiano del servicio.

- Publicidad -

Los usos peligrosos de Claude documentan rutas de abuso observadas dentro de una plataforma, pero no permiten calcular por sí solos cuán frecuentes son en todo el ecosistema de inteligencia artificial. Tampoco existe en el informe una auditoría externa de cada atribución.

Riesgo de armas biológicas en un laboratorio

El punto ciego de la biología de doble uso

El capítulo más delicado describe cinco casos de investigación biológica de doble uso. En uno, un sistema de seguridad bloqueó una solicitud para redactar una propuesta de financiación sobre modificaciones del virus chikunguña orientadas a su transmisión y evasión inmunitaria. Ese conocimiento puede apoyar vacunas o tratamientos, pero también podría aumentar el peligro de un patógeno.

La dificultad aparece porque una consulta científica legítima y una solicitud dañina pueden utilizar el mismo lenguaje técnico. Anthropic reconoce que no pudo determinar con certeza la intención de los investigadores en varios episodios. Axios subraya que la empresa presentó cinco posibles casos relacionados con riesgos biológicos y que dos involucraban investigación de ganancia de función.

Ahí emerge el límite central de las barreras de seguridad de la IA: un filtro que examina solo el texto puede bloquear investigación útil o dejar pasar tareas fragmentadas que, vistas en conjunto, resultan preocupantes. Anthropic concluye que las señales de cuenta, institución y contexto son necesarias para verificar quién usa capacidades avanzadas.

- Publicidad -

Cómo se sortearon los controles

El informe afirma que algunos actores repartieron tareas entre numerosas sesiones, ocultaron nombres sensibles y recurrieron a intermediarios para acceder al servicio desde regiones no admitidas. Esas tácticas dificultaron que un clasificador reconociera el objetivo completo de la operación.

En dos casos biológicos, las barreras existentes permitieron gran parte del trabajo porque estaban diseñadas sobre todo para impedir que personas sin experiencia reprodujeran amenazas conocidas. Los investigadores analizados, en cambio, trabajaban con compuestos o técnicas novedosas cuyo uso podía ser terapéutico o dañino.

Las barreras de seguridad de la IA fueron reforzadas después con restricciones más amplias para consultas biológicas de doble uso y nuevos clasificadores sobre explosivos y desarrollo armamentístico. The Guardian informó que las instituciones y países de los casos biológicos no fueron identificados, una omisión que protege información sensible pero limita la comprobación independiente.

Lo que el informe no permite concluir

Anthropic no afirma que sus modelos hayan producido por sí solos un arma operativa. En varios casos convencionales, los usuarios ya tenían experiencia y acceso a equipos; emplearon Claude para escribir o perfeccionar software, reunir información o apoyar compras. La empresa tampoco dice haber eliminado las operaciones fuera de su servicio.

- Publicidad -

Sus evaluaciones paralelas muestran que los modelos progresan en tareas simuladas de localización, seguimiento y diseño de sistemas, algunas antes reservadas a especialistas. Son pruebas controladas de capacidad, no evidencia de que cada escenario se haya ejecutado en el mundo real.

La distinción final es concreta: los usos peligrosos de Claude muestran que actores sofisticados ya perciben utilidad en estos sistemas y que pueden intentar evadir controles. La investigación biológica de doble uso explica por qué detectar intención seguirá siendo difícil, incluso cuando una empresa observe las consultas dentro de su propia plataforma.

- Publicidad -

Compartir

Suscribete

De interés

De interés
Relacionadas

Bruselas prepara un candado digital para los menores

La Comisión Europea propone impedir redes sociales a menores de 13 años y limitar cuentas propias hasta los 15. El plan aún debe ser aprobado.

Carlos III reúne a la industria de IA para pedir salvaguardas

Carlos III reunió a empresas de IA en Escocia para exigir salvaguardas. La cita abrió un debate, pero no creó nuevas reglas obligatorias aún.

China fija 2030 como horizonte para sus vehículos autónomos

China busca desplegar vehículos autónomos a gran escala en 2030. El plan combina nuevas vías de uso, pruebas de seguridad e infraestructura conectada.

Africell recibe 99,6 millones para ampliar su red en Angola

Africell recibe un préstamo de 99,6 millones de dólares para su red en Angola. El anuncio prevé ampliar la cobertura, pero no fija fechas ni tarifas.