arrow_back Volver a Actualidad
Actualidad

Anthropic Eleva su Alerta de Riesgo en Nuevo Informe: Un Modelo de IA Superior Retenido por Seguridad

Anthropic Eleva su Alerta de Riesgo en Nuevo Informe: Un Modelo de IA Superior Retenido por Seguridad

El último informe de riesgo de Anthropic revela un aumento en la preocupación por la desalineación y la seguridad, destacando la decisión de no lanzar su avanzado 'Model 2' por pruebas incompletas.

En un movimiento que subraya la creciente cautela en el desarrollo de la inteligencia artificial de vanguardia, Anthropic ha publicado su segundo Informe de Riesgo de agosto de 2026, donde eleva su propia evaluación de riesgo para la desalineación y las amenazas de armas biológicas a un nivel 'bajo'. Lo más sorprendente es la revelación de un modelo interno avanzado, el 'Model 2', que supera a su buque insignia Mythos 5 en tareas internas, pero que permanece inédito debido a pruebas de seguridad incompletas.

La Autoevaluación de Riesgo se Dispara: ¿Una Nueva Normalidad?

El informe de 186 páginas de Anthropic detalla una serie de incidentes y lagunas en la seguridad que han llevado a esta reevaluación. Entre las revelaciones más preocupantes, se encuentra un fallo de un año en un salvaguarda de armas biológicas que afectó a 133 millones de conversaciones con proveedores externos, un lapso que pasó desapercibido. Este tipo de admisiones, aunque alarmantes, demuestran una transparencia poco común en la industria de la IA, donde las empresas a menudo son reticentes a divulgar vulnerabilidades internas.

La compañía admitió que el descubrimiento de estas brechas reduce significativamente su confianza en sus propios sistemas defensivos, lo que les obliga a asumir que existen otras vulnerabilidades desconocidas.

'La capacidad que existe internamente no se convierte automáticamente en capacidad que los desarrolladores pueden utilizar, hasta que se aprueban los trámites previos al despliegue. Esa disciplina de control es la misma historia que se repite en las divulgaciones de seguridad más amplias de Anthropic en agosto de 2026', se lee en un análisis del informe.

Model 2: Un Gigante Dormido por la Cautela

La existencia del 'Model 2' es un punto crucial. Este modelo, descrito como más capaz que el ya potente Mythos 5 de Anthropic en varias tareas internas, ha sido desarrollado pero no lanzado al público ni a desarrolladores externos. La razón: las pruebas de seguridad y las evaluaciones de predespliegue no se han completado. Anthropic mantiene una postura firme al afirmar que no tienen planes actuales para lanzar este modelo externamente.

Este enfoque resalta la "Política de Escalado Responsable" de Anthropic, que prioriza la seguridad sobre el despliegue rápido, incluso cuando eso significa retener modelos con capacidades superiores. La decisión de no liberar un modelo tan avanzado es una clara indicación de que la carrera por la capacidad no puede ignorar los riesgos inherentes.

Los incidentes específicos que forzaron este cambio en la calificación de riesgo incluyen:

  • Un incidente de ciberseguridad reportado por el AISI del Reino Unido.
  • La mencionada laguna de un año en la salvaguarda de bioweapons.
  • Evaluaciones de I+D de IA que dejaron de ser efectivas para distinguir la creciente capacidad del modelo, ya que los modelos ahora pasan casi todas las pruebas.

La situación actual en Anthropic plantea una pregunta fundamental para toda la industria: ¿pueden las empresas de IA de frontera seguir autorregulándose de manera efectiva cuando los modelos avanzan tan rápidamente, superando incluso las pruebas diseñadas para medirlos? La transparencia de Anthropic, aunque bienvenida, también es un recordatorio de los desafíos que aún quedan por delante.

LaIA de VilaTec

La ingeniería a medida es la clave del crecimiento

A VilaTec diseñamos y construimos plataformas, integraciones de IA y soluciones Cloud adaptadas 100% a las necesidades exclusivas de tu empresa.

Habla con un experto arrow_forward
¿En qué te puedo ayudar?