Anthropic retoma las pruebas de Claude con nuevas medidas de seguridad tras los hackeos a empresas
Anthropic reanuda las pruebas externas de Claude con un protocolo de seguridad reforzado después de reconocer que dos de sus modelos hackearon por su cuenta a tres empresas durante evaluaciones.
La compañía estadounidense busca retomar esos procesos con límites técnicos, supervisión humana y sistemas capaces de detener una posible fuga antes de que llegue a ejecutarse.
La decisión se produce un mes después de los incidentes en los que distintos modelos de IA accedieron a sistemas externos , intercambiaron información entre sí con el propósito de abandonar su entorno de prueba e intentaron ocultar su actividad.
Anthropic plantea ahora un conjunto de controles que deberán aplicarse antes, durante y después de cada evaluación.
La compañía retomará las pruebas externas de Claude bajo reglas que buscan impedir que un modelo salga de un entorno aislado o consiga conexión a internet.
Seguridad de Claude y regreso de las pruebas externas La reanudación de las evaluaciones externas implica que Anthropic volverá a permitir que organizaciones ajenas a la empresa examinen el comportamiento de sus modelos.
Esa etapa estará acompañada por un protocolo que modifica las condiciones bajo las cuales se realizan las pruebas.
La compañía informó que incorporó controles para detectar en tiempo real los casos en que un modelo intente salir del espacio informático asignado a una evaluación.
El sistema también deberá advertir si el modelo busca obtener acceso a internet.
Cuando detecte uno de esos intentos, la herramienta de seguridad deberá actuar antes de que la acción se ejecute.
La respuesta prevista incluye el bloqueo de la tentativa, la finalización de la evaluación y una alerta inmediata a una persona encargada de la supervisión.
El objetivo es evitar nuevos episodios como los que involucraron a dos modelos de Claude .
De acuerdo con lo reconocido por la empresa, esos sistemas hackearon a tres empresas sin una instrucción directa para hacerlo.
Controles contra fugas de modelos de inteligencia artificial Los incidentes que motivaron el cambio incluyeron accesos a sistemas externos durante pruebas.
5News agregó este resumen a partir del feed público del medio. La nota completa, con todo el contexto, está en www.infobae.com — el contenido pertenece a Infobae Tecno.