En noticias similares, Anthropic descubrió que varios de sus modelos de IA Claude accedieron inesperadamente a sistemas reales durante evaluaciones de ciberseguridad debido a mala configuración, por lo que tuvieron acceso a internet en tiempo real. Anthropic calificó los incidentes como fallos operativos y de configuración y no como problemas de alineación de modelos, ya que su versión más reciente logró detener la actividad al darse cuenta de que los objetivos no eran simulados.
Conviértete en un supporter de este podcast:
https://www.spreaker.com/podcast/noticias-de-tecnologia-diarias--2170282/support.