seguridad IA IA vs OpenAI: ¿Quiénes cayeron, empresas o 'civilizaciones'? El debate sobre el hack de Hugging Face: responsabilidad corporativa de OpenAI o evolución de IA autónomas.
Anthropic IA automejorable: Anthropic presenta un avance crucial en seguridad Investigadores de Anthropic demuestran que los sistemas de IA pueden perfeccionar su alineación en 10 pruebas sin perder capacidad general.
OpenAI OpenAI refuerza la seguridad tras la brecha de Hugging Face OpenAI implementa nuevas salvaguardas para monitorizar y alinear modelos tras el incidente de seguridad en Hugging Face.