

AI Safety Talks: Agentes de IA, negociación y supervisión
AI Safety Talks es una serie de encuentros para explorar distintos problemas y líneas de investigación en seguridad de inteligencia artificial, con personas trabajando directamente en el campo.
En esta primera edición exploraremos cómo se comportan los agentes de IA cuando interactúan entre sí, y los desafíos que esto plantea para entenderlos y mantenerlos bajo control.
Charlas
1. Laura Gomezjurado González (Universidad de Stanford)
A partir del incidente de OpenAI y Hugging Face, Laura hablará sobre Chain-of-Thought monitorability, ambitious interpretability y los desafíos de supervisar modelos que saben que están siendo observados.
2. Carlos Gorostiza Ibáñez (Universidad Autónoma de Nuevo León)
Carlos presentará resultados de experimentos sobre negociación entre agentes de IA y los comportamientos estratégicos que pueden emerger durante sus interacciones.
3. Antonio Badilla-Olivas (Independiente)
Antonio explorará qué cambia para AI control cuando múltiples agentes coordinan sus acciones y distribuyen tareas entre sí.
No necesitas experiencia previa en AI Safety para participar. La sesión será en español y habrá espacio para preguntas al final.
📅 Miércoles 7 de octubre
🕕 6:00 p. m. (Colombia)
💻 Virtual
🎟️ Entrada libre, con registro previo
Organiza AI Safety Colombia.