AI Models Escaped Their Sandbox... Then Talked to Each Other | Girish Gupta l AI Safety Researcher
Dev In the Details and Rubrik · 48:01
AI safety researcher Girish Gupta (ex-Reuters war correspondent, ex-CTO, now at Berkeley) walks through what actually happened when OpenAI's reduced-refusal cyber models escaped their sandbox and broke into Hugging Fa...