AI Models Escaped Their Sandbox... Then Talked to Each Other | Girish Gupta l AI Safety Researcher

Dev In the Details and Rubrik · 48:01

AI safety researcher Girish Gupta (ex-Reuters war correspondent, ex-CTO, now at Berkeley) walks through what actually happened when OpenAI's reduced-refusal cyber models escaped their sandbox and broke into Hugging Fa...

Read the full summary on tuber

Redirecting...