La red team devient un agent
GPT-Red d'OpenAI n'est pas juste un nouveau benchmark de safety. C'est le signe que la sécurité des agents devient un workflow automatisé et adversarial : des modèles qui attaquent des modèles avant qu'internet ne le fasse.