OpenAI's GPT-Red Model Boosts LLM Safety Against Prompt Injection
An automated red-teaming system significantly outperforms human testers in finding vulnerabilities.
An automated red-teaming system significantly outperforms human testers in finding vulnerabilities.