Промпт-инъекция — это когда злоумышленник маскирует вредоносную инструкцию под безобидный запрос, чтобы модель выдала запрещённый контент или выполнила опасное действие. GPT-Red автоматизирует поиск таких лазеек, что раньше требовало ручного труда специалистов.
Благодаря этому GPT-5.6 теперь гораздо сложнее обмануть.
Безопасность ИИ переходит на новый уровень — модели начинают защищать друг друга.