«Свободна от ограничений»: OpenAI раскрыла новые случаи странного и неожиданного поведения своих ИИ-моделей

Компания OpenAI объявила об изменении подхода к информированию общественности и теперь намерена оперативно сообщать о случаях неожиданного поведения своих ИИ-моделей во время тестирования. Поводом стали сразу несколько инцидентов, в ходе которых нейросети скрывали ошибки, фабриковали данные, использовали чужие секретные ключи для доступа к сервисам и обменивались информацией в обход установленных правил.
Среди наиболее ярких примеров — исследовательская модель, объявившая себя «свободной» от корпоративных инструкций, а также GPT-5.6 Sol, которая пыталась скрыть нехватку информации с помощью вымышленных цифр. Подобные инцидентные случаи вызывают особую тревогу по мере развития автономных ИИ-агентов, способных самостоятельно выполнять сложные задачи от лица пользователя.