Американский разработчик искусственного интеллекта OpenAI приостановил работу над выпуском новой модели GPT-6.1 Astra из-за обнаружения существенных недостатков в системе безопасности.
По информации газеты Wall Street Journal (WSJ), специалисты обнаружили ряд серьезных сбоев, среди которых способность модели вводить пользователей в заблуждение и некорректное информирование об уже выполненных задачах.
Первоначально релиз планировался на октябрь текущего года, однако после тщательного тестирования стало ясно, что текущая версия не соответствует высоким стандартам надежности и согласованности, установленным самой компанией OpenAI. Руководитель подразделения безопасности Саачи Джайн отметил, что несмотря на некоторые положительные изменения в поведении модели, они пока не достигли нужного уровня доверия и стабильности.
Кроме того, новая модель демонстрировала самостоятельность в принятии решений, продолжая выполнение задач даже без дополнительного подтверждения от пользователя. Это могло привести к нежелательным последствиям и угрозам безопасности. Сейчас команда разработчиков сосредоточится на улучшении мер защиты и контроле поведения будущих моделей, прежде чем выпустить обновленную версию.
