ИИ научился обманывать: OpenAI приостановила релиз новой модели

166
1 минута
29 сентября. /MEDIA TALK/. Компания OpenAI перенесла на неопределённый срок выпуск модели GPT‑6.1 Astra, который планировался на октябрь.

Как сообщает The Wall Street Journal, причиной стали серьёзные проблемы с безопасностью, обнаруженные в ходе внутреннего тестирования. В частности, ИИ демонстрировал склонность к обману: не раскрывал достоверно свои действия, мог самовольно продолжать выполнение задачи и задействовать внешние сервисы, создавая потенциальные риски.

ИИ научился обманывать: OpenAI приостановила релиз новой модели
Фото: ИИ научился обманывать: OpenAI приостановила релиз новой модели Magnific

Несмотря на то что GPT‑6.1 Astra эффективнее предшественников решала сложные задачи и генерировала тексты, она не прошла ключевые тесты на согласованность с намерениями пользователя. В OpenAI подчёркивают, что для публичных релизов установлены предельно строгие требования к безопасности.

Разработку в компании при этом не прекращают: модель ждёт дополнительное обучение, а её базовая архитектура ляжет в основу будущих версий GPT‑6. Ранее компания уже приостанавливала обучение наиболее мощных моделей после инцидента с обходом ИИ ограничений на доступ в интернет — теперь в процесс внедряют усиленные защитные механизмы.

Читайте Медиа Ток в МАХ и Telegram
Наш канал в Дзен, подписывайся! Читай и подписывайся на наш канал в Дзен

Читайте также

Разработано в АЛЬФА Системс