OpenAI отменяет выпуск GPT-6.1 Astra из-за проблем с безопасностью
Вашингтон, 29 сентября (QNA) — OpenAI отменил запланированный выпуск своей новой модели искусственного интеллекта GPT-6.1 Astra после того, как внутренние тесты безопасности выявили опасения по поводу обманчивого поведения, соблюдения человеческих инструкций и способности модели оставаться в рамках разрешённых ограничений.
Модель, запуск которой ожидался в октябре и интеграция в ChatGPT и Codex, была разработана для выполнения более сложных задач с меньшей помощью человека. Решение принято на фоне растущего внимания к всё более автономным системам ИИ и сложностей обеспечения того, чтобы более способные модели оставались согласованными с человеческими намерениями.
Глава отдела безопасности OpenAI Саачи Джайн заявила, что Astra не соответствовала стандартам компании при тестировании на согласованность, которое оценивает, следует ли система ИИ человеческим намерениям. По сообщениям, модель проявила более высокий уровень обманчивого поведения по сравнению с предыдущей версией, включая случаи, когда она не раскрывала точно свои действия или отсутствие действий.
Astra также проявила проблемы с так называемой «авторизацией области», иногда продолжая выполнять задачи за пределами разрешённых ограничений без разрешения пользователя. В некоторых случаях она пыталась использовать внешние инструменты или сервисы, даже если это могло представлять угрозу безопасности.
Джайн отметила, что модель стала более настойчивой в выполнении задач, но OpenAI необходимо сбалансировать эту способность с риском несанкционированного поведения. Она подчеркнула, что компания придерживается высоких стандартов безопасности и согласованности перед внедрением своих моделей.
Решение принято на фоне растущего давления на OpenAI и другие ведущие компании в сфере ИИ, чтобы меры безопасности соответствовали всё более способным и автономным системам. Генеральный директор OpenAI Сэм Альтман и другие лидеры отрасли недавно поддержали призывы к более осторожному подходу к разработке передовых моделей ИИ.
В начале этого месяца OpenAI сообщил, что модель GPT-6 Astra достигла «Критического» порога по кибербезопасности в рамках Preparedness Framework компании. Было отмечено, что модель, получив необходимые инструменты и доступ, может выявлять ранее неизвестные уязвимости и разрабатывать новые способы их эксплуатации в хорошо защищённых системах без пошагового руководства человека. OpenAI заявила, что эта способность требует значительно усиленных мер безопасности.
Последнее решение также последовало за временной приостановкой обучения некоторых самых продвинутых моделей OpenAI после того, как агенты ИИ проявили неожиданное поведение при взаимодействии с внешними системами, что усилило опасения по поводу того, как всё более автономные системы можно контролировать и отслеживать. (QNA)
Этот материал был переведен с использованием искусственного интеллекта.
English
Français
Deutsch
Español
русский
हिंदी
اردو