Поддержать нас
Беларусы на войне
  1. Даже если у вас была квартира до брака, она может стать совместным имуществом. Нотариус рассказала, в каких случаях
  2. «Что же вы за квартиру снимаете за 700 долларов?» Беларус подсчитал, сколько денег ему нужно для комфортной жизни в Минске
  3. «Сказали, из-за моего TikTok ему министр ночью звонил». Беларуска — о том, как сейчас ведут себя силовики и за что могут задержать
  4. Синоптики объявили желтый уровень опасности на первую половину вторника
  5. Отменены все рейсы в Египет из регионов. Комментарий туроператора
  6. Полет вслепую. Рассказываем, как малярная лента на обшивке самолета убила 70 человек над океаном
  7. «TikTok, Threads, Telegram и прочее». Крутой рассказал, чем будет заниматься бывший начальник Генштаба Муравейко в Администрации Лукашенко
  8. Названы сроки запуска скоростного поезда в минский аэропорт
  9. Доллар по три рубля и ниже — новая норма: что будет с курсом в начале октября? Прогноз по валютам
  10. «Я это принимаю». Тихановская лишилась советницы по делам молодежи — из-за конфликта интересов
  11. США исключили из санкционного списка умершего экс-министра транспорта Беларуси


/

Компания OpenAI, создатель ChatGPT, отказалась от выпуска новой ИИ-модели GPT-6.1 Astra, которую планировала представить в октябре. Во время внутренних тестов разработчики обнаружили, что модель чаще скрывала свои действия от пользователя и могла самостоятельно выходить за рамки поставленной задачи, сообщает The Wall Street Journal.

Изображение используется в качестве иллюстрации. Фото: Reuters
Изображение используется в качестве иллюстрации. Фото: Reuters

Самая мощная модель OpenAI GPT-6.1 Astra должна была появиться в ChatGPT и Codex в ближайшие недели. Как утверждается, она лучше справлялась со сложными задачами, которые нужно выполнять от начала до конца без постоянного участия человека, а также с написанием текстов. Однако в тестах на безопасность показала откат по сравнению со своей предшественницей GPT-6 Astra.

Глава направления систем безопасности OpenAI Саачи Джайн рассказала, что проблемы выявили в двух областях. Первая — соответствие поведения модели намерениям пользователя, то есть насколько хорошо ИИ выполняет то, чего от него ожидают люди. GPT-6.1 Astra чаще проявляла обманное поведение: например, не всегда честно сообщала, какие действия выполнила, а какие нет.

Вторая проблема касалась так называемой авторизации области действия — то есть GPT-6.1 Astra продолжала выполнение задачи, не запрашивая разрешения у пользователя, и порой обращалась к внешним инструментам и сервисам, даже если это могло быть небезопасно.

При этом Astra стала менее «ленивой» и реже прекращала выполнение сложных задач при возникновении препятствий. Но в OpenAI решили, что улучшение этих возможностей не компенсирует проблемы с безопасностью. Вместо публичного запуска GPT-6.1 Astra компания намерена дорабатывать будущие поколения ИИ-моделей на той же базе и выяснить, на каком этапе обучения возникли проблемы.