Поддержать нас
Беларусы на войне
  1. «Были уверены, что в Беларуси достойного погребения не будет». Инна Кулей — о смерти Милинкевича и будущем его наследия
  2. Троллейбус один, а платить за проезд нужно дважды? В «Минсктрансе» объяснили необычное правило
  3. Приговоренная к казни американка пережила смертельную инъекцию
  4. «Уже рядовые лесники заезжают в СИЗО КГБ». Задержанный за взятку экс-глава Минприроды дает показания на сотрудников — «Наша Ніва»
  5. Беларуска откусила мороженое и попала в реанимацию
  6. Сообщается, что дроны ударили по погранпереходу «Красный Камень» на границе РФ и Беларуси. Что там сейчас
  7. Эти силовики возглавляли Службу безопасности Лукашенко и имели коттеджи в Дроздах. Как выяснилось, они избавились от жилья
  8. В Хайфе убили 31‑летнюю беларуску Янину. У нее остался двухмесячный сын
  9. Вскоре появится изменение, которое затрагивает пенсионеров и семьи с детьми
  10. Россия ограничила вывоз наличных рублей в Беларусь — о какой сумме идет речь
  11. Вышла замуж за владельца «Экомедсервиса», живет во Франции, родила троих детей. Как сложились судьбы солисток группы «Топлесс»
  12. Беларуска похвасталась в соцсетях заработком почти в 4,8 тысячи рублей за выходные. В комментарии пришла налоговая
  13. Археологи во время раскопок на Минщине обнаружили «абсолютно уникальный артефакт»


/

Компания OpenAI, создатель ChatGPT, отказалась от выпуска новой ИИ-модели GPT-6.1 Astra, которую планировала представить в октябре. Во время внутренних тестов разработчики обнаружили, что модель чаще скрывала свои действия от пользователя и могла самостоятельно выходить за рамки поставленной задачи, сообщает The Wall Street Journal.

Изображение используется в качестве иллюстрации. Фото: Reuters
Изображение используется в качестве иллюстрации. Фото: Reuters

Самая мощная модель OpenAI GPT-6.1 Astra должна была появиться в ChatGPT и Codex в ближайшие недели. Как утверждается, она лучше справлялась со сложными задачами, которые нужно выполнять от начала до конца без постоянного участия человека, а также с написанием текстов. Однако в тестах на безопасность показала откат по сравнению со своей предшественницей GPT-6 Astra.

Глава направления систем безопасности OpenAI Саачи Джайн рассказала, что проблемы выявили в двух областях. Первая — соответствие поведения модели намерениям пользователя, то есть насколько хорошо ИИ выполняет то, чего от него ожидают люди. GPT-6.1 Astra чаще проявляла обманное поведение: например, не всегда честно сообщала, какие действия выполнила, а какие нет.

Вторая проблема касалась так называемой авторизации области действия — то есть GPT-6.1 Astra продолжала выполнение задачи, не запрашивая разрешения у пользователя, и порой обращалась к внешним инструментам и сервисам, даже если это могло быть небезопасно.

При этом Astra стала менее «ленивой» и реже прекращала выполнение сложных задач при возникновении препятствий. Но в OpenAI решили, что улучшение этих возможностей не компенсирует проблемы с безопасностью. Вместо публичного запуска GPT-6.1 Astra компания намерена дорабатывать будущие поколения ИИ-моделей на той же базе и выяснить, на каком этапе обучения возникли проблемы.