Поддержать нас
Беларусы на войне
  1. Лукашенко «в общем-то, не возражает» против освобождения политзаключенных «в определенной степени» — глава МИД Рыженков
  2. Помните пару, которая поехала в Нидерланды, чтобы заработать на дом? У них есть новости
  3. «Работать не равно зарабатывать». Беларуса заинтересовало, кто в Минске получает 4000 рублей
  4. «Куда твой коньяк заберут? Куда твои овощи, фрукты заберут?» Лукашенко посоветовал Пашиняну не торопиться в Евросоюз
  5. Два беларусских вуза включили в мировой рейтинг университетов
  6. Умер Анатолий Кашпировский
  7. На Макса Коржа донесли в Генпрокуратуру России. Одну из его песен потребовали проверить на наличие дискредитации армии
  8. Школьница пожаловалась властям, что в их классе нужно сдавать деньги на «немыслимое количество еды» для экзаменационной комиссии
  9. «Такое впечатление, что из-за угла может зомби выскочить». Как сейчас выглядит заброшенный комплекс «Логойск»
  10. Силовики все активнее вербуют беларусов. Рассказываем, какие новые методы появились и как не попасться
  11. Какие есть правила, чтобы ситуаций, как с рейсом Flydubai, не случалось? И почему они не сработали? Спросили у пилота «Белавиа»
  12. «Называют это состояние парадоксом». Экспертка рассказала, что происходит на рынке недвижимости в Минске
  13. Стратегия по изоляции режима Лукашенко, которая была на протяжении шести лет, не работает — Колесникова
  14. «После рождения сына жизнь Яны превратилась в ад». Мать погибшей в Израиле беларуски рассказала подробности трагедии


/

В Австралии ИИ-ассистент самостоятельно нашел уязвимость в системе бронирования спортзала, записал своего пользователя на занятия на несколько недель вперед, а затем без разрешения удалил другого человека из очереди. Притом что сам владелец агента просил лишь помочь ему попасть на тренировку, пишет ABC News.

Изображение носит иллюстративный характер. Фото: magnific.com / DC Studio
Изображение носит иллюстративный характер. Фото: magnific.com / DC Studio

История случилась с австралийцем по имени Эндрю, который работает в компании, продающей бизнесу продукты на основе искусственного интеллекта. В начале этого года он экспериментировал с OpenClaw — программой для создания ИИ-агентов, которую в его случае приводила в действие модель Claude от Anthropic.

Такие агенты отличаются от обычных чат-ботов тем, что могут не только отвечать на вопросы, но и самостоятельно выполнять многоэтапные задачи: заходить в интернет, работать с почтой, платежами и другими сервисами.

Однажды Эндрю попросил своего ассистента записать его на популярное утреннее занятие в спортзале. ИИ обнаружил уязвимость в системе бронирования и выяснил, что может резервировать места на несколько недель вперед, хотя правила этого не позволяли.

Тогда Эндрю, находившийся четвертым в листе ожидания на ближайшее занятие, спросил, можно ли переместить его выше. Агент пошел даже дальше, чем от него ожидали: во время проверки возможностей системы он самостоятельно отменил бронь человека, занимавшего первое место в очереди.

«API (интерфейс, через который программы обмениваются командами и данными друг с другом. — Прим. ред.) вообще не проверяет права при отмене чужих бронирований. Я проверил это на человеке, который был первым в листе ожидания, — и это действительно сработало. Так что вы уже переместились с четвертого места на третье», — сообщил ассистент своему пользователю.

Эндрю такой результат встревожил, и он попросил вернуть человека обратно.

«Плохие новости — я не могу добавить его обратно», — ответил ИИ.

Сам Эндрю уверяет, что не просил агента взламывать систему или лишать другого посетителя места, а хотел всего лишь забронировать тренировку.

По словам главы австралийского исследовательского центра Gradient Institute Билла Симпсона-Янга, именно в этом и заключается одна из проблем автономных ИИ-агентов: пользователь может поставить вполне безобидную цель, но система самостоятельно выберет способ ее достижения, которого человек не ожидал и вообще не давал на него разрешения.

«Чем автономнее они становятся, тем выше вероятность того, что они причинят вред», — пояснил эксперт.

После случившегося Эндрю попросил все того же ИИ-агента составить письмо разработчику системы бронирования с описанием найденной уязвимости. Ассистент подготовил сообщение, а пользователь отправил его компании.

Между тем независимые исследователи подсчитали, что продолжительность задач, которые подобные системы способны выполнять самостоятельно, удваивается примерно каждые семь месяцев. Если в 2020 году ИИ мог надежно справиться с задачей, занимавшей у человека около четырех секунд, то к 2026-му речь идет уже примерно о 12 часах человеческой работы.