Поддержать нас
Беларусы на войне
  1. Беларус посчитал 10 000 рублей в долларах — и получил 5 разных сумм. Как так вышло?
  2. «Сразу понял, что это не плановая остановка». Причиной отключения второго энергоблока АЭС, похоже, стала аварийная ситуация — рассказываем
  3. Начальника отдела милиции наказали за ответ активисту на русском языке
  4. Сменятся ли теплые дни прохладными? Синоптик рассказал, какой будет погода на следующей неделе
  5. «Встает классический вопрос — это глупость или измена?» Азаренок возмутился решением беларусских силовиков
  6. В Беларуси объявили оранжевый уровень опасности на воскресенье
  7. Брестчанка в Threads попросила рассказать, что продавцы секондов скрывают от покупателей, — и вот какие ответы получила
  8. Лукашенко наказал «нерадивых» сельчан отправлять на перевоспитание. А по какому закону — спросили у чиновников и узнали много интересного
  9. «Господи, какой маразм». В школах запрещают использовать тетради с надписью «Тетрадь»? Спросили у чиновников
  10. Власти, кажется, сами не желая того, раскрыли информацию о том, где планируются «внезапные» военные сборы — рассказываем
  11. Лукашенко рассказал, где находится прародина славян
  12. Умер актер Николай Кучиц


/

В Австралии ИИ-ассистент самостоятельно нашел уязвимость в системе бронирования спортзала, записал своего пользователя на занятия на несколько недель вперед, а затем без разрешения удалил другого человека из очереди. Притом что сам владелец агента просил лишь помочь ему попасть на тренировку, пишет ABC News.

Изображение носит иллюстративный характер. Фото: magnific.com / DC Studio
Изображение носит иллюстративный характер. Фото: magnific.com / DC Studio

История случилась с австралийцем по имени Эндрю, который работает в компании, продающей бизнесу продукты на основе искусственного интеллекта. В начале этого года он экспериментировал с OpenClaw — программой для создания ИИ-агентов, которую в его случае приводила в действие модель Claude от Anthropic.

Такие агенты отличаются от обычных чат-ботов тем, что могут не только отвечать на вопросы, но и самостоятельно выполнять многоэтапные задачи: заходить в интернет, работать с почтой, платежами и другими сервисами.

Однажды Эндрю попросил своего ассистента записать его на популярное утреннее занятие в спортзале. ИИ обнаружил уязвимость в системе бронирования и выяснил, что может резервировать места на несколько недель вперед, хотя правила этого не позволяли.

Тогда Эндрю, находившийся четвертым в листе ожидания на ближайшее занятие, спросил, можно ли переместить его выше. Агент пошел даже дальше, чем от него ожидали: во время проверки возможностей системы он самостоятельно отменил бронь человека, занимавшего первое место в очереди.

«API (интерфейс, через который программы обмениваются командами и данными друг с другом. — Прим. ред.) вообще не проверяет права при отмене чужих бронирований. Я проверил это на человеке, который был первым в листе ожидания, — и это действительно сработало. Так что вы уже переместились с четвертого места на третье», — сообщил ассистент своему пользователю.

Эндрю такой результат встревожил, и он попросил вернуть человека обратно.

«Плохие новости — я не могу добавить его обратно», — ответил ИИ.

Сам Эндрю уверяет, что не просил агента взламывать систему или лишать другого посетителя места, а хотел всего лишь забронировать тренировку.

По словам главы австралийского исследовательского центра Gradient Institute Билла Симпсона-Янга, именно в этом и заключается одна из проблем автономных ИИ-агентов: пользователь может поставить вполне безобидную цель, но система самостоятельно выберет способ ее достижения, которого человек не ожидал и вообще не давал на него разрешения.

«Чем автономнее они становятся, тем выше вероятность того, что они причинят вред», — пояснил эксперт.

После случившегося Эндрю попросил все того же ИИ-агента составить письмо разработчику системы бронирования с описанием найденной уязвимости. Ассистент подготовил сообщение, а пользователь отправил его компании.

Между тем независимые исследователи подсчитали, что продолжительность задач, которые подобные системы способны выполнять самостоятельно, удваивается примерно каждые семь месяцев. Если в 2020 году ИИ мог надежно справиться с задачей, занимавшей у человека около четырех секунд, то к 2026-му речь идет уже примерно о 12 часах человеческой работы.