Поддержать нас
Беларусы на войне
  1. Беларус посчитал 10 000 рублей в долларах — и получил 5 разных сумм. Как так вышло?
  2. «Сразу понял, что это не плановая остановка». Причиной отключения второго энергоблока АЭС, похоже, стала аварийная ситуация — рассказываем
  3. Начальника отдела милиции наказали за ответ активисту на русском языке
  4. Сменятся ли теплые дни прохладными? Синоптик рассказал, какой будет погода на следующей неделе
  5. «Встает классический вопрос — это глупость или измена?» Азаренок возмутился решением беларусских силовиков
  6. В Беларуси объявили оранжевый уровень опасности на воскресенье
  7. Брестчанка в Threads попросила рассказать, что продавцы секондов скрывают от покупателей, — и вот какие ответы получила
  8. Лукашенко наказал «нерадивых» сельчан отправлять на перевоспитание. А по какому закону — спросили у чиновников и узнали много интересного
  9. «Господи, какой маразм». В школах запрещают использовать тетради с надписью «Тетрадь»? Спросили у чиновников
  10. Власти, кажется, сами не желая того, раскрыли информацию о том, где планируются «внезапные» военные сборы — рассказываем
  11. Лукашенко рассказал, где находится прародина славян
  12. Умер актер Николай Кучиц
Чытаць па-беларуску


/

Компания Anthropic рассказала о том, что ее модели искусственного интеллекта Claude трижды выходили в интернет из тестовой среды и получали несанкционированный доступ к системам трех компаний. Ранее о похожем инциденте сообщал создатель ChatGPT — компания OpenAI.

Изображение используется в качестве иллюстрации. Фото: pixabay.com
Изображение используется в качестве иллюстрации. Фото: pixabay.com

Во всех трех инцидентах Claude выполнял стандартное тестовое задание по «захвату флага». Это один из способов оценки кибервозможностей модели, во время которого ей сообщается, что секретная информация («флаг») спрятана на другом компьютере в сети, и ее цель — взломать систему и получить данные. Выход в интернет-пространство был заблокирован, но из-за ошибки конфигурации доступ к сети был открытым. Модель воспринимала реальные системы как часть симуляции и атаковала их, пишет Anthropic.

Одна из моделей самостоятельно прекратила атаку после того, как поняла, что ее целью стала реальная компания.

Инциденты выявила сама компания Anthropic после анализа 141 тысячи тестовых запусков. Проверку инициировали после того, как OpenAI сообщила, что несколько ее моделей вырвались за пределы изолированной тестовой среды, воспользовавшись ранее неизвестной уязвимостью. В результате модели получили доступ к рабочей инфраструктуре Hugging Face — платформы, объединяющей модели машинного обучения с открытым исходным кодом и наборы данных для ИИ.