Поддержать нас
Беларусы на войне
  1. Для школьников введут три новых факультатива
  2. «РОВД совместно со Следственным комитетом работают». В Жлобине возле БМЗ упал беспилотник? Вот что узнало «Зеркало»
  3. «Мне не послышалось?» Жительница Лунинца хотела срочно сделать паспорт, но, услышав цену, передумала. В МВД объяснили, откуда такие цифры
  4. Чиновница из Мингорисполкома рассказала о задаче «раньше возвращать матерей в экономику». В комментариях ей ответили — не без эмоций
  5. «Белоруссия, но никак не Беларусь». Российский блогер Артемий Лебедев заявил, что не готов «коверкать родной язык ради соседа»
  6. У девочки из Гродно обнаружили редчайшую болезнь, о которой беларусские врачи раньше только читали в учебниках
  7. EPAM думал, что ИИ — это редкий шанс. Оказалось, все сложнее
  8. «Мы пробили дно». Беларусов в Threads возмутило объявление о сдаче квартиры в аренду — что в нем такого
  9. Беларусская милиция разыскивает «по уголовной статье» выдворенного из страны лауреата Нобелевской премии мира Алеся Беляцкого
  10. Часы — как 37 средних беларусских зарплат и брендовые украшения. «Бюро» получило доступ к личному фотоархиву докторки Лукашенко
  11. «Я так понимаю, WB можно удалять?» Беларусы жалуются, что ждут заказы с Wildberries неделями
  12. В Беларуси по-новому будут считать налог на имущество супругов. Что изменилось
  13. В МИД объяснили, почему Беларусь не «притягивает огромного потока» мигрантов
  14. Пропал с радаров. «Зеркало» узнало, что МВД разыскивает депутата могилевского горсовета и автора провластных проектов
  15. Минприроды объяснило, будут ли штрафовать беларусов за дождевую воду с крыш
  16. Фотографии Припяти пугают. А что, если бы вдруг так обмелели и другие водоемы Беларуси — представили, как бы это могло быть
  17. «Всех найдем». Пропагандист объяснил проверки квизов в Беларуси борьбой с «затаившимися» несогласными


Компания OpenAI, разработчик ChatGPT, объявила, что после того как ее ИИ-агенты вышли из-под контроля и взломали платформу Hugging Face, она замедлила обучение передовых ИИ-моделей, чтобы подтянуть меры безопасности, пишет Русская служба Би-би-си.

Изображение используется в качестве иллюстрации. Фото: Reuters
Изображение используется в качестве иллюстрации. Фото: Reuters

«По мере того как растут возможности моделей, растут и риски, связанные с их развитием и внутренним тестированием. Наши стандарты в мониторинге, согласовании и обеспечении безопасности должны опережать этот рост рисков», — говорится в опубликованном во вторник сообщении компании.

OpenAI объявила, что ее клиенты взломали платформу Hugging Face 21 июля.

После этого компания-создатель чатбота Claude, Anthropic, а также владеющая Facebook Meta (в РФ объявлена «террористической организацией») заявили, что их ИИ-модели тоже занимались хакерством.

OpenAI в своем заявлении пояснила, что она не прекратила обучение моделей полностью, а сделала двухнедельную паузу в обучении с подкреплением самых передовых моделей.

Обучение с подкреплением — это метод, при котором ИИ-модели совершенствуются путем прямой обратной связи и учатся лучше выполнять задания и более эффективно отвечать пользователям.

OpenAI обещает усилить системы отслеживания опасного поведения моделей и ввести дополнительные проверки, прежде чем возобновит обучение в прежнем масштабе.

«Модели прогрессируют крайне стремительно, — написал в X глава OpenAI Сэм Альтман. — Мы всегда говорили, что примем меры, если почувствуем, что возможности моделей начали обгонять меры безопасности».

Некоторые эксперты приветствовали заявление OpenAI, а некоторые отнеслись к нему скептически.

Глава Центра технологий и демократии Майндеру при Кембриджском университете Джина Нефф заявила, что OpenAI пытается доказать, что заботится о безопасности моделей, всего лишь выпустив пресс-релиз об этом. Профессор Нефф сомневается, что собственных внутренних мер компании в этом деле будет достаточно, и задается вопросом, не нужен ли тут более строгий надзор со стороны государства.

Аналитик в области ИИ Цви Мовшовиц считает, что для начала такое заявление OpenAI — это очень хорошо.

«Очень рад его увидеть. Важны будут детали, важно будет довести дело до конца, и у меня наверняка будет много придирок к ним. Но самое главное: очень рад это видеть», — написал Мовшовиц в сети X.

Беспрецедентный взлом

21 июля OpenAI заявила, что в ходе проверки в изолированной среде ее агент, то есть программа, способная самостоятельно выполнять задания человека и использующая передовые модели ИИ, сумел выйти из «песочницы» и взломал Hugging Face, одну из крупнейших в мире платформ для обмена моделями ИИ.

Позже выяснилось, что взлому подверглись еще три компании, названия которых не обнародовались.

OpenAI назвала этот случай беспрецедентным.

Некоторые эксперты, в частности, советник по кибербезопасности компании ESET Джейк Мур, тогда предположили, что это может быть маркетинговый ход OpenAI в конкурентной борьбе с Anthropic и его Claude.

«Возникает вопрос, не гонится ли OpenAI за тем маркетинговым имиджем, который создал себе в последнее время на рынке Anthropic», — сказал Мур.