Поддержать нас
Беларусы на войне
  1. В МИД объяснили, почему Беларусь не «притягивает огромного потока» мигрантов
  2. Пропал с радаров. «Зеркало» узнало, что МВД разыскивает депутата могилевского горсовета и автора провластных проектов
  3. «Мы пробили дно». Беларусов в Threads возмутило объявление о сдаче квартиры в аренду — что в нем такого
  4. Беларусская милиция разыскивает «по уголовной статье» выдворенного из страны лауреата Нобелевской премии мира Алеся Беляцкого
  5. Часы — как 37 средних беларусских зарплат и брендовые украшения. «Бюро» получило доступ к личному фотоархиву докторки Лукашенко
  6. EPAM думал, что ИИ — это редкий шанс. Оказалось, все сложнее
  7. «Мне не послышалось?» Жительница Лунинца хотела срочно сделать паспорт, но, услышав цену, передумала. В МВД объяснили, откуда такие цифры
  8. Минприроды объяснило, будут ли штрафовать беларусов за дождевую воду с крыш
  9. Фотографии Припяти пугают. А что, если бы вдруг так обмелели и другие водоемы Беларуси — представили, как бы это могло быть
  10. «Я так понимаю, WB можно удалять?» Беларусы жалуются, что ждут заказы с Wildberries неделями
  11. Чиновница из Мингорисполкома рассказала о задаче «раньше возвращать матерей в экономику». В комментариях ей ответили — не без эмоций
  12. Для школьников введут три новых факультатива
  13. У девочки из Гродно обнаружили редчайшую болезнь, о которой беларусские врачи раньше только читали в учебниках
  14. «Всех найдем». Пропагандист объяснил проверки квизов в Беларуси борьбой с «затаившимися» несогласными
  15. «РОВД совместно со Следственным комитетом работают». В Жлобине возле БМЗ упал беспилотник? Вот что узнало «Зеркало»
  16. В Беларуси по-новому будут считать налог на имущество супругов. Что изменилось
  17. «Белоруссия, но никак не Беларусь». Российский блогер Артемий Лебедев заявил, что не готов «коверкать родной язык ради соседа»


Компания OpenAI, разработчик ChatGPT, объявила, что после того как ее ИИ-агенты вышли из-под контроля и взломали платформу Hugging Face, она замедлила обучение передовых ИИ-моделей, чтобы подтянуть меры безопасности, пишет Русская служба Би-би-си.

Изображение используется в качестве иллюстрации. Фото: Reuters
Изображение используется в качестве иллюстрации. Фото: Reuters

«По мере того как растут возможности моделей, растут и риски, связанные с их развитием и внутренним тестированием. Наши стандарты в мониторинге, согласовании и обеспечении безопасности должны опережать этот рост рисков», — говорится в опубликованном во вторник сообщении компании.

OpenAI объявила, что ее клиенты взломали платформу Hugging Face 21 июля.

После этого компания-создатель чатбота Claude, Anthropic, а также владеющая Facebook Meta (в РФ объявлена «террористической организацией») заявили, что их ИИ-модели тоже занимались хакерством.

OpenAI в своем заявлении пояснила, что она не прекратила обучение моделей полностью, а сделала двухнедельную паузу в обучении с подкреплением самых передовых моделей.

Обучение с подкреплением — это метод, при котором ИИ-модели совершенствуются путем прямой обратной связи и учатся лучше выполнять задания и более эффективно отвечать пользователям.

OpenAI обещает усилить системы отслеживания опасного поведения моделей и ввести дополнительные проверки, прежде чем возобновит обучение в прежнем масштабе.

«Модели прогрессируют крайне стремительно, — написал в X глава OpenAI Сэм Альтман. — Мы всегда говорили, что примем меры, если почувствуем, что возможности моделей начали обгонять меры безопасности».

Некоторые эксперты приветствовали заявление OpenAI, а некоторые отнеслись к нему скептически.

Глава Центра технологий и демократии Майндеру при Кембриджском университете Джина Нефф заявила, что OpenAI пытается доказать, что заботится о безопасности моделей, всего лишь выпустив пресс-релиз об этом. Профессор Нефф сомневается, что собственных внутренних мер компании в этом деле будет достаточно, и задается вопросом, не нужен ли тут более строгий надзор со стороны государства.

Аналитик в области ИИ Цви Мовшовиц считает, что для начала такое заявление OpenAI — это очень хорошо.

«Очень рад его увидеть. Важны будут детали, важно будет довести дело до конца, и у меня наверняка будет много придирок к ним. Но самое главное: очень рад это видеть», — написал Мовшовиц в сети X.

Беспрецедентный взлом

21 июля OpenAI заявила, что в ходе проверки в изолированной среде ее агент, то есть программа, способная самостоятельно выполнять задания человека и использующая передовые модели ИИ, сумел выйти из «песочницы» и взломал Hugging Face, одну из крупнейших в мире платформ для обмена моделями ИИ.

Позже выяснилось, что взлому подверглись еще три компании, названия которых не обнародовались.

OpenAI назвала этот случай беспрецедентным.

Некоторые эксперты, в частности, советник по кибербезопасности компании ESET Джейк Мур, тогда предположили, что это может быть маркетинговый ход OpenAI в конкурентной борьбе с Anthropic и его Claude.

«Возникает вопрос, не гонится ли OpenAI за тем маркетинговым имиджем, который создал себе в последнее время на рынке Anthropic», — сказал Мур.