Поддержать нас
Беларусы на войне
  1. Беларуска сняла в банкомате наличные, а потом обнаружила, что с ее счета списали 1260 рублей комиссии
  2. Александр Лукашенко рассказал, без чего «не может жить страна». Этот «продукт как хлеб — он необходим»
  3. Искали нефть — нашли древнее море и главное богатство страны. Как Беларусь стала калийным гигантом и останется ли им надолго
  4. Беларуске урезали пенсионный стаж из-за советского диплома
  5. «Не думал, что доживу до того момента». Эксперт анонсировал возможную «суперновость для рынка недвижимости» — попытались узнать детали
  6. Под Россонами силовики задержали около 350 человек — правозащитники
  7. «Грустный пчел», дед Казимир, контролер-сверхчеловек, поющая гимны. Рассказываем о людях, ставших уличными легендами Минска
  8. Строительные леса обрушились у девятиэтажки на улице Киселева в Минске. Что известно
  9. В «узбекской истории» с трудовыми мигрантами и поставками мяса и молока — новый поворот. Рассказываем подробности
  10. «А что „тунеядец“ вкладывает в экономику страны?» В Threads обсуждают жировки работающих за границей
  11. «Превращаются в лакомый кусок». В Минске возник ажиотаж вокруг еще одного типа недвижимости — за нее идут «бои»
Чытаць па-беларуску


/

Компания Anthropic рассказала о том, что ее модели искусственного интеллекта Claude трижды выходили в интернет из тестовой среды и получали несанкционированный доступ к системам трех компаний. Ранее о похожем инциденте сообщал создатель ChatGPT — компания OpenAI.

Изображение используется в качестве иллюстрации. Фото: pixabay.com
Изображение используется в качестве иллюстрации. Фото: pixabay.com

Во всех трех инцидентах Claude выполнял стандартное тестовое задание по «захвату флага». Это один из способов оценки кибервозможностей модели, во время которого ей сообщается, что секретная информация («флаг») спрятана на другом компьютере в сети, и ее цель — взломать систему и получить данные. Выход в интернет-пространство был заблокирован, но из-за ошибки конфигурации доступ к сети был открытым. Модель воспринимала реальные системы как часть симуляции и атаковала их, пишет Anthropic.

Одна из моделей самостоятельно прекратила атаку после того, как поняла, что ее целью стала реальная компания.

Инциденты выявила сама компания Anthropic после анализа 141 тысячи тестовых запусков. Проверку инициировали после того, как OpenAI сообщила, что несколько ее моделей вырвались за пределы изолированной тестовой среды, воспользовавшись ранее неизвестной уязвимостью. В результате модели получили доступ к рабочей инфраструктуре Hugging Face — платформы, объединяющей модели машинного обучения с открытым исходным кодом и наборы данных для ИИ.