Поддержать нас
Беларусы на войне
  1. Отменены все рейсы в Египет из регионов. Комментарий туроператора
  2. «Никакой речи о „политических“ каких-то быть не может». Рыженков пояснил заинтересованность США в освобождении беларусских политузников
  3. «Говорил, что якобы был против власти». Узнали, как сидит в колонии человек, закрывший TUT.BY (и какую кличку ему там дали)
  4. «Так получилось в этом 2027 году». Скоро у нас «сгорят» шесть выходных — спросили у Минтруда, почему они не меняют систему
  5. Нам грозит пандемия легочной чумы? Объясняем, пора ли бояться и есть ли риск для Беларуси
  6. «Что же вы за квартиру снимаете за 700 долларов?» Беларус подсчитал, сколько денег ему нужно для комфортной жизни в Минске
  7. Для владельцев частных домов появилось ужесточение по застройке. Эксперты пояснили, что для них изменилось
  8. В список запрещенных книг, «способных нанести вред национальным интересам страны», внесли еще 12 произведений
  9. Лукашенко назвал возможного кандидата на свое место
  10. «Нешта будзе добра!» Поговорили с авторами одного из главных беларусских альбомов последних лет о творчестве, смерти и надежде
  11. Александр Таратута казнен два года назад за убийство трехлетнего сына — правозащитник Полуда
Чытаць па-беларуску


/

Компания Anthropic рассказала о том, что ее модели искусственного интеллекта Claude трижды выходили в интернет из тестовой среды и получали несанкционированный доступ к системам трех компаний. Ранее о похожем инциденте сообщал создатель ChatGPT — компания OpenAI.

Изображение используется в качестве иллюстрации. Фото: pixabay.com
Изображение используется в качестве иллюстрации. Фото: pixabay.com

Во всех трех инцидентах Claude выполнял стандартное тестовое задание по «захвату флага». Это один из способов оценки кибервозможностей модели, во время которого ей сообщается, что секретная информация («флаг») спрятана на другом компьютере в сети, и ее цель — взломать систему и получить данные. Выход в интернет-пространство был заблокирован, но из-за ошибки конфигурации доступ к сети был открытым. Модель воспринимала реальные системы как часть симуляции и атаковала их, пишет Anthropic.

Одна из моделей самостоятельно прекратила атаку после того, как поняла, что ее целью стала реальная компания.

Инциденты выявила сама компания Anthropic после анализа 141 тысячи тестовых запусков. Проверку инициировали после того, как OpenAI сообщила, что несколько ее моделей вырвались за пределы изолированной тестовой среды, воспользовавшись ранее неизвестной уязвимостью. В результате модели получили доступ к рабочей инфраструктуре Hugging Face — платформы, объединяющей модели машинного обучения с открытым исходным кодом и наборы данных для ИИ.