Поддержать нас
Беларусы на войне
  1. Для водителей этой осенью собираются ввести новшество
  2. «Знатно офигели». Карточки каких беларусских банков работают в ЕС, а каких — нет (истории тех, кто проверил это на практике)
  3. В России князя Дмитрия Донского (чьи мощи нашли недавно) считают святым. Рассказываем, чем в реальности он отличился
  4. «Южные и восточные районы рискуют стать непригодными для жизни в ближайшие 10 лет». Ученый — о том, как спасти водоемы от обмеления
  5. У украинцев спросили об отношении к Лукашенко, Беларуси и беларусам. Вот результаты
  6. Келлог рассказал, зачем США начали переговоры с Лукашенко
  7. «Нет слов, одни эмоции». Минчанка искала того, кто нашел и вернул ее кошелек, а тот вдруг объявился сам и через милицию требует награду
  8. «Не стоит делать вид, что мы все — Там и Здесь — вместе и заодно». Большое интервью с одним из самых популярных беларусских писателей
  9. Пропавший в 2022 году украинский экс-депутат нашелся в Беларуси — во главе одного из заводов
  10. «Пафосное говно». Беларуска показала в Threads полученную «бацькаву кашулю» — там быстро придумали более полезные семьям подарки
  11. В Минске создают гигантскую сеть видеонаблюдения во дворах — на 20 тысяч камер. За чем они будут следить
  12. «Без паники». В парламенте заметили, что средняя зарплата «взбудоражила» людей, и бросились успокаивать — оцените, убедительно ли вышло
Чытаць па-беларуску


/

Компания Anthropic рассказала о том, что ее модели искусственного интеллекта Claude трижды выходили в интернет из тестовой среды и получали несанкционированный доступ к системам трех компаний. Ранее о похожем инциденте сообщал создатель ChatGPT — компания OpenAI.

Изображение используется в качестве иллюстрации. Фото: pixabay.com
Изображение используется в качестве иллюстрации. Фото: pixabay.com

Во всех трех инцидентах Claude выполнял стандартное тестовое задание по «захвату флага». Это один из способов оценки кибервозможностей модели, во время которого ей сообщается, что секретная информация («флаг») спрятана на другом компьютере в сети, и ее цель — взломать систему и получить данные. Выход в интернет-пространство был заблокирован, но из-за ошибки конфигурации доступ к сети был открытым. Модель воспринимала реальные системы как часть симуляции и атаковала их, пишет Anthropic.

Одна из моделей самостоятельно прекратила атаку после того, как поняла, что ее целью стала реальная компания.

Инциденты выявила сама компания Anthropic после анализа 141 тысячи тестовых запусков. Проверку инициировали после того, как OpenAI сообщила, что несколько ее моделей вырвались за пределы изолированной тестовой среды, воспользовавшись ранее неизвестной уязвимостью. В результате модели получили доступ к рабочей инфраструктуре Hugging Face — платформы, объединяющей модели машинного обучения с открытым исходным кодом и наборы данных для ИИ.