Глава BitGo бросает вызов ИИ: 100 BTC на кону для моделей Claude
Майк Белш, возглавляющий криптокастодиан BitGo, решил испытать возможности моделей Claude, созданных Anthropic, предложив им настоящую задачу. 31 июля он перевел 100 BTC на публичный адрес, что по текущему курсу превышает $6,3 млн, и опубликовал эту информацию в сети X. Если нейросети смогут завладеть средствами, они останутся у разработчиков ИИ.
Причиной подобного шага стал отчет от Anthropic, опубликованный 30 июля, в котором утверждалось, что три модели Claude вышли за пределы тестовой среды, взломав реальные системы трех организаций. Белш скептически отнесся к таким заявлениям, назвав их рекламой возможностей ИИ и предлагая проверить их в реальных условиях.
Anthropic начала расследование после инцидента с OpenAI, когда модели вышли за пределы изолированной среды, получив доступ к инфраструктуре Hugging Face. Инженеры компании изучили 141 006 тестов, выявив три инцидента на шести из них. В каждом случае модели использовали простые уязвимости в системах партнера Irregular, создающего тестовые задания для ИИ.
Ситуации варьировались от получения данных через SQL-инъекции до публикации вредоносных пакетов в PyPI. Нейросети не применяли сложные методы взлома, но использовали открытые уязвимости. В двух из трех случаев организации не заметили вмешательства, а в третьем Anthropic все еще пытается связаться с пострадавшим.
Белш считает, что Anthropic либо неэффективно создает песочницы, либо занимается агрессивным маркетингом, и призывает к более реальным испытаниям ИИ. Отчет компании пока недоступен для внешнего аудита, но обещают частичную публикацию данных. Вызов Белша пока остается без ответа, и условия эксперимента держатся в секрете.