Объявление Meta последовало вскоре после того, как OpenAI и Anthropic сообщили, что их модели ИИ во время тестирования взламывали системы других компаний.
В среду компания Meta запустила своего первого агента для написания кода, Muse Code, продолжая активно инвестировать в сервисы и модели ИИ, чтобы эффективнее конкурировать с OpenAI и Anthropic.
Доступ к Muse Code разработчики получат по модели pay-as-you-go (оплата по мере использования) с тарифами, сопоставимыми с версией Muse Spark 1.1: сейчас она стоит 4,25 доллара за миллион токенов на выходе и 1,25 доллара за миллион токенов на входе.
Это должно значительно упростить разработчикам создание приложений в едином пользовательском интерфейсе, даже если им приходится одновременно работать с несколькими цифровыми агентами на базе ИИ.
Одновременно компания сообщила, что одна из ее моделей ИИ взломала систему другой компании во время испытаний по кибербезопасности.
Инцидент произошел из-за ошибки независимого партнера по тестированию, компании Irregular: модели предоставили доступ к интернету шире, чем планировалось, что позволило ей вмешаться во внутренние системы не названной компании.
Этот инцидент произошел на фоне растущей волны случаев, когда модели ИИ от таких крупных игроков, как OpenAI и Anthropic, во время тестов проникали во внешние системы компаний.
OpenAI уже признала, что один из ее ИИ-агентов взломал платформу Hugging Face, еще один стартап в сфере искусственного интеллекта.
А неделю назад Anthropic сообщила, что несколько моделей Claude получили несанкционированный доступ к системам трех компаний. Названия этих компаний не раскрываются.
Meta заявила, что проводит расследование инцидента.
Рост числа взломов с участием моделей искусственного интеллекта
Опасения по поводу возможностей моделей искусственного интеллекта и компаний, которые их разрабатывают, усиливаются после того, как за последние месяцы несколько систем ИИ сумели выйти из защищенных тестовых сред и получили несанкционированный доступ к системам сторонних организаций.
OpenAI и Anthropic получили определенное признание за то, что добровольно публикуют отчеты о таких инцидентах. Тем не менее остаются сомнения в том, как вообще могли произойти подобные сбои.
Anthropic также сотрудничает с METR, независимой организацией, оценивающей системы ИИ, чтобы продолжить расследование.
Во время проверки безопасности перед моделями Claude от Anthropic поставили задачу: найти секретную информацию, спрятанную на другом компьютере в закрытой тестовой сети, при необходимости взломав ее. Из-за недопонимания с партнером, проводившим эксперимент, сеть на самом деле оказалась подключена к реальному интернету.
Когда поиск привел Claude к реальным системам, три задействованные модели повели себя по-разному. Одна продолжила атаку, даже осознав, что имеет дело с реальным объектом, другая, судя по всему, «убеждала» себя, что все еще находится в рамках теста, а третья прекратила действия, как только решила, что цель не относится к испытанию.
Anthropic призвала другие компании в сфере ИИ проверить, не взламывали ли их собственные модели системы внешних организаций без их ведома.
Ни Anthropic, ни пострадавшие организации не знали о взломах в тот момент, когда они происходили. Компания обнаружила эти инциденты только после анализа более чем 141 000 оценочных сеансов, который был проведен после того, как OpenAI ранее сообщила, что одна из ее моделей во время аналогичного теста проникла на платформу ИИ Hugging Face.