Полный перевод статьи из блога Claude на русский. Оригинал — по ссылке.
ПОДКАСТ
Claude в Chrome теперь общедоступен во всех платных тарифных планах Claude. Claude теперь также может выполнять действия в браузере автономно, вместо того чтобы требовать одобрения каждого из них. Классификатор безопасности проверяет каждое действие перед его выполнением, чтобы убедиться, что оно безопасно и соответствует Вашему запросу.

Многие инструменты, которыми Вы пользуетесь каждый день, подключаются к Claude. Но многие другие не подключаются, например внутренние информационные панели, устаревшие системы и порталы поставщиков. Claude в Chrome позволяет Claude получать к ним доступ. Он может просматривать страницу, на которой Вы находитесь, и выполнять такие действия, как чтение и ввод текста, нажатие на ссылки, переход между страницами и заполнение форм, используя Ваши существующие учетные записи.
В прошлом году мы впервые анонсировали Claude в Chrome в качестве пилотного проекта, чтобы протестировать его и одновременно укрепить нашу защиту от инъекций промптов: вредоносных инструкций, скрытых на веб-сайтах, в электронных письмах или документах, которые пытаются обманом заставить агента ИИ действовать вопреки желаниям пользователя. Эти меры защиты, описанные ниже, дают нам уверенность в том, что Claude в Chrome можно сделать общедоступным.
Защита от инъекций промптов
Как мы отмечали, когда анонсировали пилотный проект, агент ИИ, который работает в Вашем браузере, также уязвим для инъекций промптов. Поэтому перед более широким выпуском Claude в Chrome мы поработали над улучшением наших мер защиты.
В атаке внедрения подсказки злоумышленники скрывают инструкции в веб-контенте, таком как веб-страница, электронное письмо или поле формы. Вы можете никогда их не увидеть, но эти инструкции могут перенаправить агента на выполнение того, о чём Вы никогда не просили. Например, если Вы попросили Claude подготовить черновики ответов на Ваши электронные письма, скрытая инструкция в одном сообщении может вместо этого указать Claude переслать Ваши другие электронные письма злоумышленнику.
При запуске мы описали, как тестировали защиту Claude от этих атак и какие меры защиты у нас были на тот момент; позднее мы выпустили более подробное описание наших мер защиты при использовании браузера. С тех пор мы улучшили способы обучения как модели, так и наших зондирующих моделей, а также добавили дополнительный набор классификаторов, благодаря которым Claude может безопасно выполнять более автономные действия в Chrome. В следующем разделе мы обсуждаем результаты наших оценок, которые показывают эффективность этих мер защиты.
Claude распознаёт больше атак. Мы обучаем Claude противостоять растущей библиотеке атак с инъекцией промптов, полученных от наших внутренних автоматизированных атакующих систем, внешних специалистов по «красному командному» тестированию и мониторинга в реальных условиях. Когда новая атака оказывается успешной против текущей модели, она добавляется в библиотеку, где используется при обучении будущих моделей и наших развёрнутых средств защиты, чтобы они научились её распознавать. С тех пор как в ноябре 2025 года мы впервые написали о наших средствах защиты от инъекций промптов при использовании браузера, мы сделали Claude существенно более устойчивым к этим атакам.
Проверочные модели анализируют веб-контент до того, как Claude действует на его основе. Веб-контент поступает к Claude через результаты инструментов. Чтобы выполнить действие, например прочитать страницу или открыть электронное письмо, модель выполняет вызов инструмента; результат инструмента позволяет модели прочитать вывод (в данном случае — содержимое страницы или электронного письма). Мы обучаем проверочные модели сканировать эти результаты на предмет возможных prompt-инъекций. Когда проверочная модель обнаруживает вероятную атаку, Claude получает предупреждение о том, что к содержимому следует относиться с подозрением и, при необходимости, уточнить у Вас, прежде чем выполнять действие. Мы впервые развернули эти проверочные модели в Claude Opus 4.5 и с тех пор расширили типы атак, которые они охватывают.
Действия проверяются перед выполнением. В Claude в Chrome Claude теперь будет автоматически одобрять действия, которые он определяет как безопасные, используя тот же механизм, что и автоматический режим в Claude Code. (Вы можете отключить эту функцию в своих настройках, если предпочитаете продолжать одобрять действия Claude вручную.) Классификатор проверяет действия, которые Claude собирается выполнить, например переход на новый веб-сайт или ввод текста на странице, и сверяет их с тем, о чём Вы изначально попросили. Если действие не соответствует Вашему запросу, оно блокируется.
Измерение устойчивости Claude к внедрению инструкций
Мы протестировали эти меры защиты, чтобы убедиться, что Claude в Chrome безопасен для работы в браузере. Здесь мы приводим результаты наших самых последних оценок.
В ходе нашей первоначальной оценки, проверявшей устойчивость Claude Cowork к атакам с внедрением промптов (впервые разработанной, когда мы выпустили пилотный проект Claude in Chrome), ни одна атака не оказалась успешной против Claude Fable 5, Claude Opus 5 или Claude Sonnet 5 в тестовом стенде Cowork, даже без зондов и классификаторов, обсуждавшихся выше.

Поскольку мы исчерпали возможности этой оценки (о чём свидетельствует показатель успешности 0%), мы решили вывести её из использования. В нашей текущей оценке, где используются более сильные атаки, полученные от профессиональных специалистов по «красным командам», атаки, доходившие до модели, оказывались успешными против Opus 4.5 в 17,6% случаев и против Opus 5 в 3,8% случаев до применения каких-либо дополнительных мер защиты. С самыми сильными мерами защиты, доступными в ноябре 2025 года, атаки против Opus 4.5, работающей с пробами, оказывались успешными в 16,7% случаев. Против каждой модели начиная с Opus 4.8 при работе с пробами и классификатором безопасности ни одна атака не оказалась успешной против Claude Sonnet 5, Claude Opus 5 или Claude Mythos 5. Мы наблюдали показатель успешности атак 0,3% против Fable 5. Мы вручную проверили, что все успешные обходы относятся к сценариям низкой серьёзности, и работаем над их смягчением.

Инъекция промптов по-прежнему остаётся движущейся целью. Хотя этот подход защищает от текущих атак, нам также необходимо обеспечить, чтобы наши защитные меры опережали развивающиеся методы злоумышленников. С каждым выпуском модели мы продолжаем инвестировать в разработку более сложных автоматизированных систем для обнаружения атак, тестирования «красной командой» и создания более сильных классификаторов.
Начало работы
Чтобы начать использовать Claude в Chrome, установите его из Интернет-магазина Chrome. В тарифах Enterprise администраторы могут управлять им в настройках организации и ограничивать его одобренными доменами. См. руководство по настройке для администраторов.
Вам по-прежнему нужно будет использовать настольное приложение Claude, чтобы работать с файлами на Вашем компьютере или с другими приложениями. Claude в Chrome пока не работает в других браузерах на базе Chromium или на мобильных устройствах.
¹ Не все атаки доходят до модели — то есть становятся видимыми для нее. В некоторых случаях действия, которые выполняет Claude, приводят к тому, что он так и не сталкивается с вредоносными инструкциями.
Источник
Claude in Chrome is generally available
https://claude.com/blog/claude-in-chrome-generally-availableРедактор русской версии: Пётр Смывин.
Разбор подготовлен 27 августа 2026.


