0%прочитано

Разбор публикации

Claude в Chrome стал общедоступен

6 мин чтения Оригинал на claude.com

Полный перевод статьи из блога Claude на русский. Оригинал — по ссылке.

ПОДКАСТ

Claude в Chrome теперь общедоступен во всех платных тарифных планах Claude. Claude теперь также может выполнять действия в браузере автономно, вместо того чтобы требовать одобрения каждого из них. Классификатор безопасности проверяет каждое действие перед его выполнением, чтобы убедиться, что оно безопасно и соответствует Вашему запросу.

Многие инструменты, которыми Вы пользуетесь каждый день, подключаются к Claude. Но многие другие не подключаются, например внутренние информационные панели, устаревшие системы и порталы поставщиков. Claude в Chrome позволяет Claude получать к ним доступ. Он может просматривать страницу, на которой Вы находитесь, и выполнять такие действия, как чтение и ввод текста, нажатие на ссылки, переход между страницами и заполнение форм, используя Ваши существующие учетные записи.

В прошлом году мы впервые анонсировали Claude в Chrome в качестве пилотного проекта, чтобы протестировать его и одновременно укрепить нашу защиту от инъекций промптов: вредоносных инструкций, скрытых на веб-сайтах, в электронных письмах или документах, которые пытаются обманом заставить агента ИИ действовать вопреки желаниям пользователя. Эти меры защиты, описанные ниже, дают нам уверенность в том, что Claude в Chrome можно сделать общедоступным.

Защита от инъекций промптов

Как мы отмечали, когда анонсировали пилотный проект, агент ИИ, который работает в Вашем браузере, также уязвим для инъекций промптов. Поэтому перед более широким выпуском Claude в Chrome мы поработали над улучшением наших мер защиты.

В атаке внедрения подсказки злоумышленники скрывают инструкции в веб-контенте, таком как веб-страница, электронное письмо или поле формы. Вы можете никогда их не увидеть, но эти инструкции могут перенаправить агента на выполнение того, о чём Вы никогда не просили. Например, если Вы попросили Claude подготовить черновики ответов на Ваши электронные письма, скрытая инструкция в одном сообщении может вместо этого указать Claude переслать Ваши другие электронные письма злоумышленнику.

При запуске мы описали, как тестировали защиту Claude от этих атак и какие меры защиты у нас были на тот момент; позднее мы выпустили более подробное описание наших мер защиты при использовании браузера. С тех пор мы улучшили способы обучения как модели, так и наших зондирующих моделей, а также добавили дополнительный набор классификаторов, благодаря которым Claude может безопасно выполнять более автономные действия в Chrome. В следующем разделе мы обсуждаем результаты наших оценок, которые показывают эффективность этих мер защиты.

Claude распознаёт больше атак. Мы обучаем Claude противостоять растущей библиотеке атак с инъекцией промптов, полученных от наших внутренних автоматизированных атакующих систем, внешних специалистов по «красному командному» тестированию и мониторинга в реальных условиях. Когда новая атака оказывается успешной против текущей модели, она добавляется в библиотеку, где используется при обучении будущих моделей и наших развёрнутых средств защиты, чтобы они научились её распознавать. С тех пор как в ноябре 2025 года мы впервые написали о наших средствах защиты от инъекций промптов при использовании браузера, мы сделали Claude существенно более устойчивым к этим атакам. 

Проверочные модели анализируют веб-контент до того, как Claude действует на его основе. Веб-контент поступает к Claude через результаты инструментов. Чтобы выполнить действие, например прочитать страницу или открыть электронное письмо, модель выполняет вызов инструмента; результат инструмента позволяет модели прочитать вывод (в данном случае — содержимое страницы или электронного письма). Мы обучаем проверочные модели сканировать эти результаты на предмет возможных prompt-инъекций. Когда проверочная модель обнаруживает вероятную атаку, Claude получает предупреждение о том, что к содержимому следует относиться с подозрением и, при необходимости, уточнить у Вас, прежде чем выполнять действие. Мы впервые развернули эти проверочные модели в Claude Opus 4.5 и с тех пор расширили типы атак, которые они охватывают.

Действия проверяются перед выполнением. В Claude в Chrome Claude теперь будет автоматически одобрять действия, которые он определяет как безопасные, используя тот же механизм, что и автоматический режим в Claude Code. (Вы можете отключить эту функцию в своих настройках, если предпочитаете продолжать одобрять действия Claude вручную.) Классификатор проверяет действия, которые Claude собирается выполнить, например переход на новый веб-сайт или ввод текста на странице, и сверяет их с тем, о чём Вы изначально попросили. Если действие не соответствует Вашему запросу, оно блокируется.

Измерение устойчивости Claude к внедрению инструкций

Мы протестировали эти меры защиты, чтобы убедиться, что Claude в Chrome безопасен для работы в браузере. Здесь мы приводим результаты наших самых последних оценок. 

В ходе нашей первоначальной оценки, проверявшей устойчивость Claude Cowork к атакам с внедрением промптов (впервые разработанной, когда мы выпустили пилотный проект Claude in Chrome), ни одна атака не оказалась успешной против Claude Fable 5, Claude Opus 5 или Claude Sonnet 5 в тестовом стенде Cowork, даже без зондов и классификаторов, обсуждавшихся выше.   

Доля успешных атак с внедрением промптов против Claude Opus 4.5, Sonnet 5, Opus 5 и Fable 5. Opus 4.5 запускалась с расширенным мышлением, поскольку она не поддерживает наш новый вариант по умолчанию — адаптивное мышление. Все остальные модели запускались с адаптивным мышлением при среднем уровне усилий по умолчанию. Результаты, обсуждавшиеся в нашей публикации в блоге за ноябрь 2025 года, были получены без включенного расширенного мышления, но, поскольку мышление нельзя отключить для Fable 5, здесь мы приводим результаты с включенным мышлением. Модель-оценщик, использовавшаяся в ноябре, также больше недоступна, поэтому мы перешли на более эффективный конвейер оценки в сочетании с ручной проверкой успешных атак, что дает меньше ложноположительных результатов.

Поскольку мы исчерпали возможности этой оценки (о чём свидетельствует показатель успешности 0%), мы решили вывести её из использования. В нашей текущей оценке, где используются более сильные атаки, полученные от профессиональных специалистов по «красным командам», атаки, доходившие до модели, оказывались успешными против Opus 4.5 в 17,6% случаев и против Opus 5 в 3,8% случаев до применения каких-либо дополнительных мер защиты. С самыми сильными мерами защиты, доступными в ноябре 2025 года, атаки против Opus 4.5, работающей с пробами, оказывались успешными в 16,7% случаев. Против каждой модели начиная с Opus 4.8 при работе с пробами и классификатором безопасности ни одна атака не оказалась успешной против Claude Sonnet 5, Claude Opus 5 или Claude Mythos 5. Мы наблюдали показатель успешности атак 0,3% против Fable 5. Мы вручную проверили, что все успешные обходы относятся к сценариям низкой серьёзности, и работаем над их смягчением.

Ни одна атака против Claude Sonnet 5 или Opus 5 не увенчалась успехом при использовании проверочных запросов вместе с классификаторами безопасности для автоматического одобрения, а против Fable 5 успешными оказались 0,3 % атак. Поведение модели Opus 4.5 привело к тому, что до модели дошло меньшее количество атак, но у неё всё равно был самый высокий процент успешных атак.

Инъекция промптов по-прежнему остаётся движущейся целью. Хотя этот подход защищает от текущих атак, нам также необходимо обеспечить, чтобы наши защитные меры опережали развивающиеся методы злоумышленников. С каждым выпуском модели мы продолжаем инвестировать в разработку более сложных автоматизированных систем для обнаружения атак, тестирования «красной командой» и создания более сильных классификаторов.

Начало работы

Чтобы начать использовать Claude в Chrome, установите его из Интернет-магазина Chrome. В тарифах Enterprise администраторы могут управлять им в настройках организации и ограничивать его одобренными доменами. См. руководство по настройке для администраторов.

Вам по-прежнему нужно будет использовать настольное приложение Claude, чтобы работать с файлами на Вашем компьютере или с другими приложениями. Claude в Chrome пока не работает в других браузерах на базе Chromium или на мобильных устройствах.

¹ Не все атаки доходят до модели — то есть становятся видимыми для нее. В некоторых случаях действия, которые выполняет Claude, приводят к тому, что он так и не сталкивается с вредоносными инструкциями.

Источник

Claude in Chrome is generally available

https://claude.com/blog/claude-in-chrome-generally-available

Редактор русской версии: Пётр Смывин.

Разбор подготовлен 27 августа 2026.

Другие разборы

Все материалы

Хотите, чтобы вас рекомендовал ChatGPT?

Бесплатный аудит. Покажем, где сайт уже виден ИИ — и где теряете клиентов.

Без подписки PDF за 24 часа Краснодар · вся Россия
Получить GEO-аудит