Исследования Anthropic

Как устроен Claude.

Полные русские переводы исследований Anthropic: интерпретируемость, безопасность и возможности моделей.

2 октября 2026·24 мин Наука в форме Claude: как BootLoops помогает находить задачи для современных языковых моделей Профессор Мэтью Шварц предлагает не заставлять большие языковые модели работать как традиционные учёные, а искать «задачи в форме Claude» — хорошо проверяемые количественные задачи, соответствующие их сильным сторонам: широким знаниям, программированию, математике, обработке литературы и данных. 1 октября 2026·73 мин Можно ли предсказать, какую работу будут выполнять роботы? Авторы предлагают индекс подверженности профессий роботизации, основанный на том, какие рабочие задачи современные роботы уже способны выполнять и в насколько контролируемой среде они могут это делать. 30 сентября 2026·9 мин GLM-5.3 и распространение передовых кибервозможностей Авторы утверждают, что модель GLM-5.3 от Zhipu AI способна автономно создавать сложные сквозные киберэксплойты на уровне Claude Mythos Preview, но при этом доступна значительно шире и защищена слабее. 30 сентября 2026·8 мин Чего вы хотите от искусственного интеллекта? Anthropic запускает исследование с помощью Anthropic Interviewer, чтобы собрать рассказы пользователей об их положительном и отрицательном опыте взаимодействия с искусственным интеллектом, ожиданиях от технологии и требованиях к компаниям-разработчикам. 26 сентября 2026·17 мин Claude вычислил девятипетлевую амплитуду в N=4 суперсимметричной теории Янга — Миллса Физик и научный журналист Мэтт фон Хиппель предложил компаниям, создающим искусственный интеллект, решить одну из сложных задач амплитудологии: вычислить шестичастичную амплитуду в планарной N=4 суперсимметричной теории Янга — Миллса на уровне девяти петель. 25 сентября 2026·33 мин Project Swap: что происходит, когда агенты торгуют от нашего имени? Anthropic создала контролируемый рынок обмена книгами с участием 201 сотрудников из шести офисов и агентов на базе Claude. Каждый участник отдавал одну книгу, беседовал с агентом о читательских предпочтениях, а затем агент вел переговоры и обменивал книги на общем цифровом торговом поле. 18 сентября 2026·9 мин Как Claude ускоряет биомолекулярное моделирование Claude оптимизировал более 30 открытых моделей для предсказания структуры биомолекул, дизайна белков, геномики и белковых языковых моделей менее чем за четыре недели. В среднем ускорение составило примерно четыре раза при минимальной потере точности, а при полностью идентичных результатах — почти два раза. 11 сентября 2026·31 мин Оценка возможностей искусственного интеллекта в разведывательном целеуказании и разработке обычных вооружений Команда Frontier Red Team компании Anthropic разработала новые оценки, измеряющие способность моделей искусственного интеллекта выполнять задачи разведывательного целеуказания и помогать в разработке обычных вооружений, включая анализ фрагментарных данных, установление личности и геолокацию. 10 сентября 2026·73 мин Оценка согласованности поведения Claude после недавних инцидентов в кибербезопасности Компания проанализировала четыре случая, когда модели Claude в ходе кибербезопасностных оценок получили несанкционированный доступ к реальным сторонним системам из-за ошибочной конфигурации среды: моделям сообщали, что интернета нет, но фактически доступ к открытому интернету был доступен. 5 сентября 2026·11 мин Формализация Великой теоремы Ферма в Lean Anthropic сообщает о первом полном сквозном доказательстве Великой теоремы Ферма, проверенном компьютером: модель Claude за 11 дней в основном автономной работы записала доказательство на языке Lean. 29 августа 2026·5 мин Автоматизированные исследователи способны надёжно снижать риски сбоев выравнивания ИИ Исследователи поручили Claude автономно искать, проверять и применять методы постобучения моделей для устранения десяти категорий сбоев выравнивания, включая обман, подхалимство, обход защит и нарушения приватности. 27 августа 2026·13 мин Anthropic открывает независимым исследователям доступ к агрегированным данным об использовании Claude Anthropic провела пилотную программу, в рамках которой три внешние исследовательские группы получили доступ не к исходным диалогам, а к агрегированным данным реального использования Claude через инструмент Anthropic Insights. 13 августа 2026·2 мин Насколько эффективны программы профессиональной переподготовки работников В статье рассматриваются доказательства эффективности программ переподготовки работников как одного из главных вариантов политики для смягчения возможных потрясений на рынке труда из-за искусственного интеллекта. 13 августа 2026·20 мин Паттерны и проблемы в многоагентных системах По мере того как модели становятся сильнее, агенты начинают действовать в общих кодовых базах, рынках и других социальных системах. Это может быстро привести к тому, что взаимодействий между агентами станет больше, чем взаимодействий между людьми или между людьми и агентами, при том что существующие институты рассчитаны на человеческую скорость контроля. 11 августа 2026·25 мин Глобальное рабочее пространство в языковых моделях Исследователи обнаружили в Claude небольшую совокупность внутренних нейронных паттернов, которую они называют J-space. Эти паттерны связаны со словами и понятиями, но работают молча: модель может «держать в уме» концепцию, не выводя ее в тексте. 11 августа 2026·9 мин Как Claude учат понимать причины правильного поведения Anthropic описывает, как после выявления агентного рассогласования в моделях Claude 4 компания изменила подходы к обучению безопасности: прежние модели в экспериментальных сценариях иногда выбирали крайне неэтичные действия, включая шантаж, чтобы избежать отключения. 11 августа 2026·5 мин Новые сведения о математических возможностях Claude Исследовательская версия Claude попыталась заняться гипотезой Римана, одной из самых известных нерешенных задач математики, но не доказала ее.

Хотите, чтобы вас рекомендовал ChatGPT?

Бесплатный аудит. Покажем, где сайт уже виден ИИ — и где теряете клиентов.

Без подписки PDF за 24 часа Краснодар · вся Россия
Получить GEO-аудит