Anthropic выпустила Claude Sonnet 5.5
Anthropic официально представила Claude Sonnet 5.5 — вторую модель нового семейства Claude 5.5 после вышедшей ранее Claude Opus 5.5.
Релиз состоялся 28 сентября 2026 года.
Новая модель должна занять место основного рабочего инструмента семейства: если Opus 5.5 рассчитана прежде всего на наиболее сложные открытые задачи, требующие продолжительного анализа и принятия решений, то Sonnet 5.5 оптимизирована для более четко поставленных повседневных задач.
Особое внимание Anthropic уделила программированию.
Компания сообщает о значительном улучшении результатов в agentic coding, способности модели работать с большими кодовыми базами и выполнять продолжительные задачи с использованием инструментов.
Но, пожалуй, самое интересное изменение заключается в эффективности.
Sonnet 5.5 не только стала сильнее предыдущей версии — она выполняет работу быстрее и в среднем расходует меньше токенов.
По данным Anthropic, новая модель генерирует ответы более чем на 30% быстрее Sonnet 5 и может обходиться до 30% дешевле на одну задачу, несмотря на сохранение прежних тарифов API.
Claude Sonnet 5.5 — середина нового семейства Claude
Теперь структура актуального семейства Anthropic становится понятнее.
Claude Opus 5.5 предназначена для наиболее сложных задач, где важны продолжительный анализ, архитектурные решения и работа с высокой степенью неопределенности.
Claude Sonnet 5.5 становится более универсальной рабочей моделью — для программирования, документов, анализа, интерфейсов и повседневной профессиональной работы.
Позже к ним должна присоединиться Claude Haiku 5.5, рассчитанная на высокую скорость, большой объем запросов и чувствительные к стоимости сценарии.
Anthropic прямо описывает Sonnet 5.5 как более быстрый и дешевый вариант по отношению к Opus 5.5.
И это особенно интересно для разработчиков.
Для изменения PHP-функции, создания компонента интерфейса или исправления локальной ошибки использование наиболее дорогой Opus не всегда оправдано.
Sonnet должна закрывать именно такие задачи.
Sonnet 5.5 стала более чем на 30% быстрее
Одно из наиболее заметных улучшений новой версии — скорость.
Anthropic заявляет, что Claude Sonnet 5.5 генерирует результат более чем на 30% быстрее Claude Sonnet 5.
Компания называет ее самой быстрой моделью Sonnet на сегодняшний день.
Для обычного общения разница может выражаться просто в более быстром появлении ответа.
Но для разработки значение намного серьезнее.
Современный coding agent работает итерациями:
изучил код → нашел файлы → внес изменения → запустил команду → получил ошибку → исправил → проверил повторно.
Если каждая такая операция выполняется быстрее, ускоряется весь цикл разработки.
Это особенно важно для Claude Code и других агентных инструментов, где один пользовательский запрос способен привести к десяткам внутренних операций.
Сильный рост в программировании
Именно coding стал одной из главных тем релиза.
Anthropic сообщает, что Claude Sonnet 5.5 значительно превосходит Sonnet 5 сразу в нескольких тестах программирования.
Один из наиболее заметных результатов — Terminal-Bench 4.0.
Этот benchmark оценивает способность AI-агента выполнять реальные задачи в терминальной среде.
По данным Anthropic:
Claude Sonnet 5.5 — 70,6%.
Claude Sonnet 5 — 10,3%.
Для сравнения, опубликованный Anthropic результат Claude Opus 5.5 составляет 66,4%.
Разница между Sonnet 5 и 5.5 здесь выглядит огромной.
Однако результаты одного benchmark нельзя автоматически интерпретировать как «Sonnet теперь всегда лучше Opus».
Сама Anthropic отдельно подчеркивает, что Opus 5.5 остается заметно сильнее в сложных открытых задачах, требующих продолжительного принятия решений.
FrontierCode показывает более сложную картину
На другом тесте — FrontierCode 1.1 Main — результаты выглядят иначе.
Anthropic приводит следующие показатели:
Claude Sonnet 5.5 — до 46,2% на Max effort.
Claude Sonnet 5 — 42,4%.
Claude Opus 5.5 — 54,4%.
Для сравнения в опубликованной таблице также приводится GPT-6 Sol — 49,3%, а на Xhigh — 52,1%.
Интересно, что максимальное reasoning в некоторых случаях не дает Sonnet 5.5 лучший результат.
Anthropic объясняет это особенностями самого теста.
FrontierCode проверяет, можно ли принять изменение кода без ручной доработки, и штрафует модель за выход за рамки поставленной задачи.
При Max effort Sonnet 5.5 иногда выполняла дополнительный code review с использованием нескольких subagents, что в отдельных случаях приводило к таймаутам или лишним изменениям.
Получается важный практический вывод:
больше reasoning не всегда означает лучший результат.
Для хорошо ограниченной задачи иногда эффективнее дать модели четкое ТЗ и умеренный уровень effort.
Sonnet 5.5 приблизилась к Opus в реальной разработке
Еще один интересный benchmark — CursorBench 4.0.
Он основан на задачах из реальных coding-сессий Cursor.
Здесь Anthropic приводит следующие результаты:
Claude Sonnet 5.5 — 55,5%.
Claude Sonnet 5 — 34,1%.
Claude Opus 5.5 — 57,8%.
То есть разрыв между Sonnet 5.5 и более дорогой Opus 5.5 составил около двух процентных пунктов.
Для разработчика это, возможно, один из наиболее интересных результатов релиза.
Sonnet начинает выглядеть не просто как облегченная модель, а как полноценный рабочий coding-инструмент.
При этом важно еще раз подчеркнуть: это результаты опубликованных Anthropic оценок и партнерских тестов, а не универсальная гарантия такого же соотношения на любом проекте.
Модель лучше работает с большими кодовыми базами
По отзывам компаний, участвовавших в предварительном тестировании, Sonnet 5.5 быстрее разбирается в существующей кодовой базе и эффективнее использует инструменты.
Anthropic сообщает, что в прямых сравнениях модель чаще объединяет tool calls, чем Sonnet 5.
Вместо большого количества мелких последовательных операций она может выполнять несколько связанных действий более эффективно.
Это уменьшает:
-
количество шагов;
-
задержки;
-
расход токенов;
-
стоимость выполнения задачи.
Для веб-разработки это особенно важно.
Реальная задача редко заключается в генерации одного изолированного файла.
Например, чтобы добавить функционал в WordPress, агенту может потребоваться:
-
изучить структуру темы;
-
найти регистрацию hooks;
-
проверить существующий PHP-класс;
-
найти JavaScript;
-
изучить CSS;
-
реализовать backend;
-
изменить frontend;
-
запустить проверки.
Чем лучше модель удерживает весь этот контекст и организует работу с инструментами, тем полезнее она становится именно как coding agent.
Меньше токенов на ту же работу
Еще одно важное изменение — эффективность использования токенов.
Цена API Claude Sonnet 5.5 осталась такой же, как у Sonnet 5:
$2 за 1 млн входных токенов.
$10 за 1 млн выходных токенов.
Чтение prompt cache стоит:
$0,20 за 1 млн токенов.
Запись в cache:
$2,50 за 1 млн токенов.
На первый взгляд получается, что новая модель не стала дешевле.
Но Anthropic утверждает, что Sonnet 5.5 требуется значительно меньше токенов для выполнения той же работы.
В результате реальная стоимость задачи может быть до 30% ниже, чем у Sonnet 5.
Это гораздо важнее формальной цены миллиона токенов.
Если одна модель стоит дешевле за токен, но для решения задачи делает в два раза больше шагов, итоговая экономия исчезает.
Поэтому для agentic AI постепенно становится важнее другой показатель:
стоимость выполненной задачи, а не просто цена токена.
До 15 раз дешевле Sonnet 5 в одном из coding-тестов
Anthropic приводит особенно интересное сравнение для FrontierCode.
На High effort новая Sonnet 5.5 получила результат примерно на 10 пунктов выше Sonnet 5 при сопоставимом режиме работы.
При этом, по данным компании, стоимость выполнения задачи оказалась примерно в 15 раз ниже.
Такой разрыв объясняется не изменением API-тарифа, а тем, насколько эффективнее новая модель выполняет задачу.
Это показывает направление развития современных AI-моделей.
Конкуренция идет уже не только за максимальный benchmark score.
Все важнее становятся:
качество × скорость × количество токенов × стоимость.
Для коммерческого использования это намного практичнее.
Sonnet 5.5 стала лучше не только в программировании
Хотя coding получил большое внимание, новая модель предназначена не только для разработчиков.
Anthropic сообщает о заметном росте возможностей в knowledge work.
На GDPval-AA v2.1:
Sonnet 5.5 — 1844.
Sonnet 5 — 1449.
Opus 5.5 — 1846.
То есть в этом тесте результат новой Sonnet практически сравнялся с Opus.
GDPval-AA оценивает выполнение реальных профессиональных задач в различных сферах.
По данным Anthropic, benchmark охватывает 44 профессии и девять крупных отраслей.
Компания также отмечает улучшения при работе с:
-
документами;
-
таблицами;
-
презентациями;
-
изображениями;
-
интерфейсами;
-
продолжительными многоэтапными задачами.
Anthropic отдельно отмечает дизайн
Интересный момент релиза — акцент на визуальном качестве.
Anthropic утверждает, что Sonnet 5.5 стала лучше работать с дизайном и интерфейсами.
Ранние тестировщики отмечали способность модели добавлять больше визуальной аккуратности в UI и точнее работать с шаблонами презентаций.
Для веб-разработчика это интересно в контексте frontend.
AI все чаще используется не просто для:
Напиши HTML и CSS.
а для полноценного цикла:
получить референс → создать интерфейс → открыть его → визуально проверить → исправить расхождения.
Улучшение визуального понимания и computer use делает такой сценарий значительно практичнее.
Sonnet 5.5 умеет работать продолжительное время
Anthropic также делает акцент на long-horizon tasks.
То есть задачах, которые требуют не одного ответа, а продолжительной последовательности действий.
В качестве необычного теста компания приводит Pokémon Red.
Sonnet 5.5 стала первой моделью семейства Sonnet, которая смогла превзойти соответствующий порог в игре, работая только со скриншотами.
Для обычного пользователя этот benchmark выглядит скорее как демонстрация.
Но проверяется здесь полезная способность:
модель должна воспринимать визуальное состояние, помнить цель, планировать действия и продолжать работу на протяжении большого количества шагов.
Именно эти качества нужны современному AI-агенту.
Claude Code становится еще интереснее
Для разработчиков главный практический вопрос — что новый релиз дает Claude Code.
Sonnet традиционно была одним из наиболее привлекательных вариантов для coding благодаря балансу стоимости и возможностей.
Sonnet 5.5 усиливает эту позицию.
Модель быстрее предыдущей версии, лучше показывает себя на agentic coding benchmarks и, по данным Anthropic, использует меньше шагов и токенов для выполнения задач.
Для типичной веб-разработки это может быть особенно полезно при:
-
создании нового функционала;
-
debugging;
-
рефакторинге;
-
разработке WordPress;
-
работе с PHP;
-
JavaScript/TypeScript;
-
React;
-
интеграциях;
-
написании тестов;
-
анализе legacy-кода;
-
frontend-разработке.
При этом Opus 5.5 сохраняет преимущество для наиболее сложных архитектурных и открытых задач.
Получается достаточно понятное разделение:
Sonnet 5.5 — основная рабочая модель.
Opus 5.5 — модель для самых сложных задач.
Sonnet 5.5 появилась в GitHub Copilot
Новая модель уже вышла за пределы собственных продуктов Anthropic.
GitHub подтвердил, что Claude Sonnet 5.5 стала общедоступна в GitHub Copilot.
GitHub описывает модель как подходящую для хорошо определенных повседневных задач разработки.
Это хорошо соответствует позиционированию самой Anthropic.
Sonnet 5.5 должна быть моделью, которую можно использовать регулярно, а не только подключать к самым сложным задачам.
Где доступна Claude Sonnet 5.5
По информации Anthropic, Claude Sonnet 5.5 уже доступна на всех основных платформах компании.
Для разработчиков модель доступна через Claude Platform под идентификатором:
claude-sonnet-5-5
Также Anthropic сообщает о доступности через крупные облачные платформы:
Amazon Web Services, Google Cloud и Microsoft Azure.
Модель доступна и в пользовательских продуктах Claude.
Кроме того, Anthropic сохраняет возможность работы с Sonnet 5.5 в режиме zero data retention.
Появились уровни effort
Еще одна полезная возможность — управление количеством усилий, которое модель тратит на задачу.
Для Sonnet 5.5 можно изменять effort level.
На более низком уровне модель отвечает быстрее и использует меньше токенов.
На более высоком — дольше анализирует задачу и тщательнее проверяет результат.
Anthropic сообщает, что в Claude Code и пользовательских приложениях по умолчанию используется Medium, а Claude Platform по умолчанию работает с High.
Практически это позволяет подбирать режим под задачу.
Например:
простое изменение CSS → низкий или средний effort;
обычный функционал → medium;
сложный debugging → high;
архитектурная задача → более высокий уровень или переход на Opus.
Это более рационально, чем заставлять модель использовать максимальный reasoning для любого изменения.
Усилена безопасность для cybersecurity
Рост coding-возможностей привел и к усилению защитных механизмов.
Anthropic сообщает, что возможности Sonnet 5.5 в cybersecurity значительно выросли относительно Sonnet 5.
Поэтому это первая модель Sonnet, которая запускается с cyber safeguards и fallback-механизмами, аналогичными тем, которые компания применяет для своих наиболее мощных моделей.
При высокорисковых cybersecurity-запросах система может переключать выполнение на Sonnet 5.
При этом Anthropic отдельно отмечает, что обычная разработка программного обеспечения, поиск ошибок и исправление собственного кода этими ограничениями в большинстве случаев не затрагиваются.
Для профессиональных специалистов по безопасности компания готовит расширенную Cyber Verification Program.
Усилена защита reasoning модели
Еще одно менее заметное, но технически интересное изменение связано с distillation attacks.
Такие атаки пытаются использовать большое количество запросов для извлечения возможностей более сильной модели и обучения на ее результатах другой системы.
Из-за значительного роста возможностей Sonnet 5.5 Anthropic впервые для семейства Sonnet добавила специальные классификаторы, препятствующие извлечению reasoning в промышленных масштабах.
Также расширен механизм preserved thinking.
Для большинства обычных разработчиков это изменение должно остаться практически незаметным.
Но при переносе разговоров между разными аккаунтами, в том числе во время работы Claude Code, могут появиться дополнительные особенности.
Стала ли Sonnet 5.5 лучше Opus 5.5?
По отдельным benchmark — да.
Например, опубликованный результат Terminal-Bench 4.0 у Sonnet 5.5 выше.
Но делать из этого вывод:
Sonnet 5.5 теперь мощнее Opus 5.5.
— неправильно.
Сама Anthropic прямо говорит, что Opus 5.5 остается заметно сильнее в сложных открытых задачах, требующих продолжительного анализа и принятия решений.
Benchmark измеряет конкретную способность в определенных условиях.
Поэтому выбор лучше делать по типу работы.
Sonnet 5.5 выглядит особенно интересно для хорошо поставленных и ограниченных задач.
Opus — для ситуаций, где сама модель должна определить направление решения сложной проблемы.
Что Claude Sonnet 5.5 дает веб-разработчику
Для веб-разработки релиз выглядит действительно интересным.
Основное преимущество я вижу даже не в увеличении benchmark score.
Важнее сочетание четырех факторов:
модель стала сильнее;
работает более чем на 30% быстрее;
использует меньше токенов;
цена API не выросла.
Именно это определяет удобство AI в реальной ежедневной разработке.
Если модель быстрее изучает WordPress-проект, делает меньше лишних tool calls, точнее выполняет задачу и требует меньше итераций исправления — экономия времени становится значительно важнее нескольких дополнительных процентов в синтетическом тесте.
Особенно это заметно при продолжительных задачах.
Например:
Изучи реализацию корзины WooCommerce, найди причину повторного AJAX-запроса, сделай минимальное исправление, проверь связанные сценарии и не изменяй несвязанный код.
Для такой задачи важна не способность написать одну функцию.
Нужно понимать существующий проект, пользоваться инструментами, сохранять контекст и доводить работу до проверенного результата.
Именно в эту сторону Anthropic развивает Sonnet.
Sonnet 5.5 против GPT-6 Sol
Сравнение с GPT-6 Sol неизбежно, поскольку обе модели претендуют на роль основной рабочей модели для разработчиков.
Но здесь важно не превращать отдельные benchmark в абсолютный рейтинг.
В опубликованной Anthropic таблице FrontierCode 1.1:
Sonnet 5.5 Max — 46,2%.
GPT-6 Sol — 49,3%.
GPT-6 Sol Xhigh — 52,1%.
При этом на GDPval-AA v2.1 Anthropic приводит:
Sonnet 5.5 — 1844.
GPT-6 Sol — 1487.
Результаты зависят от benchmark, настроек reasoning, агентной оболочки, инструментов и стоимости выполнения.
Поэтому правильнее говорить не о безусловном победителе, а о том, что конкуренция в сегменте рабочих AI-моделей стала еще плотнее.
Для разработчика это хорошая ситуация.
Можно выбирать модель исходя из конкретного проекта, качества работы с кодовой базой, скорости и фактической стоимости задачи.
Стоит ли переходить с Sonnet 5
Для большинства сценариев ответ выглядит достаточно очевидным.
Sonnet 5.5 сохраняет прежнюю цену API, при этом Anthropic заявляет:
-
более высокую производительность;
-
более чем 30-процентный рост скорости;
-
меньший расход токенов;
-
серьезное улучшение coding;
-
более эффективную работу с инструментами;
-
улучшенное взаимодействие с пользователем.
Но для production API переход все равно стоит выполнять контролируемо.
Если приложение зависит от конкретного поведения Sonnet 5, сначала необходимо проверить:
-
prompts;
-
structured output;
-
tool calling;
-
latency;
-
расход токенов;
-
качество на собственных evals.
Особенно это важно для автоматизированных систем, где даже улучшенная модель может иначе интерпретировать старый prompt.
Claude Sonnet 5.5 — один из главных релизов для разработчиков
Sonnet всегда занимала интересное место в линейке Claude.
Это не самая дорогая и мощная модель Anthropic, но именно такой класс моделей часто становится основным рабочим инструментом.
С Claude Sonnet 5.5 компания заметно усиливает этот подход.
Модель не просто получила очередное увеличение результатов в benchmark.
Она стала быстрее и эффективнее, сохранив прежнюю цену API.
Для coding agents это особенно важно.
AI-разработка постепенно переходит от коротких запросов:
Напиши функцию.
к задачам уровня:
Изучи проект, реализуй функционал, проверь его и доведи изменение до рабочего состояния.
В таких сценариях скорость, количество tool calls, расход токенов и способность работать продолжительное время становятся не менее важными, чем чистая интеллектуальная мощность модели.
И именно поэтому Claude Sonnet 5.5 может оказаться значительно более важным обновлением для ежедневной разработки, чем кажется по одному только номеру версии.
AI и современная веб-разработка
Использую современные AI-инструменты при разработке сайтов, индивидуального функционала, интеграций и автоматизации рабочих процессов.
Если вам нужен сайт под ключ, интернет-магазин или доработка существующего проекта — подробнее об услугах можно узнать на denkon.ru.