Вышла Claude Sonnet 5.5 — быстрее и сильнее в коде

Вышла Claude Sonnet 5.5 — быстрее и сильнее в коде

Anthropic выпустила Claude Sonnet 5.5 — модель стала быстрее, экономнее и заметно сильнее в программировании.

Anthropic официально представила Claude Sonnet 5.5 — новую модель среднего уровня семейства Claude 5.5. Компания заявляет о более чем 30-процентном увеличении скорости генерации относительно Sonnet 5, заметном росте возможностей программирования и снижении фактической стоимости выполнения задач за счет меньшего расхода токенов. Цена API при этом не изменилась: $2 за миллион входных и $10 за миллион выходных токенов. Модель уже доступна через Claude, Claude Code, API и основные облачные платформы.

Anthropic Claude Sonnet 5.5 искусственный интеллект нейросети веб-разработка AI

Anthropic выпустила Claude Sonnet 5.5

Anthropic официально представила Claude Sonnet 5.5 — вторую модель нового семейства Claude 5.5 после вышедшей ранее Claude Opus 5.5.

Релиз состоялся 28 сентября 2026 года.

Новая модель должна занять место основного рабочего инструмента семейства: если Opus 5.5 рассчитана прежде всего на наиболее сложные открытые задачи, требующие продолжительного анализа и принятия решений, то Sonnet 5.5 оптимизирована для более четко поставленных повседневных задач.

Особое внимание Anthropic уделила программированию.

Компания сообщает о значительном улучшении результатов в agentic coding, способности модели работать с большими кодовыми базами и выполнять продолжительные задачи с использованием инструментов.

Но, пожалуй, самое интересное изменение заключается в эффективности.

Sonnet 5.5 не только стала сильнее предыдущей версии — она выполняет работу быстрее и в среднем расходует меньше токенов.

По данным Anthropic, новая модель генерирует ответы более чем на 30% быстрее Sonnet 5 и может обходиться до 30% дешевле на одну задачу, несмотря на сохранение прежних тарифов API.


Claude Sonnet 5.5 — середина нового семейства Claude

Теперь структура актуального семейства Anthropic становится понятнее.

Claude Opus 5.5 предназначена для наиболее сложных задач, где важны продолжительный анализ, архитектурные решения и работа с высокой степенью неопределенности.

Claude Sonnet 5.5 становится более универсальной рабочей моделью — для программирования, документов, анализа, интерфейсов и повседневной профессиональной работы.

Позже к ним должна присоединиться Claude Haiku 5.5, рассчитанная на высокую скорость, большой объем запросов и чувствительные к стоимости сценарии.

Anthropic прямо описывает Sonnet 5.5 как более быстрый и дешевый вариант по отношению к Opus 5.5.

И это особенно интересно для разработчиков.

Для изменения PHP-функции, создания компонента интерфейса или исправления локальной ошибки использование наиболее дорогой Opus не всегда оправдано.

Sonnet должна закрывать именно такие задачи.


Sonnet 5.5 стала более чем на 30% быстрее

Одно из наиболее заметных улучшений новой версии — скорость.

Anthropic заявляет, что Claude Sonnet 5.5 генерирует результат более чем на 30% быстрее Claude Sonnet 5.

Компания называет ее самой быстрой моделью Sonnet на сегодняшний день.

Для обычного общения разница может выражаться просто в более быстром появлении ответа.

Но для разработки значение намного серьезнее.

Современный coding agent работает итерациями:

изучил код → нашел файлы → внес изменения → запустил команду → получил ошибку → исправил → проверил повторно.

Если каждая такая операция выполняется быстрее, ускоряется весь цикл разработки.

Это особенно важно для Claude Code и других агентных инструментов, где один пользовательский запрос способен привести к десяткам внутренних операций.


Сильный рост в программировании

Именно coding стал одной из главных тем релиза.

Anthropic сообщает, что Claude Sonnet 5.5 значительно превосходит Sonnet 5 сразу в нескольких тестах программирования.

Один из наиболее заметных результатов — Terminal-Bench 4.0.

Этот benchmark оценивает способность AI-агента выполнять реальные задачи в терминальной среде.

По данным Anthropic:

Claude Sonnet 5.5 — 70,6%.

Claude Sonnet 5 — 10,3%.

Для сравнения, опубликованный Anthropic результат Claude Opus 5.5 составляет 66,4%.

Разница между Sonnet 5 и 5.5 здесь выглядит огромной.

Однако результаты одного benchmark нельзя автоматически интерпретировать как «Sonnet теперь всегда лучше Opus».

Сама Anthropic отдельно подчеркивает, что Opus 5.5 остается заметно сильнее в сложных открытых задачах, требующих продолжительного принятия решений.


FrontierCode показывает более сложную картину

На другом тесте — FrontierCode 1.1 Main — результаты выглядят иначе.

Anthropic приводит следующие показатели:

Claude Sonnet 5.5 — до 46,2% на Max effort.

Claude Sonnet 5 — 42,4%.

Claude Opus 5.5 — 54,4%.

Для сравнения в опубликованной таблице также приводится GPT-6 Sol — 49,3%, а на Xhigh — 52,1%.

Интересно, что максимальное reasoning в некоторых случаях не дает Sonnet 5.5 лучший результат.

Anthropic объясняет это особенностями самого теста.

FrontierCode проверяет, можно ли принять изменение кода без ручной доработки, и штрафует модель за выход за рамки поставленной задачи.

При Max effort Sonnet 5.5 иногда выполняла дополнительный code review с использованием нескольких subagents, что в отдельных случаях приводило к таймаутам или лишним изменениям.

Получается важный практический вывод:

больше reasoning не всегда означает лучший результат.

Для хорошо ограниченной задачи иногда эффективнее дать модели четкое ТЗ и умеренный уровень effort.


Sonnet 5.5 приблизилась к Opus в реальной разработке

Еще один интересный benchmark — CursorBench 4.0.

Он основан на задачах из реальных coding-сессий Cursor.

Здесь Anthropic приводит следующие результаты:

Claude Sonnet 5.5 — 55,5%.

Claude Sonnet 5 — 34,1%.

Claude Opus 5.5 — 57,8%.

То есть разрыв между Sonnet 5.5 и более дорогой Opus 5.5 составил около двух процентных пунктов.

Для разработчика это, возможно, один из наиболее интересных результатов релиза.

Sonnet начинает выглядеть не просто как облегченная модель, а как полноценный рабочий coding-инструмент.

При этом важно еще раз подчеркнуть: это результаты опубликованных Anthropic оценок и партнерских тестов, а не универсальная гарантия такого же соотношения на любом проекте.


Модель лучше работает с большими кодовыми базами

По отзывам компаний, участвовавших в предварительном тестировании, Sonnet 5.5 быстрее разбирается в существующей кодовой базе и эффективнее использует инструменты.

Anthropic сообщает, что в прямых сравнениях модель чаще объединяет tool calls, чем Sonnet 5.

Вместо большого количества мелких последовательных операций она может выполнять несколько связанных действий более эффективно.

Это уменьшает:

  • количество шагов;

  • задержки;

  • расход токенов;

  • стоимость выполнения задачи.

Для веб-разработки это особенно важно.

Реальная задача редко заключается в генерации одного изолированного файла.

Например, чтобы добавить функционал в WordPress, агенту может потребоваться:

  1. изучить структуру темы;

  2. найти регистрацию hooks;

  3. проверить существующий PHP-класс;

  4. найти JavaScript;

  5. изучить CSS;

  6. реализовать backend;

  7. изменить frontend;

  8. запустить проверки.

Чем лучше модель удерживает весь этот контекст и организует работу с инструментами, тем полезнее она становится именно как coding agent.


Меньше токенов на ту же работу

Еще одно важное изменение — эффективность использования токенов.

Цена API Claude Sonnet 5.5 осталась такой же, как у Sonnet 5:

$2 за 1 млн входных токенов.

$10 за 1 млн выходных токенов.

Чтение prompt cache стоит:

$0,20 за 1 млн токенов.

Запись в cache:

$2,50 за 1 млн токенов.

На первый взгляд получается, что новая модель не стала дешевле.

Но Anthropic утверждает, что Sonnet 5.5 требуется значительно меньше токенов для выполнения той же работы.

В результате реальная стоимость задачи может быть до 30% ниже, чем у Sonnet 5.

Это гораздо важнее формальной цены миллиона токенов.

Если одна модель стоит дешевле за токен, но для решения задачи делает в два раза больше шагов, итоговая экономия исчезает.

Поэтому для agentic AI постепенно становится важнее другой показатель:

стоимость выполненной задачи, а не просто цена токена.


До 15 раз дешевле Sonnet 5 в одном из coding-тестов

Anthropic приводит особенно интересное сравнение для FrontierCode.

На High effort новая Sonnet 5.5 получила результат примерно на 10 пунктов выше Sonnet 5 при сопоставимом режиме работы.

При этом, по данным компании, стоимость выполнения задачи оказалась примерно в 15 раз ниже.

Такой разрыв объясняется не изменением API-тарифа, а тем, насколько эффективнее новая модель выполняет задачу.

Это показывает направление развития современных AI-моделей.

Конкуренция идет уже не только за максимальный benchmark score.

Все важнее становятся:

качество × скорость × количество токенов × стоимость.

Для коммерческого использования это намного практичнее.


Sonnet 5.5 стала лучше не только в программировании

Хотя coding получил большое внимание, новая модель предназначена не только для разработчиков.

Anthropic сообщает о заметном росте возможностей в knowledge work.

На GDPval-AA v2.1:

Sonnet 5.5 — 1844.

Sonnet 5 — 1449.

Opus 5.5 — 1846.

То есть в этом тесте результат новой Sonnet практически сравнялся с Opus.

GDPval-AA оценивает выполнение реальных профессиональных задач в различных сферах.

По данным Anthropic, benchmark охватывает 44 профессии и девять крупных отраслей.

Компания также отмечает улучшения при работе с:

  • документами;

  • таблицами;

  • презентациями;

  • изображениями;

  • интерфейсами;

  • продолжительными многоэтапными задачами.


Anthropic отдельно отмечает дизайн

Интересный момент релиза — акцент на визуальном качестве.

Anthropic утверждает, что Sonnet 5.5 стала лучше работать с дизайном и интерфейсами.

Ранние тестировщики отмечали способность модели добавлять больше визуальной аккуратности в UI и точнее работать с шаблонами презентаций.

Для веб-разработчика это интересно в контексте frontend.

AI все чаще используется не просто для:

Напиши HTML и CSS.

а для полноценного цикла:

получить референс → создать интерфейс → открыть его → визуально проверить → исправить расхождения.

Улучшение визуального понимания и computer use делает такой сценарий значительно практичнее.


Sonnet 5.5 умеет работать продолжительное время

Anthropic также делает акцент на long-horizon tasks.

То есть задачах, которые требуют не одного ответа, а продолжительной последовательности действий.

В качестве необычного теста компания приводит Pokémon Red.

Sonnet 5.5 стала первой моделью семейства Sonnet, которая смогла превзойти соответствующий порог в игре, работая только со скриншотами.

Для обычного пользователя этот benchmark выглядит скорее как демонстрация.

Но проверяется здесь полезная способность:

модель должна воспринимать визуальное состояние, помнить цель, планировать действия и продолжать работу на протяжении большого количества шагов.

Именно эти качества нужны современному AI-агенту.


Claude Code становится еще интереснее

Для разработчиков главный практический вопрос — что новый релиз дает Claude Code.

Sonnet традиционно была одним из наиболее привлекательных вариантов для coding благодаря балансу стоимости и возможностей.

Sonnet 5.5 усиливает эту позицию.

Модель быстрее предыдущей версии, лучше показывает себя на agentic coding benchmarks и, по данным Anthropic, использует меньше шагов и токенов для выполнения задач.

Для типичной веб-разработки это может быть особенно полезно при:

  • создании нового функционала;

  • debugging;

  • рефакторинге;

  • разработке WordPress;

  • работе с PHP;

  • JavaScript/TypeScript;

  • React;

  • интеграциях;

  • написании тестов;

  • анализе legacy-кода;

  • frontend-разработке.

При этом Opus 5.5 сохраняет преимущество для наиболее сложных архитектурных и открытых задач.

Получается достаточно понятное разделение:

Sonnet 5.5 — основная рабочая модель.

Opus 5.5 — модель для самых сложных задач.


Sonnet 5.5 появилась в GitHub Copilot

Новая модель уже вышла за пределы собственных продуктов Anthropic.

GitHub подтвердил, что Claude Sonnet 5.5 стала общедоступна в GitHub Copilot.

GitHub описывает модель как подходящую для хорошо определенных повседневных задач разработки.

Это хорошо соответствует позиционированию самой Anthropic.

Sonnet 5.5 должна быть моделью, которую можно использовать регулярно, а не только подключать к самым сложным задачам.


Где доступна Claude Sonnet 5.5

По информации Anthropic, Claude Sonnet 5.5 уже доступна на всех основных платформах компании.

Для разработчиков модель доступна через Claude Platform под идентификатором:

claude-sonnet-5-5

Также Anthropic сообщает о доступности через крупные облачные платформы:

Amazon Web Services, Google Cloud и Microsoft Azure.

Модель доступна и в пользовательских продуктах Claude.

Кроме того, Anthropic сохраняет возможность работы с Sonnet 5.5 в режиме zero data retention.


Появились уровни effort

Еще одна полезная возможность — управление количеством усилий, которое модель тратит на задачу.

Для Sonnet 5.5 можно изменять effort level.

На более низком уровне модель отвечает быстрее и использует меньше токенов.

На более высоком — дольше анализирует задачу и тщательнее проверяет результат.

Anthropic сообщает, что в Claude Code и пользовательских приложениях по умолчанию используется Medium, а Claude Platform по умолчанию работает с High.

Практически это позволяет подбирать режим под задачу.

Например:

простое изменение CSS → низкий или средний effort;

обычный функционал → medium;

сложный debugging → high;

архитектурная задача → более высокий уровень или переход на Opus.

Это более рационально, чем заставлять модель использовать максимальный reasoning для любого изменения.


Усилена безопасность для cybersecurity

Рост coding-возможностей привел и к усилению защитных механизмов.

Anthropic сообщает, что возможности Sonnet 5.5 в cybersecurity значительно выросли относительно Sonnet 5.

Поэтому это первая модель Sonnet, которая запускается с cyber safeguards и fallback-механизмами, аналогичными тем, которые компания применяет для своих наиболее мощных моделей.

При высокорисковых cybersecurity-запросах система может переключать выполнение на Sonnet 5.

При этом Anthropic отдельно отмечает, что обычная разработка программного обеспечения, поиск ошибок и исправление собственного кода этими ограничениями в большинстве случаев не затрагиваются.

Для профессиональных специалистов по безопасности компания готовит расширенную Cyber Verification Program.


Усилена защита reasoning модели

Еще одно менее заметное, но технически интересное изменение связано с distillation attacks.

Такие атаки пытаются использовать большое количество запросов для извлечения возможностей более сильной модели и обучения на ее результатах другой системы.

Из-за значительного роста возможностей Sonnet 5.5 Anthropic впервые для семейства Sonnet добавила специальные классификаторы, препятствующие извлечению reasoning в промышленных масштабах.

Также расширен механизм preserved thinking.

Для большинства обычных разработчиков это изменение должно остаться практически незаметным.

Но при переносе разговоров между разными аккаунтами, в том числе во время работы Claude Code, могут появиться дополнительные особенности.


Стала ли Sonnet 5.5 лучше Opus 5.5?

По отдельным benchmark — да.

Например, опубликованный результат Terminal-Bench 4.0 у Sonnet 5.5 выше.

Но делать из этого вывод:

Sonnet 5.5 теперь мощнее Opus 5.5.

— неправильно.

Сама Anthropic прямо говорит, что Opus 5.5 остается заметно сильнее в сложных открытых задачах, требующих продолжительного анализа и принятия решений.

Benchmark измеряет конкретную способность в определенных условиях.

Поэтому выбор лучше делать по типу работы.

Sonnet 5.5 выглядит особенно интересно для хорошо поставленных и ограниченных задач.

Opus — для ситуаций, где сама модель должна определить направление решения сложной проблемы.


Что Claude Sonnet 5.5 дает веб-разработчику

Для веб-разработки релиз выглядит действительно интересным.

Основное преимущество я вижу даже не в увеличении benchmark score.

Важнее сочетание четырех факторов:

модель стала сильнее;

работает более чем на 30% быстрее;

использует меньше токенов;

цена API не выросла.

Именно это определяет удобство AI в реальной ежедневной разработке.

Если модель быстрее изучает WordPress-проект, делает меньше лишних tool calls, точнее выполняет задачу и требует меньше итераций исправления — экономия времени становится значительно важнее нескольких дополнительных процентов в синтетическом тесте.

Особенно это заметно при продолжительных задачах.

Например:

Изучи реализацию корзины WooCommerce, найди причину повторного AJAX-запроса, сделай минимальное исправление, проверь связанные сценарии и не изменяй несвязанный код.

Для такой задачи важна не способность написать одну функцию.

Нужно понимать существующий проект, пользоваться инструментами, сохранять контекст и доводить работу до проверенного результата.

Именно в эту сторону Anthropic развивает Sonnet.


Sonnet 5.5 против GPT-6 Sol

Сравнение с GPT-6 Sol неизбежно, поскольку обе модели претендуют на роль основной рабочей модели для разработчиков.

Но здесь важно не превращать отдельные benchmark в абсолютный рейтинг.

В опубликованной Anthropic таблице FrontierCode 1.1:

Sonnet 5.5 Max — 46,2%.

GPT-6 Sol — 49,3%.

GPT-6 Sol Xhigh — 52,1%.

При этом на GDPval-AA v2.1 Anthropic приводит:

Sonnet 5.5 — 1844.

GPT-6 Sol — 1487.

Результаты зависят от benchmark, настроек reasoning, агентной оболочки, инструментов и стоимости выполнения.

Поэтому правильнее говорить не о безусловном победителе, а о том, что конкуренция в сегменте рабочих AI-моделей стала еще плотнее.

Для разработчика это хорошая ситуация.

Можно выбирать модель исходя из конкретного проекта, качества работы с кодовой базой, скорости и фактической стоимости задачи.


Стоит ли переходить с Sonnet 5

Для большинства сценариев ответ выглядит достаточно очевидным.

Sonnet 5.5 сохраняет прежнюю цену API, при этом Anthropic заявляет:

  • более высокую производительность;

  • более чем 30-процентный рост скорости;

  • меньший расход токенов;

  • серьезное улучшение coding;

  • более эффективную работу с инструментами;

  • улучшенное взаимодействие с пользователем.

Но для production API переход все равно стоит выполнять контролируемо.

Если приложение зависит от конкретного поведения Sonnet 5, сначала необходимо проверить:

  • prompts;

  • structured output;

  • tool calling;

  • latency;

  • расход токенов;

  • качество на собственных evals.

Особенно это важно для автоматизированных систем, где даже улучшенная модель может иначе интерпретировать старый prompt.


Claude Sonnet 5.5 — один из главных релизов для разработчиков

Sonnet всегда занимала интересное место в линейке Claude.

Это не самая дорогая и мощная модель Anthropic, но именно такой класс моделей часто становится основным рабочим инструментом.

С Claude Sonnet 5.5 компания заметно усиливает этот подход.

Модель не просто получила очередное увеличение результатов в benchmark.

Она стала быстрее и эффективнее, сохранив прежнюю цену API.

Для coding agents это особенно важно.

AI-разработка постепенно переходит от коротких запросов:

Напиши функцию.

к задачам уровня:

Изучи проект, реализуй функционал, проверь его и доведи изменение до рабочего состояния.

В таких сценариях скорость, количество tool calls, расход токенов и способность работать продолжительное время становятся не менее важными, чем чистая интеллектуальная мощность модели.

И именно поэтому Claude Sonnet 5.5 может оказаться значительно более важным обновлением для ежедневной разработки, чем кажется по одному только номеру версии.


AI и современная веб-разработка

Использую современные AI-инструменты при разработке сайтов, индивидуального функционала, интеграций и автоматизации рабочих процессов.

Если вам нужен сайт под ключ, интернет-магазин или доработка существующего проекта — подробнее об услугах можно узнать на denkon.ru.