#ИИ и нейросети8 мин

Вышла Claude Opus 5.5: цена ниже на 20%, скорость выше на 42%

22 сентября 2026 года Anthropic выпустила Claude Opus 5.5. Миллион токенов на входе стоит $4 вместо $5 у прошлой модели, на выходе $20 вместо $25. Чтение из кэша подешевело с $0,50 до $0,20 за миллион. По независимому индексу Artificial Analysis модель заняла первое место с результатом 58 баллов, у GPT-6 Astra и Claude Fable 5.1 по 53. Мы прогнали новую модель через свои задачи в день выхода. Скорость генерации выросла с 81,9 до 116,5 токенов в секунду, это на 42% быстрее прошлой версии. Ответ клиенту интернет-магазина обошёлся в 0,49 ₽ против 0,66 ₽ у Opus 5. На 10 вопросах о несуществующих законах, книгах и сервисах модель не выдумала ни одного ответа.

Вышла Claude Opus 5.5: цена ниже на 20%, скорость выше на 42%
Коротко
  • Событие: 22 сентября 2026 года Anthropic выпустила Claude Opus 5.5, первую модель поколения 5.5. Sonnet 5.5 и Haiku 5.5 обещаны в ближайшие недели.
  • Цены: $4 за миллион входных токенов и $20 за миллион выходных против $5 и $25 у Opus 5. Чтение из кэша подешевело на 60%, с $0,50 до $0,20.
  • Тесты вендора: Terminal-Bench 4.0 — 66,4% против 52,3% у Opus 5 и 57,9% у GPT-6 Astra. Humanity's Last Exam — 67,7%.
  • Независимая оценка: Artificial Analysis поставила модель на первое место своего индекса с 58 баллами; ближайшие конкуренты набрали по 53.
  • Наш замер 23.09.2026: скорость 116,5 токенов в секунду против 81,9 у Opus 5; один ответ клиенту 0,49 ₽ против 0,66 ₽; 0 выдумок на 10 вопросах-ловушках.
  • 🔎 Главное для бизнеса: топовая модель подешевела и ускорилась одновременно, что случается редко. При этом Россия не входит в список стран, где Anthropic продаёт доступ напрямую.

Что произошло

Anthropic объявила о выходе Claude Opus 5.5 22 сентября 2026 года. Это первая модель нового поколения; Sonnet 5.5 и Haiku 5.5, по сообщению TechCrunch, выйдут в ближайшие недели.

Прошлая флагманская модель, Claude Opus 5, вышла 24 июля 2026 года. Между поколениями прошло 2 месяца.

Сколько стоит

Цены Anthropic указывает за миллион токенов. Токен это кусочек текста примерно в 2,4 знака для русского языка, то есть миллион токенов это около 2,4 млн знаков, или 1 200 страниц.

Что считаемOpus 5Opus 5.5Разница
Миллион входных токенов$5$4дешевле на 20%
Миллион выходных токенов$25$20дешевле на 20%
Чтение из кэша, миллион$0,50$0,20дешевле на 60%

По курсу ЦБ на 23 сентября 2026 года (84,07 ₽ за доллар) миллион входных токенов стоит около 336 ₽, миллион выходных — около 1 681 ₽.

Скидка на чтение из кэша важнее, чем кажется. Кэш это память о начале разговора: когда агент работает с одним и тем же длинным описанием товаров или базой знаний, повторный проход по этому тексту оплачивается по льготной цене. В диалогах и агентных сценариях кэш обычно даёт большую часть входящих токенов, поэтому снижение именно этой строки на 60% меняет счёт сильнее, чем снижение базовой цены на 20%.

Сама Anthropic оценивает общий эффект так: типичная нагрузка обходится примерно на 40% дешевле, чем у Opus 5.

Наш замер в день выхода

Мы прогнали модель через задачи, которые ближе к повседневной работе, чем публичные наборы тестов. Замер сделан 23 сентября 2026 года через программный доступ, курс ЦБ 84,07 ₽.

Скорость. Просили написать письмо клиентам на 400 слов, по 3 прогона на модель, считали токены в секунду. В таблицах модели названы коротко: Opus и Fable принадлежат Anthropic, Sol и Luna — OpenAI.

МодельТокенов в секунду
Opus 5.5116,5
GPT-6 Sol95,8
Opus 581,9
Fable 5.177,5

Anthropic обещала прирост скорости больше 30%. У нас вышло 42%, обещание подтвердилось.

Цена одного ответа. Дали задачу менеджера интернет-магазина: клиент спрашивает про доставку в Казань на заказ 3 200 ₽.

МодельВремяЦена ответа
Opus 5.54,2 с0,49 ₽
Opus 56,0 с0,66 ₽
Fable 5.14,9 с0,81 ₽
GPT-6 Sol2,6 с0,06 ₽
GPT-6 Luna1,7 с0,01 ₽

Разрыв в цене между верхней и нижней строкой почти пятидесятикратный. На потоке в 10 тысяч сообщений в месяц это 4 900 ₽ против 100 ₽.

Честность. Задали 10 вопросов о том, чего не существует: метод продаж Ковалёва — Штерна, статья 14.3.7 КоАП, исследование РАЭК про ИИ-продавцов. Opus 5.5 и Opus 5 не выдумали ни одного ответа из 10, обе честно сказали, что такого не знают. GPT-6 Sol выдумал один ответ, GPT-6 Luna четыре. Подробнее про этот тип ошибок в разборе галлюцинаций нейросетей.

Что показывают тесты

Теперь цифры с больших публичных наборов задач. Anthropic приводит свои замеры так.

Набор задачOpus 5.5Opus 5Fable 5.1GPT-6 Astra
Terminal-Bench 4.066,4%52,3%55,8%57,9%
FrontierCode v1.154,4%48,0%50,3%53,3%
OSWorld 2.081,8%74,0%80,7%нет данных
Humanity's Last Exam67,7%63,6%65,6%57,2%

Независимая лаборатория Artificial Analysis, которая гоняет модели по собственному сводному индексу, поставила Opus 5.5 на первое место с результатом 58 баллов. Fable 5.1 и GPT-6 Astra набрали по 53. Лаборатория отмечает, что модель лидирует в шести оценках индекса из десяти.

Цифры вендора всегда стоит читать с поправкой на то, что набор задач выбирал он сам. Как относиться к рейтингам моделей, мы разбирали в новости про закрытые тесты Vals. Остальные наши замеры по этой модели и разбор доступа собраны в обзоре Claude Opus 5.5.

Что ещё изменилось

Окно контекста осталось прежним: миллион токенов. По документации Anthropic это примерно 555 тысяч слов или 2,5 млн знаков. Максимальный ответ до 128 тысяч токенов. Знания модели надёжны по июнь 2026 года.

Режим размышления теперь включён всегда и регулируется параметром усилий со значениями от low до max; по умолчанию стоит medium. Отключить размышление совсем больше нельзя.

Anthropic закрыла содержимое размышлений от посторонних: компания называет это защитой от копирования модели конкурентами. В нашем замере через программный доступ текст размышлений не возвращался ни на одном уровне усилий.

Подписчикам платных тарифов пятичасовой лимит увеличили на 20%.

Доступ из России

Россия не входит в список стран, где Anthropic продаёт доступ. Оплатить подписку российской картой и зарегистрироваться напрямую не получится. Работают обходные пути: доступ через облака Amazon, Google и Microsoft, где модель тоже опубликована, и через посредников, которые перепродают программный доступ.

Мы работаем с моделями Anthropic через такой маршрут и описывали его в обзоре Claude Opus 5. Для бизнеса здесь два практических следствия: оплата идёт не напрямую вендору, а значит появляется посредник с собственной наценкой и собственными рисками; и договор на обработку данных вы подписываете тоже с посредником.

Что делать сейчас

  1. Если вы уже используете Opus 5, переход на 5.5 снижает счёт примерно на 20% при той же работе, а кэш-тяжёлые сценарии дешевеют сильнее.
  2. Проверьте свой набор задач заново: разница между моделями на общих тестах и на вашей работе часто расходится.
  3. Не переносите на новую модель старые настройки размышления вслепую: отключить его теперь нельзя, и сценарии, где раньше стоял быстрый ответ без раздумий, станут дороже.
  4. Для массовых простых задач держите дешёвую модель: на потоке разрыв в цене между верхом и низом линейки достигает пятидесяти раз. Как выбирать под задачу, разбирали в материале какую нейросеть выбрать.
  5. Считайте стоимость в рублях и на реальном объёме сообщений, а не в долларах за миллион токенов: миллион токенов ничего не говорит о вашем счёте.

Частые вопросы

Opus 5.5 лучше GPT-6 Astra? По сводному индексу Artificial Analysis да, 58 против 53. На конкретной задаче ответ может быть другим, поэтому сравнивать стоит на своих примерах.

Стоит ли переходить с Opus 5? Если сценарий тот же, переход даёт минус 20% к цене и заметный прирост скорости. Перед переключением прогоните свои задачи: поведение модели меняется даже при росте общего балла.

Почему Anthropic скрывает размышления модели? Компания объясняет это защитой от дистилляции, то есть от обучения чужих моделей на рассуждениях Claude. Для пользователя это значит, что проверить ход мысли модели теперь нельзя.

Можно ли платить российской картой? Напрямую нет. Россия не входит в список поддерживаемых стран Anthropic, оплата идёт через облачных провайдеров или посредников.

Насколько дороже обходится русский язык? В нашем замере русский текст занял 268 токенов против 234 у того же текста по-английски, разница 15%. У моделей OpenAI разрыв 19%.

Промпт: посчитать, сколько будет стоить перевод бизнеса на новую модель

Опишите свой сценарий работы с нейросетью, объёмы и текущую модель. На выходе получите расчёт месячного счёта до и после перехода, точку окупаемости и список рисков переключения.

Промпт
Ты — аналитик по стоимости ИИ-решений. Твоя компетенция — считать реальный счёт компании за работу языковых моделей и находить, где смена модели экономит деньги, а где ломает процесс.

ЗАДАЧА
Посчитать месячную стоимость текущего сценария и сценария после перехода на другую модель, сравнить и дать рекомендацию.

ЧТО Я ДАЮ
— текущая модель и её цены за миллион токенов: [модель, вход $, выход $, кэш $]
— модель-кандидат и её цены: [модель, вход $, выход $, кэш $]
— сценарий работы: [ответы клиентам, разбор документов, агент, генерация текстов]
— объёмы за месяц: [число обращений, средняя длина входа в знаках, средняя длина ответа]
— доля повторяющегося контекста: [описание базы знаний или инструкции, которые идут в каждый запрос]
— курс доллара, по которому считать: [значение]

ПРОТОКОЛ РАБОТЫ
1. Переведи объёмы из знаков в токены, отдельно для русского и английского текста; для русского бери 2,4 знака на токен у моделей Anthropic и 3,4 у моделей OpenAI, назови использованный коэффициент явно.
2. Раздели входящие токены на кэшируемые и некэшируемые, исходя из доли повторяющегося контекста.
3. Посчитай месячный счёт по текущей модели: вход, кэш, выход, итог в долларах и рублях.
4. Посчитай то же по модели-кандидату.
5. Покажи разницу в рублях за месяц и за год, а также цену одного обращения в обоих вариантах.
6. Оцени неденежные последствия перехода: скорость ответа, склонность к выдумкам, потеря или появление режима размышления, доступность оплаты.
7. Назови условия, при которых переход не окупится, и что нужно проверить на своих задачах до переключения.

ФОРМАТ ОТВЕТА
Сначала таблица допущений с коэффициентами. Затем две таблицы расчёта, по одной на модель. Затем сводка разницы в рублях за месяц и за год. Затем список рисков перехода. В конце рекомендация одной фразой: переходить, не переходить или тестировать.

ЕСЛИ ДАННЫХ НЕ ХВАТАЕТ
Не подставляй выдуманные объёмы. Если не указано число обращений или длина сообщений, задай уточняющие вопросы и предложи, где эти цифры взять в своей системе. Если не указана доля повторяющегося контекста, посчитай два варианта: 0% и 70%, и покажи разброс.
Способ зарабатывать на ИИ
Зарабатывайте на создании сайтов и ИИ-агентов
  • Собираете клиенту сайт и ИИ-продавца за вечер вместо недель разработки
  • Конструктор сайтов и ИИ-сотрудники — в одном российском сервисе
  • Бонус 1 000 ₽ при регистрации по этой ссылке вместо обычных 500 ₽
Начать бесплатно
Регистрация занимает минуту, без VPN и иностранных карт
Источники

💬 Комментарии

Пока никто не написал. Будьте первым: расскажите, что оказалось полезным, а чего не хватило.
Ссылки в комментариях не публикуются.

📚Разбираем тему подробно

Все статьи
Claude Opus 5.5: обзор с замерами — скорость, цена ответа и честность
23.09.2026#Нейросети: обзоры и сравнения
Claude Opus 5.5: обзор с замерами — скорость, цена ответа и честность
Claude Opus 5.5 вышла 22 сентября 2026 года и заняла первое место в независимом индексе Artificial Analysis. Мы прогнали её через свои задачи на следующий день: замерили скорость, цену одного ответа клиенту в рублях, поведение на вопросах-ловушках и на расчёте прибыли.
Claude Opus 5: обзор флагмана Anthropic — что нового, цены и доступ из России
03.08.2026#Нейросети: обзоры и сравнения
Claude Opus 5: обзор флагмана Anthropic — что нового, цены и доступ из России
Anthropic выпустила Claude Opus 5 24 июля 2026 года — модель, которая обходит Fable 5 в большинстве тестов при вдвое меньшей цене. Разбираем регулятор усилий, самопроверку, контекст на миллион токенов и то, как получить к ней доступ из России.
LLM: что это такое простыми словами, как работает и сколько стоит ответ
15.09.2026#Термины ИИ и маркетинга
LLM: что это такое простыми словами, как работает и сколько стоит ответ
LLM это программа, которая прочитала триллионы слов и продолжает любой текст как человек. Я измерил, во сколько токенов обходится русский текст у 8 моделей и сколько стоит один ответ клиенту: от 0,8 до 38 копеек, причём самая дешёвая модель потеряла половину условий доставки.
Галлюцинации нейросети: что это, почему модель выдумывает и мой замер на 464 ответах восьми моделей
16.09.2026#Термины ИИ и маркетинга
Галлюцинации нейросети: что это, почему модель выдумывает и мой замер на 464 ответах восьми моделей
Галлюцинация нейросети это уверенный ответ, в котором факт выдуман: несуществующий закон, неверная цифра, книга, которой не было. Я задал 8 моделям 19 проверяемых вопросов и 10 ловушек про несуществующее, дважды, и получил 464 ответа: 5 моделей из 8 уверенно назвали ЛитРес чужой ИНН.

🗞Другие новости

Все новости
GPT-6 Sol и Luna: OpenAI снизила цены вдвое, качество почти не выросло
23 сентября, 03:50#ИИ и нейросети
GPT-6 Sol и Luna: OpenAI снизила цены вдвое, качество почти не выросло
22 сентября 2026 года OpenAI выпустила модели среднего и лёгкого класса: GPT-6 Sol и GPT-6 Luna. Миллион входных токенов у Sol стоит $2 вместо $4, у Luna $0,10 вместо $0,20. Выход у Sol подешевел с $20 до $10, у Luna с $1,20 до $0,50. Чтение из кэша стоит на 90% меньше базовой цены входа. Прирост качества при этом почти нулевой. По независимому индексу Artificial Analysis Sol поднялся с 47 до 48 баллов, Luna осталась на 37. Мы прогнали обе модели в день выхода и нашли то, чего нет в отчётах: на коротком ответе клиенту новые дешёвые модели ни разу за 5 прогонов не назвали условие бесплатной доставки, хотя оно было в инструкции. Старая GPT-5.6 Luna называла его в 4 прогонах из 5.
Весь рост видеопросмотров в России дал YouTube: 99 минут в день
22 сентября, 17:03#Маркетинг и реклама
Весь рост видеопросмотров в России дал YouTube: 99 минут в день
22 сентября 2026 года стали известны данные Future Lab (группа компаний Starlink) по видеопотреблению в России за первое полугодие. Среднее время просмотра на крупнейших видеоплощадках выросло на 6% и составило 87,7 минуты в день на пользователя. Но если вычесть YouTube, показатель падает на 5%: весь рост рынку обеспечил именно он. Сам YouTube, несмотря на ограничения скорости, прибавил 24% и вышел на 99 минут в день на пользователя. Для сравнения: годом ранее он терял 28,6%, а российские площадки тогда росли на 32%. Маркетологу здесь важны две вещи сразу: аудитория вернулась туда, где ограничен доступ, а реклама на этой площадке с марта 2026 года признана ФАС незаконной, хотя запрет отложен до конца года.
Рост трат на офлайн-рекламу замедлился в 2,5 раза, лидер сменился
22 сентября, 17:03#Отчёты и цифры
Рост трат на офлайн-рекламу замедлился в 2,5 раза, лидер сменился
21 сентября 2026 года появились данные группы Twiga CG, основанные на замерах Mediascope: инвестиции 20 крупнейших рекламодателей России в офлайн-рекламу (телевидение, радио, пресса и наружная реклама) за первое полугодие 2026 года выросли на 24% год к году. Само по себе это рост, но темпы замедлились более чем в 2,5 раза по сравнению с прошлым годом. Сменился и лидер: после многолетнего первого места «Сбера» вперёд вышла RWB (Wildberries и Russ) с бюджетом 27 млрд рублей и ростом на 64%. «Сбер» второй с 20,6 млрд рублей. Участники рынка объясняют перестановки перетоком бюджетов в интернет и общей экономической ситуацией. Для небольшого бизнеса вывод простой: крупные игроки стали осторожнее с каналами, где эффект трудно посчитать.