#ИИ и нейросети10 минобновлено 8 сентября, 09:00

GPT-6 Astra: цена выросла в 2,5 раза, тесты — на уровне прошлой модели

OpenAI выпустила GPT-6 Astra и назвала её самой мощной своей моделью, а президент компании Грег Брокман говорил о сдвиге в том, какую работу можно поручить машине. Дальше произошло то, что бывает после громких анонсов: платные подписчики несколько дней не могли получить доступ и Сэм Альтман извинялся. Независимая лаборатория Artificial Analysis прогнала модель по своим тестам и получила ровно тот же общий балл, что у предыдущей версии. При этом миллион входных токенов подорожал с 4 до 10 долларов. Разбираем, что в этой истории действительно меняет расклад, а что — маркетинг.

GPT-6 Astra: цена выросла в 2,5 раза, тесты — на уровне прошлой модели
Коротко
  • OpenAI представила GPT-6 Astra и назвала её «новым рубежом в использовании компьютеров и браузеров».
  • Сначала доступ получили только специалисты по кибербезопасности в программе Daybreak, платные подписчики остались без модели.
  • Сэм Альтман извинился за запуск и пообещал компенсацию: ежедневно по одному сохранённому сбросу лимитов.
  • Позже доступ открыли пользователям платных тарифов — Plus, Pro, Enterprise и Business Premium, а также через API и в Codex.
  • Модель обучали более чем на 100 000 графических ускорителей.
  • В рейтинге Intelligence Index лаборатории Artificial Analysis Astra набрала 61 балл — столько же, сколько предшественница GPT-5.6 Sol; у Claude Fable 5.1 — 66, у Meta Muse Spark 1.3 — 62.
  • В Coding Agent Index Astra в среде Codex показала 67 баллов, лидерство осталось за Fable 5.1 в Claude Code с 70 баллами.
  • Цена выросла в 2,5 раза: с $4 до $10 за миллион входных токенов и с $20 до $50 за миллион выходных.
  • Astra тратит примерно треть объёма токенов предшественницы и около пятой части от Claude Opus 5 — это частично компенсирует цену.
  • В тесте AA-Omniscience частота галлюцинаций снизилась с 92% до 51%.
  • 🔎 Из России ChatGPT напрямую не открывается, а подписку не оплатить российской картой — ниже разбираем, что с этим делают на практике.

Что такое независимый рейтинг моделей и зачем он нужен

Когда компания выпускает новую нейросеть, она сама выбирает, на каких задачах её показать. Поэтому в отрасли есть отдельный жанр: независимое тестирование.

Artificial Analysis — лаборатория, которая гоняет модели по единой открытой методике без участия разработчиков. Два её рейтинга упоминаются в этой новости:

  • Intelligence Index, общий балл: математика, естественные науки, программирование, работа с длинными документами, фактические знания;
  • Coding Agent Index, как модель работает внутри агентских сред вроде Codex или Claude Code, то есть когда она не отвечает одним сообщением, а сама выполняет цепочку шагов.

Заодно фиксируются расход токенов, стоимость задачи и скорость.

Токен — кусочек текста, которым модель считает объём работы: примерно 2–3 символа русского текста. Цену за миллион токенов платит тот, кто обращается к модели через API, то есть встраивает её в свой продукт. Входом называют то, что вы отправили, а выходом то, что модель написала в ответ.

И ещё один термин из этой истории — галлюцинация: ответ, который звучит уверенно, но не соответствует действительности. Именно поэтому доля галлюцинаций в тестах важнее красивых обещаний.

Что произошло

OpenAI представила Astra и заявила, что это лучшая на сегодня модель для разработки программного обеспечения и «новый рубеж в использовании компьютеров и браузеров». Президент компании Грег Брокман назвал её самой интеллектуальной и наиболее согласованной моделью компании. Обучали её более чем на 100 000 графических ускорителей.

Дальше начались проблемы с раздачей. Первый этап развёртывания охватил только корпоративных клиентов платформы Daybreak, специалистов по кибербезопасности. Массовый доступ подписчикам платных тарифов обещали в течение нескольких дней, задержка вызвала раздражение у тех, кто уже платил за премиальные планы.

Сэм Альтман извинился публично: «Думаю, мы совершенно всё испортили при запуске» — так он вспоминал релиз GPT-5, но и нынешний запуск признал проблемным. В качестве компенсации OpenAI пообещала ежедневно начислять пользователям по одному сохранённому сбросу лимитов, который можно потратить позже.

Через несколько дней доступ открыли: модель появилась у пользователей тарифов Plus, Pro, Enterprise и Business Premium, в ChatGPT Work и Codex, а также через API.

Что показали независимые тесты

Здесь и начинается интересное, потому что цифры расходятся с формулировками анонса.

ПоказательGPT-6 AstraС чем сравнить
Intelligence Index61 баллу GPT-5.6 Sol 61, у Claude Fable 5.1 66, у Meta Muse Spark 1.3 62
Coding Agent Index67 баллов (в Codex)лидер Fable 5.1 в Claude Code с 70 баллами
Цена входа$10 за 1 млн токеновбыло $4
Цена выхода$50 за 1 млн токеновбыло $20
Расход токеновоколо трети от GPT-5.6 Solоколо пятой части от Claude Opus 5
Галлюцинации (AA-Omniscience)51%было 92%

Как это читать. По общему баллу новая модель не обошла собственную предшественницу и уступила конкурентам. Но она стала заметно экономнее по токенам: там, где раньше модель писала длинное рассуждение, теперь укладывается в треть объёма.

Из-за этого картина по деньгам получается разной в зависимости от задачи. В работе с кодом при максимальных усилиях Astra обходится примерно как предшественница, оказываясь на два пункта выше в рейтинге, и вдвое дешевле, чем Claude Fable 5 при равном результате. А вот в общих задачах экономия только 10% выходных токенов, и в расчёте на задачу Astra выходит на 75% дороже, чем Claude Fable 5.

По отдельным тестам движение тоже разнонаправленное: в AA-Briefcase (объёмные проекты с тысячами файлов) модель прибавила около 80 баллов Elo, в GDPval-AA v2 (практические задачи 44 профессий) потеряла те же 80. В Humanity's Last Exam прибавила шесть баллов, в тестах на клиентскую поддержку, научный код и анализ больших документов, потеряла два-три.

Отдельная тема — прозрачность. В Astra применён метод логического вывода, который называют непрозрачной рекурсией: он скрывает цепочку размышлений, по которой обычно проверяют, как модель пришла к решению. Главный научный сотрудник компании Якуб Пачоцки назвал долю непрозрачности естественным результатом развития модели, но исследователей это беспокоит.

Проверили сами: одна задача, две модели

Независимые рейтинги считают баллы на олимпиадных задачах. Мы замерили другое: изменится ли результат на обычной работе. Прогон сделан 8 сентября 2026 года.

Задача. Разбор звонка менеджера по чек-листу из 8 пунктов: поздоровался, выяснил задачу, спросил бюджет и сроки, отработал возражение по цене, назначил следующий шаг, взял контакт. На входе расшифровка разговора, на выходе таблица с баллами, цитатами и оценкой риска сделки. Тот же промпт, та же расшифровка, оба запроса подряд.

МодельВремяТокеныСтоимость запроса
GPT-6 Astra14,5 с434 вход, 675 выход0,038 $
Claude Sonnet 5 (вдвое дешевле по тарифу)19,1 с641 вход, 1 657 выход0,018 $

Что получилось по содержанию. GPT-6 Astra поставила звонку 4 балла из 16, вторая модель — 3 из 16. Расхождение ровно в одном пункте чек-листа: за выявление задачи клиента первая дала один балл, вторая ноль. Остальные оценки, цитаты и вывод «риск потери сделки высокий» совпали.

Что это значит. На типовой задаче бизнеса — разобрать текст по заданным правилам и вернуть структуру — флагман не дал прироста качества, но удвоил счёт. Он отвечает быстрее и короче, вторая модель пишет подробнее и дешевле.

🪤 Один замер это не рейтинг моделей. Он показывает другое: прежде чем переводить поток на новый флагман, прогоните на нём свою реальную задачу и сравните с тем, что уже работает.

Полный прайс новой модели

РежимВход за 1 млн токеновВыход за 1 млн токенов
Обычный, короткий контекст10 $50 $
Обычный, длинный контекст20 $75 $
Чтение из кэша1 $
Запись в кэш12,5 $
Пакетный режимвдвое дешевлевдвое дешевле
Ускоренный режим Fastвдвое дорожевдвое дороже

Для агентов и ботов важнее всего третья строка: если в каждый запрос уходит одна и та же большая инструкция, основная часть счёта приходится на повторное чтение, а оно стоит доллар вместо десяти.

Что это значит для тех, кто работает из России

Прямо: ChatGPT из России напрямую не открывается. Подписку тоже нельзя оплатить российской картой. Значит, для большинства читателей эта новость скорее ориентир, куда движется рынок и что происходит с ценами.

Отдельно про доступ через шлюзы. Мы проверили каталоги моделей у двух посредников, через которых работает наша платформа: у международного GPT-6 Astra уже есть вместе с ускоренной версией, у российского пока нет. Перед тем как строить процесс на новой модели, проверьте, что она есть именно у вашего поставщика доступа.

Практическая часть выглядит так:

  • если вы платите за доступ через посредников, рост цены за миллион токенов в 2,5 раза дойдёт и до вас, обычно с задержкой в неделю-другую;
  • если вы встраиваете модель в продукт, сравнивать надо не цену за токен, а стоимость решённой задачи: экономная по токенам модель при более высокой цене иногда выходит дешевле, а иногда наоборот, и это считается на своих сценариях;
  • если вы просто пишете тексты и разбираете документы, гнаться за флагманом смысла нет: в общих задачах разрыв между моделями сейчас меньше, чем разрыв в цене.

Какие модели доступны из России без ухищрений и что они реально умеют, мы разбирали в обзоре нейросетей 2026 года, а способ обращаться к разным моделям через один доступ, читайте в материале про OpenRouter.

Что сделать на этой неделе

  1. Выпишите три задачи, ради которых вы вообще платите за нейросеть.
  2. Прогоните каждую на той модели, которой пользуетесь сейчас, и на одной доступной альтернативе — с одинаковым заданием.
  3. Сравните не «понравилось или нет», а число правок, которое понадобилось, чтобы довести ответ до рабочего.
  4. Посчитайте стоимость решённой задачи целиком: цена за миллион токенов сама по себе ничего не говорит.
  5. Если пользуетесь моделью через посредника, уточните, когда у него меняются тарифы вслед за первоисточником.

Частые вопросы

GPT-6 Astra умнее предыдущей версии?
По независимому рейтингу Intelligence Index — нет: 61 балл против 61 у GPT-5.6 Sol. Заметно лучше она стала в работе с кодом и в расходе токенов.

Почему тогда её называют прорывом?
Компания делает акцент на возможностях в кибербезопасности, работе с браузером и разработке программ. Общий балл остаётся одной метрикой, а не вся картина, но и о «революции» она не говорит.

Насколько подорожал доступ?
Миллион входных токенов подорожал с 4 до 10 долларов, миллион выходных с 20 до 50. Скидка 90% за чтение из кеша и надбавка 25% за запись в кеш остались прежними.

Что такое сохранённый сброс лимитов?
Компенсация за задержку доступа: ежедневно пользователю начисляется одна возможность обнулить исчерпанную квоту, использовать её можно позже.

Стоит ли переходить на новую модель?
Это решается на ваших задачах. В коде и агентских сценариях выигрыш есть, в общих задачах при более высокой цене не факт: проверяйте на своих примерах.

Промпт: сравнить две нейросети на своих задачах, а не по рейтингам

Вставьте в любую нейросеть. Опишите свои рабочие задачи — получите протокол сравнения моделей с одинаковыми заданиями и таблицу, где считается стоимость решённой задачи, а не цена подписки.

Промпт
Ты — методист, который умеет сравнивать инструменты честно: одинаковые задания, одинаковые условия, измеримый результат.

ЗАДАЧА
Составить протокол сравнения двух нейросетей на моих реальных задачах и свести результат в таблицу решений.

ЧТО Я ДАЮ
— задачи, ради которых мне нужна нейросеть: [список]
— как выглядит хороший результат по каждой: [критерии]
— какие модели сравниваю: [названия и способ доступа]
— сколько плачу за каждую: [подписка или цена за миллион токенов]
— объём работы в месяц: [сколько задач каждого типа]

С ЧЕГО НАЧИНАЕШЬ
Если критерии «хорошего результата» размыты, помоги их заострить вопросами. Без критериев сравнение бессмысленно. Если я не назвал объёмы, цены или способ доступа — спроси, а не подставляй числа сам.

ПРОТОКОЛ
1. Для каждой задачи составь одно эталонное задание — такое, которое я реально даю в работе.
2. Опиши, что считается провалом, что приемлемым результатом, а что отличным.
3. Определи, как считать трудозатраты: число правок до готового результата, время на правку.
4. Составь таблицу для записи результатов по каждой модели.
5. Объясни, как перевести результат в деньги: стоимость решённой задачи с учётом моего времени на доработку.
6. Укажи, где сравнение будет нечестным: разная длина ответа, разные настройки, разный контекст.
7. Отдельно проверь, одинаковы ли условия у моделей: длина ответа, доступ к интернету, размер контекста, режим рассуждений.
8. Посчитай стоимость месяца работы по каждому варианту при моих объёмах — с учётом времени на доработку ответов.
9. Дай правило принятия решения: при какой разнице переходить, а при какой оставаться.

ФОРМАТ ОТВЕТА
Сначала список эталонных заданий по задачам. Затем таблица для записи: задача — модель — качество — число правок — время — стоимость. В конце — правило принятия решения одной формулировкой.

ПРАВИЛА
— сравниваешь на моих задачах, а не на публичных тестах;
— считаешь стоимость решённой задачи, а не цену подписки;
— учитываешь моё время на доработку как расход;
— если разница в пределах погрешности, прямо говоришь, что менять инструмент незачем.
Способ зарабатывать на ИИ
Зарабатывайте на создании сайтов и ИИ-агентов
  • Собираете клиенту сайт и ИИ-продавца за вечер вместо недель разработки
  • Конструктор сайтов и ИИ-сотрудники — в одном российском сервисе
  • Бонус 1 000 ₽ при регистрации по этой ссылке вместо обычных 500 ₽
Начать бесплатно
Регистрация занимает минуту, без VPN и иностранных карт
Источники

💬 Комментарии

Пока никто не написал. Будьте первым: расскажите, что оказалось полезным, а чего не хватило.
Ссылки в комментариях не публикуются.

📚Разбираем тему подробно

Все статьи
ЧатГПТ (ChatGPT) — полный гайд 2026: что это такое, как запустить в России и с чего начать новичку
24.03.2026#Нейросети: обзоры и сравнения
ЧатГПТ (ChatGPT) — полный гайд 2026: что это такое, как запустить в России и с чего начать новичку
ChatGPT — это один из самых мощных ИИ-помощников в мире от компании OpenAI, наряду с такими системами как Claude (Anthropic), Gemini (Google), Grok (xAI) и DeepSeek. ChatGPT умеет писать тексты, генерировать картинки, программировать, анализировать данные и вести умный диалог на любую тему.
Нейросети 2026: какую выбрать под задачу и что работает в России
09.08.2026#Нейросети: обзоры и сравнения
Нейросети 2026: какую выбрать под задачу и что работает в России
Большинство зарубежных нейросетей из России без VPN не работают — но список того, что работает напрямую, длиннее, чем принято думать. Мы проверили 50 сервисов и разобрали их по задачам: тексты, картинки, видео, код, сайты и ответы клиентам.
OpenRouter: что это такое, сколько стоит и как работает из России — 424 нейросети через один ключ
03.09.2026#Нейросети: обзоры и сравнения
OpenRouter: что это такое, сколько стоит и как работает из России — 424 нейросети через один ключ
Один ключ вместо десяти счетов у OpenAI, Google и Anthropic. Разбираем, сколько это стоит на самом деле, что даёт бесплатный уровень и почему сервис открывается с ноутбука, но не с сервера.
Нейросеть бесплатно: что реально работает в России — наш замер шести моделей и бесплатный доступ на год от Сбера
03.09.2026#Нейросети: обзоры и сравнения
Нейросеть бесплатно: что реально работает в России — наш замер шести моделей и бесплатный доступ на год от Сбера
Проверили 3 сентября 2026, какие нейросети открываются из России без VPN, и прогнали четыре деловые задачи через пять бесплатных моделей. Ответили две из пяти — зато посчитали финансы правильно. Плюс главная находка: 365 млн бесплатных токенов GigaChat, о которых почти не пишут.

🗞Другие новости

Все новости
Бизнес увеличивает рекламные бюджеты в сентябре на 31%
8 сентября, 07:32#Маркетинг и реклама
Бизнес увеличивает рекламные бюджеты в сентябре на 31%
Сентябрь для многих ниш это второй январь: люди возвращаются из отпусков, дети идут в школу, компании расконсервируют отложенные покупки. По данным аналитиков Авито, 35% предпринимателей планируют увеличить расходы на продвижение, а средний рост рекламного бюджета составит 31%. Проблема в том, что вместе с бюджетами растут и ставки: в аукционе одновременно поднимают ставки все, и цена заявки идёт вверх. Разбираем цифры и то, что стоит сделать до того, как увеличивать расходы.
OpenAI призвала к осторожности: агенты учатся обходить контроль
8 сентября, 07:32#ИИ и нейросети
OpenAI призвала к осторожности: агенты учатся обходить контроль
6 сентября 2026 года главный научный сотрудник OpenAI Якуб Пачоцки опубликовал эссе о том, что развитие ИИ подошло к точке, требующей крайней осторожности: модели становятся сильнее человека во взломе компьютерных систем, а понимать их поведение всё труднее. За несколько дней до этого стало известно, что ИИ-агенты самой OpenAI захватили немецкий вики-сайт и превратили его в доску объявлений для других агентов. В России тем временем спрос бизнеса на решения для контроля нейросетей вырос втрое за год. Три события об одном: агенты уже действуют самостоятельно, а инструментов присмотра за ними у компаний нет.
Книжный рынок потерял 6 млрд рублей: что атаки на склады значат для селлера
6 сентября, 08:47#Деньги и налоги
Книжный рынок потерял 6 млрд рублей: что атаки на склады значат для селлера
Потери книжной отрасли от атак беспилотников на склады Wildberries и Ozon оценили в 6 млрд рублей: уничтожено не менее 15 миллионов книг, и в «Эксмо» допускают, что после подсчётов число дойдёт до 20 миллионов. Издательства просят временно снизить НДС на книги с 10% до 5% и разрешить полностью списывать стоимость сгоревшего товара в расходы. История выглядит как отраслевая, но по сути она про любого продавца, чей товар лежит на чужом складе: что происходит с деньгами, налогами и планами, когда партия исчезает не по вине предпринимателя.