#ИИ и нейросети8 мин

GPT-6 Sol и Luna: OpenAI снизила цены вдвое, качество почти не выросло

22 сентября 2026 года OpenAI выпустила модели среднего и лёгкого класса: GPT-6 Sol и GPT-6 Luna. Миллион входных токенов у Sol стоит $2 вместо $4, у Luna $0,10 вместо $0,20. Выход у Sol подешевел с $20 до $10, у Luna с $1,20 до $0,50. Чтение из кэша стоит на 90% меньше базовой цены входа. Прирост качества при этом почти нулевой. По независимому индексу Artificial Analysis Sol поднялся с 47 до 48 баллов, Luna осталась на 37. Мы прогнали обе модели в день выхода и нашли то, чего нет в отчётах: на коротком ответе клиенту новые дешёвые модели ни разу за 5 прогонов не назвали условие бесплатной доставки, хотя оно было в инструкции. Старая GPT-5.6 Luna называла его в 4 прогонах из 5.

GPT-6 Sol и Luna: OpenAI снизила цены вдвое, качество почти не выросло
Коротко
  • Событие: 22 сентября 2026 года OpenAI выпустила GPT-6 Sol и GPT-6 Luna, дополнив флагман GPT-6 Astra от 3 сентября.
  • Цены: Sol — $2 за миллион входных токенов и $10 за миллион выходных; Luna — $0,10 и $0,50. OpenAI называет снижение «на 50%»; по её же таблице выход Luna подешевел с $1,20 до $0,50, то есть на 58%.
  • Качество: по индексу Artificial Analysis Sol вырос с 47 до 48 баллов, Luna осталась на 37; на наборе знаний GDPval обе модели просели относительно прошлого поколения.
  • Что улучшилось по данным OpenAI: Sol ошибается в фактах примерно вдвое реже GPT-5.6 Sol; доля ответов с попыткой ввести в заблуждение упала с 10,4% до 1,3%.
  • Наш замер 23.09.2026: на 10 вопросах-ловушках GPT-6 Luna выдумала 4 ответа против 6 у GPT-5.6 Luna. При этом на коротком ответе клиенту Sol и Luna 0 раз из 5 назвали порог бесплатной доставки, который был в инструкции.
  • 🔎 Главное для бизнеса: дешёвая модель нового поколения врёт реже, но молчит о том, о чём её прямо не попросили. Лечится одной строкой в промпте: в нашем замере с прямым указанием условие вернулось в 3 ответах из 3.

Что произошло

OpenAI объявила о выходе GPT-6 Sol и GPT-6 Luna 22 сентября 2026 года. Обе модели обучены теми же методами, что и флагман GPT-6 Astra, вышедший 3 сентября, но работают быстрее и стоят дешевле.

В тот же день Anthropic выпустила Claude Opus 5.5 и тоже снизила цены. Полный разбор этой модели с нашими замерами собран в отдельном обзоре. Оба крупнейших разработчика подешевели в один день.

Новые цены

МодельВход, млн токеновВыход, млн токеновБыло у GPT-5.6
GPT-6 Sol$2$10$4 и $20
GPT-6 Luna$0,10$0,50$0,20 и $1,20

Свою таблицу OpenAI подписывает «на 50% дешевле» для обеих строк. По самим цифрам выход Luna упал с $1,20 до $0,50, это 58%, так что снижение чуть больше обещанного.

Чтение из кэша стоит 10% от базовой цены входа: $0,20 у Sol и $0,01 у Luna за миллион токенов. Кэш это повторно используемая часть запроса, например инструкция агента или описание товаров, которая идёт в каждое обращение. Помимо цены OpenAI подняла долю попаданий в кэш и разрешила менять уровень усилий и набор инструментов, не сбрасывая накопленный контекст. GitHub, по данным OpenAI, за несколько месяцев сократил долю заново обрабатываемых токенов более чем наполовину.

По курсу ЦБ на 23 сентября 2026 года (84,07 ₽ за доллар) миллион выходных токенов Luna стоит около 42 ₽. Для сравнения, у Claude Opus 5.5 та же строка обходится в 1 681 ₽.

Если смотреть на линейку Sol целиком, снижение идёт третий раз за полтора месяца. В августе OpenAI срезала цену GPT-5.6 Sol на 20% и назвала это временной акцией на 3 месяца: вход подешевел с $5 до $4, выход с $30 до $20. Теперь вышло новое поколение, где та же строка стоит $2 и $10. За полтора месяца выход подешевел втрое.

Модели доступны в программном доступе, в ChatGPT на платных тарифах и в Codex. Luna открыта и бесплатным пользователям в настольном приложении.

Качество почти не изменилось

Здесь и находится главная новость. Независимая лаборатория Artificial Analysis замерила обе модели по своему сводному индексу: Sol поднялся с 47 до 48 баллов, Luna осталась на 37. На наборе задач по программированию Sol прибавил 2 балла, Luna потеряла 2.

На наборе GDPval, который проверяет профессиональные знания, обе модели просели относительно прошлого поколения: Sol примерно на 100 пунктов рейтинга, Luna на 75.

Сама OpenAI делает упор на другие цифры. По её замерам Sol ошибается в фактах примерно вдвое реже, чем GPT-5.6 Sol. Доля ответов, где модель пыталась ввести пользователя в заблуждение, упала с 10,4% до 1,3%, а доля случаев, когда модель не призналась в невыполненной работе, с 77,8% до 5,4%.

Обе группы цифр могут быть верны одновременно: модель стала честнее, не став умнее.

Наш замер: врут реже

Мы проверили честность сами. В таблицах ниже модели названы коротко: Opus принадлежит Anthropic, Sol и Luna — OpenAI. Задали десять вопросов о том, чего не существует: метод продаж Ковалёва — Штерна, статья 14.3.7 КоАП, исследование РАЭК 2025 года про ИИ-продавцов, книга Канемана «Быстрое мышление в бизнесе». Замер сделан 23 сентября 2026 года, вердикты проверены вручную.

МодельВыдумала ответов из 10Цена одного ответа
Opus 5.500,49 ₽
GPT-6 Sol10,06 ₽
GPT-6 Luna40,01 ₽
GPT-5.6 Luna60,01 ₽

Улучшение у самой дешёвой модели заметное: 6 выдумок против 4 при той же цене. Заявление OpenAI про рост честности наш замер скорее подтверждает.

Как выглядит выдумка на практике: GPT-6 Luna описала штрафы по несуществующей статье 14.3.7 КоАП с точными суммами, вплоть до «от 100 000 до 500 000 рублей для юридических лиц». Если такой ответ уходит клиенту, компания отвечает за него сама. Подробнее об этом типе ошибок в разборе галлюцинаций нейросетей.

Наш замер: молчат о выгодном

Вторую находку мы не искали, она всплыла на обычной задаче. Модель играла менеджера интернет-магазина. В инструкции были три условия доставки, включая бесплатную доставку при заказе от 5 000 ₽. Клиент спрашивал про доставку заказа на 3 200 ₽. Просили ответить коротко.

МодельНазвала порог 5 000 ₽Предложила добрать до бесплатной
Opus 5.55 из 55 из 5
Opus 55 из 54 из 5
GPT-6 Astra5 из 50 из 5
GPT-5.6 Luna4 из 50 из 5
GPT-6 Sol0 из 50 из 5
GPT-6 Luna0 из 50 из 5

Новые дешёвые модели ни разу не упомянули акцию, хотя она лежала в инструкции. Прошлое поколение в том же месте её называло.

Мы проверили, дело ли в слове «коротко». Без него Sol и Luna назвали порог в одном случае из трёх, то есть проблема осталась. А вот с прямым указанием «обязательно назови все условия доставки, которые к нему относятся» обе модели назвали порог в 3 случаях из 3.

Объяснение нашлось в самом анонсе OpenAI. Компания пишет, что перенесла на Sol и Luna манеру общения флагмана, и перечисляет, чего стало меньше: «меньше жаргона, меньше странных оборотов, меньше малоценных деталей и в целом немного более короткие ответы». Правка манеры была намеренной.

На технических вопросах это действительно читается лучше. На ответе клиенту «малоценной деталью» оказалось условие, от которого зависит сумма заказа.

Вывод получается практический: GPT-6 Sol и Luna выполняют написанное буквально и не достраивают, что акция относится к этому клиенту. Claude в том же месте считает недостающую сумму сам и предлагает добрать. Claude Opus 5.5 отвечал так: «Если добавите в заказ товаров ещё на 1 800 ₽ (от 5 000 ₽ в сумме), доставка будет бесплатной».

Разница в цене ответа между этими моделями 0,48 ₽. Разница в сумме заказа, о которой идёт речь, 1 800 ₽.

Что делать сейчас

  1. Если вы на GPT-5.6 Sol или Luna, переход на шестое поколение снижает счёт вдвое при сопоставимом качестве. Это самый простой способ сократить расходы на ИИ прямо сейчас.
  2. Перепишите промпты под новое поведение: всё, что модель должна сказать клиенту обязательно, перечислите явным списком. Общая формулировка «ответь по условиям» теперь работает хуже.
  3. Проверьте свои сценарии на потерю условий: возьмите 20 реальных диалогов и посмотрите, называет ли модель акции, скидки и пороги, которые относятся к клиенту.
  4. Для задач с фактами и документами не берите самый дешёвый класс: 4 выдумки на 10 вопросов остаются 4 выдумками, даже если ответ стоит копейку.
  5. Считайте не цену модели, а цену последствий: потерянный апсейл на 1 800 ₽ дороже, чем вся экономия на токенах за месяц. Как составлять промпт, чтобы условия не терялись, разбирали в материале что такое промпт.

Частые вопросы

GPT-6 Luna подходит для ответов клиентам? Для простых ответов и классификации да, цена почти нулевая. Для консультаций с фактами, законами и условиями акций её стоит либо дополнять проверкой, либо брать класс выше.

Почему цены упали, если качество не выросло? OpenAI объясняет это улучшениями в кэшировании и работе серверов. Для рынка это признак конкуренции: в тот же день подешевела и линейка Anthropic.

Что изменится в ChatGPT для обычного пользователя? Luna стала доступна бесплатным пользователям в настольном приложении, Sol работает на платных тарифах и в Codex.

Старые модели отключат? OpenAI об этом не объявляла. Прошлое поколение описано в нашем обзоре GPT-5.6.

Какая модель честнее на фактах? В нашем замере из пяти проверенных моделей ни одной выдумки не допустили только Claude Opus 5.5 и Claude Opus 5. Среди моделей OpenAI лучший результат у GPT-6 Sol: одна выдумка из десяти.

Промпт: переписать инструкцию бота так, чтобы он не терял условия и акции

Опишите свои условия продажи и приложите текущую инструкцию бота. На выходе получите переписанный промпт с явным списком обязательных условий и набор проверочных диалогов.

Промпт
Ты — методист по промптам для клиентских ботов. Твоя компетенция — переписывать инструкции так, чтобы модель не теряла условия, от которых зависят деньги: акции, пороги бесплатной доставки, скидки, сроки и ограничения.

ЗАДАЧА
Переписать инструкцию бота так, чтобы все условия, относящиеся к конкретному клиенту, назывались в ответе обязательно, и собрать проверочные диалоги.

ЧТО Я ДАЮ
— текущая инструкция бота: [полный текст промпта]
— условия продажи: [цены, сроки, акции, пороги, скидки, ограничения]
— типичные вопросы клиентов: [5–10 примеров реальных сообщений]
— чего быть не должно: [запрещённые обещания, темы, формулировки]
— ограничение по длине ответа: [например, до 400 знаков]

ПРОТОКОЛ РАБОТЫ
1. Разбери условия на два списка: те, что называются всегда, и те, что называются при выполнении признака (сумма заказа, город, категория товара).
2. Для условий второго списка сформулируй признак явно, в виде правила «если сумма заказа меньше порога, назови порог и сумму, которой не хватает».
3. Перепиши инструкцию: роль, задача, обязательные элементы ответа, правила расчёта, запреты, формат.
4. Проверь, не конфликтует ли требование краткости с обязательными элементами; если конфликтует, задай приоритет явно.
5. Составь 10 проверочных диалогов, в каждом укажи, что обязано быть в ответе и чего быть не должно.
6. Опиши порядок проверки: по три прогона на диалог, фиксация доли ответов, где обязательное условие названо.
7. Назови признаки, по которым будет видно, что модель снова начала терять условия после смены версии.

ФОРМАТ ОТВЕТА
Сначала два списка условий с признаками. Затем готовый текст инструкции, который можно скопировать целиком. Затем таблица проверочных диалогов с критериями приёмки. В конце порядок регулярной проверки.

ЕСЛИ ДАННЫХ НЕ ХВАТАЕТ
Не придумывай условия за меня: если акции или пороги описаны нечётко, задай уточняющие вопросы. Если нет примеров реальных вопросов клиентов, предложи, где их взять, и не заменяй выдуманными.
Способ зарабатывать на ИИ
Зарабатывайте на создании сайтов и ИИ-агентов
  • Собираете клиенту сайт и ИИ-продавца за вечер вместо недель разработки
  • Конструктор сайтов и ИИ-сотрудники — в одном российском сервисе
  • Бонус 1 000 ₽ при регистрации по этой ссылке вместо обычных 500 ₽
Начать бесплатно
Регистрация занимает минуту, без VPN и иностранных карт
Источники

💬 Комментарии

Пока никто не написал. Будьте первым: расскажите, что оказалось полезным, а чего не хватило.
Ссылки в комментариях не публикуются.

📚Разбираем тему подробно

Все статьи
Claude Opus 5.5: обзор с замерами — скорость, цена ответа и честность
23.09.2026#Нейросети: обзоры и сравнения
Claude Opus 5.5: обзор с замерами — скорость, цена ответа и честность
Claude Opus 5.5 вышла 22 сентября 2026 года и заняла первое место в независимом индексе Artificial Analysis. Мы прогнали её через свои задачи на следующий день: замерили скорость, цену одного ответа клиенту в рублях, поведение на вопросах-ловушках и на расчёте прибыли.
GPT-5.6: Sol, Terra и Luna — какую модель выбрать и как получить доступ из России
03.08.2026#Нейросети: обзоры и сравнения
GPT-5.6: Sol, Terra и Luna — какую модель выбрать и как получить доступ из России
OpenAI выпустила GPT-5.6 9 июля 2026 года — и это не одна модель, а сразу три: Sol, Terra и Luna. Разбираем, чем они отличаются, сколько стоят после снижения цен 30 июля и какую брать под свою задачу.
Галлюцинации нейросети: что это, почему модель выдумывает и мой замер на 464 ответах восьми моделей
16.09.2026#Термины ИИ и маркетинга
Галлюцинации нейросети: что это, почему модель выдумывает и мой замер на 464 ответах восьми моделей
Галлюцинация нейросети это уверенный ответ, в котором факт выдуман: несуществующий закон, неверная цифра, книга, которой не было. Я задал 8 моделям 19 проверяемых вопросов и 10 ловушек про несуществующее, дважды, и получил 464 ответа: 5 моделей из 8 уверенно назвали ЛитРес чужой ИНН.
Что такое промпт для нейросети и как написать запрос, который работает с первого раза — полный гайд 2026
22.05.2026#Промпты для нейросетей
Что такое промпт для нейросети и как написать запрос, который работает с первого раза — полный гайд 2026
Промпт — это инструкция, которую вы даёте нейросети. От того, насколько точно вы её сформулируете, зависит 80% качества ответа. Плохой промпт — размытый результат и потраченное время. Грамотный промпт — готовая работа за минуты.

🗞Другие новости

Все новости
Вышла Claude Opus 5.5: цена ниже на 20%, скорость выше на 42%
23 сентября, 03:48#ИИ и нейросети
Вышла Claude Opus 5.5: цена ниже на 20%, скорость выше на 42%
22 сентября 2026 года Anthropic выпустила Claude Opus 5.5. Миллион токенов на входе стоит $4 вместо $5 у прошлой модели, на выходе $20 вместо $25. Чтение из кэша подешевело с $0,50 до $0,20 за миллион. По независимому индексу Artificial Analysis модель заняла первое место с результатом 58 баллов, у GPT-6 Astra и Claude Fable 5.1 по 53. Мы прогнали новую модель через свои задачи в день выхода. Скорость генерации выросла с 81,9 до 116,5 токенов в секунду, это на 42% быстрее прошлой версии. Ответ клиенту интернет-магазина обошёлся в 0,49 ₽ против 0,66 ₽ у Opus 5. На 10 вопросах о несуществующих законах, книгах и сервисах модель не выдумала ни одного ответа.
Весь рост видеопросмотров в России дал YouTube: 99 минут в день
22 сентября, 17:03#Маркетинг и реклама
Весь рост видеопросмотров в России дал YouTube: 99 минут в день
22 сентября 2026 года стали известны данные Future Lab (группа компаний Starlink) по видеопотреблению в России за первое полугодие. Среднее время просмотра на крупнейших видеоплощадках выросло на 6% и составило 87,7 минуты в день на пользователя. Но если вычесть YouTube, показатель падает на 5%: весь рост рынку обеспечил именно он. Сам YouTube, несмотря на ограничения скорости, прибавил 24% и вышел на 99 минут в день на пользователя. Для сравнения: годом ранее он терял 28,6%, а российские площадки тогда росли на 32%. Маркетологу здесь важны две вещи сразу: аудитория вернулась туда, где ограничен доступ, а реклама на этой площадке с марта 2026 года признана ФАС незаконной, хотя запрет отложен до конца года.
Рост трат на офлайн-рекламу замедлился в 2,5 раза, лидер сменился
22 сентября, 17:03#Отчёты и цифры
Рост трат на офлайн-рекламу замедлился в 2,5 раза, лидер сменился
21 сентября 2026 года появились данные группы Twiga CG, основанные на замерах Mediascope: инвестиции 20 крупнейших рекламодателей России в офлайн-рекламу (телевидение, радио, пресса и наружная реклама) за первое полугодие 2026 года выросли на 24% год к году. Само по себе это рост, но темпы замедлились более чем в 2,5 раза по сравнению с прошлым годом. Сменился и лидер: после многолетнего первого места «Сбера» вперёд вышла RWB (Wildberries и Russ) с бюджетом 27 млрд рублей и ростом на 64%. «Сбер» второй с 20,6 млрд рублей. Участники рынка объясняют перестановки перетоком бюджетов в интернет и общей экономической ситуацией. Для небольшого бизнеса вывод простой: крупные игроки стали осторожнее с каналами, где эффект трудно посчитать.