GPT-6 Sol, Luna или Astra: как выбрать модель под задачу

Выбираем кандидата по задаче и критерию приёмки. Сравниваем прямые API-тарифы без выдуманного рейтинга и даём пустую таблицу для собственной оценки.

Обложка: трафарет чёрными линиями на светлой карточке, геометрические фигуры и английское название статьи.

Luna можно первой оценить для узких массовых задач, Sol — для повседневного кода и общей работы, Astra — для более сложных задач. Это отправная точка на основе позиционирования, а не рейтинг качества на ваших данных.

Анонс Sol/Luna и документация Astra проверены 23 сентября 2026 года. Платного сопоставительного теста трёх моделей не проводилось: победитель по точности, скорости или завершению задач не заявляется.

Сложность определяется приёмкой

Тип задачиКандидат для началаЧто проверять
Много однотипных классификаций и извлеченийLunaВерность полей, исключения, повторы
Обычные правки кода, документы, несколько шаговSolDiff, тесты, инструменты, ручные исправления
Переплетённые ограничения, дорогие ошибкиAstraЦель целиком, пропуски условий, общая стоимость

В одном процессе можно оценить несколько стадий: дешёвая модель готовит вход, другая решает сложные случаи. Но правило маршрутизации требует собственных данных. Ошибка может быть вызвана инструкцией, инструментом или контекстом, а не только выбранной моделью.

Сопоставимые ставки

Это тарифы OpenAI, Standard, ввод ≤272K, доллары США за миллион текстовых токенов.

МодельВводЧтениеЗаписьВывод
Luna0,100,010,1250,50
Sol20,202,5010
Astra10112,5050

Это прямые API-цены, не тариф Ofox и не число сообщений ChatGPT. При вводе >272K ко всему запросу применяются ставки ввода и кэша ×2, вывода ×1,5. Другие режимы и дополнительные сборы учитываются отдельно.

Если зафиксировать 20 000 обычного ввода и 5 000 вывода без кэша, получится Luna 0,0045, Sol 0,09, Astra 0,45 доллара. CSV и скрипт содержат эти расчёты.

Это арифметика одинаковых объёмов, не доказательство одинакового использования токенов или качества. Инструменты, повторы и ручная работа в пример не входят.

Критерий — до просмотра ответа

В пустой таблице приёмки запишите вход, разрешённые действия и успешный результат. Для кода закрепите commit, зависимости и тестовую команду; для извлечения — эталонные ответы и сложные записи.

Сохраняйте ID, поставщика, эндпоинт, рассуждения, права инструментов, кэш, ошибки и исправления. Разумные настройки моделей могут различаться — раскройте различия. Одинаковое название уровня рассуждений не гарантирует одинаковое количество вычислений.

Не выбирайте только лучший ответ. Включайте отвергнутые попытки и незавершённые задачи в отчёт. Предоставленная таблица не содержит баллов и не является выполненным бенчмарком.

Учитывайте цену неудачи и перехода

Если Luna часто требует ручной правки, низкая ставка токенов может не дать минимальной стоимости задачи. И наоборот, простая задача с механической проверкой не обязательно требует самой дорогой модели с первого запроса. Оба решения проверяются результатами.

Можно заранее установить причины перехода: отсутствующее поле, провал теста, нарушение ограничения. Записывайте добавочную стоимость после переключения. Высокая цена не доказывает правильность, а одна удача не подтверждает универсальную пригодность.

Сначала проверьте подключение

Доступ Sol/Luna, Batch-бюджет Luna и Responses помогут закрепить условия. Не выдавайте отказ сломанной интеграции за измерение способности модели.

Официальное позиционирование сокращает список кандидатов. Финальный выбор делают повторяемые задачи, приёмка, полные расходы и время человека.

Часто задаваемые вопросы

Sol лучше Astra для любого кода?
Такого вывода нет. Sol — кандидат для повседневной работы, сложные задачи тоже требуют сопоставимой приёмки.
Пример стоимости — реальный тест?
Нет. Он фиксирует ввод и вывод, показывая только различие ставок.
Можно маршрутизировать только по названию?
Сначала определите задачи и условия перехода, затем проверьте их реальными результатами. Позиционирование не гарантирует успех.