GPT-6 Sol, Luna или Astra: как выбрать модель под задачу
Выбираем кандидата по задаче и критерию приёмки. Сравниваем прямые API-тарифы без выдуманного рейтинга и даём пустую таблицу для собственной оценки.
Luna можно первой оценить для узких массовых задач, Sol — для повседневного кода и общей работы, Astra — для более сложных задач. Это отправная точка на основе позиционирования, а не рейтинг качества на ваших данных.
Анонс Sol/Luna и документация Astra проверены 23 сентября 2026 года. Платного сопоставительного теста трёх моделей не проводилось: победитель по точности, скорости или завершению задач не заявляется.
Сложность определяется приёмкой
| Тип задачи | Кандидат для начала | Что проверять |
|---|---|---|
| Много однотипных классификаций и извлечений | Luna | Верность полей, исключения, повторы |
| Обычные правки кода, документы, несколько шагов | Sol | Diff, тесты, инструменты, ручные исправления |
| Переплетённые ограничения, дорогие ошибки | Astra | Цель целиком, пропуски условий, общая стоимость |
В одном процессе можно оценить несколько стадий: дешёвая модель готовит вход, другая решает сложные случаи. Но правило маршрутизации требует собственных данных. Ошибка может быть вызвана инструкцией, инструментом или контекстом, а не только выбранной моделью.
Сопоставимые ставки
Это тарифы OpenAI, Standard, ввод ≤272K, доллары США за миллион текстовых токенов.
| Модель | Ввод | Чтение | Запись | Вывод |
|---|---|---|---|---|
| Luna | 0,10 | 0,01 | 0,125 | 0,50 |
| Sol | 2 | 0,20 | 2,50 | 10 |
| Astra | 10 | 1 | 12,50 | 50 |
Это прямые API-цены, не тариф Ofox и не число сообщений ChatGPT. При вводе >272K ко всему запросу применяются ставки ввода и кэша ×2, вывода ×1,5. Другие режимы и дополнительные сборы учитываются отдельно.
Если зафиксировать 20 000 обычного ввода и 5 000 вывода без кэша, получится Luna 0,0045, Sol 0,09, Astra 0,45 доллара. CSV и скрипт содержат эти расчёты.
Это арифметика одинаковых объёмов, не доказательство одинакового использования токенов или качества. Инструменты, повторы и ручная работа в пример не входят.
Критерий — до просмотра ответа
В пустой таблице приёмки запишите вход, разрешённые действия и успешный результат. Для кода закрепите commit, зависимости и тестовую команду; для извлечения — эталонные ответы и сложные записи.
Сохраняйте ID, поставщика, эндпоинт, рассуждения, права инструментов, кэш, ошибки и исправления. Разумные настройки моделей могут различаться — раскройте различия. Одинаковое название уровня рассуждений не гарантирует одинаковое количество вычислений.
Не выбирайте только лучший ответ. Включайте отвергнутые попытки и незавершённые задачи в отчёт. Предоставленная таблица не содержит баллов и не является выполненным бенчмарком.
Учитывайте цену неудачи и перехода
Если Luna часто требует ручной правки, низкая ставка токенов может не дать минимальной стоимости задачи. И наоборот, простая задача с механической проверкой не обязательно требует самой дорогой модели с первого запроса. Оба решения проверяются результатами.
Можно заранее установить причины перехода: отсутствующее поле, провал теста, нарушение ограничения. Записывайте добавочную стоимость после переключения. Высокая цена не доказывает правильность, а одна удача не подтверждает универсальную пригодность.
Сначала проверьте подключение
Доступ Sol/Luna, Batch-бюджет Luna и Responses помогут закрепить условия. Не выдавайте отказ сломанной интеграции за измерение способности модели.
Официальное позиционирование сокращает список кандидатов. Финальный выбор делают повторяемые задачи, приёмка, полные расходы и время человека.
Часто задаваемые вопросы
- Sol лучше Astra для любого кода?
- Такого вывода нет. Sol — кандидат для повседневной работы, сложные задачи тоже требуют сопоставимой приёмки.
- Пример стоимости — реальный тест?
- Нет. Он фиксирует ввод и вывод, показывая только различие ставок.
- Можно маршрутизировать только по названию?
- Сначала определите задачи и условия перехода, затем проверьте их реальными результатами. Позиционирование не гарантирует успех.


