Скидки на LLM API: 13 моделей ниже прайса, GPT-5.6 Sol за полцены

Тринадцать моделей из пяти серий тарифицируются ниже прайса. Где скидка вендора, а где своя: GPT-5.6 Sol стоит половину стандартного тарифа OpenAI.

pricingcost-optimization

Gemini 3.7 Flash API: цена $0.75 временная, minimal отдаёт 400

Gemini 3.7 Flash стоит $0.75 на входе и $3.75 на выходе — столько же, сколько 3.6 Flash. Уровней thinking три, minimal теперь возвращает 400.

geminigoogle-ai

Opus 5 против Grok 4.6: в 3.6 раза дороже за 1.75 раза кода

Одна реальная задача, замеры: Opus 5 стоит в 3.6 раза дороже Grok 4.6 и возвращает в 1.75 раза больше кода вдвое быстрее.

grokclaude

GLM 5.3 API: цены, эндпоинты и счёт за reasoning_effort

API GLM 5.3 открыт: $1.4 за вход и $4.4 за выход, как у 5.2. Замеры: на одном запросе классификации max тратит в 35 раз больше выходных токенов, чем low.

glmapi-guide

Цены Grok 4.6 API: обрыв на 200K и когда выигрывает 4.5

Grok 4.6 стоит $2 за вход и $6 за выход, но как только промпт достигает 200K, все токены удваиваются.

grokpricing

Pi Coding Agent: свой провайдер, стоимость $0 и ошибка 500

Pi показывает $0 за каждую сессию на своём провайдере, а модели Anthropic отдают 500 при рассуждении. Оба случая лечатся конфигом. Проверено на pi 0.84.1.

piagent-harness

Повышение цен DeepSeek API: до 12x, часы пик (2026)

Новые цены DeepSeek вступили в силу 2026-08-16 в 16:00 UTC. Кэш подорожал в 12.1x на V4 Pro, вывод в 4.7x на Flash. Часы пик, тарифы, расчёт счёта.

deepseekapi-pricing

DeepSeek Harness (dsh): версия, обновления, статус (2026)

DeepSeek Harness (dsh) до сих пор на 0.1.0-rc.6, сборке дня запуска. С 2026-08-13 ни одного коммита, нет релизов и тегов, issues отключены.

deepseekdeepseek-harness

Codex "couldn't load its resources": 5 причин (2026)

Панель Codex крутится 30 секунд и гаснет? У регрессии 26.803.41515 пять разных причин. Исправлено в 26.810.41047, но починили текст ошибки, а не все сбои.

codexopenai

Qwen 3.8 27B локально: где скачать GGUF и сколько нужно памяти

Qwen3.8-27B на GPU с 16 GB и RTX 5080: размеры GGUF, короткий контекст, размещение на CPU и диагностика без путаницы между файлом и VRAM.

qwenlocal-llm