Скидки на LLM API: 13 моделей ниже прайса, GPT-5.6 Sol за полцены
Тринадцать моделей из пяти серий тарифицируются ниже прайса. Где скидка вендора, а где своя: GPT-5.6 Sol стоит половину стандартного тарифа OpenAI.
Gemini 3.7 Flash API: цена $0.75 временная, minimal отдаёт 400
Gemini 3.7 Flash стоит $0.75 на входе и $3.75 на выходе — столько же, сколько 3.6 Flash. Уровней thinking три, minimal теперь возвращает 400.
Opus 5 против Grok 4.6: в 3.6 раза дороже за 1.75 раза кода
Одна реальная задача, замеры: Opus 5 стоит в 3.6 раза дороже Grok 4.6 и возвращает в 1.75 раза больше кода вдвое быстрее.
GLM 5.3 API: цены, эндпоинты и счёт за reasoning_effort
API GLM 5.3 открыт: $1.4 за вход и $4.4 за выход, как у 5.2. Замеры: на одном запросе классификации max тратит в 35 раз больше выходных токенов, чем low.
Цены Grok 4.6 API: обрыв на 200K и когда выигрывает 4.5
Grok 4.6 стоит $2 за вход и $6 за выход, но как только промпт достигает 200K, все токены удваиваются.
Pi Coding Agent: свой провайдер, стоимость $0 и ошибка 500
Pi показывает $0 за каждую сессию на своём провайдере, а модели Anthropic отдают 500 при рассуждении. Оба случая лечатся конфигом. Проверено на pi 0.84.1.
Повышение цен DeepSeek API: до 12x, часы пик (2026)
Новые цены DeepSeek вступили в силу 2026-08-16 в 16:00 UTC. Кэш подорожал в 12.1x на V4 Pro, вывод в 4.7x на Flash. Часы пик, тарифы, расчёт счёта.
DeepSeek Harness (dsh): версия, обновления, статус (2026)
DeepSeek Harness (dsh) до сих пор на 0.1.0-rc.6, сборке дня запуска. С 2026-08-13 ни одного коммита, нет релизов и тегов, issues отключены.
Codex "couldn't load its resources": 5 причин (2026)
Панель Codex крутится 30 секунд и гаснет? У регрессии 26.803.41515 пять разных причин. Исправлено в 26.810.41047, но починили текст ошибки, а не все сбои.
Qwen 3.8 27B локально: где скачать GGUF и сколько нужно памяти
Qwen3.8-27B на GPU с 16 GB и RTX 5080: размеры GGUF, короткий контекст, размещение на CPU и диагностика без путаницы между файлом и VRAM.