Claude Sonnet 5 vs Opus 4.8 (2026): на бумаге на 60% дешевле
Claude Sonnet 5 стоит $2/$10 против $5/$25 у Opus 4.8 — на 60% дешевле. Но отстаёт 63,2% против 69,2% в SWE-bench Pro, а в агентных задачах может выйти дороже Opus. Что выбрать.
Как выбрать AI-модель: не самую большую, а под задачу
Не берите самую большую AI-модель по умолчанию. Три вопроса (сложность, объём, цена ошибки) и бесплатный инструмент, что ранжирует 100+ моделей по цене, качеству и скорости.
Codex "command failed; retry without sandbox": 6 решений (2026)
Чиним «command failed; retry without sandbox» в Codex CLI на каждой правке: bubblewrap на Linux, sandbox_mode workspace-write, approval_policy on-request. 6 решений, 5 реальных багов 2026.
Doubao Seed 2.1 API (2026): Pro и Turbo без регистрации в Volcano
Вызывайте Doubao Seed 2.1 Pro ($0.884/$4.42 за M) и Turbo (вдвое дешевле: $0.442/$2.212) с одного endpoint. 256K контекста, один ключ, без отдельной регистрации в Volcano.
Kimi K2.7 Code: снизит ли счёт сокращение токенов на 30%? (2026)
Kimi K2.7 Code стоит за токен столько же, сколько K2.6 ($0.95/$4.00). Срез thinking-токенов на 30% урезает счёт на ~13% при тяжёлом рассуждении и менее 1% при тяжёлом вводе.
Ошибки импорта claude-code-sdk после переименования в июне 2026: причина и фикс
ModuleNotFoundError: claude_code_sdk или нет экспорта из @anthropic-ai/claude-code? SDK переехал в claude-agent-sdk. Фикс «до/после» для TS и Python.
Лимит Claude Code исчерпан слишком быстро: почему и 7 способов починить (2026)
Лимит Claude Code кончился к обеду? Opus жжёт в разы больше Sonnet, субагенты — 7x токенов, MCP съедает 33% контекста. Разбор через /usage и 7 решений.
Ошибка Rate Limit Reached в Claude Code: причины 429 и 6 решений (2026)
429 в Claude Code? Tier 1 режет Sonnet 4.x до 30k ITPM / 50 RPM. Читай retry-after, добавь backoff, режь ITPM кэшем или пуль ёмкость. 6 решений.
Claude Tag в Slack (2026): настройка в 4 шага, ambient-режим, дедлайн 3 августа
Claude Tag — общий @Claude-сокомандник в Slack на Opus 4.8. Настройка в 4 шага, ambient-режим, админ-скоупы и переход с Claude in Slack к 3 августа 2026.
Запуск GLM 5.2 локально (2026): 2-bit на 256 GB Mac или коробке с 4090
GLM 5.2 (753B) на своём железе: 2-bit влезает в Mac Studio на 256 GB, 4-bit просит 512 GB, ~3-9 tok/s. GGUF-кванты для llama.cpp, LM Studio и 4090.