AI 大模型怎么选?别默认选最强的,按任务选型(附免费选型工具)
选 AI 模型最大的误区,是默认挑参数最大、跑分最高的那个。这篇用『够用就好、按需升级』的思路,教你按任务复杂度、调用量、容错三个维度选型,再用一个覆盖 100+ 模型、按质量/价格/速度排序的免费工具十分钟选对。
Codex「command failed; retry without sandbox」:6 个修复方案(2026)
每次编辑都弹出 Codex CLI「command failed; retry without sandbox」?Linux 装 bubblewrap,sandbox_mode 设 workspace-write,approval_policy 设 on-request。6 个修复,5 个 2026 真实 issue。
Doubao Seed 2.1 API(2026):Pro 与 Turbo,免火山引擎注册
一个端点调用 Doubao Seed 2.1 Pro($0.884/$4.42 每 M)和 Turbo(半价:$0.442/$2.212)。256K 上下文,一把 key,无需单独注册火山引擎。
Kimi K2.7 Code:砍掉 30% token 真能让账单变便宜吗?(2026)
Kimi K2.7 Code 每 token 价格和 K2.6 一样($0.95/$4.00)。它砍掉 30% 思考 token,能让推理重的账单省约 13%,输入重的不到 1%。
2026 年 6 月改名后 claude-code-sdk 报导入错误:原因与修复
遇到 ModuleNotFoundError: claude_code_sdk,或者 @anthropic-ai/claude-code 不再导出 query?SDK 已搬到 claude-agent-sdk。附 TS 和 Python 的改前/改后对照。
Claude Code 报 429 限流怎么办?成因 + 6 种解决方法(2026)
用 API key 跑 Claude Code 报 429 rate limit?多半是触了每分钟的 RPM/ITPM/OTPM 上限。本文教你读 retry-after、加退避重试、用 prompt 缓存压低 ITPM、把容量池化,给出按 Tier 分档的 6 个修法,并讲清 429 和 529 的区别。
Claude Code 用量消耗太快?成因排查 + 7 招省 token(2026)
付费套餐刚到中午就提示用量超限?多半是默认跑 Opus、子代理并行烧 token、MCP 吃掉三分之一上下文这几件事。本文教你用 /usage 和 /context 定位元凶,给出 7 招把套餐撑长几倍,并讲清 5 小时窗口和周限的区别。
Slack 配置 Claude Tag:4 步上手、ambient 模式、8 月 3 日迁移截止(2026)
Claude Tag 是 Slack 里跑 Opus 4.8 的共享 @Claude 队友。4 步上手、ambient 模式、管理员权限,以及 2026-08-03 从 Claude in Slack 迁移的截止时间。
在本地跑 GLM 5.2(2026):2-bit 塞进 256GB Mac,或一台 4090 主机
本地跑 GLM 5.2(753B):2-bit 量化能塞进 256GB Mac Studio,4-bit 要 512GB,速度 ~3-9 tok/s。附 llama.cpp、LM Studio 和 4090 主机的 GGUF 量化档选型。
一个 API 路由 GLM-5.2、DeepSeek V4、MiniMax M3 和 Kimi K2.6(2026)
一把 ofox key 路由 4 个模型:blended 单价从 $0.19/M(V4 Flash)到 $2.40/M(GLM-5.2),差 12.86x。1M context、V4 cache 免费。一张每天 1000 任务的表把 $4,205/月 砍到 $1,453(-65.5%)。含 Python + Node。