Назад к блогу

CHANNEL / ACTIVE

#optimization

Посты с тегом02 / статей
Все теги

Дело в harness, а не в модели: почему одна и та же LLM жжет в 4 раза больше токенов без правильной обвязки

Разбор тезиса 'harness > модель' через призму экономии токенов: одна и та же модель решила 6.7% задач без обвязки против 68% с правильным harness — и потратила при этом в 4 раза меньше токенов. Что такое harness, почему именно в нем прячется счет за токены и что доказывают работы Life-Harness и Meta-Harness. Плюс почему ваш стек Claude Code (субагенты, скиллы, хуки, графы) уже сам по себе и есть harness.

Как сэкономить токены в LLM: практический гайд для Claude Code

Рабочие подходы к экономии токенов в Claude Code и Opus 4.7/4.8: субагенты, скиллы, хуки, китайские модели, графы знаний, RAG, xhigh effort, управление сессией, суммаризация на дешевой модели, сжатие входа (headroom, pxpipe, mcp-compressor) и экономия на стороне сервера (Tool Search, context editing, prompt caching, Batches API). Чеклист для сокращения расходов в 10 раз.