LogoLL

Блог Леонида Лукина

Рубрика: Prompt Caching

Гайд по экономии токенов и команде /context в Claude Code

Подробный практический разбор работы с контекстным окном в Claude Code CLI. Объясняем теорию, анализируем команду /context, логику авто-компактации и делимся проверенными лайфхаками для экономии токенов и сохранения «памяти» ИИ.

Оптимизация расходов и ускорение работы LLM при помощи Prompt Caching на OpenRouter

Узнайте, как устроена технология Prompt Caching на OpenRouter. В статье разбираются различия между автоматическим и явным кэшированием, механизм липкой маршрутизации (sticky routing), способы отслеживания расхода токенов и практические примеры интеграции на Python для оптимизации расходов на API.

Как экономить токены при работе с Claude Code

Автономные AI-агенты, такие как Claude Code, расходуют значительный объем токенов из-за непрерывного цикла планирования и отправки контекста проекта. Это становится особенно заметно при подключении сторонних моделей вроде DeepSeek через API-прокси. В этой статье собраны практические методы и инструменты для снижения расходов: от встроенных команд управления контекстом и тонкой настройки переменных окружения до специализированных open-source утилит, позволяющих сократить объем передаваемых данных без потери качества работы.