LogoLL

Блог Леонида Лукина

Рубрика:

Полное руководство по Plan Mode и Ultraplan в Claude Code

Подробный разбор режимов планирования в Claude Code CLI. Узнайте, как исследовать кодовую базу, создавать интерактивные планы в облаке и экономить токены без риска для продакшена.

Легендарный зеленый Telecaster Фрэнсиса Росси

История знаменитого зеленого Fender Telecaster Фрэнсиса Росси из Status Quo. Разбираем уникальные модификации легендарного инструмента, купленного всего за £75, и развенчиваем популярный миф о загадочном отверстии в его корпусе.

Гайд по экономии токенов и команде /context в Claude Code

Подробный практический разбор работы с контекстным окном в Claude Code CLI. Объясняем теорию, анализируем команду /context, логику авто-компактации и делимся проверенными лайфхаками для экономии токенов и сохранения «памяти» ИИ.

Три этюда по статистике

Подборка исторических и литературных примеров о том, как человеческий разум — даже профессиональный — ошибается в оценке рисков, теории вероятностей и повседневных совпадений. В тексте собраны три взгляда на иллюзию контроля и когнитивные искажения: излишняя уверенность капитана «Титаника», парадокс о размере выборок из книги Нассима Талеба «Черный лебедь» и ироничный «закон подлости» на трамвайной остановке от Ильфа и Петрова.

Оптимизация расходов и ускорение работы LLM при помощи Prompt Caching на OpenRouter

Узнайте, как устроена технология Prompt Caching на OpenRouter. В статье разбираются различия между автоматическим и явным кэшированием, механизм липкой маршрутизации (sticky routing), способы отслеживания расхода токенов и практические примеры интеграции на Python для оптимизации расходов на API.

Гайд по плагину Ponytail для Claude Code

Подробный обзор плагина Ponytail для Claude Code. Рассказываем, как перестроить работу ИИ-ассистента по принципу «лестницы решений», заставив его отказаться от лишнего оверэнжиниринга, сократить объем генерируемого кода на 70% и значительно снизить расходы на API-токены.

Экономим до 50%+ токенов в Claude Code, или Полный гайд по утилите Token Optimizer

Подробное руководство по установке и настройке плагина Token Optimizer для Claude Code. Разбираем, как избавиться от перерасхода контекста, настроить активное сжатие лишней прозы, а также запустить локальный дашборд на Windows для детального мониторинга сессий и снижения затрат на API.

Кастомизация статус-бара в Claude Code через /statusline

Разбираем команду /statusline в Claude Code: как настроить статусную строку в терминале для удобного мониторинга лимитов контекста, текущих затрат на API, Git-статуса и других параметров сессии. Внутри — практические примеры конфигурации, скрипты и полезные лайфхаки для работы.

Как выжать максимум из OpenRouter при помощи Provider Selection

Использование объекта provider в OpenRouter дает разработчикам полный контроль над инфраструктурой исполнения LLM. Настраивая роутинг через Provider Selection, вы можете существенно снизить расходы на API без потери качества, гарантировать соблюдение SLA по задержкам и застраховать свои приложения от падения отдельных провайдеров.

Как экономить токены при работе с Claude Code

Автономные AI-агенты, такие как Claude Code, расходуют значительный объем токенов из-за непрерывного цикла планирования и отправки контекста проекта. Это становится особенно заметно при подключении сторонних моделей вроде DeepSeek через API-прокси. В этой статье собраны практические методы и инструменты для снижения расходов: от встроенных команд управления контекстом и тонкой настройки переменных окружения до специализированных open-source утилит, позволяющих сократить объем передаваемых данных без потери качества работы.