LogoLL

Блог Леонида Лукина

Рубрика: DeepSeek

Запуск Claude Code с моделями Yandex AI Studio через локальный прокси-сервер LiteLLM и API Яндекс Облака

Практическое руководство по интеграции консольного агента Claude Code с OpenAI-совместимым API Яндекс Облака. Разбираем архитектурное несоответствие протоколов, настраиваем транслирующий прокси-сервер LiteLLM и решаем частые проблемы установки зависимостей в Windows.

Как автоматизировать смену моделей и API-ключей в Claude Code без ручной правки конфигов

Устали каждый раз вручную менять API-ключи и модели в JSON-файлах конфигурации Claude Code? В этой статье мы разбираем три практических способа автоматизировать процесс: от встроенных команд переключения на лету (включая гибридный режим opusplan) до интеграции удобной CLI-утилиты claude-provider.

Оптимизация расходов и ускорение работы LLM при помощи Prompt Caching на OpenRouter

Узнайте, как устроена технология Prompt Caching на OpenRouter. В статье разбираются различия между автоматическим и явным кэшированием, механизм липкой маршрутизации (sticky routing), способы отслеживания расхода токенов и практические примеры интеграции на Python для оптимизации расходов на API.

Как выжать максимум из OpenRouter при помощи Provider Selection

Использование объекта provider в OpenRouter дает разработчикам полный контроль над инфраструктурой исполнения LLM. Настраивая роутинг через Provider Selection, вы можете существенно снизить расходы на API без потери качества, гарантировать соблюдение SLA по задержкам и застраховать свои приложения от падения отдельных провайдеров.

Как экономить токены при работе с Claude Code

Автономные AI-агенты, такие как Claude Code, расходуют значительный объем токенов из-за непрерывного цикла планирования и отправки контекста проекта. Это становится особенно заметно при подключении сторонних моделей вроде DeepSeek через API-прокси. В этой статье собраны практические методы и инструменты для снижения расходов: от встроенных команд управления контекстом и тонкой настройки переменных окружения до специализированных open-source утилит, позволяющих сократить объем передаваемых данных без потери качества работы.