Запуск Claude Code с моделями Yandex AI Studio через локальный прокси-сервер LiteLLM и API Яндекс Облака
Практическое руководство по интеграции консольного агента Claude Code с OpenAI-совместимым API Яндекс Облака. Разбираем архитектурное несоответствие протоколов, настраиваем транслирующий прокси-сервер LiteLLM и решаем частые проблемы установки зависимостей в Windows.
Оптимизация расходов и ускорение работы LLM при помощи Prompt Caching на OpenRouter
Узнайте, как устроена технология Prompt Caching на OpenRouter. В статье разбираются различия между автоматическим и явным кэшированием, механизм липкой маршрутизации (sticky routing), способы отслеживания расхода токенов и практические примеры интеграции на Python для оптимизации расходов на API.
