LiteLLM: единый API для десятков LLM — как не писать код под каждого провайдера
Разработчики, интегрирующие LLM в проекты, часто сталкиваются с проблемой: у каждого провайдера свой API, свой формат запросов и своя логика. LiteLLM решает это, предлагая единый SDK и прокси-сервер, который поддерживает OpenAI, Anthropic, Cohere, Google, Azure, Meta Llama и десятки других моделей. Всё управляется через один вызов — достаточно указать имя модели, а библиотека сама маршрутизирует запрос.
Инструмент поддерживает стриминг, функции (function calling), логирование, fallback-модели и мониторинг. Можно запустить локальный proxy-сервер, который будет распределять запросы между разными моделями по заданным правилам. Это позволяет не привязываться к одному провайдеру, тестировать разные модели и переключать их без переписывания кода.
Для команд, которые уже используют LLM или только планируют, LiteLLM экономит время разработки и упрощает эксплуатацию. Весь код — open-source, доступен на GitHub, и активно обновляется сообществом.