Оптимизация затрат на LLM в пайплайне

★ 6.8 · general

cost-optimizer — это скилл для Claude Code, который отслеживает суммарные расходы на LLM в ходе выполнения DAG и в реальном времени принимает решения, чтобы уложиться в бюджет. При превышении порогов он понижает тир модели (например, с Opus до Haiku), пропускает необязательные узлы или досрочно останавливает пайплайн, возвращая частичные результаты с разбивкой затрат. Перед каждым узлом скилл оценивает стоимость на основе среднего числа токенов и исторических данных; после завершения формирует отчёт с рекомендациями по экономии — например, заменить модель или распараллелить независимые узлы. Подходит командам, которым нужно контролировать бюджет на запросы, анализировать расходы по узлам или оптимизировать маршрутизацию моделей по стоимости; для выбора модели под конкретный узел используйте llm-router.