Documentation
README
成本感知型 LLM 流水线 (Cost-Aware LLM Pipeline)
在保持质量的同时控制 LLM API 成本的模式。将模型路由 (Model Routing)、预算跟踪 (Budget Tracking)、重试逻辑 (Retry Logic) 和提示词缓存 (Prompt Caching) 组合成一个可复用的流水线。
何时启用
- 构建调用 LLM API(Claude、GPT 等)的应用
- 处理具有不同复杂度的批量项目
- 需要将 API 支出控制在预算范围内
- 在不牺牲复杂任务质量的前提下优化成本
核心概念
1. 基于任务复杂度的模型路由 (Model Routing)
为简单任务自动选择更便宜的模型,将昂贵的模型留给复杂任务。
This is the opening of the README. Read the full README on GitHub.