2 篇
fallback 的触发条件、切换 provider 或模型的取舍、如何解读请求最终结果,以及如何用 request_id 支撑上游故障的运维排查。
深入拆解智能模型路由的工作原理:EWMA 延迟评分、成本/速度/质量加权策略,以及生产级 AI 系统里自动故障转移的实现思路与取舍。