尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

Switchyard 健康检查与调试:/health、/v1/models、dry-run 快速上手指南

Switchyard 健康检查与调试:/health、/v1/models、dry-run 快速上手指南 Switchyard 健康检查与调试/health、/v1/models、dry-run 快速上手指南【免费下载链接】SwitchyardSwitchyard lets LLM applications route traffic across models and providers while preserving native OpenAI and Anthropic API compatibility - enabling flexible model selection, benchmarking, and cost/performance optimization.项目地址: https://gitcode.com/GitHub_Trending/switch/SwitchyardSwitchyard是一个 LLM 流量路由网关让应用在同一套 OpenAI / Anthropic 兼容接口背后自由切换不同模型与供应商。刚部署完却不确定配置是否生效客户端连不上不知道该查哪里这篇文章带你用3 个内置调试入口——/health存活探针、/v1/models模型列表、--dry-run配置校验——快速完成一次完整的健康检查与调试。为什么需要这三个调试入口Switchyard 服务端以标准 HTTP 服务形式运行默认端口4000所有端点在服务启动时会以横幅形式打印出来见 crates/switchyard-server/assets/startup_banner.txt。日常运维中最常见的三类问题服务到底活没活→ 用/health路由配置里有哪些模型在对外服务→ 用/v1/models改完配置文件不启动就能验证吗→ 用--dry-run三者都无需发真实 LLM 请求零成本、零消耗是调试路由网关的第一站。一分钟上手三个调试入口逐一说清/health最常用的存活探针GET /health是标准的 liveness 端点服务正常时返回{status: ok}一行验证curl http://127.0.0.1:4000/health这个端点非常适合接入Kubernetes 的 liveness/readiness 探针负载均衡器健康检查监控系统的拨测脚本它的实现极其轻量见 crates/switchyard-server/src/lib.rs因此返回 200 只代表服务进程在运行不代表后端模型全部可用——这一点在排查时要记住。/v1/models核对路由配置是否真的生效GET /v1/models返回当前部署对外提供的全部路由兼容 OpenAI 的模型列表格式并额外附上model_pool、default_model、能力信息是否支持工具调用、上下文窗口等定义见 crates/switchyard-server/src/lib.rs。curl http://127.0.0.1:4000/v1/models典型用途核对配置TOML 里写了 5 条路由返回里只有 4 条说明有一条被静默过滤检查配置即可定位确认可用 ID客户端请求体中的model字段必须匹配这里的id写错会直接 404查看能力每条路由都声明了streaming、tool_calling、context_window等能力位端点说明详见 crates/switchyard-server/README.md。--dry-run不启动、不占端口先验证配置改完配置文件最稳妥的做法是先用--dry-run做纯校验——它会完整加载配置、构建运行时但不绑定任何 socket打印摘要后直接退出switchyard-server --config config.toml --dry-run一切正常时输出形如server OK: general, fast, ...如果配置有误比如base_url非法会直接报错退出。这正是 CI 场景的理想用法配置变更先跑 dry-run通过后再滚动重启。参数定义见 crates/switchyard-server/src/cli.rs执行逻辑见 crates/switchyard-server/src/lib.rs。 一个实用技巧在部署脚本里先执行--dry-run失败就阻断发布避免带着坏配置启动后才发现。配套排查端点问题更深时看这两个当/health正常但业务请求异常时继续往下查端点作用什么时候用GET /v1/stats各模型调用量、token 用量与算法级统计怀疑流量没走预期路由时GET /metricsPrometheus 格式指标接入监控告警POST /v1/stats/reset清零累计统计做基准测试前Prometheus 指标说明见 docs/internal/metrics_reference.md完整的告警规则示例参考 examples/prometheus/switchyard.rules.yaml。实战三步完成一次完整体检以仓库自带的开发配置 dev-server/config.toml 为例启动前switchyard-server --config dev-server/config.toml --dry-run—— 确认配置合法启动后curl http://127.0.0.1:4000/health—— 确认服务存活业务前curl http://127.0.0.1:4000/v1/models—— 确认路由与能力符合预期三步都通过即可放心接入应用流量。参考文件与延伸阅读服务端端点总表crates/switchyard-server/README.md服务端完整配置说明crates/switchyard-server/CONFIGURATION.mdCLI 参数参考docs/cli_reference.md路由算法文档判断流量该去哪时看这里docs/routing_algorithms/overview.md核心库说明crates/libsy/README.md掌握/health、/v1/models与--dry-run你已经具备了 Switchyard 日常运维所需的 80% 调试能力。【免费下载链接】SwitchyardSwitchyard lets LLM applications route traffic across models and providers while preserving native OpenAI and Anthropic API compatibility - enabling flexible model selection, benchmarking, and cost/performance optimization.项目地址: https://gitcode.com/GitHub_Trending/switch/Switchyard创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表