AI model routing, governance, and resilience infrastructure for MoonBit
Dependencies
moon fmt
moon check
moon testmoon update
moon check --deny-warn
moon testmoon run examples/gateway_demoInvoke-WebRequest http://127.0.0.1:3000/healthzInvoke-WebRequest -Method Post `
-ContentType 'application/json' `
-Body '{"model":"demo", "stream": true, "messages": [{"role":"user","content":"hello"}]}' `
http://127.0.0.1:3000/v1/chat/completionsmoon publish请求能力判断
-> Provider 选择
-> 预算与限流检查
-> 请求执行
-> 超时、重试、熔断或 Fallback
-> 流式响应转发
-> Token、费用、延迟和错误记录OpenAI-compatible Client / MoonBit API
|
HTTP Gateway
|
请求解析与治理策略
|
能力过滤与路由评分
|
弹性执行与流式处理
|
Provider Adapter / Mock Provider
|
调用记录、用量和指标统计| 项目 | 主要语言 | 已有能力 | MoonRoute 的差异 |
|---|---|---|---|
| LiteLLM | Python | 多模型统一调用、Proxy、成本统计、预算、限流、重试、Fallback 和负载均衡 | MoonRoute 不实现 100+ Provider SDK,聚焦 MoonBit-native 治理核心、Mock Provider 和可复现策略测试 |
| RouteLLM | Python | 基于偏好数据训练 LLM Router,并提供服务和评估框架 | MoonRoute 首期采用确定性运行时评分,不包含训练和偏好数据管线 |
| Portkey AI Gateway | TypeScript / JavaScript | 多模型 Gateway、路由、Fallback、重试、Circuit Breaker、预算、限流和 SSE 等 | MoonRoute 不做企业级控制台和大规模 Provider 集成,重点是 MoonBit 库接口和核心治理状态机 |
| Envoy AI Gateway | Go + Envoy | Kubernetes/Envoy 体系中的 AI 流量入口、路由、策略、限流和观测 | MoonRoute 不依赖 Kubernetes、Envoy 或 CRD,首期以单进程 MoonBit 库和本地 Gateway 为目标 |
| Bifrost | Go | 多 Provider OpenAI-compatible Gateway、请求排队、Provider 生命周期管理和 AI 流量统一入口 | MoonRoute 不以高吞吐网关性能为首要目标,重点是可解释的治理策略、可测试状态机和 MoonBit API |
| Shepherd Model Gateway | Rust | 高性能模型 Gateway、缓存感知路由、gRPC、负载均衡、限流、熔断和多租户能力 | MoonRoute 不追求 GPU 集群调度和高性能生产部署,重点是 MoonBit 生态中的轻量治理抽象 |
| AISIX AI Gateway | Rust | OpenAI-compatible Gateway、路由与故障转移、预算、限流、Guardrails、缓存和观测 | MoonRoute 不复制完整生产网关功能,首期聚焦治理核心、Mock Provider、单进程内存状态和验证型 Demo |
| llm_interop | MoonBit | 多供应商协议抽象、流式调用、工具调用和协议转换 | MoonRoute 在其上层补充路由、预算、限流、重试、熔断、Fallback 和 Gateway 治理能力 |
底层 Provider SDK / llm_interop
|
MoonRoute Governance Core
|
Gateway / AI ApplicationInstall
Download zipAI model routing, governance, and resilience infrastructure for MoonBit
Dependencies