分流策略测试 (Router Control)
分流轨迹追踪 (Trace Engine)
模型响应结果 (Output Sandbox)
🤖 Auto 模式 (Workers AI 智能分流) v3.7 观察期
客户端选择 auto 虚拟模型时, 由 Workers AI 根据任务内容智能路由到下表显式池之一。
1 周观察期结束后才会接入 保存并实时生效 逻辑。
X-Router-Auto-Classifier / X-Router-Auto-Confidence / X-Router-Auto-Tier 等 6 个调试头, 可在 Live Monitor 面板查看。1 周后接入“保存”逻辑即可在 UI 调整。
🔀 虚拟模型别名映射 (Virtual Models)
配置客户端调用的模型名称别名(如 general, cheap, multimodal, deep-think, voice),指定主选中模型与失败时的自动降级备选(Fallbacks)。
📏 长短文本智能分流策略 (Content-Length Routing)
当客户端使用 model: "general" 时,根据提示词 Prompt 字符总数评估:未超阈值路由至高性价比轻量模型;超时自动转由高性能大模型处理。
⚖️ 权重负载均衡节点 (Weighted Balancing Nodes)
当携带请求头 X-Routing-Strategy: weighted 时生效,按设定权重值在多个节点间随机分发流量。
🔑 上游 API Key 配置引导
您可以通过以下两种推荐方式填入提供商 API Key:
- 方式 1(推荐):Cloudflare AI Gateway 控制台 — 在 Cloudflare 后台 AI Gateway -> Providers 统一设置密钥,高安全且修改无需重部署 Worker。
- 方式 2:Worker Secrets 环境变量 — 使用命令行设置密钥:
npx wrangler secret put OPENAI_API_KEY或在本地开发环境创建.dev.vars文件。
🚫 404 模型黑名单管理
已知上游返回 404 的模型名列表,路由时会自动从 allTargets 中剥除这些节点,避免请求失败。存储在 KV 中,修改后立即生效。
📈 流量时序 (按 Provider 堆叠)
🔀 实时路由轨迹流
🧩 策略分布 (近窗口)
🎯 节点命中率 Top 10
🗂 按功能分类 (Functional Categories)
火山方舟模型广场按名/能力划分到 6 大类;每个分类在右侧给出 Top-2 适配候选 (按“已开通 Running + 日期新 + 上下文大”加权评分)
,“应用”可一键填充配置中心对应虚拟模型的 primary 与 fallback。
| 分类 (Category) | 🏆 Top-2 适配候选 (推荐填入虚拟模型) | 本分类下全部模型 (点击表头应用 Top-2 → 配置中心) | 分布 |
|---|---|---|---|
| 未查询 | |||
🔗 模型广场 ↔ 接入点 映射 (Joined View)
| 广场模型 ID (model_id) | 供应商 (owned_by) | 接入点 ID (endpoint_id) | 状态 | 接入点名称 (name) |
|---|---|---|---|---|
| 未查询 | ||||
📡 接入点明细 (Endpoints)
| 接入点 ID | 模型 (model) | 名称 (name) | 状态 | 更新时间 |
|---|---|---|---|---|
| 未查询 | ||||
🔍 筛选条件
🎯 筛选后的模型 (filtered · 0)
| 模型 ID | 供应商 | 类型 | 上下文 | 能力 / 特征 |
|---|---|---|---|---|
| 等待筛选结果 | ||||
🗂 全量模型广场 (modelsSquare · 0)
展示 getSiliconFlowModelsOverview 拉取到的所有模型。该区域不受筛选影响。
| 模型 ID | 供应商 | 类型 | 上下文 | 能力 / 特征 |
|---|---|---|---|---|
| 点击上方 加载广场 拉取数据 | ||||