Claude / GPT 多模型 API 网关
评测任务
固定样本、固定模型和固定评分字段。适合模型评测、prompt 对比和实验脚本用户,包含可执行步骤、配置边界、验证方法和相关排错入口。
样本集
固定输入集合。
模型
固定模型 ID。
评分
格式、准确性、稳定性分开。
实践核对
LabRouter AI 的这个页面围绕“评测、对比、可复现”展开,适合模型评测、prompt 对比和实验脚本用户。完成页面步骤后,请用当前站点的模型列表和一条最小请求验证,而不是直接把示例当作生产保证。
落地检查
固定样本、版本和记录字段,确保实验结果可复现。 LabRouter AI 的公开页面只描述可验证的配置和记录方法,不替代你自己的容量、合规和成本评估。
| 检查项 | 推荐动作 | 记录字段 |
|---|---|---|
| 入口 | 请求 https://labrouterai.xyz/v1/models | 状态码、模型 ID、时间 |
| 任务 | 按“benchmarks”页面的场景限制输入和并发 | 任务名、负责人、环境 |
| 成本 | 区分输入、输出、缓存和失败重试 | token、重试率、余额 |