Claude / GPT 多模型 API 网关

评测任务

固定样本、固定模型和固定评分字段。适合模型评测、prompt 对比和实验脚本用户,包含可执行步骤、配置边界、验证方法和相关排错入口。

样本集

固定输入集合。

模型

固定模型 ID。

评分

格式、准确性、稳定性分开。

实践核对

LabRouter AI 的这个页面围绕“评测、对比、可复现”展开,适合模型评测、prompt 对比和实验脚本用户。完成页面步骤后,请用当前站点的模型列表和一条最小请求验证,而不是直接把示例当作生产保证。

落地检查

固定样本、版本和记录字段,确保实验结果可复现。 LabRouter AI 的公开页面只描述可验证的配置和记录方法,不替代你自己的容量、合规和成本评估。

检查项推荐动作记录字段
入口请求 https://labrouterai.xyz/v1/models状态码、模型 ID、时间
任务按“benchmarks”页面的场景限制输入和并发任务名、负责人、环境
成本区分输入、输出、缓存和失败重试token、重试率、余额