MirrorWorkforce 模型检测 协议审计、流式 SSE、文本指纹和能力衰减风险检测
检测服务 等待配置
MirrorWorkforce Benchmark Console

MirrorWorkforce中转站模型检测网页工作台

填写接口、模型和测试规则后即可自动跑完多维检测,并输出知识、推理、型号特征、真实流式 SSE、协议一致性、响应结构、文本指纹辅助归因、有效努力指数与降级风险。字段旁边给了示例,首次使用可以一键填入演示值再替换成真实 API Key。

检测配置

所有影响检测准确性的参数都需要显式填写

必填

基础参数

先确认中转站和模型
填入 API 地址和 Key 后可拉取可用模型。

运行参数

建议先用 1 轮试跑
最小试跑建议 Claude 示例:claude-opus-4-8;GPT 示例:gpt-5.5;轮次:1;超时:120。

测试用例

可编辑 prompt 与质量规则

汇总结果

检测完成后会自动刷新指标

当前中转站-
模型-
用例数-
总请求数-
综合评分-
成功率-
加权质量-
协议通过率-
响应结构率-
型号一致率-
文本指纹-
衰减风险-
风险标记-
输入 Tokens-
输出 Tokens-

模型检测结论

检测完成后生成综合判断。

指标表

成功率、加权质量、协议结构、文本指纹和衰减风险

中转站 成功率 质量通过率 加权质量 协议 流式协议 结构 型号一致 文本指纹 有效努力 降级风险 风险标记 空响应计费 平均延迟 首 token 总输入 总输出 评分上限 评分
暂无结果

问答明细

逐轮展示 prompt、模型回答和判定信号

检测完成后显示每轮问答结果