Jev 101
简体中文 ▾
简体中文English
工具目录/评估与校准
社区项目

typesafe-ai-benchmark

iammrduncan/typesafe-ai-benchmark · 评估与校准

模拟 System One 输出结构的大语言模型网关,用于对比研究。

评估网关
查看英文原文

LLM gateway that mimics the System One output shape for comparison work.

结果只适用于各项目的数据集、提示词、模型版本和测量设置。收录表示证据可检查,不代表本站或原清单独立重跑了基准。

收录与研究来源

以下保留前版来源,不代表本版重新安装或审计了此项目。

cobanov/awesome-jev →fatwang2/awesome-jev →