在包含 100 个模拟工具的个人助理测试框架中,对比大语言模型工具选择与 Jev 路由。
查看英文原文
Compares LLM tool selection with Jev routing in a personal-assistant harness containing 100 mocked tools.
结果只适用于各项目的数据集、提示词、模型版本和测量设置。收录表示证据可检查,不代表本站或原清单独立重跑了基准。
收录与研究来源
以下保留前版来源,不代表本版重新安装或审计了此项目。
cobanov/awesome-jev →原审查固定 README · 037de11 →原审查实现文件 · agent/lib/jev-router.ts →
