首页 /基准、评测与校准 /jev-eval-agent

jev-eval-agent

带 100 个模拟工具的个人助理智能体,测量受 Jev 门禁的智能体需要多少步。

本页由英文清单自动生成。

来自 readme

jev-eval-agent 🇺🇸 English · 🇧🇷 Leia em português A personal-assistant agent built with eve (Vercel), with 100 mocked tools, served through OpenRouter. The repository exists to answer one question: how many steps does the agent need to finish the same task when the LLM picks the tool itself vs. when Jev (TypeSafe's classifier) picks it? AGENTMODE Who …

详情

分区
基准、评测与校准
owner
vinilana
星标
95
复刻
10
最近提交
2026-09-17
语言
HTML

这是什么

形态
数据集或基准
宿主智能体
独立运行
面向人群
研究人员
成熟度
文档

适合用来

最匹配的意图