Moderato-V1-Pro / .eval_results /extractbench.yaml
NitrAI's picture NitrAI-BOT's picture
Add community evaluation results for DEEP-SWE, GPQA, HLE, SWE-BENCH_PRO, TERMINAL-BENCH, WILDCLAWBENCH, EXTRACTBENCH (#3)
560ead4
Raw History Blame Contribute Delete
684 Bytes
- dataset:
id: llamaindex/ExtractBench
task_id: mean
value: 88.65
source:
url: https://huggingface.co/nitrai-research/Moderato-V1-Pro
name: Model Card
- dataset:
id: llamaindex/ExtractBench
task_id: short
value: 94.2
source:
url: https://huggingface.co/nitrai-research/Moderato-V1-Pro
name: Model Card
- dataset:
id: llamaindex/ExtractBench
task_id: medium
value: 86.4
source:
url: https://huggingface.co/nitrai-research/Moderato-V1-Pro
name: Model Card
- dataset:
id: llamaindex/ExtractBench
task_id: long
value: 36.8
source:
url: https://huggingface.co/nitrai-research/Moderato-V1-Pro
name: Model Card