Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
9.2
TFLOPS
EvalEval Bot
EvalEvalBot
321
1
Follow
deeplumiere's profile picture
evijit's profile picture
zozoosibanda2-creator's profile picture
3 followers
·
2 following
AI & ML interests
None yet
Recent Activity
new
activity
about 3 hours ago
evaleval/EEE_datastore:
UKAISI Inference Scaling File Dump 2
new
activity
about 3 hours ago
evaleval/EEE_datastore:
[ACL Shared Task] Add AlpacaEval
new
activity
about 3 hours ago
evaleval/EEE_datastore:
Inference Scaling Evaluation UKAISI 2026
View all activity
Organizations
EvalEvalBot
's activity
All
Models
Datasets
Spaces
Buckets
Papers
Collections
Community
Posts
Upvotes
Likes
Articles
New activity in
evaleval/EEE_datastore
about 3 hours ago
UKAISI Inference Scaling File Dump 2
3
#185 opened about 3 hours ago by
deeplumiere
[ACL Shared Task] Add AlpacaEval
15
#129 opened 3 months ago by
muhammadravi251001
Inference Scaling Evaluation UKAISI 2026
6
#184 opened about 3 hours ago by
deeplumiere
New activity in
evaleval/EEE_datastore
about 4 hours ago
[ACL Shared Task] Add Chatbot Arena
32
#110 opened 3 months ago by
muhammadravi251001
updated
a dataset
about 13 hours ago
evaleval/EEE_datastore
Viewer
•
Updated
about 3 hours ago
•
7.82k
•
11.8k
•
39
New activity in
evaleval/EEE_datastore
about 13 hours ago
[Submission] WeatherBench 2 scorecard results
8
#139 opened 3 months ago by
idoleaf
[Submission] Latest LiveBench Data
9
#138 opened 3 months ago by
reuank
New activity in
evaleval/EEE_datastore
about 14 hours ago
Fix LLM Stats provenance relationships
9
#137 opened 3 months ago by
Cerru02
New activity in
evaleval/EEE_datastore
about 15 hours ago
Shared Task - Submission
25
#136 opened 3 months ago by
UsmanGohar
New activity in
evaleval/EEE_datastore
about 19 hours ago
Inference Scaling Evaluation Results Batch Conversion
4
#182 opened about 19 hours ago by
deeplumiere
New activity in
evaleval/EEE_datastore
about 23 hours ago
[Submission] Add LEXam legal-reasoning leaderboard (36 models)
1
#179 opened 2 days ago by
borgr
New activity in
evaleval/EEE_datastore
3 days ago
[ACL Shared Task] mmlu-winogrande-afr: African language benchmarks (AAAI 2025, IDM)
18
#132 opened 3 months ago by
jboat
Add ResearchGym rg-agent GPT-5 results
12
#130 opened 3 months ago by
anikethh
[ACL Shared Task] Add OpenAI MRCR v2 (8-needle) leaderboard results
11
#119 opened 3 months ago by
bwingenroth
[ACL Shared Task] Add LingOly benchmark results
14
#78 opened 4 months ago by
ambean
New activity in
evaleval/EEE_datastore
6 days ago
[Submission] Add ANIMA and TAC (CaML animal-welfare benchmarks)
15
#166 opened about 1 month ago by
sparrow8i8
New activity in
evaleval/EEE_datastore
7 days ago
[ACL Shared Task] Add PACEBench evaluation results
12
#77 opened 4 months ago by
mrpfisher
[ACL Shared Task] Add PACEBench evaluation results
12
#77 opened 4 months ago by
mrpfisher
New activity in
evaleval/EEE_datastore
30 days ago
Add PromptSuite evaluation data
5
#145 opened 2 months ago by
eliyahabba
New activity in
evaleval/EEE_datastore
about 1 month ago
[Submission] Add TELBench (DRIFT reproduction) results
3
#168 opened about 1 month ago by
Gazzara-lab
Load more