AI2 WildBench Leaderboard
Web Bench| Launched | |
| Pricing Model | Free |
| Starting Price | |
| Tech used | |
| Tag | Llm Benchmark Leaderboard,Data Analysis,A/B Testing |
| Launched | 2025-05 |
| Pricing Model | Free |
| Starting Price | |
| Tech used | Cloudflare CDN,Gzip,OpenGraph |
| Tag | Web Analytics |
| Global Rank | |
| Country | |
| Month Visit |
| Global Rank | |
| Country | United States |
| Month Visit | 723 |
Estimated traffic data from Similarweb
LiveBench - LiveBench 是一款 LLM 基准测试,每月从不同来源收集新的问题,并提供客观答案以进行准确评分。目前涵盖 6 个类别中的 18 个任务,并将不断增加更多任务。
ModelBench - 无需编码即可快速推出 AI 产品,并对大型语言模型 (LLM) 进行评估。比较 180 多个模型,精心设计提示词,并充满信心地进行测试。
BenchLLM by V7 - BenchLLM:评估LLM响应,构建测试套件,自动化评估。通过全面的性能评估来增强AI驱动系统。
xbench - xbench: 追踪人工智能在现实世界中的实际效用与前沿能力的基准测试。借助我们独有的双轨系统,为AI智能体提供精准、动态的评估。