Hugging Face's logo Hugging Face
  • Models
  • Datasets
  • Spaces
  • Buckets new
  • Docs
  • Enterprise
  • Pricing
    • Website
      • Tasks
      • HuggingChat
      • Collections
      • Languages
      • Organizations
    • Community
      • Blog
      • Posts
      • Daily Papers
      • Hardware
      • Learn
      • Discord
      • Forum
      • GitHub
    • Solutions
      • Team & Enterprise
      • Hugging Face PRO
      • Enterprise Support
      • Inference Providers
      • Inference Endpoints
      • Storage Buckets

  • Log In
  • Sign Up

SanaullahTareen07
/
evaluating-frontier-llms-bemchmarking

Text Classification
Joblib
Safetensors
English
llm-evaluation
benchmarking
pareto-frontier
Bradley-Terry
failure-clustering
Model card Files Files and versions
xet
Community
evaluating-frontier-llms-bemchmarking
193 MB
Ctrl+K
Ctrl+K
  • 1 contributor
History: 3 commits
SanaullahTareen07's picture
SanaullahTareen07
Upload 923 files
bd23c0e verified 9 days ago
  • findings-zipped
    Upload 923 files 9 days ago
  • llm_analytics_exports
    Upload 923 files 9 days ago
  • llm_analytics_report
    Upload 923 files 9 days ago
  • saved_ml_models
    Upload 923 files 9 days ago
  • visualization
    Upload 923 files 9 days ago
  • .gitattributes
    3.29 kB
    Upload 923 files 9 days ago
  • LLM_Benchmark_Telemetry_Results.docx
    926 kB
    xet
    Upload 923 files 9 days ago
  • LLM_Benchmark_Telemetry_Results.pdf
    1.02 MB
    xet
    Upload 923 files 9 days ago
  • README.md
    252 Bytes
    Update README.md 9 days ago
  • analysis-llms-worldwide.ipynb
    586 kB
    Upload 923 files 9 days ago
  • gpt-image-2_Prompt_A_sleek_minimal_horizontal_bar_chart_rendering._The_bars_are_futuristic_m-0.jpg
    127 kB
    xet
    Upload 923 files 9 days ago