• LLM Benchmarking Survey

    Please provide structured benchmarking feedback about large language models. All responses help improve assessment practices. Title: LLM Benchmarking Survey.
  • Which models did you compare against?*
  • Evaluation criteria considered*
  • Task types assessed*
  • Per-criterion Likert scale ratings*
    Rows
  • Should be Empty:
Select theme: