跳至主要内容
造物矩阵

GitHub Repo

MLGroupJLU/LLM-eval-survey

一份关于大语言模型(LLM)评估的综述论文及其配套资源集合,系统整理了评估方法、基准和论文,帮助研究者和开发者理解LLM评测全貌。

benchmarkdataset resourceevaluationlarge language modelsllmllm evalllmssurvey paper

推荐理由

适合作为LLM评估方向的知识图谱和选题起点,创造者可借此拆解评估框架、撰写教程或构建更完善的评测基准。

二创切入点

  • 围绕项目能力写工具教程、场景拆解或对比评测。
  • 复制 GitHub 概要后可直接改写成文章、社媒卡片或选题备忘。
  • 生成分享卡片可以用于私域传播、收藏夹或选题库归档。

项目事实

语言
未知
协议
未标注
Issues
7
首次收录
2026/07/08