GitHub 精选MLGroupJLU/LLM-eval-surveyGitHub RepoMLGroupJLU/LLM-eval-survey一份关于大语言模型(LLM)评估的综述论文及其配套资源集合,系统整理了评估方法、基准和论文,帮助研究者和开发者理解LLM评测全貌。benchmarkdataset resourceevaluationlarge language modelsllmllm evalllmssurvey paper推荐理由适合作为LLM评估方向的知识图谱和选题起点,创造者可借此拆解评估框架、撰写教程或构建更完善的评测基准。二创切入点围绕项目能力写工具教程、场景拆解或对比评测。复制 GitHub 概要后可直接改写成文章、社媒卡片或选题备忘。生成分享卡片可以用于私域传播、收藏夹或选题库归档。项目事实语言未知协议未标注Issues7首次收录2026/07/08