GitHub 精选huggingface/evaluation-guidebookGitHub Repohuggingface/evaluation-guidebookHugging Face 出品的 LLM 评估指南,涵盖自动基准、人工评估、LLM-as-a-judge 等理论与实战技巧,适合初学者到高级用户。ai evaluationbenchmark tutorialdataset resourceevaluationevaluation guideevaluation metricsknowledge workflowllm evaluation推荐理由创造者可将其作为 LLM 评估的必读教程,用于写评测分享、构建评估工作流或设计自己的评测方法。二创切入点围绕项目能力写工具教程、场景拆解或对比评测。复制 GitHub 概要后可直接改写成文章、社媒卡片或选题备忘。生成分享卡片可以用于私域传播、收藏夹或选题库归档。项目事实语言Jupyter Notebook协议otherIssues5首次收录2026/07/03