GitHub 精选mbzuai-oryx/Awesome-LLM-Post-trainingGitHub Repombzuai-oryx/Awesome-LLM-Post-training精选LLM后训练教程、综述与指南,涵盖微调、强化学习、测试时扩展等技术,助你深入理解推理型大模型。content ideafine tuninglearning pathllm post trainingreasoning llmreinforcement learningsurveyvertical app idea推荐理由可作为LLM后训练领域的系统学习路线图,适合用来撰写技术综述文章或拆解主流推理模型(如DeepSeek-R1)的训练方法论。二创切入点围绕项目能力写工具教程、场景拆解或对比评测。复制 GitHub 概要后可直接改写成文章、社媒卡片或选题备忘。生成分享卡片可以用于私域传播、收藏夹或选题库归档。项目事实语言Python协议未标注Issues11首次收录2026/07/03