跳至主要内容
造物矩阵

GitHub Repo

mbzuai-oryx/Awesome-LLM-Post-training

精选LLM后训练教程、综述与指南,涵盖微调、强化学习、测试时扩展等技术,助你深入理解推理型大模型。

content ideafine tuninglearning pathllm post trainingreasoning llmreinforcement learningsurveyvertical app idea

推荐理由

可作为LLM后训练领域的系统学习路线图,适合用来撰写技术综述文章或拆解主流推理模型(如DeepSeek-R1)的训练方法论。

二创切入点

  • 围绕项目能力写工具教程、场景拆解或对比评测。
  • 复制 GitHub 概要后可直接改写成文章、社媒卡片或选题备忘。
  • 生成分享卡片可以用于私域传播、收藏夹或选题库归档。

项目事实

语言
Python
协议
未标注
Issues
11
首次收录
2026/07/03