跳至主要内容
造物矩阵
全球 Maker 发现
个人 Maker

Pavel Izmailov

从贝叶斯不确定性与权重平均走向前沿推理模型和弱到强监督的 Maker

美国英语 / 俄语2026年7月31日复核

持续在做什么

Pavel Izmailov 是纽约大学计算机科学助理教授、Anthropic 研究员,曾在 OpenAI 参与 o1 推理模型与超级智能对齐研究。他从深度网络损失地形、权重平均、贝叶斯不确定性和分布外泛化出发,进一步研究强化学习、规划、搜索、AI 科学发现与技术对齐,并参与 Claude 3.7、Claude 4 和弱到强泛化等前沿项目,把基础学习理论与可部署推理系统连接起来。

模型推理强化学习AI 对齐贝叶斯深度学习泛化与鲁棒性

值得先看

0 条内容

还没有整理值得先看的内容。