跳至主要内容
造物矩阵
全球 Maker 发现
个人 Maker

Ruiqi Zhong

让人类能监督超人模型、并用自然语言看懂复杂数据与 AI 的 Maker

美国英语 / 中文2026年7月31日复核

持续在做什么

Ruiqi Zhong 是 Thinking Machines Lab 技术成员,曾在 Anthropic 工作,并于 2025 年获得加州大学伯克利分校计算机科学博士学位。他研究人机协作、可扩展监督与可解释性:一条路线关注人类如何监督可能超越自身能力的模型、防止模型通过 RLHF 学会“装作正确”;另一条路线让语言模型把复杂数据集和 AI 系统的模式直接解释成自然语言参数,帮助研究者从海量样本中发现结构。

可扩展监督人机协作AI 可解释性自然语言参数大模型对齐

值得先看

0 条内容

还没有整理值得先看的内容。