
个人 Maker
Ruiqi Zhong
让人类能监督超人模型、并用自然语言看懂复杂数据与 AI 的 Maker
持续在做什么
Ruiqi Zhong 是 Thinking Machines Lab 技术成员,曾在 Anthropic 工作,并于 2025 年获得加州大学伯克利分校计算机科学博士学位。他研究人机协作、可扩展监督与可解释性:一条路线关注人类如何监督可能超越自身能力的模型、防止模型通过 RLHF 学会“装作正确”;另一条路线让语言模型把复杂数据集和 AI 系统的模式直接解释成自然语言参数,帮助研究者从海量样本中发现结构。
值得先看
0 条内容还没有整理值得先看的内容。
