跳至主要内容
造物矩阵
全球 Maker 发现
个人 Maker

Sander Dieleman

把音乐、图像与视频生成模型写成可理解、可复用研究工具的 Maker

比利时英语 / 荷兰语2026年7月31日复核

持续在做什么

Sander Dieleman 是比利时机器学习研究者,现于伦敦的 Google DeepMind 研究大规模生成模型。他在根特大学完成博士研究,早期聚焦音乐音频的层次表示、分类与推荐,随后参与 WaveNet、AlphaGo、Lyria、Imagen 2/3、Veo、Nano Banana 与 Gemini Omni 等工作,横跨语音、音乐、图像和视频生成。Sander 也是 Theano 生态轻量神经网络库 Lasagne 的主要开发者之一,并长期通过个人博客用图示、公式和可复现思路解释扩散模型、潜空间、蒸馏与流映射,把前沿研究转化为开发者能理解和应用的工具。

生成模型扩散模型音频生成图像与视频生成开源机器学习

值得先看

0 条内容

还没有整理值得先看的内容。