
个人 Maker
Sander Dieleman
把音乐、图像与视频生成模型写成可理解、可复用研究工具的 Maker
持续在做什么
Sander Dieleman 是比利时机器学习研究者,现于伦敦的 Google DeepMind 研究大规模生成模型。他在根特大学完成博士研究,早期聚焦音乐音频的层次表示、分类与推荐,随后参与 WaveNet、AlphaGo、Lyria、Imagen 2/3、Veo、Nano Banana 与 Gemini Omni 等工作,横跨语音、音乐、图像和视频生成。Sander 也是 Theano 生态轻量神经网络库 Lasagne 的主要开发者之一,并长期通过个人博客用图示、公式和可复现思路解释扩散模型、潜空间、蒸馏与流映射,把前沿研究转化为开发者能理解和应用的工具。
值得先看
0 条内容还没有整理值得先看的内容。
