亚历克·拉德福德 Alec Radford

OpenAI 核心研究者,GPT 系与 CLIP 的关键作者,生成式预训练与多模态对比学习的推动者。

研究方向及演变

生成对抗网络(早期 DCGAN)→ 生成式语言模型预训练(GPT/GPT-2)→ 图文对比多模态(CLIP)→ 语音(Whisper)。主线是「大规模自监督/弱监督预训练学通用表征」。

单位沿革(时间线)

  • 早年与同学创办 Indico(Olin College 辍学)。
  • OpenAI,2016–2024。
  • 2024 年后去向 待核实。

代表作(本 Wiki 双链)

  • clip(CLIP,2021)— 自然语言监督学习视觉表征,图文对比预训练,深刻影响 VLM 视觉编码器(含 OCR/文档解析模型的视觉侧)。

活跃时间与影响

2010 年代中至今。GPT 系开创生成式预训练路线;CLIP 的图文对齐范式是现代多模态大模型(包括文档解析 VLM 的视觉-语言对齐)的基石之一。