research release

Flamingo visual language model

DeepMind introduced Flamingo, a visual language model accepting interleaved image, video and text prompts and performing few-shot multimodal tasks without task-specific fine-tuning.

Original sources

Open artifact View JSON