Published Jul 3, 2023

Unifying Vision and Language Models with Mohit Bansal - 636

Mohit Bansal discusses the innovative unification of vision and language models to create more efficient, multimodal AI systems like VLT5 and UDOP, while addressing generative AI evaluation challenges like bias and factuality. He highlights significant advancements in processing diverse data types and emphasizes programmatic explainability to boost AI transparency and reliability.
Episode Highlights
The TWIML AI Podcast (formerly This Week in Machine Learning & Artificial Intelligence) logo

Popular Clips

Episode Highlights

Related Episodes