Presentation

Orchestrating Multimodal Control for Unified Audio-Visual Synthesis
DescriptionThis course introduces a unified paradigm for multimodal control of joint audio-visual synthesis using the LTX-2 foundation model. Beyond text prompts, we demonstrate precise control via audio, video, imagery, and spatial data. Attendees will learn dual-stream transformer architectural innovations and practical techniques for orchestrating high-fidelity, aligned multimodal generation
Event Type
Course
TimeTuesday, 21 July 20263:45pm - 5:15pm PDT
LocationRoom 408 A
Interest Areas
New Technologies
Keywords
Animation
Art
Artificial Intelligence/Machine Learning
Audio
Computer Vision
Digital Twins
Generative AI
Rendering
Registration Categories
Full Conference Supporter
Full Conference