Presentation
Orchestrating Multimodal Control for Unified Audio-Visual Synthesis
DescriptionThis course introduces a unified paradigm for multimodal control of joint audio-visual synthesis using the LTX-2 foundation model. Beyond text prompts, we demonstrate precise control via audio, video, imagery, and spatial data. Attendees will learn dual-stream transformer architectural innovations and practical techniques for orchestrating high-fidelity, aligned multimodal generation

Event Type
Course
TimeTuesday, 21 July 20263:45pm - 5:15pm PDT
LocationRoom 408 A
New Technologies
Animation
Art
Artificial Intelligence/Machine Learning
Audio
Computer Vision
Digital Twins
Generative AI
Rendering
Full Conference Supporter
Full Conference
