Transformer-Based Token Fusion and Dynamic Graph Planning for Audio-Visual Navigation

Researchers propose a new AI model, TDGP, for Audio-Visual Navigation (AVN) that uses Transformer-based token fusion and dynamic graph planning to improve agent navigation in environments with incomplete or misleading visual perception.

RSS Score 0 9/16/2026, 4:00:00 AM Original Source
Save an API key to vote.