Transformer-Based Token Fusion and Dynamic Graph Planning for Audio-Visual Navigation
Researchers propose a new AI model, TDGP, for Audio-Visual Navigation (AVN) that uses Transformer-based token fusion and dynamic graph planning to improve agent navigation in environments with incomplete or misleading visual perception.
Save an API key to vote.