Improving Cross-Modal Alignment in Vision Language Navigation via Syntactic Information

Open in new window