Jason / Works Embodied AIZero to One
Works
没主意?快捷入口
Heatmap · 标签共现矩阵

21 × 21 共现强度。

格子越深,两个 tag 共同出现的论文越多。对角线 = 该 tag 自身论文数。看这页能发现"谁经常和谁一起出现"——比如 transformer × VLA 高,RF × tactile 几乎为零。

visionlanguagetransformerdiffusionVLAimitationVLMmanipulationRLdataset3Dnavigationaudio-speechflow-matchingRF-radarworld-modelsim2reallocomotiontactilemamba-ssmopen-source visionlanguagetransformerdiffusionVLAimitationVLMmanipulationRLdataset3Dnavigationaudio-speechflow-matchingRF-radarworld-modelsim2reallocomotiontactilemamba-ssmopen-source vision: 107 107 vision × language: 57 57 vision × transformer: 48 48 vision × diffusion: 34 34 vision × VLA: 26 26 vision × imitation: 29 29 vision × VLM: 31 31 vision × manipulation: 19 19 vision × RL: 15 15 vision × dataset: 17 17 vision × 3D: 18 18 vision × navigation: 13 13 vision × audio-speech: 5 5 vision × flow-matching: 6 6 vision × RF-radar: 9 9 vision × world-model: 5 5 vision × sim2real: 8 8 vision × locomotion: 4 4 vision × tactile: 6 6 vision × mamba-ssm: 3 3 vision × open-source: 3 3 language × vision: 57 57 language: 90 90 language × transformer: 39 39 language × diffusion: 26 26 language × VLA: 34 34 language × imitation: 24 24 language × VLM: 39 39 language × manipulation: 21 21 language × RL: 15 15 language × dataset: 18 18 language × 3D: 6 6 language × navigation: 5 5 language × audio-speech: 3 3 language × flow-matching: 6 6 language × RF-radar: 1 language × world-model: 5 5 language × sim2real: 4 4 language × locomotion: 6 6 language × tactile: 4 4 language × mamba-ssm: 1 language × open-source: 3 3 transformer × vision: 48 48 transformer × language: 39 39 transformer: 78 78 transformer × diffusion: 31 31 transformer × VLA: 23 23 transformer × imitation: 16 16 transformer × VLM: 20 20 transformer × manipulation: 11 11 transformer × RL: 9 9 transformer × dataset: 7 7 transformer × 3D: 12 12 transformer × navigation: 7 7 transformer × audio-speech: 9 9 transformer × flow-matching: 7 7 transformer × RF-radar: 5 5 transformer × world-model: 7 7 transformer × sim2real: 1 transformer × locomotion: 3 3 transformer × tactile: 3 3 transformer × mamba-ssm: 2 transformer × open-source: 1 diffusion × vision: 34 34 diffusion × language: 26 26 diffusion × transformer: 31 31 diffusion: 60 60 diffusion × VLA: 24 24 diffusion × imitation: 23 23 diffusion × VLM: 16 16 diffusion × manipulation: 23 23 diffusion × RL: 6 6 diffusion × dataset: 9 9 diffusion × 3D: 9 9 diffusion × navigation: 7 7 diffusion × audio-speech: 1 diffusion × flow-matching: 11 11 diffusion × RF-radar: 2 diffusion × world-model: 7 7 diffusion × sim2real: 5 5 diffusion × locomotion: 2 diffusion × tactile: 1 diffusion × mamba-ssm: 1 diffusion × open-source: 1 VLA × vision: 26 26 VLA × language: 34 34 VLA × transformer: 23 23 VLA × diffusion: 24 24 VLA: 59 59 VLA × imitation: 13 13 VLA × VLM: 35 35 VLA × manipulation: 23 23 VLA × RL: 11 11 VLA × dataset: 15 15 VLA × 3D: 5 5 VLA × navigation: 3 3 VLA × audio-speech: 1 VLA × flow-matching: 12 12 VLA × RF-radar: 0 VLA × world-model: 2 VLA × sim2real: 3 3 VLA × locomotion: 3 3 VLA × tactile: 3 3 VLA × mamba-ssm: 2 VLA × open-source: 1 imitation × vision: 29 29 imitation × language: 24 24 imitation × transformer: 16 16 imitation × diffusion: 23 23 imitation × VLA: 13 13 imitation: 57 57 imitation × VLM: 9 9 imitation × manipulation: 20 20 imitation × RL: 21 21 imitation × dataset: 11 11 imitation × 3D: 9 9 imitation × navigation: 4 4 imitation × audio-speech: 1 imitation × flow-matching: 6 6 imitation × RF-radar: 2 imitation × world-model: 5 5 imitation × sim2real: 3 3 imitation × locomotion: 5 5 imitation × tactile: 2 imitation × mamba-ssm: 1 imitation × open-source: 0 VLM × vision: 31 31 VLM × language: 39 39 VLM × transformer: 20 20 VLM × diffusion: 16 16 VLM × VLA: 35 35 VLM × imitation: 9 9 VLM: 57 57 VLM × manipulation: 17 17 VLM × RL: 7 7 VLM × dataset: 18 18 VLM × 3D: 3 3 VLM × navigation: 3 3 VLM × audio-speech: 1 VLM × flow-matching: 9 9 VLM × RF-radar: 0 VLM × world-model: 1 VLM × sim2real: 3 3 VLM × locomotion: 3 3 VLM × tactile: 1 VLM × mamba-ssm: 1 VLM × open-source: 3 3 manipulation × vision: 19 19 manipulation × language: 21 21 manipulation × transformer: 11 11 manipulation × diffusion: 23 23 manipulation × VLA: 23 23 manipulation × imitation: 20 20 manipulation × VLM: 17 17 manipulation: 47 47 manipulation × RL: 14 14 manipulation × dataset: 16 16 manipulation × 3D: 2 manipulation × navigation: 5 5 manipulation × audio-speech: 0 manipulation × flow-matching: 7 7 manipulation × RF-radar: 0 manipulation × world-model: 1 manipulation × sim2real: 5 5 manipulation × locomotion: 3 3 manipulation × tactile: 1 manipulation × mamba-ssm: 0 manipulation × open-source: 0 RL × vision: 15 15 RL × language: 15 15 RL × transformer: 9 9 RL × diffusion: 6 6 RL × VLA: 11 11 RL × imitation: 21 21 RL × VLM: 7 7 RL × manipulation: 14 14 RL: 43 43 RL × dataset: 13 13 RL × 3D: 7 7 RL × navigation: 3 3 RL × audio-speech: 0 RL × flow-matching: 2 RL × RF-radar: 0 RL × world-model: 8 8 RL × sim2real: 4 4 RL × locomotion: 6 6 RL × tactile: 1 RL × mamba-ssm: 2 RL × open-source: 0 dataset × vision: 17 17 dataset × language: 18 18 dataset × transformer: 7 7 dataset × diffusion: 9 9 dataset × VLA: 15 15 dataset × imitation: 11 11 dataset × VLM: 18 18 dataset × manipulation: 16 16 dataset × RL: 13 13 dataset: 41 41 dataset × 3D: 5 5 dataset × navigation: 3 3 dataset × audio-speech: 1 dataset × flow-matching: 3 3 dataset × RF-radar: 0 dataset × world-model: 3 3 dataset × sim2real: 5 5 dataset × locomotion: 1 dataset × tactile: 0 dataset × mamba-ssm: 1 dataset × open-source: 1 3D × vision: 18 18 3D × language: 6 6 3D × transformer: 12 12 3D × diffusion: 9 9 3D × VLA: 5 5 3D × imitation: 9 9 3D × VLM: 3 3 3D × manipulation: 2 3D × RL: 7 7 3D × dataset: 5 5 3D: 26 26 3D × navigation: 4 4 3D × audio-speech: 0 3D × flow-matching: 1 3D × RF-radar: 7 7 3D × world-model: 0 3D × sim2real: 1 3D × locomotion: 0 3D × tactile: 2 3D × mamba-ssm: 0 3D × open-source: 0 navigation × vision: 13 13 navigation × language: 5 5 navigation × transformer: 7 7 navigation × diffusion: 7 7 navigation × VLA: 3 3 navigation × imitation: 4 4 navigation × VLM: 3 3 navigation × manipulation: 5 5 navigation × RL: 3 3 navigation × dataset: 3 3 navigation × 3D: 4 4 navigation: 21 21 navigation × audio-speech: 2 navigation × flow-matching: 2 navigation × RF-radar: 7 7 navigation × world-model: 1 navigation × sim2real: 0 navigation × locomotion: 3 3 navigation × tactile: 1 navigation × mamba-ssm: 0 navigation × open-source: 0 audio-speech × vision: 5 5 audio-speech × language: 3 3 audio-speech × transformer: 9 9 audio-speech × diffusion: 1 audio-speech × VLA: 1 audio-speech × imitation: 1 audio-speech × VLM: 1 audio-speech × manipulation: 0 audio-speech × RL: 0 audio-speech × dataset: 1 audio-speech × 3D: 0 audio-speech × navigation: 2 audio-speech: 18 18 audio-speech × flow-matching: 0 audio-speech × RF-radar: 0 audio-speech × world-model: 0 audio-speech × sim2real: 0 audio-speech × locomotion: 0 audio-speech × tactile: 1 audio-speech × mamba-ssm: 0 audio-speech × open-source: 0 flow-matching × vision: 6 6 flow-matching × language: 6 6 flow-matching × transformer: 7 7 flow-matching × diffusion: 11 11 flow-matching × VLA: 12 12 flow-matching × imitation: 6 6 flow-matching × VLM: 9 9 flow-matching × manipulation: 7 7 flow-matching × RL: 2 flow-matching × dataset: 3 3 flow-matching × 3D: 1 flow-matching × navigation: 2 flow-matching × audio-speech: 0 flow-matching: 18 18 flow-matching × RF-radar: 1 flow-matching × world-model: 1 flow-matching × sim2real: 0 flow-matching × locomotion: 1 flow-matching × tactile: 0 flow-matching × mamba-ssm: 0 flow-matching × open-source: 0 RF-radar × vision: 9 9 RF-radar × language: 1 RF-radar × transformer: 5 5 RF-radar × diffusion: 2 RF-radar × VLA: 0 RF-radar × imitation: 2 RF-radar × VLM: 0 RF-radar × manipulation: 0 RF-radar × RL: 0 RF-radar × dataset: 0 RF-radar × 3D: 7 7 RF-radar × navigation: 7 7 RF-radar × audio-speech: 0 RF-radar × flow-matching: 1 RF-radar: 17 17 RF-radar × world-model: 0 RF-radar × sim2real: 0 RF-radar × locomotion: 1 RF-radar × tactile: 0 RF-radar × mamba-ssm: 0 RF-radar × open-source: 0 world-model × vision: 5 5 world-model × language: 5 5 world-model × transformer: 7 7 world-model × diffusion: 7 7 world-model × VLA: 2 world-model × imitation: 5 5 world-model × VLM: 1 world-model × manipulation: 1 world-model × RL: 8 8 world-model × dataset: 3 3 world-model × 3D: 0 world-model × navigation: 1 world-model × audio-speech: 0 world-model × flow-matching: 1 world-model × RF-radar: 0 world-model: 15 15 world-model × sim2real: 3 3 world-model × locomotion: 0 world-model × tactile: 0 world-model × mamba-ssm: 2 world-model × open-source: 0 sim2real × vision: 8 8 sim2real × language: 4 4 sim2real × transformer: 1 sim2real × diffusion: 5 5 sim2real × VLA: 3 3 sim2real × imitation: 3 3 sim2real × VLM: 3 3 sim2real × manipulation: 5 5 sim2real × RL: 4 4 sim2real × dataset: 5 5 sim2real × 3D: 1 sim2real × navigation: 0 sim2real × audio-speech: 0 sim2real × flow-matching: 0 sim2real × RF-radar: 0 sim2real × world-model: 3 3 sim2real: 13 13 sim2real × locomotion: 1 sim2real × tactile: 2 sim2real × mamba-ssm: 1 sim2real × open-source: 0 locomotion × vision: 4 4 locomotion × language: 6 6 locomotion × transformer: 3 3 locomotion × diffusion: 2 locomotion × VLA: 3 3 locomotion × imitation: 5 5 locomotion × VLM: 3 3 locomotion × manipulation: 3 3 locomotion × RL: 6 6 locomotion × dataset: 1 locomotion × 3D: 0 locomotion × navigation: 3 3 locomotion × audio-speech: 0 locomotion × flow-matching: 1 locomotion × RF-radar: 1 locomotion × world-model: 0 locomotion × sim2real: 1 locomotion: 11 11 locomotion × tactile: 0 locomotion × mamba-ssm: 0 locomotion × open-source: 0 tactile × vision: 6 6 tactile × language: 4 4 tactile × transformer: 3 3 tactile × diffusion: 1 tactile × VLA: 3 3 tactile × imitation: 2 tactile × VLM: 1 tactile × manipulation: 1 tactile × RL: 1 tactile × dataset: 0 tactile × 3D: 2 tactile × navigation: 1 tactile × audio-speech: 1 tactile × flow-matching: 0 tactile × RF-radar: 0 tactile × world-model: 0 tactile × sim2real: 2 tactile × locomotion: 0 tactile: 9 9 tactile × mamba-ssm: 0 tactile × open-source: 0 mamba-ssm × vision: 3 3 mamba-ssm × language: 1 mamba-ssm × transformer: 2 mamba-ssm × diffusion: 1 mamba-ssm × VLA: 2 mamba-ssm × imitation: 1 mamba-ssm × VLM: 1 mamba-ssm × manipulation: 0 mamba-ssm × RL: 2 mamba-ssm × dataset: 1 mamba-ssm × 3D: 0 mamba-ssm × navigation: 0 mamba-ssm × audio-speech: 0 mamba-ssm × flow-matching: 0 mamba-ssm × RF-radar: 0 mamba-ssm × world-model: 2 mamba-ssm × sim2real: 1 mamba-ssm × locomotion: 0 mamba-ssm × tactile: 0 mamba-ssm: 4 4 mamba-ssm × open-source: 0 open-source × vision: 3 3 open-source × language: 3 3 open-source × transformer: 1 open-source × diffusion: 1 open-source × VLA: 1 open-source × imitation: 0 open-source × VLM: 3 3 open-source × manipulation: 0 open-source × RL: 0 open-source × dataset: 1 open-source × 3D: 0 open-source × navigation: 0 open-source × audio-speech: 0 open-source × flow-matching: 0 open-source × RF-radar: 0 open-source × world-model: 0 open-source × sim2real: 0 open-source × locomotion: 0 open-source × tactile: 0 open-source × mamba-ssm: 0 open-source: 3 3

★ 对角线 mustard = 该 tag 论文数 / 非对角 coral = 共现数 / 数字 ≥3 才显示