Posted in X-Review

[ ICML 2026 ] Think in Latent, Explain in Language: Self-Explainable Latent Reasoning

안녕하세요. 오늘은 ICML 2026에서 흥미로운 주제를 다룬 논문이 있어 소개하려 합니다. 요즘 latent reasoning 쪽을 흥미 있게 팔로우하고 있었는데, ICML에 관련 논문이 있어 읽어보고 리뷰하게…

Continue Reading
Posted in X-Review

[ICRA 2026] Spatially-anchored Tactile Awareness for Robust Dexterous Manipulation

안녕하세요. 이번에 읽은 논문은 촉각 센서와 관련된 논문입니다. 이번에 진행하는 휴머노이드 실증 과제에 촉각 센서가 사용될 예정인데.. 이전부터 관련해서 관심은 많았지만 실제로 학습에 사용해본 적은…

Continue Reading
Posted in Paper X-Review

[ICML 2026] Plug-and-Play Label Map Diffusion for Universal Goal-Oriented Navigation

안녕하세요. 이번에 리뷰로 가져온 논문은 ICML 2026에 올라온 Plug-and-Play Label Map Diffusion for Universal Goal-Oriented Navigation이라는 논문입니다. 해당 논문의 핵심 아이디어 같은 경우는 지금까지 리뷰했던…

Continue Reading
Posted in Paper X-Review

[ICML2026]VideoKR: Towards Knowledge- and Reasoning-Intensive Video Understanding

본 논문은 새롭게 수집된 고품질의 QA 밴치마크 데이터셋을 제공하고, 이를 활용하였을때 모델의 성능이 개선됨을 통해 잘 구성된 데이터셋이 모델 성능 개선에 필수 요소임을 드러낸 연구입니다….

Continue Reading
Posted in X-Review

[ICCV 2023] VAD: Vectorized Scene Representation for Efficient Autonomous Driving

Introduction 자율주행을 하기 위해서는 먼저 주변의 환경을 인식하고, 미래의 움직임을 예측하고, 이를 토대로 내가 어떻게 갈지 계획해야합니다. 이 논문 이전에 유명한 자율주행 방법론을 한번 살펴봅시다(UniAD,…

Continue Reading
Posted in X-Review

[ICLR 2026] DiVE-k: Differential Visual Reasoning for Fine-Grained Image Recognition

Abstract LVML은 방대한 text 지식을 보유하고 있으나, 이를 fine-grained image recognition에 적용하기에는 어려움 겪고있으며, 시각적으로 유사한 카테고리를 구분하지 못하는 경우가 많습니다. 정확한 문자열이 일치할 경우…

Continue Reading
Posted in X-Review

[ICML 2026] Are Object-Centric Representations Better At Compositional Generalization?

오늘은 object-centric representation이 정말로 composition 능력에 강인한가? 에 대해 분석한 논문을 리뷰해보겠습니다. Venue: ICML 2026 Authors: Ferdinand Kapl, Amir Mohammad Karimi Mamaghan, Maximilian Seitzer, Karl Henrik…

Continue Reading
Posted in X-Review

[cvpr 2025]Sonata: Self-Supervised Learning of Reliable Point Representations

안녕하세요 손우진입니다.오늘 리뷰할 논문은 CVPR 2025에 발표된 3D Self-Supervised Learning 논문, “Sonata: Self-Supervised Learning of Reliable Point Representations” 입니다. 3D 포인트에 대한 파운데이션 모델을 찾아보던중…

Continue Reading
Posted in Paper X-Review

[AAAI 2026] Rethinking Visual Token Reduction in LVLMs Under Cross-Modal Misalignment

Abstract LVLMs 들은 visual 입력들을 dense 한 sequences 들의 패치들로 변환하여 미세한 semantics들을 포착한다고 합니다. 이러한 visual tokens 들은 textual tokens 들과 달리 토큰수가 많고…

Continue Reading
Posted in X-Review

[2025 ACL] Shifting from Ranking to Set Selection for Retrieval Augmented Generation

이번 X-Review에서 소개할 논문은 Shifting from Ranking to Set Selection for Retrieval-Augmented Generation입니다. 이 논문은 RAG에서 retrieval을 단순히 관련 passage를 순위화하는 문제가 아니라, 질문에 필요한…

Continue Reading