이 승현 – Page 2 – Robotics and Computer Vision Lab

이 예은 on [NIPS 2017]Attention Is All You Need01/11/2026
안녕하세요 인하님, 좋은 리뷰 감사합니다. 쉽게 설명해주셔서 덕분에 공부가 많이 되었습니다. positional encoding 부분에서 궁금한 점이 있는데요, 하필 sinusoid 형태의…
이 승현 on [CVPR 2025]Compositional Caching for Training-free Open-vocabulary Attribute Detection01/08/2026
질문 감사합니다. φ_db와 φ_llm을 곱하는 게 아니 더하는 등의 다양한 조합에 대해서는 논문에 따로 언급하고있지 않습니다. (Supplementary Material에도 따로 없네요)…
안 우현 on [arXiv 2025]OmniVLA: An Omni-Modal Vision-Language-Action Model for Robot Navigation01/06/2026
안녕하세요 우진님 댓글 감사합니다. 리뷰에서 말씀드렸다 싶이 예를들어 어떤 샘플이 현재 이미지 + 언어 프롬프트만 있고 2D 포즈/goal image가 없다면,…
홍 주영 on [EMNLP 2025] X-CoT: Explainable Text-to-Video Retrieval via LLM-based Chain-of-Thought Reasoning01/06/2026
좋은 질문 감사합니다. q–v를 각각 평가하거나 q와 여러 비디오를 한 번에 비교하는 방식은 계산적으로는 효율적이겠지만, LLM이 각 비디오를 절대적인 기준으로…
홍 주영 on [EMNLP 2025] X-CoT: Explainable Text-to-Video Retrieval via LLM-based Chain-of-Thought Reasoning01/06/2026
좋은 질문 감사합니다. X-CoT를 단순히 백본 모델의 오답을 고치는 '교정기' 라기보다는, 임베딩 유사도만으로는 잘 드러나지 않는 차이를 비교해 주는 보완…

Author: 이 승현

[ICCV 2025]A0: An Affordance-Aware Hierarchical Model for General Robotic Manipulation

[CVPRw 2024] Strategies to Leverage Foundation Model Knowledge in Object Affordance Grounding

2025 상반기 회고

[ICRA 2025(Best Paper Finalist)]UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation

[CVPR 2025(Highlight)] OmniManip: Towards General Robotic Manipulation via Object-Centric Interaction Primitives as Spatial Constraints

[arXiv 2024]EVF-SAM: Early Vision-Language Fusion for Text-Prompted Segment Anything Model

[ICRL 2025] Weakly-Supervised Affordance Grounding Guided by Part-Level Semantic Priors

[ICRA 2022] Affordance Learning from Play for Sample-Efficient Policy Learning

[Arxiv 2025]AffordanceSAM: Segment Anything Once More in Affordance Grounding

[CVPR 2025]VidBot: Learning Generalizable 3D Actions from In-the-Wild 2D Human Videos for Zero-Shot Robotic Manipulation

Conference Deadline

NEW POST

New Comment