Author: rcvlab
[ICML 2021] Learning Transferable Visual Models From Natural Language Supervision (CLIP) – Part 2
안녕하세요. 백지오입니다. 열세 번째 X-REVIEW는 지난 리뷰에 이은 CLIP 리뷰 파트 2입니다. 지난 파트 1 리뷰에서 CLIP의 개념과 방법론을 알아보았는데, 이번 리뷰에서는 저자들이 수행한 실험과…
[ECCV 2018] Implicit 3D Orientation Learning for 6D Object Detection from RGB Images
안녕하세요. 이번에도 6D pose estimation 논문입니다. 좀 지난 논문이긴 하지만, 아직까지도 reference가 달리기도 하고 6D 관련 논문에서는 꽤 많은 인용수를 가지고 있는 논문이라 읽으려고 항상…
[ICML 2021] Learning Transferable Visual Models From Natural Language Supervision (CLIP) – Part 1
이런 분들께 이 논문을 추천드립니다. CLIP이 도대체 뭔지 궁굼하신 분 Multi-modal Joint Embedding에 관심이 있으신 분 27 페이지에 달하는 이 논문을 읽을 엄두가 안 나시는…
[CVPR2023] PiMAE:Point Cloud and Image Interactive Masked Autoencoders for 3D Object Detection
Masked autoencoder는 시각적인 표현력을 잘 학습할 수 있어 몇몇의 독립적인 modality에서 좋을 결과를 보였지만 multi-modal의 경우 많이 적용이 되지 못했다. 본 논문에서는 point cloud와 rgb…
[KCCV 2023] 학회 참관기
안녕하세요. 백지오입니다.이번 주 X-REVIEW는 코엑스에서 진행된 KCCV 2023 학회 참관기를 남겨보도록 하겠습니다. 저는 이전부터 이러한 학회에 참석하는 것을 좋아해서, 개인적으로 pycon이나 GTC Korea와 같은 다양한…
[WACV2023] Masked Autoencoder for Self-Supervised Pre-training on Lidar Point Clouds
본 논문은 3d point cloud를 voxel로 처리하여 mae를 적용한 논문을 찾다 알게되어 읽어보게되었다. 기존의 indoor환경에서 mae를 적용했던 point-mae와 비슷하지만 본 논문에서의 voxel-mae는 outdoor환경에서 평가하였다. 저자는…
[CVPR 2019] Normalized Object Coordinate Space for Category-Level 6D Object Pose and Size Estimation
안녕하세요. 이번에도 6D pose estimation 관련 논문 리뷰를 진행합니다. 좋은 기업들과 학교에서 참여한 논문이라 매우 신뢰도가 올라가는 것 같습니다. 이번 논문은 unseen object에 대한 pose…
[CVPR 2022] Everything at Once – Multi-modal Fusion Transformer for Video Retrieval
이런 분들께 이 논문을 추천드립니다. 멀티 모달, 특히 비디오를 멀티 모달(영상 + 오디오 + 텍스트)로 이해하는 것에 흥미가 있으신 분 뭔가 새로운 걸 보고 싶으신…
[CVPR 2020]Single-Stage 6D Object Pose Estimation
안녕하세요, 양희진입니다. 이번에도 6D pose estimation 논문을 가져왔습니다. single-stage로 pose를 추정한다고 해서 해당 논문을 구현한 코드를 보니correspondence-extraction 모델에 따라 loss를 보면 어떤 correspondence-extraction 모델을 쓸지에…
[IJCV 2022] DnS: Distill-and-Select for Efficient and Accurate Video Indexing and Retrieval
안녕하세요. 백지오입니다. 열 번째 X-REVIEW는 Knowledge Distillation 기반의 Video Retrieval 방법인 DnS입니다. 저널 논문은 이번에 처음 읽어보았는데, 투 컬럼 22 페이지의 압도적인 분량에 그만 정신이…
안녕하세요 주연님 좋은 댓글 감사합니다. 우선 생각하신 분석이 제가 논문 읽으면서 느낀것과 같습니다. 즉 저자가 주장하는 camera 시점의 bias 가…