Author: rcvlab
[MM 2022] X-CLIP: End-to-End Multi-grained Contrastive Learning for Video-Text Retrieval
이런 분들께 이 논문을 추천드립니다. CLIP을 비디오에 적용하는 방식에 흥미가 있으신 분 Video Text Retrieval에서 fine-grained와 coarse-grained를 모두 활용하는 cross-grained 방식이 궁굼하신 분 이 논문을…
[Neurocomputing 2022] CLIP4Clip: An Empirical Study of CLIP for End to End Video Clip Retrieval
이런 분들께 이 논문을 추천드립니다. CLIP을 비디오에 적용하는 방식에 흥미가 있으신 분 이 논문을 깊게 이해하려면 다음 지식이 필요합니다. Multi-modal contrastive learning에 대한 이해 (CLIP…
[CVPR 2018 workshop]SuperPoint: Self-Supervised Interest Point Detection and Description
안녕하세요, 과제에 대한 추가적인 연구가 필요하게 되어 이번에는 딥러닝 기반의 Feature Matching을 수행하는 SuperPoint를 리뷰해보았습니다. 추후 과제의 목표를 임베디드 보드에 탑재하는 것으로 하는데 FPS도 잘…
[ECCV 2022] LocVTP: Video-Text Pre-training for Temporal Localization
이런 분들께 이 논문을 추천드립니다. Video-Text Pre-training에 관심 있으신 분 Temporally aware한 feature를 위한 context warping에 흥미가 있으신 분 이 논문을 깊게 이해하려면 다음 지식이…
[ECCV 2020] NeRF: Representing Scenes as Neural Radiance Fields for View Synthesis
안녕하세요, 이번에는 김태주 연구원님께서 6D Pose estimation task와 한 번 접목시켜보도록 공부해보라고 하셨던 조언을 듣고, 다들 알고 계실 것 같은 NeRF를 리뷰해봤습니다. 카메라 기반의 방법론이다보니…
What should we consider to write a clean and efficient code as a researcher?
안녕하세요. 백지오입니다. 열 여덟 번째 X-REVIEW는 논문 리뷰가 아닌 코드에 관련된 내용을 준비했습니다. 연구실에서 공부와 여러 task를 진행하며, 자연스럽게 논문과 관련된 코드를 많이 읽고, 실행해볼…
[ICLR 2023] CLIP-VIP: Adapting Pre-Trained Image-Text Model to Video-Language Alignment
이런 분들께 이 논문을 추천드립니다. CLIP과 같은 이미지 사전학습 모델을 대규모 비디오 데이터셋에서 추가 사전학습 시키는 방법이 궁굼하신 분 Subtitle과 Caption으로 다른 성질의 text 데이터…
[RA-L 2021] Category-Level Metric Scale Object Shape and Pose Estimation
안녕하세요, 이번에도 6D pose estimation 관련 논문입니다. NOCS를 이전에 리뷰를 했었는데, NOCS를 이용한 +something을 한다고 하길래 읽어보았습니다. 해당 논문은 KAIST RCV Lab.에서 작성된 논문이라 어려워보여도 읽어보려고…
[CVPR 2023] Distilling Vision-Language Pre-training to Collaborate with Weakly-Supervised Temporal Action Localization
이런 분들께 이 논문을 추천드립니다. Weakly Supervised Temporal Action Localization의 최신 방법론이 궁굼하신 분 CLIP을 temporal action localization에 응용하는 방법이 궁굼하신 분 상호 보완적인 두…
[CVPR 2023] Boosting Weakly-Supervised Temporal Action Localization with Text Information
이런 분들께 이 논문을 추천드립니다. Weakly Supervised Temporal Action Localization의 최신 방법론이 궁굼하신 분 Weakly Supervised Learning에 Text label을 Training signal로 사용하는 방식에 흥미가 있으신…
안녕하세요 주연님 좋은 댓글 감사합니다. 우선 생각하신 분석이 제가 논문 읽으면서 느낀것과 같습니다. 즉 저자가 주장하는 camera 시점의 bias 가…