Author: rcvlab

RCV연구실 홈페이지 관리자 입니다.
Posted in Paper X-Review

[MM 2022] X-CLIP: End-to-End Multi-grained Contrastive Learning for Video-Text Retrieval

이런 분들께 이 논문을 추천드립니다. CLIP을 비디오에 적용하는 방식에 흥미가 있으신 분 Video Text Retrieval에서 fine-grained와 coarse-grained를 모두 활용하는 cross-grained 방식이 궁굼하신 분 이 논문을…

Continue Reading
Posted in Paper X-Review

[Neurocomputing 2022] CLIP4Clip: An Empirical Study of CLIP for End to End Video Clip Retrieval

이런 분들께 이 논문을 추천드립니다. CLIP을 비디오에 적용하는 방식에 흥미가 있으신 분 이 논문을 깊게 이해하려면 다음 지식이 필요합니다. Multi-modal contrastive learning에 대한 이해 (CLIP…

Continue Reading
Posted in Paper X-Review

[CVPR 2018 workshop]SuperPoint: Self-Supervised Interest Point Detection and Description

안녕하세요, 과제에 대한 추가적인 연구가 필요하게 되어 이번에는 딥러닝 기반의 Feature Matching을 수행하는 SuperPoint를 리뷰해보았습니다. 추후 과제의 목표를 임베디드 보드에 탑재하는 것으로 하는데 FPS도 잘…

Continue Reading
Posted in Paper X-Review

[ECCV 2022] LocVTP: Video-Text Pre-training for Temporal Localization

이런 분들께 이 논문을 추천드립니다. Video-Text Pre-training에 관심 있으신 분 Temporally aware한 feature를 위한 context warping에 흥미가 있으신 분 이 논문을 깊게 이해하려면 다음 지식이…

Continue Reading
Posted in Paper X-Review

[ECCV 2020] NeRF: Representing Scenes as Neural Radiance Fields for View Synthesis

안녕하세요, 이번에는 김태주 연구원님께서 6D Pose estimation task와 한 번 접목시켜보도록 공부해보라고 하셨던 조언을 듣고, 다들 알고 계실 것 같은 NeRF를 리뷰해봤습니다. 카메라 기반의 방법론이다보니…

Continue Reading
Posted in X-Review

What should we consider to write a clean and efficient code as a researcher?

안녕하세요. 백지오입니다. 열 여덟 번째 X-REVIEW는 논문 리뷰가 아닌 코드에 관련된 내용을 준비했습니다. 연구실에서 공부와 여러 task를 진행하며, 자연스럽게 논문과 관련된 코드를 많이 읽고, 실행해볼…

Continue Reading
Posted in Paper X-Review

[ICLR 2023] CLIP-VIP: Adapting Pre-Trained Image-Text Model to Video-Language Alignment

이런 분들께 이 논문을 추천드립니다. CLIP과 같은 이미지 사전학습 모델을 대규모 비디오 데이터셋에서 추가 사전학습 시키는 방법이 궁굼하신 분 Subtitle과 Caption으로 다른 성질의 text 데이터…

Continue Reading
Posted in Paper X-Review

[RA-L 2021] Category-Level Metric Scale Object Shape and Pose Estimation

안녕하세요, 이번에도 6D pose estimation 관련 논문입니다. NOCS를 이전에 리뷰를 했었는데, NOCS를 이용한 +something을 한다고 하길래 읽어보았습니다. 해당 논문은 KAIST RCV Lab.에서 작성된 논문이라 어려워보여도 읽어보려고…

Continue Reading
Posted in Paper X-Review

[CVPR 2023] Distilling Vision-Language Pre-training to Collaborate with Weakly-Supervised Temporal Action Localization

이런 분들께 이 논문을 추천드립니다. Weakly Supervised Temporal Action Localization의 최신 방법론이 궁굼하신 분 CLIP을 temporal action localization에 응용하는 방법이 궁굼하신 분 상호 보완적인 두…

Continue Reading
Posted in Paper X-Review

[CVPR 2023] Boosting Weakly-Supervised Temporal Action Localization with Text Information

이런 분들께 이 논문을 추천드립니다. Weakly Supervised Temporal Action Localization의 최신 방법론이 궁굼하신 분 Weakly Supervised Learning에 Text label을 Training signal로 사용하는 방식에 흥미가 있으신…

Continue Reading