Category: News
[WACV2022]Hierarchical Proxy-based Loss for Deep Metric Learning
요약:해당 논문은 classification 구조를 갖는 task에서 class간 Hierarchical 구조를 고려할 수 있도록 설계된 Deep metric learning 방법론입니다. 배경 소개: Deep Metric Learning(DML)이란 convolutional neural networks를…
[arXiv2015]Particular object retrieval with integral max-pooling of CNN activations
Abstract CNN feature를 이용한 이미지 representation 은 기존의 short-vector represnetation방식보다 좋은 성능을 낸다. 그러나 기하학적 정보가 필요한 re-ranking방식과 호환되지 않으며, 정확한 descriptor매칭, 기하학적 re-ranking, 또는…
[arXiv 2015]Near-Duplicate Video Retrieval by Aggregating Intermediate CNN Layers
Abstract NDVR(Near-Duplicate Video Retrieve) 문제는 비디오 콘텐츠 성장으로 많은 관심을 끌고있으며, 이는 중복에 정도가 높은 것이 특징이다. 효율적 NDVR 접근법이 필요하며, CNN의 높은 성능에서 동기부여를…
[arXiv 2022] Disentangled Representation Learning for Text-Video Retrieval
현재 Text-to-video retrieval 에서 SOTA 를 달성하고 있는 논문입니다. 중국의 유명한 인터넷 플랫폼 서비스 기업인 ‘alibaba’에 속한 인공지능 연구기관 ‘DAMO academy’에서 나온 논문이에요. 리뷰 시작하도록…
[2022 IEEE Access]Content-Based Video Retrieval With Prototypes of Deep Features
캡스톤에서 V2V를 하게 되어 Video Retrieval관련 논문을 찾아보게 되었습니다. content-based video retrieval이기는 하지만 contribution을 읽어봤을 때, 영상적인 측면에서 기여가 있다고 판단하여 읽게 되었습니다. Abstract 해당…
[CVPR2020]Unsupervised Intra-domain Adaptation for Semantic Segmentation through Self-Supervision
합성 데이터를 이용하여 학습한 모델을 real 데이터에 적용할 때 어떤 방식을 활용하여 도메인간의 차이를 줄이는 지 알아보기 위해 읽게 된 논문입니다. CNN방식은 어노테이션 된 라벨링에…
[CVPR 2020] Momentum Contrast for Unsupervised Visual Representation Learning
[Link] Momentum Contrast for Unsupervised Visual Representation Learning Self-Supervised 의 대표적인 방법론인 Moco를 리뷰하겠습니다. Introduction MoCo는 contrastive loss를 사용하는 self-supervised model 입니다. 당시 contrastive learning…
[WACV 2021] RefineLoc : Iterative Refinement for Weakly Supervised Action Localization
Before Review 이번 리뷰는 다시 Action Localization으로 준비했습니다. 그 중 Video Level의 annotation 만을 사용하는 Weakly Supervised 방법론을 읽어보았습니다. 방법론 자체는 간단했지만 저자가 주장하는 motivation에는…
[ACMMM 2007] Practical Elimination of Near-Duplicates from Web Video Search
겨울방학 동안 매주 Video Retrieval 관련 논문 리뷰 하기…! 첫번째 게시글 입니다. 해당 분야에서 자주 보이는 Visual-centeric 한 dataset 인, CC_WEB_VIDEO 에 대한 논문을 리뷰하겠습니다….
[CVPR 2020] PV-RCNN: Point-Voxel Feature Set Abstraction for 3D Object Detection
이번 주 x-review주제는 3D Detection 입니다. 해당논문은 2020 CVPR 논문으로 KITTI데이터셋에서 SOTA를 달성했었습니다. 1년사이에 판도가 많이 바뀌긴 했는데 읽게된 계기는 KITTI dataset에서 pedestrian 카테고리 SOTA를…
Q1. k-means 실험의 목적? >> DINOv2+k-means와 DINOv2+CA는 DINOSAURv2의 장점이 단순히 token을 줄였기 때문인지 확인하는 비교 실험입니다. 아마 리뷰어가 "그냥 토큰…