Author: rcvlab
[DCC17] Compact Deep Invariant Descriptors for Video Retrieval
논문: Compact Deep Invariant Descriptors for Video Retrieval 2014년 Motion Picture Experts Group (MPEG)은 Compact Descriptor for Video Analysis (CDVA) 표준화 작업을 시작했습니다. 이 작업을…
EfficientDet: Scalable and Efficient Object Detection
Mingxing Tan, Ruoming Pang, Quoc V. Le 1. EfficientDet 은 “EfficientNet : Improbing Accuracy and Efficiency through AutoML and Model Scaling” 의 저자들이 속한 Google…
Pedestrain Detection(정찬호)
1,2차:SSD 논문 원복 하며 디버깅하면서 코드 오류 잡기 3차:backbone을 VGGNet에서 EfficientNet으로 바꾸어 backbone변화에 따른 성능 변화 리포팅 시도한 step 1. normalize&width scaling 2. resolution scaling…
[CVPR] Deep Residual Learning for Image Recognition
ResNet은 레이어를 깊게 쌓을때, 레이어의 층의 깊이 때문에 발생하는 gradient vanishing/exploding 로 인해 역전파가 제대로 진행되지않아 학습 성능을 떨어뜨리는 경우를 완화하는 Shortcut(Skip) connection방법을 적용하여 VGG-16(19)보다…
[NIPS2017] Attention Is All You Need
논문: Attention Is All You Need Facebook AI Research에서 DETR: End-to-End Object Detection with Transformers 논문[1], 블로그[2], 코드[3]를 동시에 공개하면서 attention 혹은 Transformer라는 방법에 대해…
Distinctive Image Features from Scale-Invariant Keypoints
ETRI 과제 진행에 있어 SIFT 코드의 진행과정 이해가 필요해 본 논문을 선택해 리뷰합니다. 본 논문은 SIFT를 설명하는 논문이다. SIFT가 keypoint 를 추출하는 알고리즘의 순서에 맞게…
M2Det: A Single-Shot Object Detector based on Multi-Level Feature Pyramid Network
Scale의 변화는 object detection분야에서 중요한 요소중 하나이며 다양한 방법론들이 제안되고 있다. Proposed Method backbone과 Multi-Level Feature Pyramid Network(MLFPN)에서 features를 추출한다. SSD와 유사하게 bounding box와 class에…
[arXiv] Range Conditioned Dilated Convolutions for Scale Invariant 3D Object Detection
논문: Range Conditioned Dilated Convolutions for Scale Invariant 3D Object Detection Waymo에서 CVPR2020을 앞두고 challenge[1]를 하는 것을 익히 알고 있을 겁니다. 또한 저희 연구실에서도 Waymo에서…
Feature Pyramid Networks for Object Detection
Tsung-Yi Lin1,2, Piotr Dollar´ 1 , Ross Girshick1 , Kaiming He1 , Bharath Hariharan1 , and Serge Belongie2 1Facebook AI Research (FAIR) 2Cornell University and…
Scalability in Perception for Autonomous Driving: Waymo Open Dataset
이번 PD챌린지를 진행하면서 PD에 적합한 데이터셋에 모델을 pretrain시키면, 그렇지 않은 모델보다 성능이 더 좋다는 사실을 알게되었습니다. 이를 적용하고자 데이터셋을 찾아보다 Waymo데이터셋이 이미 다운 받아져 있다는것이…
![[DCC17] Compact Deep Invariant Descriptors for Video Retrieval](https://server.rcv.sejong.ac.kr/wp-content/uploads/2020/06/Screen-Shot-2020-06-05-at-6.14.24-PM-480x360.png)
안녕하세요 주연님 좋은 댓글 감사합니다. 우선 생각하신 분석이 제가 논문 읽으면서 느낀것과 같습니다. 즉 저자가 주장하는 camera 시점의 bias 가…