전체 글
-
DSPNet: Dual-vision Scene Perception for Robust 3D Question Answering논문 스터디 2026. 4. 17. 09:22
3D QA를 해결하려고 하는 논문이고, 2D QA와의 차이점과 기존 방법의 문제점을 지적하면서 정석적으로 문제를 해결하고 있다. Contribution은 3가지가 있는데 뒤에서 소개하겠다. Task에 대해서 좀더 말하자면, 2D QA는 이미지의 description을 통해서 질문 프롬프트에 대답을 하고, 3D QA는 거기서 나아가 geometric한 정보를 인지하고 공간적으로 의미있는 연관관계?(spatially semantic dependencies)를 찾아낸다. 물체의 위치를 찾는 Visual grounding 말고도 질문하는 물체의 특징을 파악하거나 어떤 물체에 대해서 다른 물체가 상대적으로 어떤 위치에 있는지를 파악하는데 도움이 되는 듯 하다. 논문에 이미지를 pointcloud에 back-pro..
-
Failed to initialize NVML: Unknown Error에러 관리 2024. 10. 7. 22:18
[이슈]host machine에서는 GPU가 잘 detect 되는데, docker container에서는 Failed to initialize NVML: Unknown Error, Failed to detect NVIDIA driver version.이런 에러가 났다. [host machine]- NVIDIA GeForce RTX 4090 x4- nvidia-driver-560 (recommanded) installed- cuda 12.6 [docker container]- nvcr.io/nvidia/pytorch:22.11-py3- pytorch 1.13- cuda 11.8 [해결 방법]1. docker info를 확인한다. Cgroup Driver에 systemd라고 되어있으면 그게 문제다. do..
-
20240703 - 과거일기 2024. 9. 22. 19:23
오랜만에 옛날 생각이 났다. 매우 어릴적의 나. 초등학교도 들어가지 않았을 때 언니가 너무 미워서 죽여버리고 싶었지만 엄마에겐 조기졸업을 해서 언니보다 위에 있고 싶다고 말했었다. 내가 특별히 엄청난 일을 당했던걸까? 모르겠다. 언니가 평범한 질투는 아니었던 건 맞다. 거기에 더해 내 말을 들어주는 어른도, 친구도 없었던 게 나에게 상처가 되었다. 그렇게 매일 밤마다 반복해서 떠오르는 감정들은 매우 어릴적부터 무려 제작년?까지 나를 괴롭혔다. 나는 복수심과 나 자신에 대한 연민으로 건강한 생각을 할 수 없었다. 그땐 몰랐지만. 병원에 가기 전까진 그저 그 시간들을 버텼다. 저릿한 손과 축축한 베개와 함께하면서. 부정적인 생각을 멈출 수 없었고, 이런 생각들은 전혀 도움이 되지 않는다는 생각조차 하기가 어..
-
[논문리뷰] ViDAR : Visual Point Cloud Forecasting enables Scalable Autonomous Driving (2)논문 스터디 2024. 3. 15. 18:48
말이 너무 많아졌다.. 궁금한 점들이나 중요한 부분은 표시해놔야 겠다. Latent Rendering preliminary에서 다시 본론으로 돌아와서, ViDAR의 첫번째 method latent rendering이다. 그래서 뭘 rendering한다는 건지, rendering한 결과가 어떻게 되는건지 제발 알려주면 좋겠다. differentiable ray casting과 달리 discriminative하고 representative 한 feature를 찾기 위해, ray-wise feature를 feature expectation function으로 계산하고 ray-wise feature를 associated conditional probability로 weighting하여 each grid의 fea..
-
[논문리뷰] ViDAR : Visual Point Cloud Forecasting enables Scalable Autonomous Driving (1)논문 스터디 2024. 3. 14. 20:53
논문 링크 : https://arxiv.org/pdf/2312.17655.pdf 이번 학기에 해야하는 주제이다. 무엇을 접목할 수 있을까? 어떤 걸 접목하면 문제가 더 쉽게 풀릴까? 아니면 정확도가 높아질까? 기존 논문의 문제는 뭘까? 이런 생각들을 정리하려면 먼저 첫 논문을 자세히 들여다봐야 될 것 같아 리뷰로 남긴다. Introduction 논문의 motivation은 self-supervised learning에서 시작한다. 보통 2D image의 downstream task에서는 self-supervised learning으로 pretrain 된 모델을 다시한번 supervised learning으로 학습시킨다. 그렇게 하면 모델은 좀더 물체의 특징을 정교하게 기억하는 것 같다.(??? 뇌피셜이다..
-
[논문리뷰] BEVFormer: Learning Bird’s-Eye-ViewRepresentation from Multi-Camera Images viaSpatiotemporal Transformers논문 스터디 2024. 3. 8. 17:12
논문 링크 : https://arxiv.org/pdf/2203.17270.pdf 어쩌다 보니 이쪽으로 흘러들어와 방황한지 일 년이 넘었다. 이제 끝을 맺어야 할 것 같아 시작한 졸업 논문이 되었으면 하는 주제 Point cloud forecasting 에서 쓰이는 BEVFormer를 리뷰해보려 한다. 이어 BEVFormerV2도 리뷰할 예정이다. 논문을 읽었을 때는 읭 스럽다. 이게 어떻게 하다가 생각이 났는지, 왜 이게 되는지에 대한 설명이 좀 부족한 것 같다. Contribution은 Spatial attention, Temporal attention, BEV query 이다. Motivation 3D object detection과 segmentation에서 BEV 라는 representation을..
-
[논문리뷰] Improving non-transferable representation learning by harnessing content and style논문 스터디 2024. 2. 8. 16:41
논문 : https://openreview.net/pdf?id=FYKVPOHCpE ICLR2024 splotlight 에서 재미있는 논문 몇 편을 찾았다. 그 중 첫 번째로 읽는 논문이다. Non-transferable representation learning 이라는 제목에 transfer learning, representation learning에 관심이 있어 읽어보게 되었다. 읽다보니 domain adaptation, continual learning, knowledge distillation 과 상당히 비슷하다는 느낌을 받았다. 찾아보니 저자가 또 그쪽에 많은 논문을 낸 듯 하다. Introduction 먼저 task를 소개하겠다. Non-transferable representation lea..
-
[ADHD 환자의 일기] 12월 28일일기 2023. 12. 28. 11:36
지금은 아침. 국밥 먹으러 왔다. 할많하않이었던 12월 이었고 일기를 쓴지 한 달이나 됐더라. 일기를 쓰기엔 마음이 바빴고 정리할 시간이, 또는 정신이 필요했다. 차라리 일기를 쓰고 좀더 정신 차리고 했으면 더 나았을 수도 있지만 이미 지나간 일이다. 나는 요새 밤에 잠을 안자고 밤새도록 웃긴 걸 찾아본다. 그러다보면 내가 좀 괜찮아진 것 같은 느낌도 들다가 다시 울컥할 것도 같다가. 잠안자고 웃긴 걸 보는 이유는 가장 큰 건 아마 잠드는게 무서워서인 것 같다. 잠들기 위해서는 눈감고 누워있어야 하니까. 눈감고 누워있으면 다시 생각나니까. 생각나면 또 울고 계속 생각하니까. 그래서 웃긴 걸 보다가 지쳐 잠들고 싶은데 난 아침이 되어야만 지친다. 생각을 할 수 있는 시간이 두렵다. 내가 무슨 생각을 할지 ..