본문 바로가기

전체 글90

AI 개발자 취업 후기 작년 8월 부스트캠프를 수료한 뒤로 반년 간의 취준 그리고 다시 반년 간의 대학원 준비를 거친 뒤 1년 만에 취업에 성공했다.처음 목표는 데이터 사이언티스트로서 리서처가 되는 것이었는데 결국 AI 개발자로 취업했으며 1년 동안 어떻게 준비했는지, 취준 기간 동안 도움이 됐던 것들 그리고 느낌점등을 적어보려 한다. 2023년 후기부스트캠프를 수료한 뒤에는 자소설닷컴에 올라오는 대기업, 중견기업에 지원했고 자소서를 작성하거나 코테 준비 그리고 대기업 인적성을 준비하며 시간을 보냈었다.아무런 준비나 조사 없이 주먹구구식으로 지원했으니 붙을리 없었고 결과적으로 4개월을 통째로 날려버렸다. 이때 돌아보면 자격증이나 논문리뷰 영어공부등 부가적으로 할 수 있던게 많았는데 하나쯤은 붙을 거라고 자만심에 차있던 것 같다.. 2024. 8. 13.

기존 딥러닝 개발환경 복제하기 딥러닝 개발할 때 가장 어렵고 시간을 많이 잡아먹는 부분이 환경 세팅이다. cuda부터 시작해 환경을 새로 깔아야 할 때는 어쩔 수 없이 하나씩 맞추면 되지만 기존 환경이 있으면 이를 그냥 사용하면 된다. 그럼에도 불구하고 굳이 기존 환경을 복제하기로 마음 먹었는데 또 무언가 막무가내로 설치하다 버전이 꼬이게 될 경우를 상상하다 보니 너무 절망스러웠기 때문이다. 먼저 가상환경을 만들고 pip를 최신화한다.(가상환경을 깔면 당연히 기존 pip 버전을 따라갈 줄 알았는데 그 버전에 최적인? pip를 깔아주는 것 같아 그냥 업그레이드 하였다)가상환경 생성(venv)가상환경 생성(venv)및 활성화python -m venv testsource ./test/bin/activatepip 업그레이드pip instal.. 2024. 6. 24.

Visual Prompt Tuning(2022) 리뷰 FAIR에서 저술한 논문이며 Vision도메인에 prompt를 적용시킨 논문이라 생각해 읽어보았는데 그보다는 LoRA와 같은 parameter efficient tuning이 메인이 되는 논문이었다. 최근에 모델 사이즈가 커지며 이 분야도 각광받고 있어서 그냥 계속 읽고 리뷰해 보았다.Abstract이 논문에서는 기존에 large scale transformer 모델들을 full fine-tuning(FF)를 통해 학습하는 것을 대체하는 Visual Prompt Tuning(VPT)를 제시한다. VPT는 llm의 발전에서 영향을 받았고 모델의 backbone을 freeze한채 1% 이하의 parameter를 추가로 학습하여 FF와 비견되는 성능을 보여주는 효율적인 방법론임을 시사한다. Introducti.. 2024. 6. 13.

Self-training with Noisy Student improves ImageNet classification(2020) 리뷰 ViT가 나온 뒤 현재는 ViT의 다양한 variants들이 CV도메인에서는 SOTA를 달성했다. 하지만 이전에는 CNN과 Noisy student training을 사용한 방법론이 SOTA의 대다수를 차지하고 있었는데 이번에는 그 방법론을 처음 제시간 논문을 리뷰해 보겠다. Abstract 이 논문은 labeled data가 풍부한 상황에도 적용가능한 semi supervised 학습법인 Noisy student training을 제안한다. 이 기법은 distillation시 student model을 teacher와 동일 혹은 큰 사이즈를 사용해 학습하며 student의 학습 시 noise를 더해주는데 저자는 이러한 부분에서 self-training 그리고 distillation의 아이디어를 활용했다.. 2024. 4. 9.

[백준] 2098번 외판원 순회 (Python) https://www.acmicpc.net/problem/2098 2098번: 외판원 순회 첫째 줄에 도시의 수 N이 주어진다. (2 ≤ N ≤ 16) 다음 N개의 줄에는 비용 행렬이 주어진다. 각 행렬의 성분은 1,000,000 이하의 양의 정수이며, 갈 수 없는 경우는 0이 주어진다. W[i][j]는 도시 i에서 j www.acmicpc.net 문제 외판원 순회 문제는 영어로 Traveling Salesman problem (TSP) 라고 불리는 문제로 computer science 분야에서 가장 중요하게 취급되는 문제 중 하나이다. 여러 가지 변종 문제가 있으나, 여기서는 가장 일반적인 형태의 문제를 살펴보자. 1번부터 N번까지 번호가 매겨져 있는 도시들이 있고, 도시들 사이에는 길이 있다. (길이.. 2024. 3. 13.

Training data-efficient image transformers& distillation through attention 리뷰(DeiT, 2021) MIM 방법론 중 대표격인 BeiT를 읽으며 큰 생각없이 동시에 읽었는데 이름빼고는 분야가 완전히 달랐다. 그렇지만 ViT에 ConvNet을 distillation하는 방법에 흥미도 생겼고 결과도 꽤 좋은것 같아 먼저 리뷰해보려한다. Abstract ViT는 고성능이지만 좋은 성능을 위해 많은 데이터 학습이 필요하다는 고질적인 문제점이 있다. 즉 ViT는 자원효율이 낮다고 볼 수 있다. 이 논문에서 저자는 오직 ImageNet만을 사용해 conv-free 모델을 학습시키는데 이를 위해 convnet의 정보를 transfer할 수 있는 token base distillation방법을 제안한다. Introduction Convnet에서 ViT로의 발전을 언급한 후 ViT의 단점인 적은 데이터셋에는 훈련이 잘.. 2024. 3. 6.

ViT구현(Pytorch) ViT를 읽고 Pytorch로 구현해보았다. 원본 코드는 jax로 구현되어 있기에 깃허브에서 star가 높은 레포를 참고해 진행하였다. dropout은 생략하고 구현했으니 주의! 참고한 레포 링크: https://github.com/lucidrains/vit-pytorch GitHub - lucidrains/vit-pytorch: Implementation of Vision Transformer, a simple way to achieve SOTA in vision classification wit Implementation of Vision Transformer, a simple way to achieve SOTA in vision classification with only a single trans.. 2024. 2. 6.

Masked Autoencoders Are Scalable Vision Learners(MAE, 2022) 리뷰 이전에 CL과 MIM의 비교 논문을 읽고 MIM에 흥미가 생겨 읽어본 논문이다. 다양한 MIM 논문 중 이를 고른 이유는 저자가 Kaiming he였다는 점이 한몫했던 것 같다. Abstract 초록에서는 이 논문의 방법론, 실험, contribution을 짧게 설명했다. 눈에 띄는 부분만 요약하면 아래와 같다. 1. Input image를 random하게 mask하고 복원하는 masked auto encoders 소개 2. Encoder와 decoder 구조를 사용하며 encoder는 mask token을 사용하지 않는 비대칭 구조 3. 훈련시간을 3배 이상 줄이며 기존 방법론과 유사하거나 더 좋은 성능을 보여줌. Introduction 하드웨어 발전으로 모델의 크기는 계속 커지나 그에 걸맞은 labe.. 2024. 1. 29.

이전 1 2 3 4 5 6 7 ··· 12 다음

티스토리툴바