728x90 Vit1 컴퓨터 비전 학습 로드맵: 영상처리·CNN·YOLO·ViT를 한 흐름으로 영상처리를 공부할 때 히스토그램·침식·SIFT를 외운 뒤 곧바로 CNN·YOLO·ViT로 넘어가면 개념이 서로 끊긴다. 그러나 모두 같은 질문을 다룬다. 픽셀에서 필요한 신호를 어떻게 뽑고, 그 신호로 무엇을 판단할 것인가? 이 흐름을 잡으면 전통 영상처리와 딥러닝 시각 모델을 서로 대체 관계가 아닌 도구 상자로 볼 수 있다. 하나의 상황으로 시작하기 공장 카메라에서 안전모를 찾는다고 하자. 밝기 보정과 노이즈 제거는 입력을 안정시키고, 에지와 특징점은 형태를 수치로 바꾼다. CNN은 학습 데이터에서 필요한 특징을 직접 배우고, 검출 모델은 사람과 안전모의 위치를 낸다. ViT는 이미지를 패치 묶음으로 바꿔 멀리 떨어진 영역의 관계까지 본다. 같은 카메라 장면이 전처리·.. 2026. 7. 30. 이전 1 다음 728x90