Computer_Vision
-가장 지도학습 스러운 인공지능: 컴퓨터 비젼-
-가장 지도학습 스러운 인공지능: 컴퓨터 비젼-
🍀 지도학습 (Supervised Learning)
지도학습은 학습 데이터에 대한 입력(input)과 정답(output) 즉, 레이블(label)이 모두 제공될 때 사용되는 방법입니다. 지도 학습의 목표는 주어진 입력으로부터 출력을 예측하는 함수를 만드는 것입니다. 이 때 학습 알고리즘은 데이터로부터 패턴을 학습하여, 새로운 입력 데이터가 주어졌을 때 그에 상응하는 출력을 예측할 수 있습니다.
예를 들어, 스팸 메일 분류기를 만들 때, 수많은 이메일 데이터와 그 이메일이 '스팸'인지 '정상'인지에 대한 레이블이 학습 데이터로 사용됩니다. 학습 과정에서 모델은 이메일의 특징을 바탕으로 스팸과 정상 메일을 구분하는 방법을 학습하고, 이후 새로운 이메일이 주어졌을 때 스팸인지 아닌지를 예측할 수 있게 됩니다.
Computing Vision
🍀 컴퓨터 비전(Computer Vision)이란
기계가 인간의 시각과 유사한 방식으로 이미지와 비디오를 이해하도록 하는 기술 분야
🍀 컴퓨터 비전(Computer Vision)의 원리
영상 수집: 카메라나 스캐너와 같은 장치를 통해 이미지 또는 비디오를 획득합니다.
전처리: 획득한 이미지에서 노이즈를 제거하거나 히스토그램 평활화 등을 통해 이미지의 품질을 향상시킵니다.
특징 추출: 이미지에서 중요한 정보를 추출하는 과정으로, 에지(edge) 검출, 코너(corner) 검출, 블롭(blob) 검출 등이 여기에 해당합니다.
분석 및 인식: 추출된 특징을 바탕으로 패턴 인식 알고리즘을 통해 객체를 분류하거나 인식합니다.
행동 결정: 인식된 정보를 기반으로 특정 작업을 수행합니다(예: 로봇의 움직임 제어).
🍀 컴퓨터 비전(Computer Vision)의 특징
다양성: 컴퓨터 비전은 다양한 유형의 이미지 및 비디오 소스에서 작동할 수 있으며, 다양한 환경과 조건에서 정보를 추출할 수 있습니다.
복잡성: 실세계의 이미지는 매우 복잡하며, 조명 변화, 장애물, 스케일 변화 등 다양한 요인이 인식 과정에 영향을 줄 수 있습니다.
실시간 처리: 많은 컴퓨터 비전 시스템은 실시간으로 데이터를 처리하고 응답할 수 있어야 합니다.
자동화: 컴퓨터 비전은 수동으로 처리하기 힘든 대량의 이미지 데이터를 자동으로 처리할 수 있습니다.
🍀 컴퓨터 비전(Computer Vision)의 사용예시
얼굴 인식: 스마트폰의 얼굴 인식 잠금 해제, 공항 보안 검색 등에서 사용됩니다.
자율 주행 자동차: 주변 환경을 인식하고 장애물을 피하는 데 필요한 이미지 처리 기술입니다.
의료 영상 분석: MRI나 CT 스캔 이미지를 분석하여 질병을 진단하는 데 사용됩니다.
감시 시스템: 보안 카메라를 통해 비정상적인 활동을 감지하고 경보를 울립니다.
🍀 컴퓨터 비전(Computer Vision)의 관련 파이썬 라이브러리
OpenCV (Open Source Computer Vision Library): 이미지 처리 및 컴퓨터 비전을 위한 강력하고 오픈 소스인 라이브러리입니다.
Mediapipe: Google에서 개발한 오픈 소스 프레임 워크입니다. 비디오, 오디오, 시계열 데이터 등 미디어 처리 파이프라인 구축하는데 활용됩니다.
TensorFlow, PyTorch: 딥러닝 프레임워크로서 컴퓨터 비전 문제를 해결하는 데 널리 사용됩니다.
scikit-image: 파이썬 기반의 이미지 처리 라이브러리입니다.
MATLAB Computer Vision Toolbox: 알고리즘 개발과 프로토타이핑을 위한
🍀 MS의 컴퓨터 비젼 모델 정리 설명(출처: MS learn)
이미지 분류에는 콘텐츠에 따라 이미지를 분류하기 위한 기계 학습 모델을 훈련하는 작업이 포함됩니다. 예를 들어 교통 모니터링 솔루션에서는 이미지 분류 모델을 사용하여 택시, 버스, 자전거 등 포함된 차량 유형을 기준으로 이미지를 분류할 수 있습니다.
객체 감지 기계 학습 모델은 이미지 내의 개별 객체를 분류하고 경계 상자를 사용하여 해당 위치를 식별하도록 훈련되었습니다. 예를 들어 교통 모니터링 솔루션은 객체 감지를 사용하여 다양한 등급의 차량 위치를 식별할 수 있습니다.
이미지의 각 픽셀을 특정 클래스에 할당하여 개체와 배경을 구분하고 경계를 정확히 정의합니다. 예를 들어, 도시 장면 이미지에서 건물, 도로, 사람, 차량 등을 각각의 클래스로 구분합니다. 이 기술은 픽셀 수준의 분류와 개체의 정확한 경계 식별을 통해 자율 주행, 의료 영상 분석, 위성 이미지 분석 등 다양한 분야에서 활용됩니다.
기계 학습 모델과 고급 이미지 분석 기술을 결합하여 이미지를 분류하는 데 도움이 되는 "태그" 또는 이미지에 표시된 장면을 요약하는 설명 캡션을 포함하여 이미지에서 정보를 추출하는 솔루션을 만들 수 있습니다.
얼굴 감지는 이미지에서 사람의 얼굴을 찾는 특수한 형태의 객체 감지입니다. 이는 분류 및 얼굴 기하학 분석 기술과 결합되어 얼굴 특징을 기반으로 개인을 인식할 수 있습니다.
광학 문자 인식은 이미지에서 텍스트를 감지하고 읽는 데 사용되는 기술입니다. OCR을 사용하여 사진 속 텍스트(예: 도로 표지판, 상점 정면)를 읽거나 편지, 송장, 양식 등 스캔한 문서에서 정보를 추출할 수 있습니다.
🍀 Onaclick AI 컴퓨터 비젼
대한민국 대표 인공지능 교육 사이트인 원클릭 AI에서는 컴퓨터 비젼을 활용한 피지컬 실습을 할 수 있도록 무료 웹페이지를 설계해 놓았습니다.
아래 링크를 연결하여 설명을 읽어봅시다. 쉽게 '컴퓨터 비젼' 교육을 할 수 있습니다.