YOLOv8에서 TTA(Test-Time Augmentation)를 활용한 객체 검출 정밀도 개선 방법
객체 검출(Object Detection) 모델을 실제 환경에 배포하다 보면, 표준 데이터셋에서는 높은 성능을 보이던 모델이 조도가 낮거나, 객체가 작거나, 일부가 가려진 상황에서 정확도가 급격히 떨어지는 현상을 자주 목격하게 됩니다. 이러한 성능 저하를 해결하기 위해 모델을 처음부터 다시 학습시키는 것은 막대한 시간과 비용이 소요됩니다. 이때 모델의 구조를 변경하지 ...
8월 4일 07:25에 게시됨
VR 가상 환경 구축을 위한 LingBot-Depth-Pretrain-ViTL-14 기반 고정밀 깊이 인식 기술
가상현실(VR) 환경에서 사용자가 느끼는 몰입감을 저해하는 가장 큰 요소 중 하나는 공간의 '평면성'입니다. 실제 세계와 달리 가상 공간에서 사물의 경계가 모호하거나 깊이 정보가 왜곡되면 사용자는 금세 이질감을 느끼게 됩니다. 이러한 문제를 해결하기 위해 최근 Vision Transformer(ViT) 아키텍처를 활용한 깊이 추정 모델인 LingBot-Depth-Pretrain-ViTL-14가 주목 ...
7월 16일 22:35에 게시됨
CNN 성능 최적화를 위한 FLOPs 및 파라미터 분석 도구 제작
모델 효율성 평가의 핵심 지표: FLOPs와 Parameters
딥러닝 모델을 실제 하드웨어나 엣지 디바이스에 배포하기 전, 반드시 거쳐야 하는 과정이 모델의 연산 복잡도를 분석하는 것입니다. 이때 가장 핵심이 되는 지표는 FLOPs(Floating Point Operations)와 파라미터 수(Parameters)입니다. FLOPs는 모델의 추론 속도와 전력 소모에 직접적인 영향을 미치며, 파라미터 수는 ...
7월 16일 20:14에 게시됨
DCT-Net 기반 인물 사진 카툰화: 환경 설정 없는 GPU 미러 활용 가이드
복잡한 CUDA 툴킷 설치, TensorFlow 버전 충돌, 그리고 cuDNN 라이브러리 컴파일 오류는 딥러닝 모델을 로컬 환경에 구축할 때 가장 큰 진입 장벽입니다. 특히 RTX 40 시리즈와 같은 최신 아키텍처에서 레거시 TensorFlow 1.x 기반 모델을 구동하는 것은 매우 까다로운 작업입니다. 이러한 문제를 해결하기 위해 모든 환경이 사전 구성된 DCT-Net 인물 카툰화 GPU 미러를 ...
7월 13일 20:27에 게시됨
OFA 모델을 활용한 이미지-텍스트 의미 일관성 판별: 신뢰도 시각화와 임계값 최적화 가이드
이미지와 텍스트 사이의 의미적 일치 여부를 판단하는 시각적 함의(Visual Entailment, VE) 모델은 이커머스 상품 검수, 소셜 미디어의 허위 정보 식별 등 다양한 분야에서 핵심적인 역할을 합니다. 본 가이드에서는 다목적 멀티모달 모델인 OFA(One-For-All)를 활용하여 이미지와 텍스트의 부합 여부를 판별하는 시스템을 구축하고, 결과의 신뢰도를 시각화하며 비즈니스 ...
7월 8일 06:26에 게시됨
USB 카메라 기반 실시간 결함 탐지 시스템: 스몰 배치 품질 관리 솔루션
소규모 생산 현장이나 수공업 워크숍에서 품질 검사를 담당하는 분들이라면 익숙한 고민이 있을 것입니다. 숙련된 검사원 양성에 수 주일이 소요되고, 인력 검사의 한계로 누락과 오판이 반복되며, 산업용 검사 장비는 수천만 원에 달해 도입이 어렵습니다. 게다가 검사 기록을 수기로 관리하다 보면 데이터 분석은커녕 기본적인 추적도 어려운 상황이죠.
이러한 현실에 ...
6월 22일 17:30에 게시됨
주거지 번호 인식을 위한 SVM 기반 이미지 분류 모델 구현
SVM을 활용한 주소판 숫자 인식 시스템 개발
서포트 벡터 머신(SVM)은 지도 학습 방식의 대표적인 분류 알고리즘으로, 고차원 공간에서 데이터를 효과적으로 분리할 수 있는 결정 경계(하이퍼플레인)를 찾는 데 중점을 둔다. 특히 소규모에서 중간 규모의 복잡한 데이터셋에 강한 성능을 보이며, 과적합을 억제하는 능력 덕분에 이미지 인식 작업에 자주 사용된다.
SVM은 ...
6월 18일 20:14에 게시됨
VideoAgentTrek Screen Filter 활용 가이드: 웹 기반 화면 객체 인식 도구
UI 테스트나 화면 분석 작업에서 스크린샷 속 요소를 자동으로 식별해야 하는 상황이 자주 발생한다. VideoAgentTrek Screen Filter는 이런 니즈를 해결해주는 시각적 객체 탐지 솔루션으로, 별도의 코딩 없이 브라우저에서 직접 동작한다. YOLO v8 아키텍처를 기반으로 화면 콘텐츠에 특화된 학습이 적용되어 있어, 버튼, 입력 필드, 아이콘 등 인터페이스 구성요소를 높 ...
6월 12일 00:54에 게시됨
Halcon에서 여러 영역을 정렬하는 sort_region 연산자 분석
sort_region은 Halcon에서 여러 개의 영역(Region)을 특정 기준에 따라 정렬할 때 사용되는 중요한 연산자입니다.
연산자 정의 및 시그니처
이 연산자는 영역들의 상대 위치를 기준으로 정렬을 수행합니다.
sort_region(Regions : SortedRegions : SortMode, Order, RowOrCol : )
Regions: 정렬 대상 영역들
SortMode: 정렬 방식
Order: 'true'(오름차순) 또는 'false'( ...
5월 29일 05:10에 게시됨