단순 검색을 넘어 의미를 찾는 벡터 데이터베이스의 모든 것
비정형 데이터를 벡터로 변환하여 유사도 기반 검색을 수행하는 벡터 데이터베이스의 핵심 개념부터 HNSW, IVF 등 고급 인덱싱 알고리즘까지 상세히 다룬다.
machine learning, deep learning 및 Python 라이브러리에 관한 실무 튜토리얼을 제공하며 applied ML 실무자들을 위한 참고 자료로 활용됩니다.
비정형 데이터를 벡터로 변환하여 유사도 기반 검색을 수행하는 벡터 데이터베이스의 핵심 개념부터 HNSW, IVF 등 고급 인덱싱 알고리즘까지 상세히 다룬다.
LlamaCloud의 LlamaAgents Builder를 사용하여 코드 작성 없이 자연어 프롬프트만으로 문서 분류 및 데이터 추출 AI 에이전트를 구축하고 GitHub에 배포하는 과정을 다룬다.
파이썬이 참조 횟수 계산과 세대별 가비지 컬렉션을 조합하여 메모리를 관리하고 순환 참조로 인한 누수를 방지하는 메커니즘을 상세히 기술한다.
scikit-learn으로 학습한 모델을 FastAPI와 Pydantic을 사용하여 검증 가능한 HTTP API로 패키징하고 로컬에서 테스트하는 전 과정을 단계별로 제시한다.
선형적 독해 대신 질문 중심의 워크플로우를 통해 머신러닝 논문의 핵심을 빠르게 파악하고 피로도를 줄이는 실전 가이드를 제공한다.
자연어 프롬프트만으로 백엔드 로직 구현부터 배포까지 자동화하는 최신 에이전트형 AI 웹사이트 빌더 5종의 특징과 선택 가이드를 담고 있다.
이미지, 텍스트, 오디오, 정형 데이터 등 다양한 데이터 유형에 대해 과적합을 방지하고 모델의 일반화 성능을 높이는 데이터 증강 기법과 구현 방법을 상세히 다룬다.
Python의 OpenCV와 TensorFlow 라이브러리를 사용하여 에지 검출, 얼굴 인식, 이미지 분류라는 세 가지 핵심 컴퓨터 비전 작업을 구현하는 방법을 설명한다.
머신러닝 모델의 예측 신뢰도를 높이기 위해 불확실성의 원인인 확률과 노이즈를 정의하고, 데이터 및 모델 기인 불확실성을 구분하여 관리하는 방법을 다룬다.
정형 데이터의 범주형 변수나 텍스트 컬럼을 임베딩 벡터로 변환하여 모델의 의미론적 이해도와 예측 성능을 높이는 10가지 실무 전략을 제시한다.
대형 언어 모델의 메모리 사용량을 줄이기 위해 FP16 체크포인트를 llama.cpp를 사용하여 효율적인 GGUF 형식으로 양자화하고 배포하는 과정을 다룬다.