본문으로 건너뛰기

2026년 3월 3일 AI 뉴스

16

관심 태그 추가

위성 이미지 데이터셋 구축을 자동화하는 오픈소스 도구 depictAI 공개

위성 이미지 기반 컴퓨터 비전 모델 학습을 위해 Sentinel-2와 Landsat 데이터를 로컬에서 대규모로 수집하고 내보낼 수 있는 웹 기반 도구인 depictAI가 출시되었습니다.

ESP32-S3에서 MobileNetV2와 얼굴 인식을 구현하는 방법

ESP32-S3 마이크로컨트롤러에서 TFLite와 ESP-DL을 활용하여 MNIST 분류부터 MobileNetV2까지 구현한 Edge AI 프로젝트 모음입니다.

긴 대화도 끊김 없이 즐기는 AI 채팅 최적화 도구 공개

ChatGPT와 Claude 등 주요 AI 서비스에서 발생하는 긴 대화창의 성능 저하 문제를 해결하고 메시지 로딩 방식을 최적화하는 오픈소스 확장 프로그램을 소개합니다.

RTX 3060으로도 충분하다 저사양 최적화와 편의성을 극대화한 새로운 WebUI Codex 등장

Vue 3와 FastAPI 기반으로 구축된 Codex는 저사양 그래픽카드 최적화와 직관적인 UI를 제공하는 새로운 Stable Diffusion 인터페이스입니다.

퍼플렉시티보다 저렴한 1.2초 속도의 웹 검색 기반 AI 답변 API

실시간 웹 검색 결과와 인용을 제공하며 기존 서비스보다 저렴한 가격과 빠른 속도를 강점으로 내세운 OpenAI 호환 API인 MIAPI가 공개되었습니다.

변수명도 없고 오직 논리만 존재한다: AI 모델 전용 언어 Vera의 등장

AI 모델이 코드를 생성할 때 발생하는 일관성 결여와 오류를 해결하기 위해 변수명을 없애고 Z3 SMT 솔버로 논리적 계약을 강제하는 기계 중심 프로그래밍 언어 Vera를 소개합니다.

137억 원의 개발 비용을 절반으로 줄이는 클로드 AI 기반 조직 개편 가이드

15년 경력의 기술 컨설턴트가 클로드(Claude) AI 에이전트를 도입하여 100인 규모 개발팀의 운영 비용을 53% 절감하고 생산성을 2배 이상 높이는 구체적인 실행 방안을 제시합니다.

모바일 GPU로 구현하는 영지식 기계학습의 기술적 도전과 미래

모바일 환경에서 개인정보를 보호하며 모델 실행의 무결성을 증명하기 위한 GKR 기반 영지식 증명 시스템의 기술적 선택과 하드웨어 제약 사항을 분석합니다.

200만 토큰 사용료가 단돈 8달러? 프롬프트 캐싱과 TEM 프레임워크의 위력

상태 저장형(Stateful) 아키텍처와 TEM 프레임워크를 활용하여 LLM 운영 비용을 획기적으로 낮추고 컨텍스트 효율성을 극대화한 공주(Gongju) 프로젝트를 소개합니다.

라즈베리 파이 5로 구현하는 고성능 비전 AI: Qwen 3.5 벤치마크

라즈베리 파이 5의 8GB 및 16GB 모델에서 Qwen 3.5 시리즈의 다양한 양자화 모델을 테스트하여 실용적인 추론 속도와 최적의 모델 조합을 확인했습니다.

환각 현상을 90% 차단하는 멀티 에이전트 비판적 검토 설계법

CrewAI와 비판적 에이전트 패턴을 결합하여 시장 조사 데이터의 환각 현상을 줄이고 분석의 신뢰도를 높이는 멀티 에이전트 시스템 설계 사례를 공유합니다.

소형 모델의 구원투수, Qwen 3.5 생각하기 모드 활용법

Qwen 3.5 모델군을 대상으로 매개변수 크기에 따른 생각하기 모드의 효용성을 실험한 결과, 소형 모델에서는 추론과 문맥 유지력이 크게 향상되나 대형 모델에서는 큰 차이가 없음을 확인했습니다.

유튜브와 PDF를 한 번에 AI 에이전트 스킬로 변환하기

다양한 형식의 소스 자료를 분석하여 Claude나 Cursor 등 30여 개의 AI 에이전트에서 즉시 사용 가능한 검증된 기술로 변환해 주는 서비스입니다.

AI의 자율 행동을 어떻게 감시할까? 내부 감사를 위한 추적 시스템 구축 가이드

AI 에이전트의 자율적인 동작을 모니터링하고 내부 감사를 수행하기 위해 대시보드와 분석 도구에 통합 가능한 소프트웨어 기반 추적 방식을 제안합니다.

기존 FlashAttention보다 40배 빠른 새로운 Triton 커널 등장

GQA 대칭성을 활용한 SyDecode 파이프라인을 통해 기존 FlashAttention 대비 최대 40배의 속도 향상과 90%의 VRAM 절감을 실현한 새로운 Triton 커널을 소개합니다.

LM Studio 사용자 필독: 모델 성능을 갉아먹는 3가지 치명적 파서 버그

LM Studio의 파서가 추론 블록 내부의 도구 호출 패턴을 오인하고 다중 MCP 서버 등록 시 충돌을 일으켜 모델이 정상 작동함에도 빈 응답이나 오류를 출력하는 문제를 분석했습니다.