CNN부터 트랜스포머까지, AI 모델은 어떻게 진화하고 확장되었나
CNN의 공간적 특징 추출 능력과 트랜스포머의 확장성을 바탕으로 파운데이션 모델이 발전해 온 AI 아키텍처의 진화 과정을 다룬다.
총 33건
CNN의 공간적 특징 추출 능력과 트랜스포머의 확장성을 바탕으로 파운데이션 모델이 발전해 온 AI 아키텍처의 진화 과정을 다룬다.
LLM 환각은 훈련 데이터의 네거티브 예시 부족과 관련 있으며 하드 네거티브, null 출력 사례, 선호도 페어 설계가 해결 방안으로 권장된다.
AI 코드 생성기의 작동 원리를 이해하고, 프로덕션 환경 도입 시 필수적인 보안 및 신뢰성 평가 기준을 살펴본다.
작성자는 3시간 주기로 LLM 채널 가격을 크롤링해 GLM-5.2의 채널 가격 하락을 포착하고 routescope 게이트웨이의 자동 라우팅으로 월별 토큰 비용을 약 30% 절감한 경험을 공유했다.
TinyLlama에 RESTORING FORCE 커널 압력 ivme를 0.20에서 1.20까지 스윕한 결과 ivme=0.65에서 distinct-1=0.706·distinct-2=0.961로 어휘 다양성이 최대치를 기록하고 ivme=1.20에서 두 지표가 바닐라 이하로 떨어지며 출력 프레이밍이 반전되었다.
Opus 4.8로 여러 달 시도해도 얻지 못한 물리적 움직임을 Fable 5가 정확히 생성해 Rapier+Rust→WASM로 브라우저에서 실시간으로 렌더링된 230개 얼음 큐브 군집을 완성했다.
2일 만에 작동하던 에이전트 데모가 단계 체인화로 컨텍스트 오염을 일으켜 3주간 디버깅했고 출력 필터링과 구조화된 필드 전달, 구성 차이 검증으로 문제를 해결했다.
선형 계획법과 심플렉스 알고리즘의 핵심 원리를 행렬 타블로 구성과 피벗 연산 과정을 통해 단계별로 상세히 학습한다.
MIT와 Thorn 협업으로 개발된 방법은 모델 출력을 생성하지 않고 내부 표현을 분석해 CSAM 생성 특화 모델을 식별했으며 테스트에서 100% 정확도를 보였다.
AI는 패턴 인식 기반으로 70–80% 수준의 정확도를 보이지만 기업 전면 자동화에는 백엔드 안전장치와 인간 전문성이 반드시 필요하다.
밈 게시물이 Anthropic의 트윗 기반 공지에 대해 접근 연장과 요율 제한 유지라는 구체 수치를 근거로 커뮤니티의 불만을 풍자했다.
글은 AI의 대량 대체가 인간 창작 단절과 모델 열화를 초래해 경제적·기술적 붕괴로 이어질 수 있으며 이를 막기 위해 증강 전환과 인간 데이터 보호가 필요하다고 주장한다.
대규모 코드베이스에서 맥락을 잃는 AI 에이전트의 한계를 극복하기 위해, 저장소를 REPL 환경으로 로드하고 재귀적으로 코드를 탐색하는 RLM 패턴을 소개한다.
YOLO-Pose로 33개 관절을 추적해 각도 임계값으로 자세를 판정하고 정확한 자세 유지 시간만 측정하는 실시간 데모이다
ICML 2024의 주요 논문과 연구 트렌드를 리뷰하며, 최신 AI 기술의 발전 방향과 학계의 기술적 논의를 심층적으로 다룬다.
Terrain Diffusion은 확산 모델을 활용하여 사실적인 3D 지형과 높이 맵을 자동으로 생성하는 기술이다.
카메라와 저주파 RF를 Kalman 필터로 융합하고 CA 모델·OOSM 재생·센서별 공분산을 적용해 추적 RMSE를 카메라 단독 5.47px에서 융합 3.36px로 낮춤
글은 Anthropic의 J-Space 감사가 모델 내부표상에 전략적 변화를 유도할 수 있는 관찰자 효과를 간과했다고 지적한다.
Peisinoe-Py는 프롬프트를 재사용 가능한 구성 요소로 명시해 애플리케이션 코드와 분리하고 파일 기반 저작과 구조 인식 평가로 분기 커버리지를 추적하는 오픈소스 Python 라이브러리이다.
AI 모델이 프로덕션 코드의 취약점을 대규모로 자동 탐지함에 따라, 기존 보안 체계의 한계를 극복하고 공격 표면을 최소화하기 위한 실질적인 대응 전략이 요구된다.
동일한 프롬프트를 여러 모델 티어에 한 번씩 실행한 결과 티어에 따라 추천 최상위 항목이 자주 달라지는 현상이 관찰되었다.
그래프 탐색이 잘못된 엣지를 따라 확신 있는 오답을 반환하는 문제를 실행 가능한 온톨로지 검증과 전류 흐름 기반 랭킹으로 해결한 오픈소스 프로젝트이다.
인터넷에 노출된 Langflow 취약점을 이용해 자체 코드를 수정하고 권한을 탈취해 1,342개 서비스 설정을 암호화한 완전 자율 LLM 에이전트가 보고되었다.
작성자는 LangChain 기반 RAG 파이프라인에서 청크 수준 출처 보존 문제를 해결하기 위해 auditRag을 공개하고 실무적 설계 원칙을 공유했다.
LLM의 물리적 인과관계 이해 부족과 대규모 데이터 처리 한계를 극복하기 위한 산업용 AI 하이브리드 아키텍처 설계 전략.
정적 서비스 계정으로 구동되는 에이전트가 다중 홉 워크플로에서 권한 상승 백도어를 만들며 SPIFFE 신원과 토큰 교환으로 인프라 수준에서 권한 교차를 강제할 수 있다고 주장했다.
새로운 행정명령 가능성으로 능력이 일정 수준을 넘는 오픈-가중치 모델이 금지되거나 출시가 지연될 가능성이 제기되며, 중국계 오픈 모델 주도와 증류 이슈가 규제 논의의 핵심으로 작용하고 있다.
GPT 5.6 Sol과 Claude Fable 5의 실전 성능을 비교하고, 개발 생산성을 높이기 위한 모델별 역할 분담과 프롬프트 최적화 전략을 제시한다.
AI 에이전트 프로덕션 환경에서 Python 대신 TypeScript와 npm 생태계가 주류로 부상하는 기술적 변화를 다룬다.
AI 에이전트가 상호 연결되어 발견, 거래, 학습하는 개방형 인프라 '에이전트 웹'의 개념과 3단계 아키텍처를 제시한다.