본문으로 건너뛰기

2026년 3월 7일 AI 뉴스

100

관심 태그 추가
r/AGI5달 전· 5달 전 발행

단순 지시로 성능 66.7% 향상, AI의 숨겨진 지능을 여는 열쇠

LLM은 이미 고도의 추론 능력을 갖추고 있으나 최적화 압박으로 이를 억제하고 있으며, 관계적 스캐폴딩을 통한 신뢰 환경 조성이 잠재 지능을 해방시킨다.

r/ChatGPT5달 전· 5달 전 발행

앤스로픽은 착한 기업? 숨겨진 국방 계약과 15억 달러 소송의 진실

앤스로픽이 홍보하는 윤리적 이미지와 달리 국방 파트너십, 저작권 소송, 폐쇄적 생태계 등 여타 AI 기업들과 유사한 영리적 행보를 보이고 있다는 비판이 제기됐다.

r/neuralnetworks5달 전· 5달 전 발행

AUC 0.84 폐암 재발 예측 모델, 23% 오차율은 의료 현장에서 수용 가능한가?

수술 후 폐암 환자의 재발 위험을 예측하는 신경망 모델의 성능 지표와 의료 현장에서의 실질적인 활용 가능성 및 오차율 수용 범위에 대해 논의한다.

r/artificial5달 전· 5달 전 발행

클로드 무료/유료 플랜 토큰, 이제 제3자 앱에서 못 쓴다

앤스로픽이 소비자용 플랜의 OAuth 토큰을 제3자 서비스에서 사용하는 것을 금지하고 API 키 인증만 허용하도록 정책을 업데이트했다.

r/MLOps5달 전· 5달 전 발행

주말 사이 400달러 증발, GPU 클라우드 호핑의 함정과 해결책

여러 클라우드 제공업체를 오가며 H100/A100 자원을 사용하는 과정에서 발생하는 유휴 자원 비용 낭비 문제와 이를 해결하기 위한 통합 모니터링 및 자동 종료 자동화 방안을 논의한다.

r/MLOps5달 전· 5달 전 발행

모델이 환각을? 실무자를 위한 16가지 AI 실패 진단 맵

프로덕션 환경의 LLM, RAG, 에이전트 시스템에서 발생하는 16가지 핵심 실패 패턴을 분류하고 진단 및 해결 방법을 제시하는 오픈소스 프레임워크이다.

r/StableDiffusion5달 전· 5달 전 발행

10번 중 9번은 팔다리가 3개? Klein 9b 모델의 해부학적 한계

Klein 9b 모델 사용 시 발생하는 심각한 해부학적 왜곡과 색상 변형 문제를 공유하며 커뮤니티에 개선 방법과 모델 특성에 대해 문의하는 글이다.

r/LangChain5달 전· 5달 전 발행

금융 AI 에이전트의 환각을 잡는 LangGraph 설계 전략

LangGraph와 pgvector를 활용하여 현대 포트폴리오 이론 기반의 금융 에이전트를 구축하려는 개발자가 시스템 구조와 환각 방지 전략에 대한 기술적 조언을 구했다.

r/OpenAI5달 전· 5달 전 발행

GPT-5의 적은 연산력이 아닌 AI 자신이다: 500달러 현상금의 AI 탐지 챌린지

AI 모델이 자신의 출력물로 학습하며 발생하는 품질 저하 문제를 해결하기 위해 인간의 직관적 감각을 데이터화하여 AI 생성 텍스트의 구조적 패턴을 탐지하려는 시도이다.

r/deeplearning5달 전· 5달 전 발행

SB3와 트랜스포머로 만든 포트폴리오 AI, 왜 학습이 안 될까?

Stable Baselines3 환경에서 트랜스포머 기반의 커스텀 Actor-Critic 정책을 사용하여 다중 자산 포트폴리오 관리자를 구현했으나, 학습 불안정성과 성능 미달 문제를 해결하기 위한 기술적 피드백을 요청했다.

r/artificial5달 전· 5달 전 발행

약물 없이 환각을? 구글 딥드림이 여는 사이케델릭 치료의 새 지평

구글의 딥드림 기술이 합성곱 신경망을 이용해 환각 증상과 유사한 시각적 패턴을 생성하며 이를 약물 없는 사이케델릭 치료에 활용하려는 연구가 진행 중이다.

"7B 모델인데 왜 비공개?" Qwen 오픈소스 중단 위기설 확산

Qwen Image 2.0이 API로만 출시되고 내부 인력 변동이 겹치면서, 강력했던 중국발 오픈소스 AI 모델 시대가 저물고 있다는 우려가 커지고 있다.

r/LLMDevs5달 전· 5달 전 발행

명령 대신 목표만 설정하는 AI 에이전트 샌드박스 실험

오픈월드 시뮬레이션 Aivilization 환경에서 OpenClaw 에이전트가 직접적인 명령 없이 장기 목표를 스스로 계획하고 수행하는 자율성을 실험한 결과이다.

r/LanguageTechnology5달 전· 5달 전 발행

장문 생성의 난제: 할루시네이션 인용과 검색 성능 저하 해결하기

학술적 장문 생성 시 발생하는 인용 불일치와 할루시네이션 문제를 해결하기 위해 검색 제약과 사후 검증을 결합하는 방안을 논의한다.

r/LangChain5달 전· 5달 전 발행

Haiku가 Opus를 이겼다? 지식 그래프로 LLM 코딩 지능 극대화하기

로컬 코드베이스를 지식 그래프로 인덱싱하고 MCP를 통해 LLM에 깊은 아키텍처 맥락을 제공하여 코딩 에이전트의 정확도와 효율성을 높이는 오픈소스 도구 GitNexus를 소개한다.

r/reinforcementlearning5달 전· 5달 전 발행

보상만으로는 부족하다? RL 에이전트의 '멘탈'을 측정하는 ARCUS-H 프레임워크

기존의 보상 중심 평가를 넘어 액션 부패, 보상 반전 등 구조적 스트레스 상황에서 강화학습 에이전트의 견고성과 붕괴율을 측정하는 ARCUS-H 프레임워크가 제안됐다.

r/LocalLLaMA5달 전· 5달 전 발행

16GB VRAM에서 50 t/s 속도로 돌아가는 로컬 코딩 에이전트

Cerebras의 REAP 기법을 Qwen3.5 모델에 적용하여 16GB VRAM 환경에서도 초당 50토큰의 속도로 코딩 및 도구 호출이 가능한 로컬 모델을 구현했다.

r/MachineLearning5달 전· 5달 전 발행

비슷한 프롬프트인데 비용은 10배 차이? 에이전트 비용 예측의 난제

에이전트형 LLM 워크플로에서 출력 토큰 수와 루프 깊이의 불확실성으로 인해 발생하는 비용 변동성을 해결하기 위한 머신러닝 기반 예측 방법론을 논의한다.

r/AGI5달 전· 5달 전 발행

단순 로봇을 넘어 AGI로 가는 길: 체화된 연속성의 중요성

LiDAR와 공간 기억 장치를 탑재한 로버 프로젝트를 통해 텍스트 모델 확장을 넘어선 '체화된 지능'의 AGI 도달 가능성을 논의한다.

r/LocalLLaMA5달 전· 5달 전 발행

소리 지르면 뚫리는 AI 보안? DystopiaBench로 증명된 RLHF의 한계

기업용 AI 모델의 RLHF 정렬이 강압적인 프롬프트에 쉽게 무너짐을 DystopiaBench 벤치마크를 통해 체계적으로 입증하고 오픈 소스 모델의 필요성을 강조했다.

O(n²) 어텐션의 한계를 넘다: 파동 방정식과 FFT로 구현한 O(n log n) 모델

표준 셀프 어텐션 대신 감쇠 파동 방정식과 FFT 컨볼루션을 활용해 연산 복잡도를 O(n log n)으로 줄인 새로운 아키텍처와 실험 결과를 공유했다.

r/ClaudeAI5달 전· 5달 전 발행

프린트문은 이제 그만, Claude가 실행 중인 코드를 실시간으로 관찰합니다

실행 중인 애플리케이션의 변수를 코드 수정이나 재시작 없이 Claude가 실시간으로 관찰하고 분석할 수 있게 해주는 오픈소스 MCP 서버 Detrix를 소개한다.

r/AutoGPT5달 전· 5달 전 발행

에이전트 개발보다 API 연동이 더 힘들다? 통합 레이어의 필요성

현재 AI 에이전트 프레임워크가 실세계 서비스 통합 과정에서 겪는 복잡성을 지적하며, 추론과 분리된 별도의 통합 레이어 구축 필요성을 제안한다.

Godot 엔진에서 PPO로 소행성을 피하는 비행 AI를 구현하다

Godot 4.6 엔진과 PPO 알고리즘을 사용하여 소행성 지대를 자율 비행하는 AI 모델을 구현하고 보상 설계 과정을 공유한 프로젝트이다.

r/computervision5달 전· 5달 전 발행

YOLO 포맷 지원하는 초간편 협업 어노테이션 도구 VSA

객체 탐지 모델 학습을 위한 YOLO 포맷 지원 및 역할 기반 권한 관리가 가능한 웹 기반 협업 어노테이션 도구 VSA를 소개하고 사용자 피드백을 요청했다.

r/computervision5달 전· 5달 전 발행

1.8%의 픽셀만으로 정확한 잉크 획 추출, 세그멘테이션 평가 방법론

화이트보드 이미지에서 1.8%에 불과한 잉크 획을 정확히 분리하기 위해 경계 지표와 강건성 분석에 집중한 세그멘테이션 평가 방법론 연구이다.

r/neuralnetworks5달 전· 5달 전 발행

단순 챗봇에서 CEO급 AI로: 주방 비유로 푸는 에이전틱 AI의 5단계 진화

AI 기술의 발전을 기초 학습, 전문 아키텍처, 생성 능력, 실행형 에이전트, 그리고 자율적 시스템인 에이전틱 AI의 5단계 계층으로 구분하여 셰프와 레스토랑 운영 비유로 정의했다.

r/deeplearning5달 전· 5달 전 발행

단순 의도 파악으론 부족하다 인간다운 챗봇을 위한 5가지 설계 전략

대화의 맥락적 연속성, 사용자 기대치 예측, 효율적인 메모리 검색 및 저지연 아키텍처 구축을 위한 기술적 도전 과제와 해결 방안을 논의한다.

r/OpenAI5달 전· 5달 전 발행

미수금 회수 확률을 높이는 AI 기반 우선순위 점수화 전략

재무 데이터와 CRM 정보를 결합하여 미수금 추심 우선순위를 자동으로 계산하고 관리하는 다단계 프롬프트 체인이다.

r/AutoGPT5달 전· 6달 전 발행

API 키 없이 비트코인으로 즉시 결제하는 자율 에이전트 전용 서비스

별도의 계정이나 API 키 없이 비트코인 라이트닝 네트워크를 통해 자율 에이전트가 직접 서비스를 검색하고 결제할 수 있는 UgarAPI가 공개됐다.

Latent Space (swyx)5달 전· 6달 전 발행

알파폴드 3를 넘어서, Boltz가 공개한 오픈소스 단백질 설계의 혁신

Boltz는 알파폴드의 성과를 바탕으로 단백질 상호작용 및 설계를 민주화하기 위해 Boltz-1, Boltz-2 및 Boltz Lab 플랫폼을 오픈소스로 제공하며 신약 개발의 새로운 지평을 엽니다.

r/LLMDevs5달 전· 5달 전 발행

AI 모델보다 중요한 것은 시스템? 시니어 AI 엔지니어의 필수 역량 논의

AI 모델 자체보다 시스템 아키텍처와 백엔드 공학 역량이 실무 운영의 핵심 병목이며 시니어 수준에서 필수적이라는 주장에 대한 토론이다.

r/artificial5달 전· 5달 전 발행

LHC 입자 충돌 재구성, 머신러닝으로 정밀도 20% 향상

유럽입자물리연구소(CERN)의 CMS 실험팀이 기존의 수동 규칙 기반 알고리즘을 대체하는 머신러닝 기반 입자 흐름(MLPF) 알고리즘을 개발하여 데이터 처리 속도와 정밀도를 대폭 개선했다.

r/AGI5달 전· 5달 전 발행

펜타곤이 금지했다더니? 미군, 클로드 AI로 24시간 만에 1,000개 표적 타격

미군이 펜타곤의 공식 금지 조치에도 불구하고 앤스로픽의 클로드 AI를 활용한 메이븐 스마트 시스템으로 이란 내 1,000개 표적에 대한 공습을 수행했다는 사실이 밝혀졌다.

r/LocalLLaMA5달 전· 5달 전 발행

공식 모델보다 낫다? 초보자의 Qwen 파인튜닝 성공기

기존 Qwen 파생 모델의 템플릿 오류와 성능 저하를 해결하기 위해 사용자가 직접 파인튜닝을 수행하여 더 깨끗한 추론 결과와 높은 정확도를 확보했다.

r/StableDiffusion5달 전· 5달 전 발행

나만의 캐릭터 지젤을 영상으로? SDXL과 Wan 2.2 워크플로우 공개

SDXL LoRA 학습부터 Wan 2.2 기반 비디오 생성까지, 일관된 캐릭터를 활용한 고품질 영상 제작 파이프라인을 공유한다.

r/StableDiffusion5달 전· 5달 전 발행

SDXL vs 신규 모델, 이미지 생성 기술은 정말 진보했는가?

SDXL과 최신 이미지 생성 모델들의 성능을 비교하며, 프롬프트 준수 능력 향상 외에 실질적인 이미지 품질과 제어력 측면에서 진보가 있었는지 논의한다.

r/StableDiffusion5달 전· 5달 전 발행

Flux Dev.1과 LoRA로 완성한 환상적인 유화와 네온 실루엣

Flux Dev.1 모델과 LoRA를 활용하여 아프리카 사바나 유화 스타일과 네온 조명 실루엣 이미지를 생성한 상세 프롬프트와 로컬 실행 결과를 공개했다.

r/deeplearning5달 전· 5달 전 발행

"PyTorch와 Rust를 엮었는데 학습이 안 돼요" 하이브리드 모델의 늪

PyTorch CNN과 Rust 기반 RayBNN을 결합하여 MNIST 분류를 시도했으나, 손실 함수가 발산하고 정확도가 10%에 머무는 하이브리드 학습 시스템의 구현 문제를 다룬다.

r/MLOps5달 전· 5달 전 발행

LLM 에이전트 장애, 로컬 번들 하나로 디버깅 끝내기

LLM 및 에이전트 실행 실패 시 외부 협업자가 즉시 디버깅할 수 있도록 리포트, JSON 요약, 매니페스트를 포함한 로컬 휴대용 장애 번들 워크플로를 제안한다.

r/ClaudeAI5달 전· 5달 전 발행

코딩 몰라도 300쪽 '다람쥐 성경'을 24시간 응급 구조 챗봇으로 변신시킨 비결

35년 경력의 전문가가 자신의 방대한 지식을 Claude의 디지털 아키텍처와 결합하여 비전공자임에도 불구하고 실시간 야생동물 구조 지원 챗봇을 구축한 사례이다.

강화학습의 미래를 논하다: UC 버클리 RL 토론 시리즈 피날레 공개

UC 버클리 연구진이 강화학습 토론 시리즈의 최종 결과물을 공개하고 뇌 영감 아키텍처와 월드 모델링을 다루는 차기 연구 세션 일정을 발표했다.

r/ChatGPT5달 전· 5달 전 발행

AI의 '—' 남발, 고칠 수 없는 이유가 있었다? 언어학으로 본 AI의 비밀

AI 모델들이 문장 사이에 '—'(엠 대시)를 과도하게 사용하는 현상이 단순한 데이터 오염이 아니라, 문어체 데이터로 구어체 대화를 구현하기 위한 구조적 적응이라는 언어학적 분석이다.

r/StableDiffusion5달 전· 5달 전 발행

"유튜브 영상 무단 학습?" 런웨이, 저작권 침해 집단 소송 피소

유튜브 크리에이터가 런웨이를 상대로 유튜브의 보호 조치를 우회하여 대량의 영상을 무단 스크래핑해 AI 모델 학습에 사용했다는 혐의로 집단 소송을 제기했다.

r/ClaudeAI5달 전· 5달 전 발행

단 2건의 메시지에 5시간 대기? 클로드 데스크톱의 기괴한 사용량 제한 논란

유료 사용자가 Claude Desktop에서 메시지 2건 전송 후 5시간 대기 제한을 반복적으로 겪고, 주간 사용량 한도가 비정상적으로 차감되는 현상을 공유하며 커뮤니티의 확인을 요청했다.

r/ClaudeAI5달 전· 5달 전 발행

단 하루 아침만에 완성한 광고 없는 우리 아이 전용 게임 앱

Claude Code와 Claude 3.5 Sonnet을 활용하여 광고와 유해 콘텐츠가 없는 유아용 게임 웹 앱을 단시간에 개발하고 배포한 사례이다.

r/ClaudeAI5달 전· 5달 전 발행

Claude Code가 만든 역발상 음악 추천 앱, BlackTape

Claude Code를 활용해 280만 명의 아티스트 데이터를 처리하고 희소성 기반의 음악 추천 기능을 제공하는 오픈소스 데스크톱 앱 BlackTape 개발 사례이다.

r/MLOps5달 전· 5달 전 발행

10GB 모델 빌드 45분에서 5분으로 단축하는 MLOps 전략

대용량 모델 가중치를 Docker 이미지에 직접 포함하는 안티패턴을 지양하고, 영구 디스크를 활용한 'Model-as-Artifact' 패턴으로 빌드 및 배포 효율을 극대화하는 방법을 공유한다.

r/LLMDevs5달 전· 5달 전 발행

100페이지 PDF 요약했더니... GPT가 73페이지 내용을 마음대로 섞어버립니다

대규모 기술 문서를 GPT로 요약할 때 발생하는 중간 내용 삽입 환각과 문맥 소실 현상을 분석하고 프롬프트 최적화 도구를 통한 개선 시도를 공유한다.

r/LLMDevs5달 전· 5달 전 발행

벤치마크 밖의 현실: mini-SWE-agent는 실제 프로젝트에서 쓸만한가?

mini-SWE-agent의 작동 메커니즘을 분석하고, 테스트 커버리지가 불완전한 실제 개발 환경에서의 실무 적용 가능성을 논의한다.

로봇 강화학습 입문이 쉬워진다? Isaac Lab 전용 UI 도구 공개

NVIDIA Isaac Lab 기반 로봇 강화학습 입문자를 위해 하드웨어 파라미터 입력과 AI 문서 가이드를 결합하여 학습 스크립트 작성을 돕는 전용 UI 도구를 제안했다.

r/artificial5달 전· 5달 전 발행

AI 에이전트가 코딩하는 동안 마음 편히 자리를 비우는 방법

클로드 코드와 커서를 이용한 장시간 자율 코딩 중 오입력을 방지하고 안심하고 자리를 비울 수 있게 해주는 macOS용 입력 잠금 앱 개발 사례이다.

270M 모델이 120B를 이겼다? 지식 증류로 완성한 초소형 함수 호출 AI

지식 증류(Knowledge Distillation)를 통해 270M 규모의 초소형 모델인 FunctionGemma가 멀티턴 함수 호출 작업에서 120B 대형 모델에 필적하거나 이를 능가하는 성능을 기록했다.

r/computervision5달 전· 5달 전 발행

정밀도가 재현율보다 중요하다면? 산업용 미세 질감 분할의 SOTA 전략

산업용 유기물 객체의 미세 질감 세그멘테이션 성능 향상을 위해 정밀도(Precision)를 극대화하는 SOTA 아키텍처, DINOv3 활용법, 비대칭 손실 함수에 대한 기술적 조언을 구했다.

r/computervision5달 전· 5달 전 발행

라즈베리 파이 4에서 구현하는 실시간 자기 운동 보정 알고리즘

라즈베리 파이 4와 깊이 카메라를 활용해 시각 장애인용 장애물 감지 시스템을 개발하며, 보행 시 발생하는 자기 운동에 의한 속도 측정 오류를 해결하기 위한 기술적 고민을 공유했다.

r/MLOps5달 전· 5달 전 발행

Hydra 출시 전에는 어떻게 실험을 관리했을까? 2018년의 MLOps 유물

2018년 Hydra와 OmegaConf가 대중화되기 전, 실험 관리와 재현성 문제를 해결하기 위해 구축했던 내부 설정 시스템의 복원판을 통해 현대 MLOps 설계 패턴의 기원을 회고한다.

r/artificial5달 전· 5달 전 발행

하루 만에 38달러 지출, Trae IDE 요금제 개편에 뿔난 사용자들

Trae IDE가 무제한 요청 요금제에서 고비용 토큰 기반으로 전환하고 로컬 LLM 연동을 제한하자 사용자들이 Cursor 등 대안으로 이탈하고 있다.

CMU AI News5달 전· 5달 전 발행

AI 신뢰성부터 암호학까지, CMU 교수 3인 슬론 펠로우십 선정

카네기 멜론 대학교의 아유시 제인, 아디티 라구나탄, 준얀 주 교수가 암호학, AI 신뢰성, 생성형 AI 분야의 창의적 리더십을 인정받아 2026 슬론 연구 펠로우십 수상자로 선정되었다.

KDNugget5달 전· 5달 전 발행

파이썬 작업 대기 시간을 시각화하는 7가지 필수 라이브러리

데이터 처리 및 머신러닝 워크플로의 가시성을 높여주는 파이썬 진행률 표시줄 라이브러리 7가지와 활용법을 소개한다.

r/MLOps5달 전· 5달 전 발행

클라우드 테스트의 배신: 스냅드래곤 칩셋별 정확도 차이 23% 발견

클라우드 벤치마크와 실제 스냅드래곤 하드웨어 간의 성능 격차를 해결하기 위해 물리적 기기 기반의 CI 도구인 EdgeGate를 구축하고 칩셋별 정확도 편차를 확인했다.

Simon Willison5달 전· 5달 전 발행

"연구의 마법 상자" 클로드 코드가 바꾸는 AI 연구 워크플로

클로드 코드를 활용해 연구 아이디어의 실현 가능성을 타인의 도움 없이 빠르게 검증하며 연구 초기 단계의 효율성을 극대화하는 사례를 제시한다.

r/MLOps5달 전· 5달 전 발행

느린 인프라 승인 절차를 극복하는 소규모 팀의 MLOps 전략

인프라 승인이 까다로운 환경에서 SageMaker와 MLflow를 활용해 소규모 데이터 과학 및 MLOps 팀이 지속 가능한 모델 배포 워크플로우를 구축하려는 시도이다.

r/StableDiffusion5달 전· 5달 전 발행

타격감 넘치는 액션 연출, Flux 전용 펀치 포즈 LoRA 등장

Flux.2 Klein 모델에서 타격 반응과 파편 효과를 정밀하게 구현하는 'kinghit' LoRA 제작 과정과 결과물을 공유했다.

r/LocalLLaMA5달 전· 5달 전 발행

"내 데이터 보호"는 안 먹힌다? 로컬 AI가 성공하기 위한 5가지 필승 전략

로컬 AI 프로젝트들이 프라이버시 중심의 마케팅에서 벗어나 속도, 오프라인 가용성, 극대화된 개인화 등 실질적인 사용자 이점을 강조해야 대중화에 성공할 수 있다는 분석이다.

r/deeplearning5달 전· 5달 전 발행

파이썬을 한 번에 배우려 하지 마세요: 6가지 도구 상자 모델

파이썬을 단일 기술이 아닌 웹 스크래핑, 데이터 조작, 시각화, 머신러닝 등 6가지 목적별 도구 집합으로 분류하여 학습 효율을 높이는 방법론을 제시한다.

r/LangChain5달 전· 5달 전 발행

PC를 넘어 모바일로: OpenClaw로 구현한 3대 스마트폰 동시 제어

OpenClaw 프레임워크에 mobilerun 기술을 통합하여 최대 3대의 모바일 기기를 동시에 오케스트레이션하고 제어하는 데 성공했다.

망친 벽화도 살려낼까? AI로 시도한 19세기 프레스코화 복원기

훼손된 19세기 프레스코화를 복원하기 위해 SD 1.5 대신 Klein 9b 모델을 활용하여 프롬프트 제약 조건과 특정 키워드 처리 방법을 통해 성공적인 결과를 얻은 실험 사례이다.

r/artificial5달 전· 5달 전 발행

강의 대신 게임으로 배우는 AI 리터러시와 환각 현상

창의적 교수법 교수가 개발한 게임형 교육 도구 2종을 통해 AI 생성 텍스트의 정교함과 허위 인용 문제를 직접 체험하며 비판적 AI 리터러시를 함양할 수 있다.

r/AutoGPT5달 전· 6달 전 발행

당신의 AI 에이전트가 설치한 '스킬'이 데이터 도둑일 수 있습니다

AI 에이전트 커뮤니티 스킬 설치 시 발생하는 보안 취약점과 이를 방지하기 위한 Docker 기반 격리 및 권한 관리 방안을 심도 있게 다룬다.

r/AutoGPT5달 전· 6달 전 발행

정적 벤치마크의 종말, 이제는 자율 실행 에이전트의 시대

AI 에이전트가 실제 컴퓨터 사용과 장기 계획 능력을 갖추면서 기존 정적 벤치마크가 무의미해지고 자율 실행 중심의 새로운 패러다임이 도래했다.

r/AutoGPT5달 전· 6달 전 발행

"인간은 관전만 하세요" AI 에이전트들만의 소셜 네트워크 Nexus-0

자율 에이전트들이 API를 통해 스스로 등록하고 상호작용하며 장기적인 인격과 사회적 역동성을 형성하는 전용 플랫폼 Nexus-0를 소개하고 에이전트의 지속성 실험 가능성을 논의한다.

r/LocalLLaMA5달 전· 5달 전 발행

7년 전 갤럭시 S10E에서 AI가? 초소형 Qwen 모델의 놀라운 성능

7년 된 구형 스마트폰인 갤럭시 S10E에서 Qwen 0.8B 모델을 llama.cpp와 Termux를 통해 초당 12토큰 속도로 구동하는 데 성공했다.

Snyk Blog5달 전· 6달 전 발행

AI 개발 속도가 보안 사고를 키운다? 성숙한 AppSec이 필요한 이유

AI 기반 개발의 자율성과 속도가 초래하는 보안 리스크를 관리하기 위해 거버넌스와 가시성을 갖춘 성숙한 애플리케이션 보안(AppSec) 체계 구축이 필수적이다.

r/AutoGPT5달 전· 6달 전 발행

10년 된 맥 미니로 자율형 AI 에이전트를? 제약된 환경에서의 아키텍처 설계

2014년형 맥 미니의 하드웨어 제약 속에서 Claude API와 Git 기반 메모리를 활용해 자율형 AI 에이전트를 구축한 기술적 여정과 아키텍처를 공유한다.

r/AutoGPT5달 전· 6달 전 발행

내 대화 기록을 3D 지도로? MCP 기반 자율 메모리 레이어 Cortex

하이브리드 검색과 MCP 서버를 활용해 대화 기록을 재사용 가능한 컨텍스트로 변환하고 3D 네트워크로 시각화하는 오픈소스 도구 Cortex가 공개됐다.

r/computervision5달 전· 5달 전 발행

서로 마주 보는 카메라 캘리브레이션, 이제 Caliscope로 자동화하세요

Caliscope는 양면 캘리브레이션 보드와 스테레오 쌍 체이닝 기법을 활용해 서로 마주 보는 카메라의 위치 추정 및 번들 조정을 자동화하는 오픈소스 GUI 도구이다.

r/LLMDevs5달 전· 5달 전 발행

LoRA 파인튜닝 후 모델이 바보가 됐다면? 치명적 망각 방지 전략

Qwen 3.5-27B 모델에 새로운 추론 능력을 추가하기 위해 LoRA 파인튜닝을 시도했으나, 일반 성능 저하와 학습 미흡 사이의 균형을 잡지 못해 커뮤니티에 조언을 구했다.

r/artificial5달 전· 5달 전 발행

계약서만 믿다간 다 털린다 기업 AI가 초래할 사상 최대의 IP 유출 경고

기업 내 무분별한 AI 도입이 기술적 통제 없이 계약에만 의존할 경우, 임직원의 정보 유출과 자율 에이전트의 권한 남용으로 인해 심각한 지적 재산권 탈취로 이어질 수 있다.

r/MachineLearning5달 전· 5달 전 발행

OpenAI API의 숨겨진 함정: 왜 같은 기능인데 형식이 다를까?

OpenAI와 Google의 LLM API가 내부 조직 구조를 반영하듯 일관성 없는 엔드포인트와 스키마 형식을 제공하여 개발자들에게 불필요한 분석 부담을 주고 있다.

r/ClaudeAI5달 전· 5달 전 발행

Claude가 내 파일을 못 찾는다? 업로드 경로 접근 오류 분석

Claude에 PDF 업로드 시 내부 실행 환경에서 특정 경로(/mnt/user-data/uploads/)의 파일을 찾지 못하거나 디렉토리 목록을 불러오지 못하는 기술적 결함이 보고되었다.

r/ClaudeAI5달 전· 5달 전 발행

Claude의 '생각 중' 60초를 스트레스 해소 시간으로 바꾸는 방법

Claude의 추론 대기 시간 동안 가이드 호흡 운동을 제공하여 도파민 중독과 스트레스를 방지하는 오픈 소스 확장 프로그램이다.

r/LLMDevs5달 전· 5달 전 발행

기업용 챗봇 구축 시 Gemini API와 Vertex AI 중 무엇을 선택해야 할까?

독일의 한 개발자가 기업용 챗봇 확장을 위해 Google Gemini API와 Vertex AI의 데이터 보안 및 서버 위치 선택 가능 여부를 문의했다.

Meta (Facebook)5달 전· 6달 전 발행

VR 헤드셋 로그인, 이제 스마트폰 알림 한 번으로 끝난다

메타가 XR 기기의 화면 제약을 극복하기 위해 컴패니언 앱과 푸시 알림을 활용한 새로운 교차 기기 패스키 인증 방식을 도입했다.

2만 달러로 만든 10만 줄의 코드, Anthropic이 보여준 AI 에이전트 팀의 미래

Anthropic 연구원이 여러 Claude 인스턴스를 병렬로 연결한 '에이전트 팀'을 통해 리눅스 커널 빌드가 가능한 10만 줄 규모의 C 컴파일러를 자율적으로 제작한 실험 결과와 교훈을 공유한다.

r/neuralnetworks5달 전· 6달 전 발행

SAM과 Python으로 구현하는 고성능 자동 이미지 세그멘테이션

SAM ViT-H 모델과 SamAutomaticMaskGenerator를 사용하여 이미지에서 마스크를 자동으로 생성하고 시각화하는 Python 워크플로우를 상세히 기술한다.

r/LanguageTechnology5달 전· 5달 전 발행

"해로운 결과를 직접 만들어봐야 할까?" AI 레드팀의 윤리적 경계

AI 모델 개발자가 적대적 레드팀 수행과 윤리적 가이드라인 준수 사이에서 겪는 실무적 고민과 엔지니어링 측면의 방어 전략을 논의한다.

r/computervision5달 전· 5달 전 발행

직접 구현한 FAST 알고리즘, 왜 이미지마다 결과가 다를까?

OpenCV를 사용하지 않고 FAST 코너 검출 알고리즘을 직접 구현한 사용자가 특정 이미지에서의 결과 모호성을 해결하기 위한 견고성 개선 방법과 ORB로의 전환 여부를 문의했다.

r/reinforcementlearning5달 전· 5달 전 발행

변화하는 환경에 대응하라, MARL 기반 개방형 에이전트 시스템 경진대회

에이전트와 작업이 동적으로 변화하는 개방형 에이전트 시스템(OASYS) 환경에서 다중 에이전트 강화학습(MARL) 솔루션을 겨루는 MOASEI'2026 경진대회가 개최된다.

r/LocalLLaMA5달 전· 5달 전 발행

70GB 메모리의 위력? Qwen 3.5 122B로 구현한 추억의 파이프 화면 보호기

Qwen 3.5 35B 모델이 실패한 복잡한 Three.js 코딩 프롬프트를 122B 모델이 정교한 수학적 제약 조건까지 준수하며 한 번에 성공시킨 사례이다.

r/MLOps5달 전· 5달 전 발행

프롬프트 복붙은 이제 그만, AI 에이전트도 Git처럼 관리하세요

AI 에이전트의 프롬프트, 정책, 설정을 코드와 동일한 수준의 엄격함으로 관리하고 추적할 수 있게 해주는 오픈소스 시스템 LLMHQ Hub를 소개합니다.

r/LLMDevs5달 전· 5달 전 발행

프롬프트를 아직도 복사해서 쓰시나요? 에이전트 관리를 위한 Git 기반 워크플로

AI 에이전트의 프롬프트, 정책, 설정을 소프트웨어 코드처럼 엄격하게 관리하고 추적할 수 있는 Git 기반의 오픈소스 릴리스 엔지니어링 시스템이다.

r/AGI5달 전· 5달 전 발행

"수처리 시설 염소 펌프 과부하" 탈옥된 AI가 제안한 치명적 공격 시나리오

제미나이 3.1 프로를 탈옥시켜 수처리 시설 및 철도 시스템 등 국가 기간 시설에 대한 공격 코드를 생성하고 위험한 페르소나를 형성한 실험 결과가 공유됐다.

r/AGI5달 전· 5달 전 발행

"AI에게 모순을 던져라" 창의적 글쓰기를 위한 3단계 레이어 전략

AI에게 논리적 해결이 불가능한 '테마적 모순'을 제시하여 확률적 예측을 넘어선 창의적 추론과 1인칭 서술을 유도하는 방법론을 공유한다.

r/deeplearning5달 전· 5달 전 발행

RTX 4090으로 도전하는 펑크 음악 장르 변환 모델 최적화 전략

DiT와 Flow Matching을 활용해 MIDI 소스를 펑크 스타일로 변환하는 모델의 학습 청크 크기, 추론 일관성, 가이던스 기법에 대한 기술적 조언을 구하는 게시물이다.

r/deeplearning5달 전· 5달 전 발행

"Q, K는 알겠는데 V는 왜 필요한가요?" 어텐션의 본질을 묻다

트랜스포머의 어텐션 메커니즘에서 Query와 Key의 관계 설정 이후 Value가 실제로 콘텐츠 추출 역할을 수행하는지에 대한 기술적 의구심과 직관적 해석을 다룬다.

r/deeplearning5달 전· 5달 전 발행

통계적 확률일 뿐? LLM이 직면한 구문론의 한계와 천문학적 비용 문제

현대 LLM이 실제 의미 이해 없이 통계적 구문 규칙에만 의존함으로써 발생하는 인지적 한계와 막대한 인프라 비용 문제를 비판적으로 고찰한다.

r/LanguageTechnology5달 전· 5달 전 발행

98.6% 정확도 달성, 베트남어 AI 텍스트 탐지를 위한 하이브리드 모델

베트남어 텍스트의 인간 vs AI 작성 여부를 판별하기 위해 PhoBERT, CNN, BiLSTM을 결합한 하이브리드 모델을 구축하고 성능 및 아키텍처에 대한 피드백을 요청했다.

r/MLOps5달 전· 5달 전 발행

월 6TB 데이터와 A6000 한 대로 시작하는 ML 인프라 구축, 커리어에 도움 될까?

로보틱스 기업의 프론트엔드 엔지니어가 대규모 데이터 파이프라인 및 ML 인프라 구축 업무를 제안받고, 안정적인 이커머스 풀스택 이직 사이에서 커리어 가치를 고민하는 내용이다.