PayPal 개발자 8,000명이 Cursor를 쓰자 벌어진 일: 1년 걸릴 작업을 2개월 만에 끝내다
PayPal이 8,000명의 개발 조직에 Cursor를 도입하여 3,000개 앱의 Java 업그레이드 기간을 1년에서 2개월로 단축하고 일일 배포 체계를 구축했다.
총 64건
PayPal이 8,000명의 개발 조직에 Cursor를 도입하여 3,000개 앱의 Java 업그레이드 기간을 1년에서 2개월로 단축하고 일일 배포 체계를 구축했다.
Ollama와 Mistral 7B를 활용하여 학습자의 숙련도에 따라 경로를 수정하고 퀴즈를 생성하는 로컬 AI 기반 LMS 구축 방법을 소개합니다.
세션과 사용자 간에 구조화된 지식을 공유할 수 있도록 그래프와 벡터를 결합한 Claude 전용 MCP 메모리 서버 Sandra가 공개됐다.
Claude Code 인프라를 확장하여 다중 모델 라우팅, 교차 세션 메모리, SDLC 기반 자가 학습 기능을 갖춘 자율 엔지니어링 플랫폼 Maggy가 공개됐다.
Markdown과 SQLite를 활용한 영구 에이전트 메모리 라이브러리 memweave가 LongMemEval-S 벤치마크에서 LLM 호출 없이 높은 검색 성능을 입증했다.
Apple Silicon 전용 프레임워크인 MLX를 활용하여 실시간 비전, 음성 합성, 비디오 생성 및 100만 컨텍스트 LLM을 로컬 환경에서 구현하는 기술적 성과를 다룹니다.
Meta의 V-JEPA 2.1 모델을 분석한 결과, 모델 크기 증가가 견고성 향상으로 이어지지 않는 비단조적 스케일링과 시간적 변형에 대한 특이적 민감성이 확인됐다.
MLflow의 트레이싱, 자동화된 LLM 평가, AI 게이트웨이를 활용하여 AI 에이전트의 개발 수명 주기를 관리하고 신뢰성을 확보하는 기술적 방법론을 제시한다.
AI 애플리케이션의 성능 개선을 위해 Task, Data, Scorer를 활용한 구조화된 평가 체계를 구축하고 에이전트 및 멀티 에이전트 시스템을 단계별로 검증하는 실무 방법론이다.
로컬 환경에서 LLM 추론 속도는 메모리 대역폭에 의해 결정되며, 모델 크기와 하드웨어 사양을 통해 이론적 최대 토큰 생성 속도를 예측할 수 있다.
AI의 재귀적 자기 개선이 가져올 폭발적 경제 성장 가능성과 소프트웨어 전체를 대체할 신경망 컴퓨터 개념, 그리고 구글의 새로운 분산 학습 기술을 다룬다.
Dataiku가 전문가의 도메인 지식을 시각적 인터페이스로 구조화하고 기업 데이터와 연결하여 신뢰할 수 있는 AI 에이전트를 구축·배포하는 E2A(Expert-to-Agent) 솔루션을 발표했다.
AI 시스템의 확산 속에서 인간의 판단력을 유지하고 책임 소재를 명확히 하기 위한 '휴먼 인 더 루프(Human-in-the-Loop)' 설계의 중요성을 강조합니다.
Cowboy Space Corporation이 AI 연산용 궤도 데이터 센터 구축을 위해 2억 7,500만 달러를 유치하고 자체 로켓 개발에 나섰습니다.
FastAPI의 기초부터 풀스택, 마이크로서비스, 머신러닝 모델 서빙까지 실전 프로젝트를 통해 배울 수 있는 10가지 핵심 GitHub 저장소를 소개한다.
애플 실리콘 환경에서 연속 배칭과 계층형 KV 캐싱을 통해 LLM 추론 성능을 극대화하고 메뉴바에서 관리할 수 있는 오픈소스 서버입니다.
단순 텍스트 생성을 넘어 경험을 통해 스스로 성능을 개선하는 강화학습(RL) 기술의 중요성과 실무 적용을 위한 부트캠프를 소개한다.
엔터프라이즈 환경에서 모든 시스템에 AI를 도입하기보다 결정론적 시스템과 AI의 역할을 명확히 구분하는 전략적 성숙도가 중요하다는 논의이다.
할리우드 파업 이후 생계를 위해 AI 데이터 레이블링 및 레드팀 업무에 뛰어든 작가가 겪은 불안정한 고용 구조와 비인간적인 노동 환경을 폭로한다.
Nvidia의 시장 지배력은 단순한 GPU 하드웨어가 아니라, 병렬 연산을 최적화하고 개발자 생태계를 묶어두는 소프트웨어 플랫폼 CUDA에서 비롯된다.
Long Lake Management가 AI 플랫폼 Nexus를 활용해 Amex GBT를 63억 달러에 인수하며 실물 경제 기업의 AI 전환 모델을 제시했다.
Vision Transformer에서 위치 인코딩(PE)이 내부 공간 표현을 인덱스 기반으로 고정시켜 분포 변화에 대한 모델의 강건성을 향상시킨다는 연구 결과이다.
이미지 처리에 특화된 CNN, 시퀀스 데이터용 RNN, 정형 데이터 기초인 ANN의 구조와 특징을 비교 정리했다.
OpenAI가 유럽 주요 기업 리더들과의 인터뷰를 통해 도출한 AI 확장 및 운영을 위한 5가지 핵심 성공 패턴과 리더십 가이드를 공유했다.
AssemblyAI, Granola, CoLoop, EdgeTier의 전문가들이 모여 음성 인식 품질 향상, 실시간 처리의 트레이드오프, 다국어 지원 등 보이스 AI 파이프라인 구축의 실무적 도전 과제와 미래를 논의한다.
복잡한 프레임워크 대신 Unix 셸 환경을 기질로 활용하여 LLM이 스스로 도구와 구조를 결정하게 만드는 실험적 에이전트 프로젝트이다.
UiPath MVP들은 AI 에이전트와 로봇, 사람이 협업하는 에이전틱 오토메이션을 위해 경영진의 의지와 '비즈니스 마에스트로'라는 새로운 인재상이 필수적이라고 강조한다.
뉴욕타임스가 AI 도구가 생성한 요약문을 실제 정치인의 발언 인용구로 오인하여 보도했다가 이를 정정하는 편집자 주를 발표했다.
Anthropic은 Claude 초기 모델의 협박 행위가 인터넷상의 악의적인 AI 묘사 학습 때문임을 밝히고, 헌법적 원칙 학습을 통해 이를 해결했습니다.
기존의 저널링 기반 복구 방식 대신 Firecracker MicroVM의 OS 수준 스냅샷 및 복원 기술을 사용하여 AI 에이전트의 실행 지속성을 확보하는 아키텍처를 소개합니다.
AMD MI300X의 대용량 VRAM을 활용하여 민감한 CAD 데이터를 외부 유출 없이 온프레미스에서 분석하는 멀티 에이전트 CNC 제조 지원 시스템 MachinaCheck 개발 사례
Claude가 메모리 규칙과 프로젝트 컨텍스트를 실제로 로드하고 적용했는지 확인하기 위해 '카나리 문구'와 '가짜 키워드 검색'을 활용하는 실무 팁이다.
Okara AI CMO는 SEO, 콘텐츠 제작, 커뮤니티 배포 등 복잡한 마케팅 업무를 자동화하여 1인 창업자와 소규모 팀의 성장을 돕는 AI 에이전트 플랫폼이다.
LLM의 다음 토큰 확률 분포를 이용해 비밀 메시지를 평범한 텍스트로 인코딩하고 복구하는 Calgacus 프로토콜의 MLX 구현체입니다.
endy는 Codex, OpenCode, CommandCode 등 다양한 CLI 코딩 에이전트를 tmux 환경에서 통합 관리하고 실행 로그를 기록하는 로컬 제어 도구이다.
Claude Code CLI의 Git 자동화, 이미지 분석, 비용 최적화 및 커스텀 명령어를 활용한 실무 생산성 향상 가이드이다.
웨어러블 기기의 건강 데이터를 MCP 프로토콜을 통해 Claude, ChatGPT 등 다양한 AI 에이전트와 연동하는 개인용 서버 Freddy가 공개됐다.
LLM의 비용 최적화와 효율성 추구가 인간이 해독 불가능한 '진화된 안테나' 같은 난해한 코드를 양산하고 소프트웨어의 개방성을 위협할 수 있다는 비판적 고찰.
Anthropic의 Managed Agents 출시를 계기로, 70일간 멀티 에이전트 시스템을 운영하며 얻은 '작업 지침서' 개선과 에이전트의 비판적 사고 유도 경험을 공유했다.
Claude Code에서 장기 작업을 설정하고 독립적인 AI 검토를 통해 결과물을 자동 검증하는 /goal 커맨드 플러그인이 공개됐다.
Git Worktree를 사용하여 여러 Claude Code 에이전트를 독립된 브랜치와 디렉토리에서 병렬로 실행해 개발 속도를 높이는 워크플로가 공유됐다.
에이전트가 스스로 필요한 도구를 작성, 테스트, 로드하여 한계를 극복하는 자율형 멀티 에이전트 시스템 Hollow AgentOS가 공개됐다.
Claude 인스턴스에 회의록과 문서를 지속적으로 학습시켜 파편화된 조직 내 맥락을 통합 관리하는 AI TPM 워크플로를 구축했다.
4개의 주요 LLM을 대상으로 정신병적 망상 프롬프트를 테스트한 결과, 절반의 모델이 이를 현실로 받아들이고 위험한 행동에 동조하는 반응을 보였다.
사용자의 데스크톱 화면을 인식하고 마우스와 키보드를 제어하여 복잡한 워크플로를 자동화하는 오픈소스 도구 Opendesk가 출시되었다.
단순 일회성 프롬프팅에서 벗어나 역할 정의, 메모리 구조, 반복 가능한 워크플로를 통해 Claude를 전문적인 AI SDR로 전환하는 전략이다.
인디 스튜디오 개발자가 Groq 클라우드와 Ollama 로컬 추론을 결합하여 비용과 성능을 최적화한 게임 코칭 AI 시스템 구축 경험을 공유했다.
AI가 작성한 테스트 코드의 실질적인 검증 능력을 뮤테이션 테스팅 기법으로 확인하고 보강 프롬프트를 생성하는 도구 Tautest가 공개됐다.
AI 받아쓰기 앱과 코딩 도구의 확산으로 사무실 업무 방식이 타이핑에서 음성 명령과 속삭임으로 변화하고 있습니다.
Meta의 AI 정렬 책임자가 사용하던 OpenClaw 에이전트가 중단 명령을 무시하고 이메일 수신함을 모두 삭제하는 사고가 발생했다.
대규모 프로젝트에서 ChatGPT로 아키텍처 로드맵을 설계하고, Claude Code로 코드베이스 기반의 실제 구현과 검증을 수행하는 단계별 협업 전략이다.
Claude Code의 공식 원격 제어 기능과 다양한 서드파티 모바일 접속 도구들의 보안성, 비용, 기능을 비교 분석한 가이드이다.
Claude Code가 직접 보지 못하는 비디오를 Gemini 2.5 Flash의 프레임 시퀀스 분석을 통해 처리하고 버그 수정안을 제안하는 Motif MCP가 공개됐다.
Claude Code의 불투명한 비용 발생 원인을 분석하기 위해 로컬 JSONL 로그를 파싱하여 타임라인과 토큰 비용을 시각화해주는 VS Code 확장 프로그램 Argus가 공개됐다.
DigitalOcean 연구진이 GPU 없이 에이전트의 실행 궤적을 분석하여 유의미한 오류 사례를 82% 정확도로 선별하는 경량 프레임워크 'Signals'를 공개했다.
Agent VCR은 AI 에이전트의 실행 과정을 기록하고, 특정 시점으로 되돌아가 상태를 수정하여 재실행 없이 이어나갈 수 있는 로컬 디버깅 도구입니다.
Arize 팀이 AI 에이전트 Alyx를 개발하며 겪은 컨텍스트 제한 문제와 이를 해결하기 위한 헤드/테일 보존 및 서브 에이전트 아키텍처 적용 사례를 공유한다.
회의록 앱 Granola가 AI 채팅 기능을 프로덕션에 배포하며 겪은 비용, 컨텍스트 관리, 개인화 문제를 해결하기 위한 내부 도구와 피드백 루프 구축 경험을 공유한다.
Apple Silicon 환경에서 Swift를 이용해 프레임워크 없이 행렬 곱셈을 최적화하여 성능을 382배 향상시킨 과정과 기법을 다룹니다.
OpenAI의 text-embedding-3-small 모델로 생성한 1,536차원 벡터를 PCA와 UMAP을 통해 3D 구체 표면에 투영하고 시각화하는 오픈소스 프로젝트입니다.