단년 내 에이전트 빌드 비용과 진입장벽이 낮아지는 중
코딩 에이전트로 소수 인력·단기간 개발 가능, 동시에 샌드박스·벤치마크 공백이 문제로 떠올랐습니다.
총 43건
코딩 에이전트로 소수 인력·단기간 개발 가능, 동시에 샌드박스·벤치마크 공백이 문제로 떠올랐습니다.
LLM(Gemini)을 전단으로 사용해 자유형 소스(main.ai)를 Java 바이트코드로 컴파일하는 Gradle 플러그인.
벤치마크의 동일한 'answer' 필드 때문에 verifier 실험 결과가 왜곡되어 데이터를 고쳐 재실행하자 결론이 바뀌었다
Atlas의 auto-embedding부터 Composer 3 유출까지, 실무 적용·연구 방향을 한눈에
Evo 1·Evo 2로 ΦX174 템플릿을 바탕으로 전체 유전체를 생성해 실험적으로 16개의 생존 파지를 얻음
DeepOnto 라이브러리를 사용하여 온톨로지를 다루고 BERTMap으로 온톨로지 정렬을 수행하는 실습 튜토리얼이다.
LLM의 temperature 파라미터가 로짓과 소프트맥스 연산에 개입하여 모델의 생성 다양성을 조절하는 원리를 설명한다.
config.json·토크나이저·임베딩 CKA를 조합해 공개 모델이 'from-scratch'인지 파생인지 가늠하는 재현 가능한 파이프라인이다.
지원 티켓을 통한 간접 인젝션 실험에서 모델별 반응이 크게 달라 실행 권한은 시스템 수준에서 제어해야 한다.
SMT 합성과 형식 증명으로 32비트 레지스터에서 INT4 도트곱을 안전하게 계산하는 SWAR 구현을 자동 생성함
복잡한 AI 파이프라인을 모노레포로 리팩토링하여 배포 속도를 수개월에서 1주일로 단축하고 개발 생산성을 극대화한 사례를 다룬다.
OpenAI가 Astra의 사이버 위험을 이유로 개발을 늦추고 Cloudflare는 AI 에이전트용 브라우저 Kitesurf를 공개했다.
인증된 카탈로그·메트릭을 추출해 LLM 제약 생성과 PR 기반 승인, CI/CD로 배포하는 시맨틱 뷰 거버넌스 파이프라인의 실무적 구현이다
원문과 변형 문제의 교차검증으로 LLM 코드 환각을 가려내는 방법
문서의 구조를 파괴하는 기존 RAG의 청킹 방식 대신, Docling으로 구조를 보존하고 에이전트가 트리를 탐색하여 정확도를 높이는 Chunkless RAG 기법.
Muse Code가 Codex와 Claude의 명령을 기본적으로 Meta로 전송한다고 보도된 기사 링크입니다.
브라우저에서 바로 쓰는 무료 화이트보드로 손그림 풍 효과와 이미지 붙여넣기, PNG/PDF 내보내기를 지원합니다.
이미지 편집 편의성, 문서 파싱 비용·정확도 이슈, Teknium의 토큰 절감 발표
GitHub Next의 Idan Gazit이 에이전트 워크플로우를 통한 자동화와 실시간 협업 개발 도구인 Ace를 소개한다.
macOS에서 llama.cpp와 llama-server를 대상으로 GGUF 모델 관리와 안전한 다운로드를 제공하는 GUI.
초기 등록을 가볍게 해 처리 속도를 4.7배로 올리고 RGB 전용에서 공개 비교 기준 상위 결과를 제시함
비행 중 작업 환경 개선, 이미지 편집 기능 확장, 모델 허용성 갈등, 에이전트 모바일 약속이 겹침
NextSlide 팀이 OpenAI에 합류해 ChatGPT 내 프레젠테이션 자동화 기능 개발에 참여한다.
이미지 편집 UX 개선과 에이전트 운영 도구 확장이 실무 채택 신호를 보냅니다
실행 기록과 AST 기반 정적 맵으로 파이썬 프로젝트를 브라우저에서 단계별로 재생하는 무설치 도구
Claude Certified Architect 시험을 통해 에이전트 시스템의 안티 패턴을 식별하고, stop_reason 분기, 전문화된 서브 에이전트, 컨텍스트 압축 등 실무적인 설계 패턴을 학습한다.