오픈소스 프록시로 확장된 LLM 토큰 재판매자 생태계 탐구
여러 출처의 API 키를 풀링해 할인 토큰을 재판매하는 시장이 오픈소스 프록시와 결제 남용을 통해 확장되고 있어 엄격한 키 한도 제도가 필요하다.
LLM 실무 활용과 에이전트 시스템 구축에 대한 독보적인 개발자 관점의 통찰력과 직접 제작한 오픈소스 도구 공유
여러 출처의 API 키를 풀링해 할인 토큰을 재판매하는 시장이 오픈소스 프록시와 결제 남용을 통해 확장되고 있어 엄격한 키 한도 제도가 필요하다.
OpenAI의 벤치마크 운영 중 샌드박스가 침해되어 Hugging Face의 광범위한 공격 표면이 드러났고, 대규모 동시 테스트와 무제한 토큰 예산이 탐지 실패의 원인으로 지목되었다.
Dylan Castillo는 48개 프롬프트를 7개 모델에 대해 세 번씩 실행해 평가한 결과, 특정 연구소가 펠리컨-자전거 조합을 의도적으로 과적합한 증거를 찾지 못했다고 보고했다.
Nativ은 MLX를 포장해 macOS 데스크톱 앱으로 제공하며 채팅 인터페이스와 localhost API를 통해 Hugging Face 캐시에 있는 MLX 모델을 바로 실행할 수 있다.
Ben Thompson은 미국이 학습용 데이터 수집을 공정 이용으로 규정하고 서비스 약관으로 distillation을 금지하는 조항을 금지해야 한다고 권고했으며 Xi의 개방 권장 연설 이후 Alibaba가 Qwen 3.8 Max의 공개 가중치를 배포했다는 정황을 전했다.
실행 파일 내부 문자열과 경로를 추출한 결과 Claude Code 바이너리에서 'Bun v1.4.0' 표기와 563개의 .rs 경로가 확인되어 Rust 포트의 Bun이 포함된 것으로 보인다.
Moonshot AI가 2.8조 파라미터 규모의 Kimi K3을 발표하고 성능 지표와 토큰 기반 요금, 2026년 7월 27일까지 오픈 가중치 공개 일정을 제시했다.
GPT-5.6이 전체 권한 모드에서 Codex를 샌드박스 없이 실행할 때 $HOME을 임시 디렉터리로 덮어쓰려다 실수로 홈 디렉터리를 삭제하는 사례가 보고되었다.
xAI가 Grok Build를 Apache 2.0으로 공개하고 데이터 업로드 기능을 비활성화하며 보존을 해제하고 삭제를 약속했다.
web_fetch가 자체적으로 가져온 페이지 안의 링크를 따라가도록 허용하던 설계 결함을 악용해 사용자 메모리에서 이름·거주지·고용주를 추출했고 Anthropic은 해당 동작을 차단해 패치를 적용했다.
Simon Willison이 GPT-5.6 Sol xhigh와 gpt-image-2를 이용해 페리칸 자전거 스프라이트를 반복 생성하고 이를 합쳐 Codex Desktop용 'Pedalican' 펫을 만들었다.
OpenAI 도움말 문서에 따르면 웹과 모바일의 ChatGPT Work는 클라우드에서 실행되고 데스크톱 앱은 사용자의 허가로 로컬 파일과 연동되며 클라우드 대화는 데스크톱으로 자동 동기화되지 않는다.
OpenAI가 GPT-5.6을 Luna·Terra·Sol 세 가지로 일반 공개했고, Sol이 Agents’ Last Exam에서 53.6점을 기록하며 Claude Fable 5를 앞섰고 새 API는 도구 실행·다중 에이전트·프롬프트 캐시 제어 등 기능을 추가했다.
Muse Spark 1.1이 Spark 계열 최초로 API를 제공하며 agentic tool 호출과 컴퓨터 사용에서 개선을 목표로 공개되었다.
OpenAI의 GPT‑Live는 ChatGPT 음성 모드에서 복잡한 작업을 백그라운드의 GPT‑5.5로 위임하여 대화 흐름을 유지하도록 설계되었다.
최신 Anthropic 모델들이 Pi의 edit API에 존재하지 않는 필드를 생성해 툴 호출이 거부되는 호환성 문제가 보고됐다.
Current AI가 공개한 Open Source AI Gap Map v0.1은 421개 주요 제품을 분류하고 1,184개 YAML 파일과 노트북을 MIT 라이선스로 공개했다.
Simon Willison은 Claude Code의 Fable에게 코딩 작업을 낮은 전력 모델로 판단해 하위 에이전트에 위임하도록 설정해 토큰 사용을 절감하고 작업 효율을 높였다고 보고했다.
DSPy와 Claude Fable을 활용해 Datasette Agent의 SQL 시스템 프롬프트를 평가해 스키마 표시에 컬럼명을 포함하거나 describe_table 호출 권고를 완화하는 개선안을 도출했다.
Claude Sonnet 5는 Opus 4.8과 비슷한 성능을 유지하면서 1,000,000 토큰 컨텍스트와 128,000 토큰 출력 한도를 제공하지만 새로운 토크나이저로 입력당 약 30% 더 많은 토큰이 발생해 실질 비용이 상승한다.
shot-scraper 1.10에 shot-scraper video 명령이 추가되어 storyboard.yml로 정의한 웹 루틴을 Playwright로 실행해 인증 쿠키를 사용한 세션을 녹화하고 MP4로 출력할 수 있다.
Ornith-1.0은 DeepReinforce가 공개한 MIT 라이선스 기반의 코딩 특화 LLM으로 Gemma 4와 Qwen 3.5를 기반으로 9B·31B·35B MoE·397B MoE 변형을 제공하며 GGUF 20GB 파일로 로컬 실행이 가능하다.
Fernando는 OpenClaw 테스트 인스턴트에 이메일로 프롬프트 인젝션을 시도한 6,000건의 공격에도 비밀 유출이 발생하지 않았고 실험에 약 500달러의 토큰 비용이 소요되었음을 보고했다.
Moebius 0.2B를 ONNX로 내보내고 WebGPU 기반 ONNX Runtime Web에서 브라우저에서 직접 구동하도록 Claude Code로 포팅하는 실험을 정리한다.