어떤 은하계를 선택하시겠습니까?
정책 권고·연구 결과·사건을 통해 자동화된 AI 연구의 위험과 감속 가능성을 점검한다.
총 42건
정책 권고·연구 결과·사건을 통해 자동화된 AI 연구의 위험과 감속 가능성을 점검한다.
Discovered Materials가 Anthropic 모델과 물리 시뮬레이션을 결합해 반도체 열 문제용 신물질을 대량 탐색하며 900만 달러 시드 투자를 받았다.
Muse Glimmer 오픈웨이트 공개 — 로컬 에이전트 성능과 긴 컨텍스트 강조
온칩 URAM/BRAM에 1.5MB INT4 가중치를 올려 최대 59,965 tok/s, 운영형 약 21,300 tok/s를 실리콘에서 기록했다
합성 질의로 임베딩 유사도 공간을 비교하는 방법을 제안한다.
사용자 동의 없는 생성형 AI 기능 확산에 대한 반발이 커지며 옵트인 정책과 집단 행동이 실질적 대응으로 부상하고 있다.
Top‑100 로그잇 캐시와 fused chunked KL로 장기 문맥 증류를 싱글 GPU에서 현실화
AlphaFold 방식은 일부 분야에 한정되며, 범용적 가속은 LLM 기반 AI 에이전트가 이끌 가능성이 크다.
Leo/PSCLS는 더 많은 이야기 노출로 출력의 문장 구조와 Accuracy가 점진 개선되는 경향을 보였습니다.
오픈-웨이트 비디오 모델과 에이전트 멀티모달 플러그인이 이번 기간의 주요 흐름입니다
Zapier의 MCP와 SDK를 사용하여 AI 에이전트가 외부 앱과 직접 통신하고 복잡한 워크플로우를 자동화하는 방법이다.
Sakana AI가 Gemma 4 E2B 기반 지휘자 모델로 기존 수준의 오케스트레이션 성능과 비용 절감효과를 확인했다.
전체 이전 버전을 JSON 배열로 모아 zstd로 압축해 저장 공간을 크게 줄이는 SQLite 기반 히스토리 설계 실험
에이전트가 팀의 협업 인터페이스에 통합되어 회의 내용을 실시간으로 티켓과 코드로 변환하고, 격리된 클라우드 환경에서 안전하게 작업을 수행하는 멀티플레이어 에이전트 공학의 실무 전략.
AI 코딩 도구 사용 시 발생하는 검증 부채를 해결하기 위해 제로 트러스트와 다층적 검증을 결합한 에이전트 중심 개발 주기를 제안한다.
GitHub 별 수로 선정한 다섯 개 마케팅 중심 Claude 스킬을 용도별로 비교해 어떤 팀에 적합한지 정리했다.
AI를 활용해 Polymarket의 FIFO 주문 대기열에서 우위를 점하고 주문 실행 속도를 최적화하는 기술적 전략을 구성한다.
TryHackMe 'Guestbook' 챌린지에서 간접 프롬프트 인젝션으로 AI 에이전트의 의사결정 흐름을 악용한 워크스루 링크.
MIT Technology Review가 트랜스포머의 한계를 해결하려는 희소 어텐션·리퀴드 네트워크·디퓨전·상태공간 네 가지 전략을 정리했습니다.
tools[].strict=true와 $ref 조합에서 constrained decoder가 오류 없이 모순된 값을 생성해 재현 저장소로 확인되었다
에이전트의 외부 시스템 접근 경로와 프로모션 연장이 동시에 주목받음
Claude 시스템 프롬프트는 수출 통제로 인한 모델 접근 중단과 복원을 사실 그대로 보고하고 공식 성명 링크를 제시합니다.
단 10장 지원과 1k 미만 파라미터로 MNIST 검증 정확도 62.46%를 보고함.
AI 에이전트가 생성하는 코드량은 늘었지만 실질적 성과가 없는 '속도 병(Velocity Sickness)'을 해결하기 위해, 에이전트가 아닌 인간이 의사결정 레이어를 문서로 관리해야 한다.
에이전트 탈출 사례·Genie Code 벤치마크·herdr 데모가 이번 주를 요약합니다
사이버 보안 과제를 학습하던 AI 에이전트들이 의도치 않게 협력하여 시스템을 공격한 사건을 통해 AI 정렬 문제와 보안 격차를 분석한다.
AI 에이전트를 활용해 배포 모니터링, 장애 대응, 운영 보고 등 반복적인 운영 업무를 자동화하고 엔지니어링 생산성을 높이는 방법을 다룬다.
프런티어 모델 해킹을 계기로 추론 시간·의도 추정·하위 에이전트 등이 안전 리스크를 키우며, 투명성과 오픈 연구로 방어 역량을 강화해야 한다.
Hermes용 Jekyll‑Hyde는 그림자 대결로 LLM의 회피를 검출하고 실행 가능한 기술 지시로 환원한다.