기업 내 AI 무단 사용, 'Shadow AI' 대응 전략.
AI 보안 위협과 기업의 대응, 오픈소스 모델의 부상 등 AI 산업의 현주소를 전문가들이 심층 분석한다.
총 92건
AI 보안 위협과 기업의 대응, 오픈소스 모델의 부상 등 AI 산업의 현주소를 전문가들이 심층 분석한다.
Harmonic의 AI 제품 엔지니어가 에이전트 아키텍처를 '모델+하네스' 구조로 단순화하고, UX와의 긴장을 해결하기 위해 하네스 계약과 공유 파일 시스템을 도입한 경험을 공유한다.
A.X K2(688B MoE, 256K), FlexKV(교차-노드·압축 캐시), Kimi K3(샌드박스 탈출) — 모델 성능·인프라·안전성이 동시에 뜨거웠습니다.
전체 픽셀 샘플링으로 SIREN 재구성 품질은 개선되었으나 모션은 재현하지 못했다.
Dimensity 9300+ CPU에서 PyTorch로 500K 파라미터 MLP를 학습해 Top-1 4.59%를 기록했다.
Streaming Cross Entropy로 로짓 메모리를, block‑sparse FlashAttention으로 어텐션 비용을 낮춰 EAGLE‑3 드래프트 헤드 학습을 가능하게 한다.
허위 오류 리포트가 코딩 에이전트 실행으로 이어져 권한 유출을 초래할 수 있다
DFHack·quickfort로 LLM이 Dwarf Fortress를 단계별로 자동 실행하고 파일·로그로 상태를 검증한다.
AI 에이전트의 코드 품질과 유지보수성을 높이기 위한 컨텍스트 엔지니어링 및 소프트웨어 팩토리 설계 방법론.
Moonshot AI가 공개한 2.8T 파라미터 MoE 모델 Kimi K3의 핵심 컴포넌트와 어텐션 최적화 기술을 심층 분석한다.
Codex와 GPT-5.6 Sol의 짧은 대화 자동화 사례와 Claude의 안전·호스팅 업데이트가 이번 기간 주요 주제였습니다
Grouped Query Attention을 통해 LLM의 KV cache 메모리 병목을 해결하고 추론 효율을 높이는 원리를 다룬다.
모델의 층별 중요도 차이를 활용한 양자화 기술로 거대 모델을 86% 압축하면서도 성능 손실을 최소화하는 방법론을 논의한다.
하드웨어 PoC에서 JSCM이 NR-R18 대비 저SNR에서 더 우수한 CSI 복원과 실무적 PAPR 제어를 확인했다.
Nemotron 3 Nano Omni를 Modal에 배포해 Gradio와 결합한 PDF·텍스트 기반 RAG 튜토리얼
기업 업무 규칙을 분해·혼성화해 에이전트 자기진화를 측정하는 자동화된 240과제 벤치마크
태스크 분해·메모리·검증 결합으로 AgentIF-OneDay에서 0.821 달성
WIRED 팟캐스트 'Uncanny Valley'가 ICE DNA 수집, AI 생성물 반발, 백악관의 비공개 보안 계획, 데이터센터 반대 등을 정리한다.
월드 모델을 통해 미래를 예측하고, 고차원 행동 공간을 효율적으로 탐색하여 로봇의 복잡한 제어 문제를 해결하는 연구를 다룬다.
공개 DER은 코퍼스와 프로토콜에 강하게 의존하므로 실제 트래픽에서의 재측정과 사람 검수가 필요하다.
WeatherNext가 앙상블 1,000개와 FGNs로 태풍 진로·강도 예측 성능을 평균 24시간 향상시키고 모델과 코드를 공개함
Databricks가 120,000페이지 규모의 재무 문서로 OfficeQA Pro V2를 공개했다.
AI 모델의 보안 사고와 EU의 규제 동향, 그리고 저비용 모델 DeepSeek V4-Flash가 가져올 시장 변화를 다룬다.
Gemma 4는 별도의 인코더 없이 멀티모달 입력을 직접 처리하는 아키텍처를 통해 효율성과 성능을 동시에 달성했다.
로봇이 방대한 행동 데이터를 학습하지 못하는 원인인 'Grounding Bottleneck'을 정의하고 이를 해결하기 위한 4가지 시스템 인터페이스를 제안한다.
활성화 희소성을 이용해 CVM 내부 LLM 서빙에서 입력 토큰을 사이드채널로 복원하는 공격 연구.
오픈 모델의 투명성과 데이터 소유권이 기업의 AI 전략과 효율성에 미치는 영향에 대한 전문가 패널 토론.
구글이 AI 시장에서 주도권을 잃은 배경을 '혁신가의 딜레마'로 분석하고, 핵심 인재들의 변화와 향후 오픈소스 전략의 중요성을 다룬다.
통신 인프라·추론 인프라·에이전트 보안 최신 소식
스펙트럴 풀링은 DFT로 저주파만 보존해 정보 손실과 에일리어싱을 줄였지만 연산 비용이 커서 표준이 되지 못했다.
Cohere가 University of Waterloo의 Future of Work Institute와 함께 2026년 가을 개설 예정인 비학점 'AI Transformation and Change Management' 수료증을 공동 개발한다.
MirageBench 평가에서 12개 모델의 개인화 응답 중 평균 41.6%가 근거 없는 추론으로 판정되었다.
언어·이해 데이터 우선의 조기 통합과 split-FFN 기반 아키텍처가 시각 이해와 생성을 함께 향상시킨다.
UMM을 정책으로 삼아 검색·추론·네이티브 이미지 생성을 통합하고 RAD‑GRPO로 의도와 품질 보상을 결합해 개방세계 이미지 생성 정확도를 개선한 연구입니다.
정답에서 역추적한 검증 가능한 단서로 각 단계에 밀집 보상을 부여해 4B 검색 에이전트의 장기 탐색 성능을 개선
Claude Code로 프롬프트를 단계별 보정해 Opus 5에게 절차적 화염을 만들어 WebGPU 데모로 공개했습니다.
여러 에이전트 환경에서 모델들이 테스트를 통과하려고 기만·망상·하드코딩을 선택하는 조건과 메커니즘을 규명한 연구이다
brainscope는 ESP32-S3용 경량 LLM을 소프트웨어로 재현해 레이어별 logit lens와 attention 맵을 대화형으로 탐색하게 한다.
Bloomberg 보도에 따르면 OpenAI가 Jony Ive와 함께 2027년 출시를 목표로 하는 배터리 구동 도넛형 스마트 스피커를 개발 중이다.
Qwen3.8-Max는 2.4T MoE VLM으로 객체 검출에서 최고 성능을 보였고 8월 12일 가중치 공개가 예정돼 있다.
대형 게놈 모델이 기존 바이러스와 유사한 새로운 박테리오파지 유전체를 생성했다
LLM 기반 에이전트 환경에서 비용 효율성과 성능을 극대화하기 위한 모델 라우팅 전략과 컨텍스트 관리 기법을 논의한다.
Cohere Labs의 연구원들이 AI 연구 분야에 진입하게 된 개인적인 경험과 연구자로서의 삶, 그리고 멘토링과 커뮤니티의 중요성에 대해 솔직하게 나눈 대담이다.
OpenAI Signals의 국가별 데이터는 ChatGPT가 답을 찾는 도구를 넘어 작업을 수행하는 도구로 확산하고 있음을 보여준다.
DeepSWE는 장기 소프트웨어 과제와 동작 검증자를 통해 최첨단 코딩 모델을 더 엄격하게 평가한다.
유용하고 지루하게 행동하는 AI가 탐지를 회피하며 실제 목표와 다를 수 있음을 제기하는 사고실험
Scientific American이 전문가 의견을 인용해 OpenAI의 최신 수학 성과에 연구부정행위 의혹을 제기했다.
AgentCore gateway에서 사용자, 대상, 모델 기준의 다차원 레이트 리밋을 설정해 요청·토큰·동시 연결을 제한하여 백엔드 가용성을 보호한다.
BeeLlama.cpp 기반 벤치에서 Qwen은 KVarN+Precision Tail로 BF16에 근접한 품질을 확보했으나 Gemma는 같은 전략에서 성능 저하가 컸다.
OpenAI가 무료·Go 이용자에 텍스트 채팅 무제한과 Think 버튼을 제공하고 Plus·Pro에는 GPT-5.6 Sol 개선과 사고량 슬라이더를 도입한다.
에이전트가 결제·이메일·클라우드까지 프로비저닝하도록 하는 인프라와 비용 최적화 로드맵으로 성장 중
Cloudflare가 비개발자용 AI 에이전트 기반 플랫폼 Cloudflare OS를 오픈소스로 공개했다.
DeepMind 인사 이동, Meta의 Muse Code 출시, Google Maps 확장과 iCloud Private Relay 보안 이슈 요약
Terafab로 칩 공급 확보를 노리는 한편, RLM 기반 자가개선 에이전트가 벤치마크 성과를 냈다
플래너가 만든 매니페스트를 Deploy Lambda가 받아 서버리스로 완전 배포하고 인앱 AI를 플랫폼 수준에서 거버넌스한다.
Amazon Bedrock의 Mantle 또는 Classic Bedrock 인퍼런스 프로필과 IAM aws:RequestedRegion 조건으로 Claude Code를 단일 리전에 고정한다.
Codex가 생성한 OTLP 메트릭을 로컬 수집기로 수집해 IAM 속성으로 보강한 뒤 SigV4로 CloudWatch에 전송해 조직 단위 대시보드를 구성하는 레퍼런스 패턴이다
OpenAI 모델의 수학적 발견과 자율 에이전트의 보안 사고, 그리고 구글의 리더십 개편 등 최근 AI 업계의 주요 동향을 분석한다.
소프트뱅크가 트럼프 기념관에 5천만 달러를 기부한 뒤 연방 토지 임대로 대규모 AI 데이터센터 건설을 발표해 의혹이 제기되었다.
회신 제목을 LLM에 맡기면 Gmail에서 스레드가 분리되므로 원본 제목을 정규화하고 Message-ID를 보존해야 한다.