관련 기사 바로가기
사고 흐름 위조(chain-of-thought forgery)가 LLM 안전성을 근본적으로 약화시킨다고 연구진이 주장했다. 이 공격은 입력에 위조된 내부 메모를심GPT‑Red: 자기 개선을 통한 모델 견고성 강화IBM 시큐리티 인텔리전스: AI 레드팀 도구와 사이버 보안의 미래AI 산업의 격전: Inkling 모델부터 AWS의 10억 달러 투자까지Ben’s Bites: Thinking Machines의 Inkling 공개와 GLM-5.2 비전 확장, GPT-Red로 훈련된 GPT-5.6 Sol 등 최신 모델·안전·툴 소식OpenAI가 GPT-Red 자기대전으로 GPT-5.6의 프롬프트 인젝션 방어를 강화했다