TL;DR
오픈 모델 생태계가 확대되면서 서구 모델 제작자는 Apache 2.0 같은 개방형 라이선스로 이동하는 반면, 중국의 일부 선도 모델 제작자는 상업 서비스에 추가 계약이나 제한을 붙이는 흐름을 보입니다. Zhipu의 GLM-5.3은 이전 MIT 라이선스에서 맞춤형 라이선스로 바뀌었고, Model as a Service 사업자와 계열사의 12개월 매출 합계가 100억 달러를 넘으면 상업적 이용 전에 Z.AI 보안 심사를 요구합니다. 글은 계열사의 정의가 불명확하고 영문·중문 조항의 해석 차이도 있어 채택 장벽이 생길 수 있다고 짚습니다. 모델 추천 목록에서는 MIT 라이선스의 Motif-3, IMO 2026 만점 기록을 가진 dots3, 새로운 구조를 적용한 Qwen3.8-Flash, 잠재력이 있으나 과도한 사고 문제가 있는 Hy4-preview 등이 주목받습니다.
섹션별 상세
용어 해설
- 오픈 모델 라이선스(Open Model License)
- — 오픈 모델 라이선스는 모델 가중치와 파생물을 사용·수정·배포할 수 있는 조건을 정한 법적 문서입니다. MIT나 Apache 2.0처럼 폭넓은 상업 이용을 허용하는 유형과, 특정 매출 기준·서비스 형태·금지 용도에 따라 추가 계약이나 보안 심사를 요구하는 맞춤형 라이선스로 나뉩니다.
- 모델 서비스형 사업(Model as a Service)
- — Model as a Service는 사업자가 모델을 직접 제공하는 대신 추론이나 Fine-tuning 기능을 외부 이용자에게 서비스 형태로 제공하는 방식입니다. GLM-5.3 라이선스에서는 이 사업을 운영하는 주체와 계열사의 매출 합계가 특정 기준을 넘으면 상업적 이용 전에 Z.AI의 보안 심사를 받도록 규정합니다.
- GDN
- — GDN은 Qwen3.8-Flash의 아키텍처에 포함된 구성 요소로, Qwen Sparse Attention 및 51B n-gram embeddings와 함께 대규모 모델의 구조적 변화를 이루는 요소로 제시됩니다. 원문은 GDN의 내부 계산 방식이나 구현 세부 수치를 별도로 밝히지 않습니다.
- Qwen Sparse Attention
- — Qwen Sparse Attention은 Qwen3.8-Flash에 사용된 어텐션 구조입니다. 원문은 125B-A6B 모델 구성과 GDN, 51B n-gram embeddings를 함께 제시하면서 다음 Qwen 세대에서 유사한 구조가 널리 채택될 가능성을 연결합니다.
- 벤치맥싱(Benchmaxxing)
- — Benchmaxxing은 모델이 실제 활용성보다 벤치마크 점수 최적화에 치우쳤다는 비판을 가리키는 표현입니다. GLM-5.3-Flash는 먼저 정체를 알 수 없는 무료 모델로 공개되어 관심과 추측을 키웠고, 상대적으로 높은 성능을 통해 오픈 모델 출시 때 반복되는 이 비판을 누그러뜨렸다고 평가됩니다.
기술
- MIT license
- Apache 2.0
- Model as a Service
- GDN
- Qwen Sparse Attention
- n-gram embeddings
- OpenRouter
- OpenCode
활용 사례
- LLM 추론 서비스 운영
- LLM Fine-tuning 서비스 제공
- 오픈 모델의 상업적 도입
- 모델 라이선스와 계열사 조건 검토
- 대형 언어 모델 아키텍처 비교
언급된 리소스
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.