TL;DR
이 이미지는 NIOS English Solved Question Paper용 HTML 파일 생성 과제에서 Gemini와 Claude의 결과물을 7개 AI가 평가한 점수를 비교합니다. Gemini는 OpenAI, DeepSeek, Grok, Gemini, Meta AI의 평가에서 앞섰고, Claude는 Kimi AI와 자체 평가에서 우세했습니다. 승패는 Gemini 5회, Claude 2회였으며 평균 점수는 Gemini 86.3점, Claude 78.6점으로 집계됐습니다. Gemini의 전체 평균 우위는 7.7점이지만, 특정 HTML 생성 과제에 한정된 결과입니다.
섹션별 상세
이미지 분석

표에는 OpenAI, Moonshot AI의 Kimi AI, DeepSeek, xAI의 Grok, Claude, Gemini, Meta AI가 부여한 Gemini와 Claude의 점수 및 승리 격차가 담겨 있습니다. Gemini는 7개 평가 중 5회 승리하고 평균 86.3점을 기록해 Claude의 평균 78.6점보다 7.7점 높았지만, 비교 과제는 특정 HTML 파일 생성으로 한정돼 있습니다.
Gemini와 Claude가 NIOS English Solved Question Paper용 HTML 파일을 생성한 결과를 7개 AI 평가자의 점수로 비교한 표입니다.

상단 표는 평가자별 점수를 보여주며, DeepSeek는 Gemini에 100점과 Claude에 68점을 줬고 Kimi AI는 Claude에 91점과 Gemini에 79점을 부여했습니다. 하단 집계에서는 Gemini가 5회 승리, Claude가 2회 승리했으며 평균 점수는 각각 86.3점과 78.6점으로 표시됩니다.
Gemini와 Claude의 AI 평가 결과, 승패 횟수, 전체 평균 점수를 요약한 비교 인포그래픽입니다.
용어 해설
- HTML
- — 웹 브라우저가 읽는 문서 구조를 정의하는 마크업 언어입니다. 이 비교에서는 각 모델이 NIOS English Solved Question Paper용 HTML 파일을 생성하고, 그 결과물을 AI 평가자가 점수화하는 기준으로 사용됐습니다.
- AI 평가(AI Evaluation)
- — AI 시스템의 출력물을 일정한 과제와 점수 기준에 따라 비교하는 절차입니다. 이미지에서는 OpenAI, Kimi AI, DeepSeek, Grok, Claude, Gemini, Meta AI가 Gemini와 Claude가 만든 HTML 파일을 각각 평가한 결과를 집계했습니다.
- 평균 점수(Average Score)
- — 여러 평가 결과를 하나의 대표 수치로 묶은 값입니다. 이미지의 평균은 7개 평가에서 Gemini가 86.3점, Claude가 78.6점을 기록해 두 모델 사이의 전체 성과 차이를 비교하는 데 쓰였습니다.
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
