용어 해설
- 수학적 추론(Mathematical Reasoning)
- — 수학적 추론은 수학 문제를 읽고 문제의 조건을 기호·식·단계로 변환한 뒤 연역적·계산적 절차를 통해 정답을 도출하는 능력으로, LLM의 출력이 단순 통사적 정답이 아니라 연속적 계산·논증 과정을 포함하는지 평가하는 데 중요하다.
- 다국어 벤치마크(Multilingual Benchmark)
- — 다국어 벤치마크는 동일한 평가 과제를 여러 언어로 제공하여 모델의 언어 간 성능 차이를 측정하는 데이터셋·평가 체계로, 번역 품질·문화적 표현 차이·저자원 언어의 자원 부족이 결과에 미치는 영향을 분리해서 해석하는 데 사용된다.
- 지침(명령) 준수 능력(Instruction-Following)
- — Instruction-Following은 모델이 주어진 지시문(prompt) 구조와 목적을 정확히 해석하고 출력 형식과 요구사항을 충족하도록 반응하는 능력으로, 수학 문제에서 정답뿐 아니라 풀이 형식·중간 산출물을 요구할 때 성능에 결정적 영향을 미친다.
- 사람 검수 기반 검증(Human-Curated Validation)
- — 사람 검수 기반 검증은 자동 번역이나 기계 생성 초안을 네이티브 화자가 문맥·수리적 정확성·표현 적합성 관점에서 검토·수정하는 절차로, 특히 저자원 언어에서 기계 번역 오류로 인한 평가 왜곡을 줄이는 데 핵심적이다.
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.