Skip to content

7부 퀴즈. 거대 언어 모델

범위: 21장 ~ 24장

0 / 14 문제 맞힘
'다음 토큰 예측'이라는 목표가 광범위한 능력을 낳는 이유는?
스케일링 법칙이 말하는 바와, 모델·데이터 배분에 관한 두 번째 발견은?
환각이 '거짓말'이 아닌 이유와, 대응되는 처방 셋은?
'단계별로 생각하라'가 성능을 올리는 구조적 이유는?
사전학습 모델이 질문에 질문으로 답하는 현상과 정렬의 목표를 설명하라.
SFT의 원리와 한계는?
RLHF의 세 단계와 KL 벌점이 필요한 이유는?
DPO가 RLHF를 어떻게 압축했는가?
LLM 활용의 세 다이얼과 시도 순서, 그리고 그 순서인 이유는?
RAG의 두 단계와, RAG 실패의 대부분이 어디에 있는가?
'사내 규정집으로 파인튜닝했더니 틀린 조항을 댄다'의 원인과 처방은?
도구 사용의 원리 세 조각과, 그것이 LLM 한계에 대한 처방인 이유는?
에이전트의 실체를 한 문장으로 말하고, 도구 실패를 예외로 중단하지 않는 이유를 설명하라.
에이전트 안전장치 다섯 가지를 나열하라.