개념
LLM
많은 텍스트를 학습해 다음 말을 예측하고 문장을 생성하는 거대언어모델.
핵심 포인트
- 엄청난 양의 글을 학습해 "다음에 올 말"을 확률로 예측하는 모델이다.
- 이 예측을 반복해 한 단어씩 이어 붙이며 문장을 생성한다.
- 번역·요약·작문·코딩 등 한 모델로 여러 일을 처리할 수 있다.
- 학습 시점 이후의 일이나 내부 자료는 모르며, 사실을 지어낼 수 있다(환각).
예시
ChatGPT 같은 도구는 "오늘 날씨를 시로 써 줘"라는 요청에 다음 단어를 차례로 예측해 시를 만든다.
한 걸음 더
LLM은 정답을 "찾아오는" 검색엔진이 아니라, 그럴듯한 말을 "생성"하는 모델이다 — 그래서 사실 확인이 필요하다.