13편: ChatGPT의 등장과 LLM(대형언어모델) 대중화
- 공유 링크 만들기
- X
- 이메일
- 기타 앱
2017년 구글이 발표한 트랜스포머 아키텍처는 인공지능이 인간의 언어를 처리하는 방식을 송두리째 바꿔놓았습니다. 문장 전체를 한 번에 읽고 단어 사이의 유기적인 관계를 파악하는 이 기술은 대형언어모델(LLM, Large Language Model)이라는 거대한 공룡이 탄생할 수 있는 완벽한 자양분이 되었습니다. 그리고 2022년 11월 말, 연구실의 두꺼운 논문 속에만 존재하던 이 거대한 기술이 단 하나의 웹사이트를 통해 대중의 일상 속으로 진격했습니다. 바로 오픈AI(OpenAI)의 'ChatGPT'의 등장입니다.
처음 ChatGPT가 출시되었을 때, 저 역시 호기심에 사이트에 접속해 몇 가지 질문을 던져보았던 기억이 생생합니다. 기존의 심심이나 관공서의 딱딱한 챗봇을 생각했던 저는 온몸에 소름이 돋는 충격을 받았습니다. "조선시대 왕들의 가상 단톡방 시나리오를 짜줘"라는 황당한 요구에, 각 왕의 업적과 성격을 반영한 위트 있는 대화문을 단 몇 초 만에 거침없이 쏟아냈기 때문입니다.
단순히 검색 결과를 나열하는 것을 넘어, 맥락을 이해하고 인간처럼 고도로 정제된 문장을 '생성'해내는 능력은 인류가 한 번도 경험해보지 못한 새로운 충격이었습니다. ChatGPT는 출시 단 5일 만에 사용자 100만 명을 돌파했고, 두 달 만에 월간 활성 사용자(MAU) 1억 명을 넘어서며 인터넷 역사상 가장 빠른 속도로 대중화를 이뤄냈습니다.
어떻게 이런 기적 같은 일이 가능했을까요? 핵심은 트랜스포머 구조를 극단적으로 거대하게 키운 LLM의 스케일업(Scale-up) 전략에 있었습니다. 오픈AI는 모델의 크기(파라미터 수)를 키우고, 인터넷상의 수조 개에 달하는 문장 데이터를 통째로 학습시켰습니다.
여기에 챗GPT가 대중의 마음을 사로잡을 수 있었던 결정적인 한 조각은 바로 '인간 피드백 기반 강화학습(RLHF, Reinforcement Learning from Human Feedback)'이었습니다. 아무리 똑똑한 인공지능이라도 인터넷의 가짜 뉴스나 욕설을 그대로 배우면 위험한 답변을 출력하게 됩니다. 오픈AI는 수많은 인간 검수자들을 고용해 AI가 내놓은 여러 답변 중 어떤 것이 더 유익하고, 안전하며, 인간의 대화 에티켓에 부합하는지 끊임없이 점수(피드백)를 주며 훈련시켰습니다.
이 과정을 거치면서 AI는 단순한 문장 완성 기계에서, 인간의 질문 의도를 정확히 파악하고 예의 바르게 답하는 '비서'의 인격을 갖추게 된 것입니다. 우리가 느끼는 자연스러움은 바로 이 지독할 정도의 인간 정제 과정에서 탄생했습니다.
ChatGPT가 쏘아 올린 공은 순식간에 글로벌 빅테크 기업들의 전쟁으로 번졌습니다. 구글은 부랴부랴 '바드(현 제미나이)'를 발표했고, 마이크로소프트는 오픈AI와 손을 잡고 자사의 검색 엔진과 오피스 프로그램에 AI를 전면 도입했습니다. 메타는 소스코드를 공개한 '라마(LLaMA)'를 선보이며 오픈소스 생태계를 이끌었습니다. 바야흐로 딥러닝의 시대를 넘어 '생성형 AI의 시대'이자 LLM의 춘추전국시대가 열린 것입니다.
그러나 이 화려한 대중화의 이면에는 초기에 누구도 예상치 못했던 기괴한 부작용들이 숨어있었습니다. AI가 너무나도 당당하고 매끄러운 어조로 '완벽한 거짓말'을 지어내기 시작한 것입니다. 세종대왕이 맥북프로를 던진 사건을 그럴싸한 실록의 한 구절처럼 창작해내는 AI의 모습을 보며, 사람들은 감탄을 넘어 이 기술을 어디까지 믿어야 할지 깊은 고민에 빠지게 되었습니다.
[핵심 요약]
2022년 말 출시된 ChatGPT는 트랜스포머 아키텍처를 기반으로 한 대형언어모델(LLM)을 전 세계 대중에게 각인시킨 역사적 사건입니다.
인간 피드백 기반 강화학습(RLHF)을 적용하여, AI가 단순한 문장 나열을 넘어 인간의 대화 의도와 에티켓을 이해하도록 정교하게 훈련시켰습니다.
ChatGPT의 성공은 글로벌 빅테크 기업들의 생성형 AI 개발 경쟁을 촉발시켰으나, 동시에 정교한 거짓말을 만들어내는 새로운 기술적 과제를 남겼습니다.
[다음 편 예고]
인공지능이 인간처럼 말을 잘하게 되었지만, 그만큼 치명적인 약점도 드러났습니다. 다음 편에서는 생성형 AI의 가장 큰 고질병인 '할루시네이션(환각 현상)'과 인터넷 데이터를 무단으로 학습하면서 발생한 '저작권 분쟁' 등 현재 AI가 마주한 가혹한 한계들을 짚어보겠습니다.
- 공유 링크 만들기
- X
- 이메일
- 기타 앱
댓글
댓글 쓰기