wirae.me

LLM의 한계와 소설쓰기: <먼저 온 미래>를 읽고

장강명 작가의 <먼저 온 미래>를 읽으면, ‘하루 명작을 288권 써내는 AI’ 사고실험이 등장한다. 이렇게나 좋은 소설을 많이 쓸 수 있는 AI가 존재한다면 현재의 문학이라는 것이 존재할 수 있겠느냐는 물음이다. 의미 있는 물음이라고 생각한다. 하지만 나는 ‘하루에 명작 288권을 써내는 AI’라는 건 있을 수 없다고 주장할 것이다.

문단과 학계와 독자로 이루어진, 예의 ‘비평장’이라고 할만한 것이 어떤 소설을 명작으로 인정하지 않으면 그건 명작이라고 할 수 없는데, 내 생각에 이런 이슈가 되는 소설은 한 해에 한 권이 나올까말까 하다. AI가 하루 288권을 써내든, 플랑크 시간 동안 그레이엄 수권을 써내든 똑같다. 사람이 읽을 수 있는 속도가 한정되어 있다면 명작이 나올 수 있는 숫자도 마찬가지다. 알다시피 명작이 아니면 다 그저 그런 소설이다. 인간이 그렇듯이 AI도 90%는 쓰레기를 쓸테고, 9%는 좀 읽을만한 걸 쓰고, 1% 남짓이 수작이 되고, 그런 수작이 10년 정도 쌓였을 때 그 중 0.1% 정도나 계속해서 읽히는 명작으로 남을 것이다. AI 등장 이후에도 우리가 공유할 수 있는 명작이란 게 존재하여 비평장이 그걸 알아볼 눈이 있다면 그냥 그렇게 될 것이다.

…뭐, 좋다. 이상은 ‘명작’이라는 어휘에 꼬투리를 잡은 것이다. 간단히 말해서 시장이 소화할 수 있는 책에 한계가 있다고만 받아들여도 된다. 그냥 상상력을 밀고나가 보자. 아마도 작가가 의도했던 그대로, AI가 시장을 완전 점령하고 항상 그 어떤 작가의 글 보다도 좋은 글을 쓴다고 가정하자. 명작 선정 조차도 AI가 하고, 그런 명작이 매일 같이 쏟아진다면? 그리고 완벽한 알고리즘으로 독자 취향에 맞는 최고의 걸작을 갱신하며 매일 준다면? 그리고 그런 책이 인간 작가의 소설과 동등한 가격으로 팔리고 있어서 가격 차등도 없다면? 방금의 가정들 조차도 하나하나 논박이 될 수 있겠으나(사람들이 그렇게 책을 많이 읽는다고?), 일단 이런 가정까지 도달하면 도대체 무엇을 왜 거절해야 되는지 알 수 없다.

여기까지 오면 도서 시장 밖에선 이미 AGI에 도달한 AI가 스스로를 개선하며 기술 특이점을 돌파했으며 인간은 노화와 질병과 사고를 모두 극복했을 것이다.그러니까 ‘하루에 명작을 288권 써내는 AI’는 애초에 유토피아를 가정하고 있다. 유토피아를 내놓고 그걸 의심해야 된다고 주장하는 건 언어 도단이고, 의심할 수 있다면 애초에 유토피아를 말한 게 아니다. 그럼 이 유토피아는 책에서 언급된 것처럼 그냥 받아들이는 것말고 할 수 있는 게 없을 것이다. 유토피아를 걱정할 거라면 차라리 AI에 의한 세계 종말 시나리오를 대비하는 쪽이 낫다.

AGI는 간단히 말하면 인간과 같은 인공지능을 말한다. 하지만 기계이므로 빠르고 복제도 가능하다. 만약 인간이 AGI를 만들 수 있다면, AGI는 개선된 AGI를 만들 수 있다. 그럼 개선된 AGI는 더 개선된 AGI를 만들 수 있을 것이다. 그렇게 개선된 AGI들은 인간의 여러가지 문제, 지구 온난화와 에너지 문제 해결, 인류를 이롭게하는 새로운 발명과 난치병 정복 등의 일을 할 수 있을 거라고 본다. 그래서 AGI의 등장을 기술 특이점, 그러니까 기술 발전의 속도가 빠르게 가속화되는 시점의 시발점으로 본다. 그러니 LLM의 최고 화두는 LLM이 AGI가 될 수 있느냐는 것이다.

일단 내 입장은 LLM은 AGI 같은 게 될리가 없다고 보는 입장이다. 현행 LLM은 몇 년 전 테드 창이 ‘응용 통계’에 불과하다는 주장이나, 여러 AI 학자들이 말하는 ‘확률적 앵무새’라고 하는 주장에서 전혀 벗어나지 않았다. 응용 통계라는 건 LLM이 가지고 있는 방대한 데이터를 통해 단어간 상관관계를 학습하여, 확률 분포에 따라 예측하는 것에 불과하며, LLM 스스로는 자신이 무슨 말을 하는지 이해하지 못한다. 그리고 LLM은 ‘환각 만드는 기계’이기도 하다. 구조적으로 확률적이기 때문에 환각률이 0%에 도달하는 건 불가능하며 환각을 줄이려는 시도(모르는 것을 모른다고 주장하는 것 등)는 오히려 유창성을 손상시키는 결과를 가져온다.

이런 주장도 있다. 업스케일링을 통해 자연히 LLM이 AGI에 도달한다는 것이다. 짧게는 27년, 멀게는 35년이면 인간이 기술 특이점을 돌파한다는데, 사실 기존의 업스케일링을 통한 LLM의 기능 상승은 이미 한계에 부딪쳤다. 이 세상엔 더는 LLM에게 넣을 데이터가 그냥 없다. 25년 부터의 데이터는 LLM 그 자신이 넣은 데이터로 오염되어 있기에, 테드 창이 이야기한 ‘흐릿한 JPEG’를 문자 그대로 수행하게 된다. 자기 자신을 학습해서 점진적으로 열화하고 마는 것이다. 대안들이 제시되지만 LLM을 만드는데 가장 유효했던 프리트레이닝을 할 수 있는 데이터 자체가 고갈되었다. 적어도 전과 같은 방식으로 나아질 수는 없는 것이다. 그리고 이 시점에서 LLM은 ‘여전히 답이 없는 문제’에 대해 인간보다 나은 답을 주지 못한다.

물론 저자는 AGI 같은 것을 가정하지 않고, 현행 LLM만으로도 큰 충격을 줄 수 있다고 주장은 한다. 이미 현행 인공지능인 알파고가 바둑계를 변성시켰으니, LLM 또한 그럴 수 있다는 것이다. 저자는 소설가이므로 자연스럽게 바둑계와 문학계를 등치한다. 하지만 이것도 문제가 있다.

바둑은 명백하게 답이 있는 게임이다. 바둑에 돌을 놓을 수 있는 모든 경우의 수를 알고 있다면, 바둑은 필승법이 존재하는 완전정보 게임이다. 반면에 소설은 어떤가? 무엇이 더 나은 소설임을 결정하는가? 그건 위에서 언급했던 것처럼 임의의 비평장이 결정한다. 바둑은 강화 학습을 통해서 어떤 수가 다른 수보다 더 낫다고 판단한다. 하지만 소설은 불가능하다.

LLM은 토큰 단위에서 처리된다. 간단하게는 단어 단위로 처리된다고 할 수 있는데, 특정한 단어가 다른 단어에 비해 더 나은 점수를 이룬다고 볼 수 없다. 그렇게 보기에는 소설은 너무 유기적이다. 각각의 단어가 다른 단어들과 연결되어 있고 같은 단어가 어디에 배치되어 있느냐에 따라 점수를 달리 매겨야 한다. 특히 LLM은 단어를 문자 그대로 이해하는 게 아니라 벡터값을 지정해서 각 단어 사이의 관계로 이해하는데, 소설을 비롯한 각종 문학은 단어의 일상적인 사용을 부정하기 때문에 한층 더 어려우며, LLM이 문학적 표현을 사용하더라도 상투적인 표현으로 천착하게 된다(그래서 LLM이 항상 상대적으로 문학보다 비문학을 더 잘 쓰는 것이기도 하다).

그리고 LLM은 순방향으로 한 번에 하나의 단어를 배치한다. 프롬프트를 한 번 출력한다면 수정을 요구하기 전까지 하나의 글 안에서 문장을 재배치하거나 더 나은 추가 문장을 삽입하는 기능이 없다. 수정을 요구한다면, 그건 이미 작가의 창의력이 개입된다. 순수한 의미에서의 LLM 창작이 아니고, LLM이 온전하게 소설을 변성시킬 수 있다는 근거가 되지 못한다.

저자는 나아가 문학은 어려울지라도 ‘많이 팔리는 소설’, 즉 대중소설이나 베스트셀러는 가능하지 않겠느냐고도 이야기한다. 하지만 한국 시장에서 많이 팔리는 양귀자의 ‘모순’이나 김호연의 ‘불편한 편의점’, 김초엽의 ‘양면의 조개껍데기’가 얼마나 비슷할 것인지 모르겠다.

베스트셀러가 아니라 하나의 장르소설 안에서도 어떤 규칙을 찾는 건 실패할 가능성이 크다. 예를 들어 테드 창과 베르나르 사이에서 공통점을 찾고 그것을 규칙으로 만들고 체화하여 소설로 쓸 수 있을까? 나는 그 둘 사이의 중간쯤 되는 소설이 무엇인지 잘 모르겠다. 이른바 서브 장르, 장르의 장르로까지 좁힌다면 그건 그것대로 데이터 부족으로 작가의 스타일과 장르 관습을 구분하지 못할 것이다. 그게 되면 웹소설 작가들은 태반이 LLM을 붙들고 있을 것이다. 하지만 내가 아는 한 LLM을 쓰는 작가들은 신문물을 체험해보거나 구글 대신 쓰거나 정신적인 지지와 응원을 바라는 목적 정도로만 쓰고 있다.

LLM으로 모든 글을 쓸 필요는 없다. 현재 수준의 LLM을 이용해서 글을 쓴다면 프롬프트를 잘 짜서 기획을 하고 그 기획을 손본 뒤 나온 초고를 적당히 직접 윤문하는 것이 이상적인 LLM 글쓰기일 것이다. 분명 LLM을 이용해 문학상을 수상하는 작가도 있는 걸 보면 이런 LLM을 통한 창작은 불가능이 아니다. 하지만 적어도 상업적 글쓰기에서는 시기 상조다. 아직은 일반적인 글쓰기만큼 품이 들거나 그 이상의 노력을 해야만 가능하다. LLM이 AGI는 되지 못할지라도 더 나아지긴 할 것이다. 그리고 LLM을 통한 창작이 대중화 되지 않았기 때문에 아직은 LLM을 사용해서 글을 쓰는 것이 미숙해서 그럴지도 모른다.

하지만 LLM을 통한 글쓰기 그 자체가 글쓰기에 대한 근본적인 문제를 초래한다는 건 널리 알려져 있다. 간단한 문제다. 글을 잘 쓰기 위해서는 그만큼 좋은 글이 무엇인지 알아야 한다. 하지만 LLM으로 출력하는 글을 ‘좋다’라고 느낀다면 그 사람은 LLM 이상의 글을 쓸 수 없다. 반대로 LLM으로 출력되는 글을 ‘나쁘다’라고 느낀다면 그 사람은 LLM으로 자신의 실력에 미치지 못하는 글만 쓰고 있다는 뜻이다. 어느 쪽이든 LLM을 이용한다면 LLM에 대해서 비판적인 시각을 견지해야만 LLM의 한계를 벗어날 수 있다. 이 말은 LLM을 비판할 수 있는 시각을 가져야 한다는 뜻이고, 비판할 역량을 가지기 위해선 스스로 LLM을 사용하지 않고 LLM보다 나은 글을 쓸 수 있어야 한다는 뜻이기도 하다. 그리고 그럴 수 있다면… LLM을 왜 글쓰기에 사용해야 하는가?

물론 사용해야하는 여타의 이유가 있을 수 있고, 거기에 대해 동의한다. 잘 사용한다면 LLM은 글쓰기 시간을 줄이고 쉽지 않은 노동을 생략할 수 있다. 그리고 작가에 따라 항상 고품질의 글을 지향하지 않을 수 있다. 하지만 아직 LLM에는 더 많은 문제가 있다.

LLM을 이용하는 브레인스토밍은 단기적으로는 창의성에 도움을 받을 수 있지만 장기적으로는 혼자 아이디어를 떠올리는데 어려움을 겪게 된다. 설단 현상 중에 LLM에 단어를 물어보는 습관조차도 인지력 향상에는 도움을 주지 않는다. 그러니까 LLM은 근육 보조를 위해 보조 기기를 몸에 항상 착용하는 것과 비슷하다. 스트랩이나 파워리프팅 벨트 따위를 착용하면 당장은 도움이 되지만 습관적으로 착용하게 되면 지지를 받는 근육이 약해진다. 마찬가지다. LLM은 뇌를 지지하는 보조 기기다. 습관화된 LLM의 사용은 글쓰기 역량을 키우는데 도움을 주지 않으므로 LLM을 비판할 역량을 가지지 못하게 만들어 LLM이 작가 그 자신의 글쓰기 한계가 된다.

때문에 글쓰기에서의 LLM 사용은 역설적이다. 특히 글쓰기를 익히는 수준에선 아주 급할 때가 아니면 LLM을 써선 안 되는데, 반대로 LLM 사용을 익히지 않으면 LLM 사용 기능이 떨어지므로 쓰는 게 의미가 없다. 이 둘 사이의 간극을 어떻게든 작가 자신이 조절해나가면서 쓰는 게 최선인데 달리 말하면 사용하지 않아도 그만이라는 뜻이다. 적어도 저자가 지적한 ‘현행 LLM’ 수준에선 그렇다.

현행이 아닌 앞으로의 LLM은 문학, 정확히는 소설계에서 어떻게 받아들여질까? 나는 LLM과 소설가의 관계는 더 비슷한 건 알파고와 바둑 기사의 관계보다 LLM과 개발자 사이의 관계에 가까울 거라고 예상한다. 현재 프로그래머 업계는 시간을 내서 LLM 사용을 배운 시니어 그룹과 LLM 사용에 기대어 프로그래밍을 해온 주니어 그룹 사이에 큰 격차가 벌어졌다고 한다. 이는 위에서 언급한 것처럼 작업을 배우는 도중 LLM 사용에 기대는 경우 작업을 숙련하는데 도움을 주지 않는 걸 넘어 숙련에 방해가 되기 때문으로 보인다. 이런 부분은 확실하게 비슷하다.

물론 온전하게 닮을 거라고 생각하진 않는다. 프로그래밍은 LLM이 잘하는 일이다. 이 부분은 오히려 바둑과 비슷하다. 문제가 있고 그 문제를 해결할 답이 존재한다. 토큰 하나하나가 의미 있는 값으로 그 자리에 놓여 있다. 그걸 이해할 방법도 존재한다. 하지만 소설은 별로 그렇지 않다. LLM에게 소설을 좀 써보라고 하면 무슨 스타일을 흉내내고 있는지도 모른다. 가장 글을 못 쓰는 사람도 적어도 그렇게 상투적이진 않다. 글을 못 쓰더라도 개성적이다. LLM은 그런 개성조차 없다. 남들과 똑같은 글을 쓸 거라면 당연히 글을 쓸 이유 같은 건 없다. 글쓰기는 결국 자기 표현이다. 작가 그 자체를 우상화하여 작가되기를 희망하는 종류의 작가 지망생이 아니라면 LLM에 매달릴 이유가 없고, 그런 이들이라면 어차피 소설계에 아무런 파문도 남기지 않을 것이다.

자기 표현. 그렇다. 이 모든 것이 내 망상에 불과하여 LLM이 소설을 지배하더라도 사실 상관없다. 그래도 그냥 소설을 쓸 것이다.

내 생각엔 이렇다. 사람의 다리보다 사람이 만든 탈것이 더 잘 이동한다. 탈것에 올라타 이동하는 것이 더 편함에도, 그리고 기꺼이 그 비용을 지불할 수 있음에도, 여전히 걷는 사람들이 있다. 걸을 수 있는만큼은 걸어보자고 한다. 아마 LLM이 인간에게 있어 새로운 탈것이 되더라도 누군가 걸어볼만하다 생각이 들면 걷는 이들처럼 써볼만 하다면 스스로의 힘으로 써보려고 할 것이다. 그게 그 사람이 다른 사람과 구분되는 지점이다.

<먼저 온 미래>에서 보이는 바둑 기사에 대한 인터뷰는 인상적이고 참 좋았다. 나는 하나의 아포칼립스 소설처럼 읽었고, 어떤 비장감이 주는 지점들이 좋았다. 하지만 AI를 버블로 보는 입장에선 바둑과 문학, 그리고 AI와 비관적 전망의 연결이 헐겁다고만 느꼈다. 그리고 이런 강한 비관은 기술 선망과 연결되어 있지 않은가? AGI에 대한 가치를 높게 평가할수록 선망과 공포, 달리말하면 경외심이라고 말할 감정이 새어나온다. 그리고 빅테크 기업은 이런 경외심에 기대어 하나의 종교를 이룬다. 난 AI가 그 정도는 아니라고 생각한다.

← 당신들은 이렇게 시간 전쟁에서 패배한다 감상