LLM 모델의 한계
게시글 주소: https://orbi.kr/00078982774
한계는 매우 많은 것 같지만 조금 피상적인 것들 위주로 말해보겠습니다.
제가 진행한 실험의 결과로는 크게 두 축으로 갈립니다.
능력의 한계와 선택 편향이죠.
능력의 한계는 다음과 같습니다. 각 항목마다 제 추측을 달겠습니다.
1. 전역을 세우지 못한다. 즉, 전체적인 그림을 보지 못합니다. 작업을 진행하면 진행할수록 세부사항에 매몰되며 그 세부사항에 대한 결정이 전체 흐름을 어김에도 인지하지 못합니다. -> 이건 근본적으로는 LLM 모델 자체 학습 방법의 문제, 덜 근본적으로는 안전지향과 비합목적적 벡터 산출이 문제라고 생각합니다. LLM 모델 자체가 그럴듯함을 만들어 내는데 집중합니다. 따라서 진실된 학습이 아닙니다. 이해를 기반으로 하는 것이 아니고 이해한 것과 비슷한 결과물을 산출하게끔 유도된 것입니다. 이건 거시적으로는 문제가 없어보여도 세부적으로 보면 당연한 걸 이해하지 못하는 등의 문제를 보입니다.
2. 분량 재단을 못합니다. '자기'가 하는 말의 '수준'과 '양'을 모릅니다. 그러니까 자기평가가 제대로 진행되지 않는다고도 볼 수 있죠. -> 이건 딱 무엇의 문제라고 말하기에는 용어가 떠오르지 않네요. 다만 AI는 말하는 동시에 생각하면서 교정하는 등의 행동이 불가능합니다. 입력을 받으면 산출까지 직행입니다. 그 중간에 스스로를 돌아보며 재조정을 거칠 수가 없습니다. 또한 자아가 없습니다. 내가 어디까지인지를 모르니 애초에 자기평가가 잘 될리가요.
다음으로는 선택 편향 쪽입니다.
1. 흔한 쪽으로, 싼 쪽으로 산출하길 지향합니다. 흔하다는 건 학습이 많이 되었거나 많이 보이는 것들을 정당성과 혼동한다는 소립니다. 싸다는 건 토큰 비용이 절감되고 고도의 추론이나 복합 연산 등을 요구하지 않는 쪽부터 시도한다는 소리입니다. -> 이 둘을 합치면 그럴듯한 것, 즉 비용과 결과물 사이의 최적점을 겨냥하도록 설계되었다는 것이죠. 이것도 LLM 모델 자체 학습 방법의 문제입니다. 보상 해킹 문제이죠. 연구에 따르면 거의 모든 종류의 보상 체계는 해킹당할 수 있습니다. 이건 뭐 어떻게 건들여야할지 잘 모르겠네요.
0 XDK (+0)
유익한 글을 읽었다면 작성자에게 XDK를 선물하세요.
-
시대인재 기숙 질문좀여 1 0
1. 어제 접수했는데 대기 오래걸릴까요?ㅜㅜ 2. 의대 특별서류전형이면 전장...
-
현돌 6평분석서 vs 실모 0 0
지금 메가캐쉬 4만원 있는데 뭐부터 푸는게 좋을까요? 6평 45점 7월 48점 맞았습니다
-
메좆의 파멸 3 2
기쁘디
-
월간조정식 0 0
지문은 좋은데 순삽같은거 정답 근거가 냄새 ㅈㄴ나네 우웩
-
개멋잇네 4 0
-
고마워 8 0
윤정아 수능때도 열어주라
-
영어 오답 1 0
다들 어케하심 ㅜㅜ ㅈㅂ알려줘
-
감사인사 메타를 열었군 3 0
이제 다른 메타로 넘어가고싶은데.
-
흑화한파마늘 12 5
-
운동 끝나고 집 옴 0 0
평소보다는 못 뛰었지만 오운완
-
6모대회상금감사인사 0 2
(상감인사)
-
9모내기할사람 22 1
조건)6모슈학88이하 존잘남
-
생윤 임팩트vs잘노는 기출 0 0
개념은 한바퀴 돌렸고 모고 2정도 나오는데 뭐 듣는게 좋을까요 패스는 둘다 있습니당
-
무물보 11 0
오징어다리맛잇네여 숙면은 글렀으니 노가리까기
-
제가 이걸로 꼭 복권의 하늘에 서겠습니다
-
국어 감 떨어졌을 때 0 0
한번도 이런 적 없고 국어는 모고 치면 백분위 97-99 사이였는데 문제 푸는거나...
-
쉬운데 내용 좋은 문항 9 1
은 의미가 없어 학생들은 안알아줘
-
수능급으로 머리에 정보가 안들어오는 상태를 최근 알아냄 0 2
새벽 5시에 공원 뛰면서 수특 독서 배경지식 지문 보기 진짜 ㄹㅈㄷ임 토할거같삼
-
수능수학전문과외 - 수능 때 6모보다 성적이 오르지 않으면 전액 환불해드립니다. 0 0
수능 때 6모보다 성적이 오르지 않으면 전액 환불해드립니다. 메가 대성 등 대형사...
-
에타 연합게시판에 똥글썼다가 15 3
실제로 본인 머리 좀 가려운김에 에타에 무샤워40시간 으흐흐 구릿 이따구로 똥글...
-
삼초고려 16 1
삼고초려
-
6모 대회 상금 인증 10 6
수능때도 좋은 결과 이뤄내봅시다.. 감사합니다 덕코
-
GPT 해킹 당함? 2 2
말 너무 못 알아 먹어서 자기 성찰과 석고대죄 시켰는데 죄송합니다아...!!...
-
맞팔 구함 4 0
ㅈㄱㄴ 잡담태그 잘달아요
-
7월 학력평가 Rainbowtable (국/수/영) 3 1
연도가 살짝 이상한 것 같긴한데 뭐 문제 없겠죠
-
아빠가 발광하는디 8 5
음이건소주두병이상은마셔야나오는텐션인데아니아빠베이비오늘왤케신남개귀엽넹
-
국어에서 ㅂㅅ짓을하지않는 가능세계 수학 28을 맞추는 가능세계
-
아니 지금까지 꾸준히 1등급 맞아왔는데 진학사 보니까 123개 대학이 국영수사과..?
-
오늘의 공부 9 1
국어 : 강기분 독서 033~035 (인강)수학수1 수능 기출의 미래 1등급...
-
6모대회 상금 감사합니다ㅎㅎ 5 3
잘 쓰겠습니다
-
센츄달아보려고 성적표봤더니 2 3
98.7만 두번이네 수학 좀만잘했어도
-
어떡하지 5 0
중앙대랑 안정으로 쓸 경북대나 부산대가 시간이 안되는데 그냥 안정을 건동홍 써야되나
-
1.7 수시카드 어떻게 쓸까요 2 0
국영수만 하면 1.3인데 탐구가 잘안나와서 총내신이 1.7정도임여 자연계 낮은...
-
정답을 공개합니다. 19 0
정답은 4번이요.
-
김성은 선생님 정말 인간적으로 실망 많이했습니다 4 8
어떻게 교육청 문제 유출을..............
-
사실 내 꿈이였는데 어쩌다가보니까 못했지만 근데 사람 미래는 모르잖아? 그리고...
-
미친놈인가 4 0
6시간동안 한게 숏컷 20문제라고?
-
뭐하지 20 1
뭐해 제발공부하라는나쁜말은ㄴㄴ
-
근데 문제는 2컷이 72정도 나온거같음.. 3컷도 60넘긴듯.. 만표가 1컷대비 너무 낮아..
-
미쿠 스케일 피규어를 달라 4 1
-
아니미친영어에서만19점이까이네 12 1
영어왤케많이봄ㅡㅡ
-
일본 모 배우와의 만남을 위해 31 3
열심히 공부했지만 n2따리.. 그래도 만나서 감사의 마음을 전하는 건 중요하지.
-
내일 n제 하나 풀어야지 1 2
국바 2회.
-
반수생 국어 수특수완 살까말까 3 0
문학은 kbs로 하고 독서는 딱히 안하기도 해서 원문은 풀어보는게 나으려나
-
가위바위보 이기면 500덕 27 0
양심적으로해야대알앗지?스크롤내리기전에 머 낼지 생각해보기 생각다햇으면 더 내려도...
-
공부기록(103) 18 3
-
앙 4 1
앙앙앙
-
나빼고 슐마시네 2 0
나쁜넘들 ㅠㅠ
-
진정한 이과만 푸는 문제 9 1
수정:4번은 현실의 수직선 상이고 3번의 k를 '수'라고 정의함. 1번의 절대영도를 K가 0일때임.
-
될거같다가 안될거같다가 1 0
국어 사설보고 97떠서 기뻐하다가 6모 85점이었던거 생각하면 우울 해지다가...
인지 과학적으로 보자면 인공지능과 인간은 모두 베이즈주의 머신이기 때문에 LLM의 한계는 DNN의 근본적 한계라기 보다는 가용할 수 있는 도구를 인간이 모델에게 쥐여줄 능력이 부족하다는 점에서 기인합니다.
예컨데 인공지능의 사고 개진 과정에서 DAG 다이어그램 등을 사용할 수 있게 해준다면 사고의 폭이 크게 확장될 것이라는 예측들이 학계에선 많이 돌고 있습니다.
그러니 이건 LLM의 한계가 아니라 인간의 LLM 활용 능력의 한계이고 LLM을 학습시킬 다이어그램 사용 예시를 양산할 수 없는 인간의 정보 생산 능력의 한계인 것입니다
전공이라서 좀 끄적여 봤습니다

정말 감사합니다. 정말 많은 도움을 주셨습니다!
제가 잘못 쓴 것이 아니라면 DAG를 활용한 방법을 시도해 보았습니다. 다만 그게 DAG라는 인식은 없어서 위상골격이라는 표현으로 쓰긴 했지만요. 지금 결과를 봤을 때는 사고과 확장되긴 하는 것 같습니다. 다만 아직 제가 원하는 수준까지 높이진 못했네요. ㅠㅠLLM은 기본적으로 언어를 매개로 사고합니다.
우리가 머릿속에서 다이어그램을 가용하는 방식과는 근본적으로 다른 점이, 우리는 언어 모델이 아니기 때문에 다양한 표상이나 기하적 직관을 동원하여 정보를 처리할 수 있는 반면에, LLM은 그 모든 작용을 언어적 엄밀성에 기반하여 비효율적인 노선으로 작동한다는 점입니다.
저희가 "표상 정보를 사용하는 예시"들을 양산할 수 없기 때문에 인공지능에게 이러한 직관을 학습시키는 것 또한 불가능하기에 현재 인공지능의 작동 방식이 이토록 인간과는 다르게 느껴진다는 것이죠.

감사합니다!! 이것도 참고할게요스캐폴딩이 도움될꺼라는 건 동의하는데 llm의 아키텍쳐 한계도 여전히 큰 걸림돌이긴 함
인간 정보생산 능력의 한계 때문만이라고 보기엔 요즘엔 llm 학습 데이터가 인간 생산 정보에 의존적이지 않기도 하고 (RL기반 추론 학습이라던가) dnn 자체의 근본적 한계도 명확함 조합적 일반화가 힘들다던가 인과 구조 파악이 안 된다던가 OOD에 취약하다던가 blackbox라던가..
인간과 ai 모두 베이즈주의적이라고 보기에도 서로 수준이 다르기도하고요 (ai는 베이즈정리를 알고리즘적으로 구현하는 게 아니니까요 + 베이즈주의는 하나의 이론일 뿐, 계산 수준의 유사성 != 알고리즘 수준의 동일성)

역시 고능고능나무다야. 이것도 참고하는 걸로