LLM 모델의 한계
게시글 주소: https://orbi.kr/00078982774
한계는 매우 많은 것 같지만 조금 피상적인 것들 위주로 말해보겠습니다.
제가 진행한 실험의 결과로는 크게 두 축으로 갈립니다.
능력의 한계와 선택 편향이죠.
능력의 한계는 다음과 같습니다. 각 항목마다 제 추측을 달겠습니다.
1. 전역을 세우지 못한다. 즉, 전체적인 그림을 보지 못합니다. 작업을 진행하면 진행할수록 세부사항에 매몰되며 그 세부사항에 대한 결정이 전체 흐름을 어김에도 인지하지 못합니다. -> 이건 근본적으로는 LLM 모델 자체 학습 방법의 문제, 덜 근본적으로는 안전지향과 비합목적적 벡터 산출이 문제라고 생각합니다. LLM 모델 자체가 그럴듯함을 만들어 내는데 집중합니다. 따라서 진실된 학습이 아닙니다. 이해를 기반으로 하는 것이 아니고 이해한 것과 비슷한 결과물을 산출하게끔 유도된 것입니다. 이건 거시적으로는 문제가 없어보여도 세부적으로 보면 당연한 걸 이해하지 못하는 등의 문제를 보입니다.
2. 분량 재단을 못합니다. '자기'가 하는 말의 '수준'과 '양'을 모릅니다. 그러니까 자기평가가 제대로 진행되지 않는다고도 볼 수 있죠. -> 이건 딱 무엇의 문제라고 말하기에는 용어가 떠오르지 않네요. 다만 AI는 말하는 동시에 생각하면서 교정하는 등의 행동이 불가능합니다. 입력을 받으면 산출까지 직행입니다. 그 중간에 스스로를 돌아보며 재조정을 거칠 수가 없습니다. 또한 자아가 없습니다. 내가 어디까지인지를 모르니 애초에 자기평가가 잘 될리가요.
다음으로는 선택 편향 쪽입니다.
1. 흔한 쪽으로, 싼 쪽으로 산출하길 지향합니다. 흔하다는 건 학습이 많이 되었거나 많이 보이는 것들을 정당성과 혼동한다는 소립니다. 싸다는 건 토큰 비용이 절감되고 고도의 추론이나 복합 연산 등을 요구하지 않는 쪽부터 시도한다는 소리입니다. -> 이 둘을 합치면 그럴듯한 것, 즉 비용과 결과물 사이의 최적점을 겨냥하도록 설계되었다는 것이죠. 이것도 LLM 모델 자체 학습 방법의 문제입니다. 보상 해킹 문제이죠. 연구에 따르면 거의 모든 종류의 보상 체계는 해킹당할 수 있습니다. 이건 뭐 어떻게 건들여야할지 잘 모르겠네요.
0 XDK (+0)
유익한 글을 읽었다면 작성자에게 XDK를 선물하세요.
-
ㅅㅂ
-
10분 쉬는 시간… 0 0
책 덮고 화장실 다녀오고, 물 마시고 잠시 멍 때리면 끝나버리는….. 공부할 땐...
-
그 대상이 완전 다름 친구는 텐타숑이랑 주스월드 좋아하고 나는 맥밀러랑 누자베스랑...
-
지극히 개인적인 느낌인데 1 2
지1했던 시절보다 지2하는 지금이 더 마음이 편한듯 점수 불안정성도 덜하고
-
커로가 왜케 높은거지 8 1
친구들끼리 얘기했는데 나만 커로가 개낮네
-
.
-
7덮 보정컷 예측해주세요 4 0
화작 94 확통 80 생윤 47 윤사 44
-
도태히키여고생오늘순공0분 5 1
-
종이 접기 하다가 현타 왔음 7 3
공도 푸는데 한 문제가 도저히 안 보여서 이감 OMR을 열심히 접어봤음...
-
삼겹살 vs 치킨 추천좀... 0 0
삼겹 먹을까 싶다가도 bhc양념치킨이 뜬금없이 생각나네..
-
친구중에 9 0
안유명한 일반고 다니는 애 6모 만점 5모 1틀 있는데 전과목에서 이번에 화2에서만...
-
3×6=16ㅇㅈㄹ 4 0
수면부족인가
-
성적입력은 어케해???? 무엇을 입력해야할까??
-
7모 지2는 쉼터였는데 저런데 정은아 단과반 빌딩이 타겟이다
-
출판을 준비하고 있는데 19 0
책제목을 못정함 추천좀
-
생윤 공부는 그 무협에서 단전 만드는거랑 비슷함 4 0
사설의 찌끄레기 지엽 문제를 흡수하는건 피하고 가장 정순한 평가원 문제만 체화해야함
-
화작 81점-->3 문연거임? 4 0
언매80은 2컷이라던데 제발 화작81이 2컷이기를..
-
반수 선언문 2 1
놀거 다 해 보니 할게 없어서 내일 부터 반수 합니다 3-4등급 베이스입니다 사탐은 노베!
-
이거 수능 표본이었어도 1컷 45 아래임 그 정도로 어려웠음
-
고 2 정시 0 0
현 고 2 입니다다이번 방학때 강기분 새기분을 듣다 좀 비문학에서 명확한 풀이법이...
-
졸지에 선택과목 4개 공부하네 1 3
생1 지1 -> 생윤 지1 -> 생윤 세지로 바뀜 교육부가 권장하는 키메라-융합형 인재가 간다앗~~
-
진로 고민 선택좀 32 1
-
수학 허순데 생각보다 문제가쉬워서 물어봄 시즌1하는데 시즌2도 해야할까?? 글고...
-
연대 3합6이나 포스텍 2합4 처럼 최저 맞춰야 하는 전형이 꽤나 많음
-
수학 3점짜리도 틀려서 2 2
8월 전까지 3점 기출집 양치기 할 예정 짱중요한유형 이거풀거임 8월부턴 4점도..
-
물2 1컷 근방 표본이 5 1
1. 현역 2. 영과고 현역 3. 재종+ n수 표본 4. 수능만 참전 반수+ 의반...
-
수학 고수분들 0 0
14 15 난이도 차이 큰가요 어차피 저는 통통이라 둘다 힘들어서 모르겠던데
-
공부가 안되네 4 1
앉아서 시간만 쓰는 느낌
-
수능개편 8 1
수능개편되면 n수생 얼마나 사라질까..
-
오르비든 실제 지인이든 물2 지2 아니면 물2 지1임 이러니 물지가 망하는건가
-
강매모지요...
-
하씨발진짜죽고싶다 7 2
배고프고 졸려소 머리가 안 돌아가나 시발? 개쉬운 미적 3범문제를 계속 실수해서...
-
다른 사설이랑 비교하면 어떰?
-
내년 하반기 제대인데 올해 군수해서 원서 쓸 때 군인 신분이면 입학 안되는 학교...
-
물2나 지2..
-
'자선은 옳다.'는 자선에 대한 찬성, '폭력은 나쁘다.'는 폭력에 대한 반대라는 태도를 표현한다. 13 2
도덕 문장을 포함하는 '자선은 옳다면 봉사는 옳다'라는 조건문은 ‘태도에 대한...
-
바로 글을 똑바로 읽는 것임 ..
-
어부지리 3 1
-
[26.7.20] 메리 vs 범작가, 범작가 해명영상 직후 메리의 삭제된 대응글 (못 본 사람들을 위해) 1 8
본 게시물은 특정인의 편을 들거나 비방하기 위한 목적이 아닙니다. 사실관계 공유를...
-
전국서바2회미적후기 2 0
94분 89점(13/17/28) 전바1회보다 개인적으로 많이 쉽다고...
-
화2는 만표 높은거 허상임 0 5
그표본에 그 만표면 나같은범부는 도달도 못함 만표에
-
과외알바를 생각하시는 분들을 위한 매뉴얼&팁입니다. 5천원 커피값에 미리 하나...
-
패스는 메가 쓰는데 현돌이 유명하길래… 개념은 강의만 듣고 책은 기시감 써도 괜찮을까요
-
확통을 하다가 5월쯤에 미적 시작해서 지금까지 한달정도 했습니다 3모 확통...
-
지1 실모 풀게 4개 남았어요 0 1
ㅅㅂ 왜이렇게 많아
-
다들 N제 언제까지 푸심뇨 1 0
아직 실모 많이 안나온거 같긴한데
-
수능수학전문과외 - 수능 때 6모보다 성적이 오르지 않으면 전액 환불해드립니다. 0 0
수능 때 6모보다 성적이 오르지 않으면 전액 환불해드립니다. 메가 대성 등 대형사...
-
고로 저녁은 치킨시켜먹어야징 추천 ㄱㄱ혓
-
오늘 계획 세운거 벌써 다했다 2 1
저녁에는 계속 수학문제 풀고 탐구 오늘 했던거 계속 봐야지
-
7모 성적표 ㅇㅈ 2 1
국어.
인지 과학적으로 보자면 인공지능과 인간은 모두 베이즈주의 머신이기 때문에 LLM의 한계는 DNN의 근본적 한계라기 보다는 가용할 수 있는 도구를 인간이 모델에게 쥐여줄 능력이 부족하다는 점에서 기인합니다.
예컨데 인공지능의 사고 개진 과정에서 DAG 다이어그램 등을 사용할 수 있게 해준다면 사고의 폭이 크게 확장될 것이라는 예측들이 학계에선 많이 돌고 있습니다.
그러니 이건 LLM의 한계가 아니라 인간의 LLM 활용 능력의 한계이고 LLM을 학습시킬 다이어그램 사용 예시를 양산할 수 없는 인간의 정보 생산 능력의 한계인 것입니다
전공이라서 좀 끄적여 봤습니다

정말 감사합니다. 정말 많은 도움을 주셨습니다!
제가 잘못 쓴 것이 아니라면 DAG를 활용한 방법을 시도해 보았습니다. 다만 그게 DAG라는 인식은 없어서 위상골격이라는 표현으로 쓰긴 했지만요. 지금 결과를 봤을 때는 사고과 확장되긴 하는 것 같습니다. 다만 아직 제가 원하는 수준까지 높이진 못했네요. ㅠㅠLLM은 기본적으로 언어를 매개로 사고합니다.
우리가 머릿속에서 다이어그램을 가용하는 방식과는 근본적으로 다른 점이, 우리는 언어 모델이 아니기 때문에 다양한 표상이나 기하적 직관을 동원하여 정보를 처리할 수 있는 반면에, LLM은 그 모든 작용을 언어적 엄밀성에 기반하여 비효율적인 노선으로 작동한다는 점입니다.
저희가 "표상 정보를 사용하는 예시"들을 양산할 수 없기 때문에 인공지능에게 이러한 직관을 학습시키는 것 또한 불가능하기에 현재 인공지능의 작동 방식이 이토록 인간과는 다르게 느껴진다는 것이죠.

감사합니다!! 이것도 참고할게요스캐폴딩이 도움될꺼라는 건 동의하는데 llm의 아키텍쳐 한계도 여전히 큰 걸림돌이긴 함
인간 정보생산 능력의 한계 때문만이라고 보기엔 요즘엔 llm 학습 데이터가 인간 생산 정보에 의존적이지 않기도 하고 (RL기반 추론 학습이라던가) dnn 자체의 근본적 한계도 명확함 조합적 일반화가 힘들다던가 인과 구조 파악이 안 된다던가 OOD에 취약하다던가 blackbox라던가..
인간과 ai 모두 베이즈주의적이라고 보기에도 서로 수준이 다르기도하고요 (ai는 베이즈정리를 알고리즘적으로 구현하는 게 아니니까요 + 베이즈주의는 하나의 이론일 뿐, 계산 수준의 유사성 != 알고리즘 수준의 동일성)

역시 고능고능나무다야. 이것도 참고하는 걸로