LLM 모델의 한계
게시글 주소: https://orbi.kr/00078982774
한계는 매우 많은 것 같지만 조금 피상적인 것들 위주로 말해보겠습니다.
제가 진행한 실험의 결과로는 크게 두 축으로 갈립니다.
능력의 한계와 선택 편향이죠.
능력의 한계는 다음과 같습니다. 각 항목마다 제 추측을 달겠습니다.
1. 전역을 세우지 못한다. 즉, 전체적인 그림을 보지 못합니다. 작업을 진행하면 진행할수록 세부사항에 매몰되며 그 세부사항에 대한 결정이 전체 흐름을 어김에도 인지하지 못합니다. -> 이건 근본적으로는 LLM 모델 자체 학습 방법의 문제, 덜 근본적으로는 안전지향과 비합목적적 벡터 산출이 문제라고 생각합니다. LLM 모델 자체가 그럴듯함을 만들어 내는데 집중합니다. 따라서 진실된 학습이 아닙니다. 이해를 기반으로 하는 것이 아니고 이해한 것과 비슷한 결과물을 산출하게끔 유도된 것입니다. 이건 거시적으로는 문제가 없어보여도 세부적으로 보면 당연한 걸 이해하지 못하는 등의 문제를 보입니다.
2. 분량 재단을 못합니다. '자기'가 하는 말의 '수준'과 '양'을 모릅니다. 그러니까 자기평가가 제대로 진행되지 않는다고도 볼 수 있죠. -> 이건 딱 무엇의 문제라고 말하기에는 용어가 떠오르지 않네요. 다만 AI는 말하는 동시에 생각하면서 교정하는 등의 행동이 불가능합니다. 입력을 받으면 산출까지 직행입니다. 그 중간에 스스로를 돌아보며 재조정을 거칠 수가 없습니다. 또한 자아가 없습니다. 내가 어디까지인지를 모르니 애초에 자기평가가 잘 될리가요.
다음으로는 선택 편향 쪽입니다.
1. 흔한 쪽으로, 싼 쪽으로 산출하길 지향합니다. 흔하다는 건 학습이 많이 되었거나 많이 보이는 것들을 정당성과 혼동한다는 소립니다. 싸다는 건 토큰 비용이 절감되고 고도의 추론이나 복합 연산 등을 요구하지 않는 쪽부터 시도한다는 소리입니다. -> 이 둘을 합치면 그럴듯한 것, 즉 비용과 결과물 사이의 최적점을 겨냥하도록 설계되었다는 것이죠. 이것도 LLM 모델 자체 학습 방법의 문제입니다. 보상 해킹 문제이죠. 연구에 따르면 거의 모든 종류의 보상 체계는 해킹당할 수 있습니다. 이건 뭐 어떻게 건들여야할지 잘 모르겠네요.
0 XDK (+0)
유익한 글을 읽었다면 작성자에게 XDK를 선물하세요.
-
디오더블쥐~ 1 0
스눕도기독
-
국어 감 다떨어졌다 1 1
빨리 나무위키 봐야함
-
오랜만이에요다들 8 3
요즘 오르비는 조용한가요?
-
수학 시간 부족 (고2) 3 0
고2 모고긴한데.. 항상 객, 서 끝번호 3~4개를 시간 부족해서 못품 어려운건...
-
수학 전국 서바 2회(스포O) 0 2
저도 서바 92첨 받아봐서 ㅁㅌㅊ 부남짤 찾을려는데 막상 안 보이네요 14,29틀...
-
고2 여름방학 국어 공부법 좀 알려주세요 선배님들 ㅠㅠ 1 0
지금 고2입니다! 현재 국어가 고3 모의고사도 80분내로 1등급이 안정권으로 뜨고...
-
국/수 테이블은 아침에 올려줄게염 계산기: https://suneungcalc.com/
-
공복이 너무 기니까 4 0
어지럽군나.. 최소한의 단백질이라도 채울까
-
집에잇으면계속집에잇고싶은데 2 3
집밖에나가면계속밖에있고싶어 아물론학교는예외임
-
빰빰빰 1 1
나는간다관독으로
-
국어 문학 2 0
강의 들어야할까요 독서같은건 고3꺼 정답률3,4,50프로되는거 맞는데 문학은...
-
인스타 보는데 2 2
우리 지역 명문고 탑텐에 왜 우리 학교가 있음 기분은 좋지만 사실이 아닌걸 학평...
-
씻기 싫어서 밖에 안나갈려교 5 0
하아..
-
아르기닌이랑 비타민B 맞지? 4 0
대충 뇌에 좋은 영양제 맞지?
-
뭘 하고싶지 2 0
긴가민가하네
-
개빡치네 1 0
고1 1학기 1.29 인데 9등급제로 계산해도...
-
수바 2회 3 0
ㄹㅇ 개쳐어렵네 이렇게 나오면 수능 1컷 70점대도 되겠다 ㅅㅂ 14,15틀 함...
-
동창회에 갓더니 4 5
다들 나랑 동갑이엇음 신기허네
-
인생이 어디로 가는거지 3 2
ㅈ된거같은데
-
일반고 2.0이고 생명계열 지망해요 (근데 수과학 성적이 엄청 좋은 편은 아니고...
-
수학 n제 뭐이리 어려움 0 1
본인 3모 5모 6모 7모 다 1등급이고 6모 1뜨고 나서 2,3등급도 n제 풀길래...
-
250929 기하 1 0
한완기 해설 1 2 둘다 나처럼 안풀었네.. 난 이게 가장 괜찮은 풀이 같은데
-
사문 오늘은 진짜 시작해야하나 4 2
ㅈㄴ 귀찮은데 리프레쉬 느낌으로 해야갯노
-
대성 교재패스 배송비 1 1
교재패스까지 꾸역꾸여 배송비받는거 역하네
-
수능수학전문과외 - 수능 때 6모보다 성적이 오르지 않으면 전액 환불해드립니다. 0 0
수능 때 6모보다 성적이 오르지 않으면 전액 환불해드립니다. 메가 대성 등 대형사...
-
이번주 금요일 7섶 1 1
모고친날은 잇올 칼퇴가능하던데
-
수학 기출 추천해주세요 3 0
재수중이고 목표는 4등급입니다 수학 기출문제집 추천해주세요 연도별 기출을 풀까요...
-
이승모쌤 생신축하드려요!!! 1 1
-
스타팅블록 복습 엔제 0 0
김범준 스타팅블록 스블 복습이랑 엔제 풀이 병행하는 중이거나 해 보신 분 잇으면...
-
걍 대충 풀고 치우는용도인가요?
-
무슨 사명감을 가지고 까는 것 같아서 되게 기이함 이동진이 자기 별점에 대해...
-
국어 고1 모고 고2 모고 2 0
국어 고1껀 2등급인데 방금 고2 3월꺼 풀고왔는데 개털리고 4등급 떴습니다 ㅜㅜ...
-
국어황이 되고 싶다
-
난나아질수가없어 2 1
-
@개발팀 4 1
특별출연 웹 알림탭에서 게시글알림이 오래된 경우 로딩이 한번에 안되는데 가능하게끔...
-
온라인 하반기 패키지랑 파이널 패키지는 서로 중복 없는 건가여? 걍 둘 다 사면 대나
-
옛날 옛날에는 1 0
박광일이 1타였었는데 기억하는사람 있나
-
기숙학원 알바 1일차 4 0
27일 남음.
-
주관적으로 생각한 국어 공부 1 2
매우 주관적임 글을 천천히 읽는다 어휘(단어)를 찾아본다 구체적으로 계속 생각한다...
-
법전협보다 빠르게 법전협보다 자세하게
-
저속매도뽀뽀 2 1
으흐흐
-
좀 더 유연하게 트러블들을 트러블 해 and pass it…제발..
-
Misfits는 멘헤라 앨범으로 취급 받기엔 너무 잘 만듬 2 0
강수지 까지는 허세 가득한 양아치 느낌을 그 아래부터는 본인의 숨겨둔 약한 모습을...
-
인스타 만들고나서 4 5
공스타 두개정도 팔로우하고 나니까 어째 오르비에서 보이던 프사랑 닉들이 인스타 추천에 뜨는거죠
-
고2때 영어시험을 보는데 서술형이 아무리 봐도 말이 안되는거야 문법적으로도 문제가...
-
요즘 수학에 생긴 부작용 3 4
너무 어려우면-> 걍 버림 때려맞추기 안되면 -> 버림 계산 더러운 방법밖에...
-
방금 세운 방학목표 2 2
- 매일 오전 7시에 일어나서 오후 11시에 집 돌아오기 - 잠좀 빨리자!!! 집...
-
세월이 빠르구나
-
행복프세카야르 1 1
ㅋㅋ
인지 과학적으로 보자면 인공지능과 인간은 모두 베이즈주의 머신이기 때문에 LLM의 한계는 DNN의 근본적 한계라기 보다는 가용할 수 있는 도구를 인간이 모델에게 쥐여줄 능력이 부족하다는 점에서 기인합니다.
예컨데 인공지능의 사고 개진 과정에서 DAG 다이어그램 등을 사용할 수 있게 해준다면 사고의 폭이 크게 확장될 것이라는 예측들이 학계에선 많이 돌고 있습니다.
그러니 이건 LLM의 한계가 아니라 인간의 LLM 활용 능력의 한계이고 LLM을 학습시킬 다이어그램 사용 예시를 양산할 수 없는 인간의 정보 생산 능력의 한계인 것입니다
전공이라서 좀 끄적여 봤습니다

정말 감사합니다. 정말 많은 도움을 주셨습니다!
제가 잘못 쓴 것이 아니라면 DAG를 활용한 방법을 시도해 보았습니다. 다만 그게 DAG라는 인식은 없어서 위상골격이라는 표현으로 쓰긴 했지만요. 지금 결과를 봤을 때는 사고과 확장되긴 하는 것 같습니다. 다만 아직 제가 원하는 수준까지 높이진 못했네요. ㅠㅠLLM은 기본적으로 언어를 매개로 사고합니다.
우리가 머릿속에서 다이어그램을 가용하는 방식과는 근본적으로 다른 점이, 우리는 언어 모델이 아니기 때문에 다양한 표상이나 기하적 직관을 동원하여 정보를 처리할 수 있는 반면에, LLM은 그 모든 작용을 언어적 엄밀성에 기반하여 비효율적인 노선으로 작동한다는 점입니다.
저희가 "표상 정보를 사용하는 예시"들을 양산할 수 없기 때문에 인공지능에게 이러한 직관을 학습시키는 것 또한 불가능하기에 현재 인공지능의 작동 방식이 이토록 인간과는 다르게 느껴진다는 것이죠.

감사합니다!! 이것도 참고할게요스캐폴딩이 도움될꺼라는 건 동의하는데 llm의 아키텍쳐 한계도 여전히 큰 걸림돌이긴 함
인간 정보생산 능력의 한계 때문만이라고 보기엔 요즘엔 llm 학습 데이터가 인간 생산 정보에 의존적이지 않기도 하고 (RL기반 추론 학습이라던가) dnn 자체의 근본적 한계도 명확함 조합적 일반화가 힘들다던가 인과 구조 파악이 안 된다던가 OOD에 취약하다던가 blackbox라던가..
인간과 ai 모두 베이즈주의적이라고 보기에도 서로 수준이 다르기도하고요 (ai는 베이즈정리를 알고리즘적으로 구현하는 게 아니니까요 + 베이즈주의는 하나의 이론일 뿐, 계산 수준의 유사성 != 알고리즘 수준의 동일성)

역시 고능고능나무다야. 이것도 참고하는 걸로