LLM 모델의 한계
게시글 주소: https://orbi.kr/00078982774
한계는 매우 많은 것 같지만 조금 피상적인 것들 위주로 말해보겠습니다.
제가 진행한 실험의 결과로는 크게 두 축으로 갈립니다.
능력의 한계와 선택 편향이죠.
능력의 한계는 다음과 같습니다. 각 항목마다 제 추측을 달겠습니다.
1. 전역을 세우지 못한다. 즉, 전체적인 그림을 보지 못합니다. 작업을 진행하면 진행할수록 세부사항에 매몰되며 그 세부사항에 대한 결정이 전체 흐름을 어김에도 인지하지 못합니다. -> 이건 근본적으로는 LLM 모델 자체 학습 방법의 문제, 덜 근본적으로는 안전지향과 비합목적적 벡터 산출이 문제라고 생각합니다. LLM 모델 자체가 그럴듯함을 만들어 내는데 집중합니다. 따라서 진실된 학습이 아닙니다. 이해를 기반으로 하는 것이 아니고 이해한 것과 비슷한 결과물을 산출하게끔 유도된 것입니다. 이건 거시적으로는 문제가 없어보여도 세부적으로 보면 당연한 걸 이해하지 못하는 등의 문제를 보입니다.
2. 분량 재단을 못합니다. '자기'가 하는 말의 '수준'과 '양'을 모릅니다. 그러니까 자기평가가 제대로 진행되지 않는다고도 볼 수 있죠. -> 이건 딱 무엇의 문제라고 말하기에는 용어가 떠오르지 않네요. 다만 AI는 말하는 동시에 생각하면서 교정하는 등의 행동이 불가능합니다. 입력을 받으면 산출까지 직행입니다. 그 중간에 스스로를 돌아보며 재조정을 거칠 수가 없습니다. 또한 자아가 없습니다. 내가 어디까지인지를 모르니 애초에 자기평가가 잘 될리가요.
다음으로는 선택 편향 쪽입니다.
1. 흔한 쪽으로, 싼 쪽으로 산출하길 지향합니다. 흔하다는 건 학습이 많이 되었거나 많이 보이는 것들을 정당성과 혼동한다는 소립니다. 싸다는 건 토큰 비용이 절감되고 고도의 추론이나 복합 연산 등을 요구하지 않는 쪽부터 시도한다는 소리입니다. -> 이 둘을 합치면 그럴듯한 것, 즉 비용과 결과물 사이의 최적점을 겨냥하도록 설계되었다는 것이죠. 이것도 LLM 모델 자체 학습 방법의 문제입니다. 보상 해킹 문제이죠. 연구에 따르면 거의 모든 종류의 보상 체계는 해킹당할 수 있습니다. 이건 뭐 어떻게 건들여야할지 잘 모르겠네요.
0 XDK (+0)
유익한 글을 읽었다면 작성자에게 XDK를 선물하세요.
-
작년보다 는거같기도 하고 0 1
N제 푸는 속도는 빨라졌는데 실모 하방이 개 떨어짐 뭐지
-
물2는 암산으로 30분컷 0 0
사문이 더 어렵다
-
분명 작년까진 1 1
물1 수특 암산컷 ㄱㄴ이었는데 지금은 왜 이러지,,,
-
폰으로 수학 푸니까 2 2
잘 안 풀리네
-
0.4cm 컸네..
-
야이 비 조금온다며 3 1
폭우자나!!!!!!!!!!
-
레니님이 독해 속도가 ㅈㄴ게 빠르신데 그걸 훈련의 영역으로 단축을 하신건지 좀...
-
결국엔 허들링 오티 0 0
안찍는다하네 어그로는 다끌어놓고 ㅅㅂㅋㅋ 미치겟다 범바오 작년보다 심해지는듯
-
영어 0 1
국어 비문학처럼 읽으니깐 잘 읽히네 2만 받자
-
지금 세사하면 미친건가? 2 1
세사 할바에 사문 이나 생윤해야하나.. 흥미는 세사인데 친구들 한테 물어보면 다들 질색함
-
제가 미적 선택자인데 6모 92 (22,28계산틀) 7모 88(22,28,30)...
-
수학 고수분들은 수1 지수함수 그래프 문제 푸실 때 3 1
이 곡선은 이런 이동으로 이렇게 변했어 이런 거 미리 찍고 들어간 다음에...
-
ㅅㅍ 7덮 국어 2 1
ㄹㅇ 6모 급인데 일단 68분컷 독서 27 문학 30 언매 11 정도 언매가...
-
방학 1 2
-
여러 강사 조교하는거 가능함? 2 0
시간만 맞으면 되나
-
연대 빵 좋다 0 5
덕분에 빵도 먹고 ebs 7일 구독권 받고 수학 수특 수완 내돈내산 아까웠는데 걍...
-
리트 풀다가 틀렸는데 0 1
리트라이 가능할까요
-
메이저리그 데뷔는 했으니 소원 이뤄서 다행
-
사실은 카공하려 했는데, 고3 때 맨날 갔었던 단골 카페가 문을 닫았더라고요!...
-
일단 풀긴 풀었는데.. 간단한 부등식인데도 오래걸려서 질문합니다. 제가 저 문제를...
-
걍 수능한번치고 국어인증하면 깔끔히 해결될것같은데 2 3
왜 안치는거지
-
잡아 족치고싶은데 어떻게 잡지 미친년인가 진짜
-
뭔가 난 과외하면 과외생한테 책 퍼줄듯 n제같은거 거지되는거 아니냐 그냥 몸이 좀...
-
안녕하세요. 일단 저는 재수생이고 현재는 지방에서 잇올 다니고 있습니다. 제가 6월...
-
아니 수학 진짜 3이야 0 2
시발
-
그냥 문제좋은건 못풀수가 없어서 걍 ㅈ구린것들조차 다 품 발상적이면 도움 ㄴㄴ인데?...
-
한전은 대체 4 1
어디까지 물을 타야 괜찮아지려나
-
와 시발 미친 0 1
오늘 약 3개월만에 아침에 졸지 않았음 내가 신기하다
-
예전에 찍은 거 맘에 안드는데 지금 찍으면 아까울 것 같아서 고민 중임
-
"국민들은 불가능한 거래" 이 대통령 분당아파트 매각 논란 1 2
"대통령 아파트 거래의 자금 조달과 근저당권 설정 방식이 일반 국민에게도 현실적으로...
-
ㅈ반고 기준 이런 경우 흔함…? 담임쌤이 통계 보여주길래 11 0
ㅈ반고 2등급 중반이, 2개 영역 합 6 못 맞추는 경우 흔함? 생활과 윤리,...
-
오르비 첨으로 글 써봐서 그 호루스코드만 읽었는데 더 읽어야 하는 게 있는지 모르겠다
-
수학은 해봤는데 국어는 어떨까
-
기출 풀 때 은근 꿀팁 0 0
기출 문제 번호 옆에 정답률이 써져있는 경우가 많은데 정답률이 2~30퍼대여도 쫄지...
-
크럭스 테이블 기준으로 기하 만표가 149로 잡히는데, 실채점 결과 149의 인원은...
-
성적표는 언제나와 ㅅㅂ
-
수능사진 어차피 여권사진이랑 규정 똑같지 않앗낭 0 1
올해는 고냥 무인사진기에서 대충 찍어야것다
-
탐구 0 0
생윤은 작년에 깊게는 아니고 학교 프린트로 개념하고 수특만 풀었고 한지는...
-
방학해서 성적표 못받음
-
물1화1 응시자수왜이래 3 1
-
우산 사라짐 1 0
어제 독재 학원 끝나고 하원하려는데 우산 누가 실수로 가져갔는지 없어져있더라 ㅅㅂ...
-
내 지능으론 공부해도 못풀듯
-
국바 2회 ㅅㅂ 2 2
가나 독서 날려서 어휘만 풀고 걍 빡쳐서 나머지 찍지도 않았는데 여기서 11점...
-
고터에 맛집 없나 8 1
고기 먹고 싶은데
-
얼버기 2 1
-
아니 이감만 풀면 왜 독서가 3 0
이해됐다고 생각하고 풀고 시간도 남는데 항상 놓치는 포인트가 있는거지 너무 기분 나쁘게 틀림
-
증사 새로 찍어야되나 4 1
6개월 이내에 찍은거 내라던데 그냥 작년에 찍은거 내도 됨?
-
삼각함수 보조선 생각 1 0
그릴때 어떻게 그리시나요 하루종일 쳐다봐도 보조선을 모르겟네
-
7모 수학 백분위 98이네 9 1
84 98 88 99 92 100인듯 대충?
인지 과학적으로 보자면 인공지능과 인간은 모두 베이즈주의 머신이기 때문에 LLM의 한계는 DNN의 근본적 한계라기 보다는 가용할 수 있는 도구를 인간이 모델에게 쥐여줄 능력이 부족하다는 점에서 기인합니다.
예컨데 인공지능의 사고 개진 과정에서 DAG 다이어그램 등을 사용할 수 있게 해준다면 사고의 폭이 크게 확장될 것이라는 예측들이 학계에선 많이 돌고 있습니다.
그러니 이건 LLM의 한계가 아니라 인간의 LLM 활용 능력의 한계이고 LLM을 학습시킬 다이어그램 사용 예시를 양산할 수 없는 인간의 정보 생산 능력의 한계인 것입니다
전공이라서 좀 끄적여 봤습니다

정말 감사합니다. 정말 많은 도움을 주셨습니다!
제가 잘못 쓴 것이 아니라면 DAG를 활용한 방법을 시도해 보았습니다. 다만 그게 DAG라는 인식은 없어서 위상골격이라는 표현으로 쓰긴 했지만요. 지금 결과를 봤을 때는 사고과 확장되긴 하는 것 같습니다. 다만 아직 제가 원하는 수준까지 높이진 못했네요. ㅠㅠLLM은 기본적으로 언어를 매개로 사고합니다.
우리가 머릿속에서 다이어그램을 가용하는 방식과는 근본적으로 다른 점이, 우리는 언어 모델이 아니기 때문에 다양한 표상이나 기하적 직관을 동원하여 정보를 처리할 수 있는 반면에, LLM은 그 모든 작용을 언어적 엄밀성에 기반하여 비효율적인 노선으로 작동한다는 점입니다.
저희가 "표상 정보를 사용하는 예시"들을 양산할 수 없기 때문에 인공지능에게 이러한 직관을 학습시키는 것 또한 불가능하기에 현재 인공지능의 작동 방식이 이토록 인간과는 다르게 느껴진다는 것이죠.

감사합니다!! 이것도 참고할게요스캐폴딩이 도움될꺼라는 건 동의하는데 llm의 아키텍쳐 한계도 여전히 큰 걸림돌이긴 함
인간 정보생산 능력의 한계 때문만이라고 보기엔 요즘엔 llm 학습 데이터가 인간 생산 정보에 의존적이지 않기도 하고 (RL기반 추론 학습이라던가) dnn 자체의 근본적 한계도 명확함 조합적 일반화가 힘들다던가 인과 구조 파악이 안 된다던가 OOD에 취약하다던가 blackbox라던가..
인간과 ai 모두 베이즈주의적이라고 보기에도 서로 수준이 다르기도하고요 (ai는 베이즈정리를 알고리즘적으로 구현하는 게 아니니까요 + 베이즈주의는 하나의 이론일 뿐, 계산 수준의 유사성 != 알고리즘 수준의 동일성)

역시 고능고능나무다야. 이것도 참고하는 걸로