LLM 모델의 한계
게시글 주소: https://orbi.kr/00078982774
한계는 매우 많은 것 같지만 조금 피상적인 것들 위주로 말해보겠습니다.
제가 진행한 실험의 결과로는 크게 두 축으로 갈립니다.
능력의 한계와 선택 편향이죠.
능력의 한계는 다음과 같습니다. 각 항목마다 제 추측을 달겠습니다.
1. 전역을 세우지 못한다. 즉, 전체적인 그림을 보지 못합니다. 작업을 진행하면 진행할수록 세부사항에 매몰되며 그 세부사항에 대한 결정이 전체 흐름을 어김에도 인지하지 못합니다. -> 이건 근본적으로는 LLM 모델 자체 학습 방법의 문제, 덜 근본적으로는 안전지향과 비합목적적 벡터 산출이 문제라고 생각합니다. LLM 모델 자체가 그럴듯함을 만들어 내는데 집중합니다. 따라서 진실된 학습이 아닙니다. 이해를 기반으로 하는 것이 아니고 이해한 것과 비슷한 결과물을 산출하게끔 유도된 것입니다. 이건 거시적으로는 문제가 없어보여도 세부적으로 보면 당연한 걸 이해하지 못하는 등의 문제를 보입니다.
2. 분량 재단을 못합니다. '자기'가 하는 말의 '수준'과 '양'을 모릅니다. 그러니까 자기평가가 제대로 진행되지 않는다고도 볼 수 있죠. -> 이건 딱 무엇의 문제라고 말하기에는 용어가 떠오르지 않네요. 다만 AI는 말하는 동시에 생각하면서 교정하는 등의 행동이 불가능합니다. 입력을 받으면 산출까지 직행입니다. 그 중간에 스스로를 돌아보며 재조정을 거칠 수가 없습니다. 또한 자아가 없습니다. 내가 어디까지인지를 모르니 애초에 자기평가가 잘 될리가요.
다음으로는 선택 편향 쪽입니다.
1. 흔한 쪽으로, 싼 쪽으로 산출하길 지향합니다. 흔하다는 건 학습이 많이 되었거나 많이 보이는 것들을 정당성과 혼동한다는 소립니다. 싸다는 건 토큰 비용이 절감되고 고도의 추론이나 복합 연산 등을 요구하지 않는 쪽부터 시도한다는 소리입니다. -> 이 둘을 합치면 그럴듯한 것, 즉 비용과 결과물 사이의 최적점을 겨냥하도록 설계되었다는 것이죠. 이것도 LLM 모델 자체 학습 방법의 문제입니다. 보상 해킹 문제이죠. 연구에 따르면 거의 모든 종류의 보상 체계는 해킹당할 수 있습니다. 이건 뭐 어떻게 건들여야할지 잘 모르겠네요.
0 XDK (+0)
유익한 글을 읽었다면 작성자에게 XDK를 선물하세요.
-
이미지써줘 4 1
-
휴릅 1 0
본인 공부 효율에 충격 받음
-
08) 오늘의 공부인증 11 10
겉보기에만 괜찮은 알맹이 하나 없는 하루였습니다 해결 방법을 찾으려하는 중이에요...
-
이불덮어조 4 1
삼칠은잘게여꾸꾸낸내
-
오늘의 명곡 0 1
https://youtu.be/hxENwcFvL3w?si=57QeMS3yUyaRl6J-
-
강k 수학 1회 92 0 1
21, 28틀 시간관리 잘됐음 오랜만에 딱 평가원 수준같음
-
하 인생 1 0
내일은 팔 어깨 복근 해야지
-
나잔다 9 1
ㄹㅇ
-
진짜 6등급제만 되었어도 0 0
1등급 0~10% 2등급 10~25% 3등급 25~50% 4등급 50~75% 5등급...
-
아예 쌩초짜 노베인데 지금부터 사탐만 주구장창 판다고하면 가능할까요 아니면 다른과목 추천좀
-
헤헤 구걸로 10만덕코 벌었어 5 2
-
숩다 수워 0 0
공부 쫘-ㄱ쫙 붙네 이기세로 9평전에 탐구 개념만 돌리자
-
오늘공부한거 4 1
어싸좀풀고 지구개념정독했습니다
-
새계 2 0
속의세계들 속의세계들 공존하나영원히단절된듯
-
쿠우쿠우 혼밥은 많이 에반가 7 1
내일 할까 고민중인데 에바인가요
-
국어 모의고사 3 0
어떤거 추천함? 화작 선택자임. 작수 77 3 올해6모 2등급 각 회차마다 느낌이 달랐으면 좋겠음
-
고양이 >>> 개 13 3
반박안받을개요
-
멘헤라 극복하는 법 1 2
삼칠마냥길가에 뒹구는 비둘기만 보고도피식 하고 웃을 수 있을 정도로단순뽕짝해지시면됨미다
-
아무도 내 얼굴을 모른다는 것
-
아니 어카지 진짜 생윤 사설 걍 걸러도 됨?
-
작수 언매 백분위 98 6평 92점(독서 보기2틀,문학2점) 10분남긴햇는데 짜피...
-
화룡점정 하사십 이런거 수2만 풀려고했는데 에반가 걍 다 푸는게 나아요? 진짜 수1...
-
배급견 내란견 이라는 단어는 많이들 쓰는데... 4 1
생각보다 스윗견 이라는 말은 사람들이 잘 안쓰는듯....
-
이세계 가고싶다 7 3
마법써보고시픔
-
다상다독 어떰? 0 1
강민철 안듣고 코동욱 듣는데 다상다독은 풀어볼지 고민중임. 비수강생이 풀어도 문제 없음?
-
개밥정식 12 3
14시간만에 먹으니 맛있군
-
반수 조언 0 1
제가 작년 수능 98 88 3 99 67(언미물생) 받고 경희대공대 재학중인...
-
작년에 들은 국어 인강 1 4
김승리T: 아수라 빼고 풀커리, 빅플릭스까지 이원준T: 브레인크래커, 스키마N,...
-
원점에서 다시 시작해 볼까 4 3
프로젝트 아키텍처부터 다시 짜야 할 것 같아요,, 저도 언젠가는 잘 할 수 있을까요,,
-
마더텅 영어독해 <<< 몇번대 문항까지 들어있는거임? 0 0
듣기 풀면서 풀어야된다는 구간도 있네
-
프세카 일섭 다운로드 2 1
왜케안되냐 두시간째 하고잇는데 자꾸 멈추고 꺼지고 ㅜㅜ
-
아니 매직했는데... 12 1
매직했는데!!!!! 곱슬은 극복을 못해..
-
내가 무슨일이 있어도 이번 여행에서 에고이스트 2회 완성함 4 1
진짜로
-
다들잘자 5 0
-
하 엔티켓 나만 어렵나ㅠㅠ 1 0
7모 14,15,21,22 틀렸는데 엔티켓 쉽지 않음.. 여기 있는 문제 다 풀면...
-
내일 입원함 4 2
응원해줘 나
-
독서실 가면 3 0
가끔 안씻고오는지 옆자리 냄새가 좀 남..
-
내프사가화질구지인이우 4 2
고화질사진은꾸츄가보인대서화질을낮춤
-
oh 엄마도 발광함 4 1
어떻게저런간사하고사악한웃음소리를낼수잇는거시디
-
하아ㅏㅏㅏㅏㅏㅏㅏㅏ 4 0
ㅏㅏㅏㅏㅏㅏㅏㅏㅏ
-
현역 순공시간 10 0
학교 가는날 기준으로 몇시간이 적당함 ㅜ 난 평균적으로는 4-5시간인데 ㅈ된듯
-
나는 얼굴이 5 1
억울하게 생겼다는 소리 많이 들음
-
6모대회 나갈걸 9 4
덕코가 너무 필요해 덕코줘
-
가끔보면 웃는게 일상인 사람과 5 1
우울한 표정이 일상인 사람이 있어
-
허수일기(33) 6 1
어째서 영어만 하면 졸린 것인가... . 다들 월요일 고생하셨어요!
-
누가 내게 다가온다면 난 이렇게 반짝일 수 있을까? (문학메타 10일차) 8 2
(…) 그렇게 원하든 원치 않든 사랑은 계속된다. 뜨거운 도시의 거리 위에서,...
-
감사합니다 6 2
막차로 상금 받음
-
오공완 ㅇㅈ 1 4
개폐급이라 말도 안 나옴
-
매일 좌절과 희망을 겪고, 영감과 지적 표류를 경험하는 일상. 흠냐뇨이!!!!
-
논술 어떻게 써야함 0 0
솔직히 수학도 못하고 글도 못써서 논술 하는 게 맞나 싶긴 한데 내신 4점따리라...
인지 과학적으로 보자면 인공지능과 인간은 모두 베이즈주의 머신이기 때문에 LLM의 한계는 DNN의 근본적 한계라기 보다는 가용할 수 있는 도구를 인간이 모델에게 쥐여줄 능력이 부족하다는 점에서 기인합니다.
예컨데 인공지능의 사고 개진 과정에서 DAG 다이어그램 등을 사용할 수 있게 해준다면 사고의 폭이 크게 확장될 것이라는 예측들이 학계에선 많이 돌고 있습니다.
그러니 이건 LLM의 한계가 아니라 인간의 LLM 활용 능력의 한계이고 LLM을 학습시킬 다이어그램 사용 예시를 양산할 수 없는 인간의 정보 생산 능력의 한계인 것입니다
전공이라서 좀 끄적여 봤습니다

정말 감사합니다. 정말 많은 도움을 주셨습니다!
제가 잘못 쓴 것이 아니라면 DAG를 활용한 방법을 시도해 보았습니다. 다만 그게 DAG라는 인식은 없어서 위상골격이라는 표현으로 쓰긴 했지만요. 지금 결과를 봤을 때는 사고과 확장되긴 하는 것 같습니다. 다만 아직 제가 원하는 수준까지 높이진 못했네요. ㅠㅠLLM은 기본적으로 언어를 매개로 사고합니다.
우리가 머릿속에서 다이어그램을 가용하는 방식과는 근본적으로 다른 점이, 우리는 언어 모델이 아니기 때문에 다양한 표상이나 기하적 직관을 동원하여 정보를 처리할 수 있는 반면에, LLM은 그 모든 작용을 언어적 엄밀성에 기반하여 비효율적인 노선으로 작동한다는 점입니다.
저희가 "표상 정보를 사용하는 예시"들을 양산할 수 없기 때문에 인공지능에게 이러한 직관을 학습시키는 것 또한 불가능하기에 현재 인공지능의 작동 방식이 이토록 인간과는 다르게 느껴진다는 것이죠.

감사합니다!! 이것도 참고할게요스캐폴딩이 도움될꺼라는 건 동의하는데 llm의 아키텍쳐 한계도 여전히 큰 걸림돌이긴 함
인간 정보생산 능력의 한계 때문만이라고 보기엔 요즘엔 llm 학습 데이터가 인간 생산 정보에 의존적이지 않기도 하고 (RL기반 추론 학습이라던가) dnn 자체의 근본적 한계도 명확함 조합적 일반화가 힘들다던가 인과 구조 파악이 안 된다던가 OOD에 취약하다던가 blackbox라던가..
인간과 ai 모두 베이즈주의적이라고 보기에도 서로 수준이 다르기도하고요 (ai는 베이즈정리를 알고리즘적으로 구현하는 게 아니니까요 + 베이즈주의는 하나의 이론일 뿐, 계산 수준의 유사성 != 알고리즘 수준의 동일성)

역시 고능고능나무다야. 이것도 참고하는 걸로