LLM 모델의 한계
게시글 주소: https://orbi.kr/00078982774
한계는 매우 많은 것 같지만 조금 피상적인 것들 위주로 말해보겠습니다.
제가 진행한 실험의 결과로는 크게 두 축으로 갈립니다.
능력의 한계와 선택 편향이죠.
능력의 한계는 다음과 같습니다. 각 항목마다 제 추측을 달겠습니다.
1. 전역을 세우지 못한다. 즉, 전체적인 그림을 보지 못합니다. 작업을 진행하면 진행할수록 세부사항에 매몰되며 그 세부사항에 대한 결정이 전체 흐름을 어김에도 인지하지 못합니다. -> 이건 근본적으로는 LLM 모델 자체 학습 방법의 문제, 덜 근본적으로는 안전지향과 비합목적적 벡터 산출이 문제라고 생각합니다. LLM 모델 자체가 그럴듯함을 만들어 내는데 집중합니다. 따라서 진실된 학습이 아닙니다. 이해를 기반으로 하는 것이 아니고 이해한 것과 비슷한 결과물을 산출하게끔 유도된 것입니다. 이건 거시적으로는 문제가 없어보여도 세부적으로 보면 당연한 걸 이해하지 못하는 등의 문제를 보입니다.
2. 분량 재단을 못합니다. '자기'가 하는 말의 '수준'과 '양'을 모릅니다. 그러니까 자기평가가 제대로 진행되지 않는다고도 볼 수 있죠. -> 이건 딱 무엇의 문제라고 말하기에는 용어가 떠오르지 않네요. 다만 AI는 말하는 동시에 생각하면서 교정하는 등의 행동이 불가능합니다. 입력을 받으면 산출까지 직행입니다. 그 중간에 스스로를 돌아보며 재조정을 거칠 수가 없습니다. 또한 자아가 없습니다. 내가 어디까지인지를 모르니 애초에 자기평가가 잘 될리가요.
다음으로는 선택 편향 쪽입니다.
1. 흔한 쪽으로, 싼 쪽으로 산출하길 지향합니다. 흔하다는 건 학습이 많이 되었거나 많이 보이는 것들을 정당성과 혼동한다는 소립니다. 싸다는 건 토큰 비용이 절감되고 고도의 추론이나 복합 연산 등을 요구하지 않는 쪽부터 시도한다는 소리입니다. -> 이 둘을 합치면 그럴듯한 것, 즉 비용과 결과물 사이의 최적점을 겨냥하도록 설계되었다는 것이죠. 이것도 LLM 모델 자체 학습 방법의 문제입니다. 보상 해킹 문제이죠. 연구에 따르면 거의 모든 종류의 보상 체계는 해킹당할 수 있습니다. 이건 뭐 어떻게 건들여야할지 잘 모르겠네요.
0 XDK (+0)
유익한 글을 읽었다면 작성자에게 XDK를 선물하세요.
-
기시감 꼭 해야 되나요 3 0
쌍윤러 림잇 마더텅 기출 임팩트 잘노기 순으로 다 돌렸고 3567순으로 생윤 50...
-
님들 6모국어 안풀었는데 2 0
언매다까먹엇는데 좀 나중에풀까
-
4등급 나오고 확통은 보통난이도면 29,30 빼고는 다 풀수있어요 공통은...
-
영대비 하면서 썰 3 2
화1 베라디 저자 분께서 학원에 놀러오셔서 중2한테 화1 실모를 풀리심 근데 누가 48점 받음
-
내가시발왜물투를할라고해서 3 1
6개월을날린거지 그냥 ㅅㅂ 화1생1 할걸
-
현역 7모 성적표 ㅇㅈ 5 0
뭔가 잘 본 과목이 없는데 국수탐 백분위는 나름 ㄱㅊ네요
-
영어유기원 5 3
영어유치원도아니고영어유기원임뇨 영어해야하는데.... 왜케하기싫지 오르비보면공통된병인듯하지만
-
유대종쌤 짤 어디갔지 3 0
그 대성쌤들 있고 그 앞에 쪼꼬미 대종쌤 있는 그 짤 어디갔지
-
사탐 7월 시작 ㅁㅌㅊ 10 0
ㅋㅋㅋㅋㅋㅋㅋㅋㅋ
-
참고) 이새끼 좆반고 통과 4,생1 4 지1 5출신 2 2
예아~~~~~
-
그 광주 여고생 살인범 4 1
레전드네 공개 총살형 해야할듯
-
저울게요 5 3
영어진짜똥나오게힘들어서울게요
-
25수능 18 19 20 꼬라지보고 화2 버림
-
갑자기 양대인 독도킥생각나버림 0 0
ㅈㄴ잘차네
-
그러다가 2609 집모쳣는데 47인가? 2컷이래서 화1로 선회하고 공부 유기때리다가 이지랄남
-
지능 ㅇㅈ 4 1
분명히 낮은게아닌데 내꼬라지는왜이렇지?
-
드릴7<4규 했던사람 누구야 1 1
드릴7이 더어렵잔아... 수2는 또이또이인데 수1은 드7이 훨 어려운듯
-
아니 열품타 안 끄고 갔네 3 0
영어만 4시간 함ㄷㄷ
-
진짜모름 걍 영재학굔데 앞에 예술만 붙인거임?
-
반수생 24일차 D-122 3 1
국수 강의 밀도가 상당히 높앗음 김동욱T 갠적으론 굳
-
수시 도태됐긴 했는데 20 4
여기 과중학교라 과떨들 ㅈㄴ 많았단말임 나는 1학년 1학기때 걍 통합과학 공부...
-
시대 사문 문서연쌤 0 0
6모 48점 1등급 7모 46점인데 시대인재 문서연 쌤 수업 들어도 괜찮을까요?...
-
평반고의 전교과 3.03에 완벽한 하향곡선. 생기부는 보는 쌤들마다 감탄할 정도로...
-
오공완 4 1
-
나는 외고가고싶었는데 1 1
중딩때 전교권에서 좀 놀았다고 이 지역은 미래가 없다 싶어서 외고로 ㅌㅌ할라고...
-
대종쌤 우승시켜 드리려 했는데 평균값이 아니라 3인팀 합산이었나 그 래서 심찬우팀...
-
은근 6 1
전국중간-낮자사고가 꿀통임 4점대도 좋은 대학교 가더라
-
풀어. 2 2
단어 알지? 풀어.오늘 n제 책 펴서 풀어.바보 같은 실수로 틀리는건 절대 안...
-
수특 국어 독서 0 0
김승리 풀커리고, 이미 tim까지 해서 기출은 끝났고, 연계 공부중입니다. 독서...
-
영과고= 설공 + 계약+ 카포지디유 수시로 가기용 외에는 가치가 없다고 생각함 정시...
-
내가 안가면 누가 가냐 생각했는데 좀 준비하다 중1때 가정사땜에 멘헤라터지고 아예...
-
고1이랑 고2 초반때 공부를 아예 놓은게 진짜 큰듯 4 1
지금 보면 그때만큼 짐승새끼가 따로 없엇던 그랫으면 지금보단 나앗을듯 ㅅㅂ
-
ㅇㅅㅇ
-
하 씹 대학 서울로 다니고 싶어서 수능 친다 관악 딱기다려
-
방학공부계획 2 0
내일플래너사기책읽기모의고사만들기국어수특하기(ㅈㄴ급함)수완도풀기물2갤칼럼다시보며실모벅벅...
-
나만 과고 손해라 생각하나 4 2
메디컬을 정시로 밖에 못 가지않음? 과고니까 공부잘하겠지 이런걸로 단순히...
-
과고 떡밥 15 0
이 도는 것 같은데 저는 할 말이 전혀 없어서 이만 공부하러 가보겠습니다. 다들 파이팅입니다
-
난 과고가 너무 가고싶엇는데 0 1
라임쩐다 과고가고싶엇음 근데 저때메타인지ㅆㅅㅌㅊ여서 당연히 과고는 들어가기도힘들고...
-
저능해서 그냥 벡터 안써야겠다 0 0
그냥 비역학 최대한 줄이고 그냥 레전드 계산 간다
-
암만 좆빠지게 해도 붙엇으면 내 지능으로는 디지유 이상을 거기서 못갓을거같음
-
몸 아플 때 얼마나 쉼? 7 0
오늘 지병(부정맥) 증상이 간만에 도져가지고 119도 부르고 (결국엔 증상이...
-
뻥이고 자사고로 바뀐 건 알고 있었는데 문과도 대우해준다길래 왔음 물론 ㅈ도 대우 안 해줌
-
과고는 생각도 없었음 2 0
영재고는 더 없었고 중딩 내신 빡세게 하고 그냥 물 흐르듯이 살았던거 같음
-
근데 별 생각 없어서 그냥 일반고로 옴
-
내신을 해 본 적이 없음 2 0
진정한 정시파이터
-
난 중딩때 들어가면 9 1
영과고는 쳐다보지도 않고 수능만 할거임 거기 가더라도 내신 도태되었음 + 사회성...
-
세지 0 0
기상쌤 계속 학생들이 어떤말하는지 보러 커뮤니티 오신다고해서 재미로 써봄. 기상쌤...
-
휴학 사유:반수 5 3
ㅇㅇ
-
중학생때 과고를 알았으면 0 0
내신 더 해서 과고갔지 ㅅㅂ
-
방학 3일이 맞냐? 0 1
수부터 금까지 3일임 학교 ㅈㄴ 가기 싫네
인지 과학적으로 보자면 인공지능과 인간은 모두 베이즈주의 머신이기 때문에 LLM의 한계는 DNN의 근본적 한계라기 보다는 가용할 수 있는 도구를 인간이 모델에게 쥐여줄 능력이 부족하다는 점에서 기인합니다.
예컨데 인공지능의 사고 개진 과정에서 DAG 다이어그램 등을 사용할 수 있게 해준다면 사고의 폭이 크게 확장될 것이라는 예측들이 학계에선 많이 돌고 있습니다.
그러니 이건 LLM의 한계가 아니라 인간의 LLM 활용 능력의 한계이고 LLM을 학습시킬 다이어그램 사용 예시를 양산할 수 없는 인간의 정보 생산 능력의 한계인 것입니다
전공이라서 좀 끄적여 봤습니다

정말 감사합니다. 정말 많은 도움을 주셨습니다!
제가 잘못 쓴 것이 아니라면 DAG를 활용한 방법을 시도해 보았습니다. 다만 그게 DAG라는 인식은 없어서 위상골격이라는 표현으로 쓰긴 했지만요. 지금 결과를 봤을 때는 사고과 확장되긴 하는 것 같습니다. 다만 아직 제가 원하는 수준까지 높이진 못했네요. ㅠㅠLLM은 기본적으로 언어를 매개로 사고합니다.
우리가 머릿속에서 다이어그램을 가용하는 방식과는 근본적으로 다른 점이, 우리는 언어 모델이 아니기 때문에 다양한 표상이나 기하적 직관을 동원하여 정보를 처리할 수 있는 반면에, LLM은 그 모든 작용을 언어적 엄밀성에 기반하여 비효율적인 노선으로 작동한다는 점입니다.
저희가 "표상 정보를 사용하는 예시"들을 양산할 수 없기 때문에 인공지능에게 이러한 직관을 학습시키는 것 또한 불가능하기에 현재 인공지능의 작동 방식이 이토록 인간과는 다르게 느껴진다는 것이죠.

감사합니다!! 이것도 참고할게요스캐폴딩이 도움될꺼라는 건 동의하는데 llm의 아키텍쳐 한계도 여전히 큰 걸림돌이긴 함
인간 정보생산 능력의 한계 때문만이라고 보기엔 요즘엔 llm 학습 데이터가 인간 생산 정보에 의존적이지 않기도 하고 (RL기반 추론 학습이라던가) dnn 자체의 근본적 한계도 명확함 조합적 일반화가 힘들다던가 인과 구조 파악이 안 된다던가 OOD에 취약하다던가 blackbox라던가..
인간과 ai 모두 베이즈주의적이라고 보기에도 서로 수준이 다르기도하고요 (ai는 베이즈정리를 알고리즘적으로 구현하는 게 아니니까요 + 베이즈주의는 하나의 이론일 뿐, 계산 수준의 유사성 != 알고리즘 수준의 동일성)

역시 고능고능나무다야. 이것도 참고하는 걸로