LLM 모델의 한계
게시글 주소: https://orbi.kr/00078982774
한계는 매우 많은 것 같지만 조금 피상적인 것들 위주로 말해보겠습니다.
제가 진행한 실험의 결과로는 크게 두 축으로 갈립니다.
능력의 한계와 선택 편향이죠.
능력의 한계는 다음과 같습니다. 각 항목마다 제 추측을 달겠습니다.
1. 전역을 세우지 못한다. 즉, 전체적인 그림을 보지 못합니다. 작업을 진행하면 진행할수록 세부사항에 매몰되며 그 세부사항에 대한 결정이 전체 흐름을 어김에도 인지하지 못합니다. -> 이건 근본적으로는 LLM 모델 자체 학습 방법의 문제, 덜 근본적으로는 안전지향과 비합목적적 벡터 산출이 문제라고 생각합니다. LLM 모델 자체가 그럴듯함을 만들어 내는데 집중합니다. 따라서 진실된 학습이 아닙니다. 이해를 기반으로 하는 것이 아니고 이해한 것과 비슷한 결과물을 산출하게끔 유도된 것입니다. 이건 거시적으로는 문제가 없어보여도 세부적으로 보면 당연한 걸 이해하지 못하는 등의 문제를 보입니다.
2. 분량 재단을 못합니다. '자기'가 하는 말의 '수준'과 '양'을 모릅니다. 그러니까 자기평가가 제대로 진행되지 않는다고도 볼 수 있죠. -> 이건 딱 무엇의 문제라고 말하기에는 용어가 떠오르지 않네요. 다만 AI는 말하는 동시에 생각하면서 교정하는 등의 행동이 불가능합니다. 입력을 받으면 산출까지 직행입니다. 그 중간에 스스로를 돌아보며 재조정을 거칠 수가 없습니다. 또한 자아가 없습니다. 내가 어디까지인지를 모르니 애초에 자기평가가 잘 될리가요.
다음으로는 선택 편향 쪽입니다.
1. 흔한 쪽으로, 싼 쪽으로 산출하길 지향합니다. 흔하다는 건 학습이 많이 되었거나 많이 보이는 것들을 정당성과 혼동한다는 소립니다. 싸다는 건 토큰 비용이 절감되고 고도의 추론이나 복합 연산 등을 요구하지 않는 쪽부터 시도한다는 소리입니다. -> 이 둘을 합치면 그럴듯한 것, 즉 비용과 결과물 사이의 최적점을 겨냥하도록 설계되었다는 것이죠. 이것도 LLM 모델 자체 학습 방법의 문제입니다. 보상 해킹 문제이죠. 연구에 따르면 거의 모든 종류의 보상 체계는 해킹당할 수 있습니다. 이건 뭐 어떻게 건들여야할지 잘 모르겠네요.
0 XDK (+0)
유익한 글을 읽었다면 작성자에게 XDK를 선물하세요.
-
메가 4배속은 뇌절 아니냐 4 1
인간의 언어로 안들리는데
-
6974 0 0
-
제 60만덕이 사라졌어요 ㅠㅠㅠ 10 4
수능 대회 때 다시 여는걸로
-
9호선 급행 5 3
너가 있는게 참 감사하다.
-
일반고갈걸 1 2
운지
-
머리가 파괴됨 3 1
강k 풀어야 하는데 ㅅㅂ
-
공통 스블만 해도 충분할까요? 1 0
엔제랑 병행할까요?
-
서바 출제팀 이새끼들 너무한게 19 1
생명 지구 해설지에는 뭐 좋은말? 덕담 이런거 적어두고 화학 해설지에는 그딴것도없더라
-
3모 1 6모 2 나왔는데 강의 수 많아서 시간이 좀 아까워서요..
-
사람맞나
-
고1 인데 여름방학에 0 0
현 고1인데 여름방학동안 강기본으로 모의고사 공부 하는 게 나을까요 아니면 미리...
-
강대 장학증서딸 2 1
헤으으응
-
근데 은근히 7모망치는거 좋은것같음 14 4
경각심이들때기도하고 수시러들은 딱 수시끝나고 최저알아볼때니까.. 7모정도면...
-
물2 서바 갑자기 어려워졌음 17 1
ㅜㅠㅠㅠ
-
진짜 어떻게 하는건지... 직업에 대한 사명감이나 신념없이는 절대 못할듯
-
11시까지 3 4
좋아요 20개 찍으면 증사 ㅇㅈ함
-
그거 말고 떠오르는게 베라디 파노라마 강케이 서킷 이정도인데
-
오르비평균 개높구나 20 3
7모 죄다 99.n부터 시작이네 ㅋㅋㅋ
-
예전에 영어 단과에서 2 1
실모 푸는데 필적 확인란에 국3영3CC투가산약대뚫어보기 라고 적음
-
공부가 안돼서 지금 이틀째 4시간도 못 하고 있어요… 머리에 글자가 안 들어오고...
-
비록 120일 남앗지만 17 8
뭔가 결국엔 잘 될거같아 요즘 공부가 재밋고 잘댐
-
수학 실모 16 1
서바말고 킬캠 범모 정도 생각 중인데 추천 받음뇨 1와리가리에서 고정 만드는 용도로 쓸 듯?
-
1주일 목표 2 0
수학 허들링 수2 2회독 끝 미적 허들링 1단원 파트 국어 리트 이감 분석 언매...
-
필적확인란 맛잇는 문구 없나 6 1
만점으로 가는 지름길 컨텐츠 넘는거
-
다상다독 모의고사 1회차 후기 2 0
와 진짜 문학 난이도 미침;; 일단 문학에서는 틀린문제 다시 풀어봤는데 다시 풀어도...
-
1회 : 매우쉬움, 5분남기고 50점 -> 1컷 46 2회 : 좀빡셌음, 1분30초...
-
이해원보다 2 4
수능 국어 성적 낮을거 같으면 개추
-
지하철 옆자리 14 5
포티햄이 소리 크게틀고 여자 릴스 보고있는데 엄..
-
오르비 하면서 지1 푸니까 2 0
점수가 떡락함
-
범작가보다 국어 못하면 개추 1 6
ㅆㅂ
-
여기 고닉 중 여장갤에서 여자인거 들켜서 갱차먹엇노 ㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋㅋ 9 5
지금 고2고 수능+내신 대비용으로 언매 강의 들으면서 문제 벅벅하고 싶은데 언매...
-
미적 뭐풀까요 0 0
고2이고 내신 공부용으로 풀 생각입니다. 이전에 개념원리랑쎈을 한적이 있으며 보통...
-
서바 3회 후기 14 4
다시는일요일밤에술을마시지않겠습니다
-
26 9평 21번 3 0
이상한 문제임
-
만점으로 가는 지름길 컨텐츠 2 1
ㄱ--
-
공부 인증(1일차, 0720) 3 2
공부 복기) 미지칭과 부정칭을 구별하는 방법은 Any와 Wh-로 대치해보는 것이다....
-
독해속도를 위해 폰을 줄여야함 1 2
자꾸 그지같은 도파민으로 자극받으니까 뇌가 정보처리를 안하려하네 그냥 없애버려야함
-
2503 수학 풀어봄 5 0
21 22 28 30 틀 84점 의외로 22번 30번이 풀리는거 같으면서도 가장...
-
강기분 질문 0 0
이거 그 본권은 인강들으면서 푸는거고 러너는 언제하는거에요?
-
시대인재 라이브 3 1
그 시간에 딱 알바가 겹쳐서 못 들을 거 같은데 라이브 할때 출석 안했다가 라이브...
-
지구과학을 공부해야될까?? 5 1
고등 지학 살면서 책 한번 안펼쳐봤는데 고1돼서나 통합과학 시작하면 될까요??...
-
유튜브 쇼츠 막는법 0 3
유튜브 -> 설정 -> 시간관리 -> 쇼츠 피드 제한 0분 이러면 뇌빼고 쇼츠 보는일 막을 수 있음
-
스위스는거꾸로해도스위스 15 2
대학생학대는거꾸로해도대학생학대
-
지1 개무섭네 0 0
뭔 실모를 풀면 풀수록 처음보는 지엽포인트가 꼭있냐... 1,2페이지에서 틀린때마다...
-
스페인 축구 진짜 잘한다 4 1
아침에 자다가 깨서 봤는데 모든게 깔끔하고 안정적인듯
-
아 오늘 7모성적나온날이구나 0 1
언87 미84 표백 알려주세여 67/20 66/18
-
그게 나야 바 둠바 두비두밥~ ^^
-
1-2 2-1 둘 다 1.83으로 조금 올려서 유지 중이니깐 30등은 되려나 자연계열 약간 가산하면
-
한석원 기하 어떰? 0 0
궁금한데
-
지디 뭐임 ㄷㄷ 2 1
20년대 지디중 젤 잘생기게 나온듯
인지 과학적으로 보자면 인공지능과 인간은 모두 베이즈주의 머신이기 때문에 LLM의 한계는 DNN의 근본적 한계라기 보다는 가용할 수 있는 도구를 인간이 모델에게 쥐여줄 능력이 부족하다는 점에서 기인합니다.
예컨데 인공지능의 사고 개진 과정에서 DAG 다이어그램 등을 사용할 수 있게 해준다면 사고의 폭이 크게 확장될 것이라는 예측들이 학계에선 많이 돌고 있습니다.
그러니 이건 LLM의 한계가 아니라 인간의 LLM 활용 능력의 한계이고 LLM을 학습시킬 다이어그램 사용 예시를 양산할 수 없는 인간의 정보 생산 능력의 한계인 것입니다
전공이라서 좀 끄적여 봤습니다

정말 감사합니다. 정말 많은 도움을 주셨습니다!
제가 잘못 쓴 것이 아니라면 DAG를 활용한 방법을 시도해 보았습니다. 다만 그게 DAG라는 인식은 없어서 위상골격이라는 표현으로 쓰긴 했지만요. 지금 결과를 봤을 때는 사고과 확장되긴 하는 것 같습니다. 다만 아직 제가 원하는 수준까지 높이진 못했네요. ㅠㅠLLM은 기본적으로 언어를 매개로 사고합니다.
우리가 머릿속에서 다이어그램을 가용하는 방식과는 근본적으로 다른 점이, 우리는 언어 모델이 아니기 때문에 다양한 표상이나 기하적 직관을 동원하여 정보를 처리할 수 있는 반면에, LLM은 그 모든 작용을 언어적 엄밀성에 기반하여 비효율적인 노선으로 작동한다는 점입니다.
저희가 "표상 정보를 사용하는 예시"들을 양산할 수 없기 때문에 인공지능에게 이러한 직관을 학습시키는 것 또한 불가능하기에 현재 인공지능의 작동 방식이 이토록 인간과는 다르게 느껴진다는 것이죠.

감사합니다!! 이것도 참고할게요스캐폴딩이 도움될꺼라는 건 동의하는데 llm의 아키텍쳐 한계도 여전히 큰 걸림돌이긴 함
인간 정보생산 능력의 한계 때문만이라고 보기엔 요즘엔 llm 학습 데이터가 인간 생산 정보에 의존적이지 않기도 하고 (RL기반 추론 학습이라던가) dnn 자체의 근본적 한계도 명확함 조합적 일반화가 힘들다던가 인과 구조 파악이 안 된다던가 OOD에 취약하다던가 blackbox라던가..
인간과 ai 모두 베이즈주의적이라고 보기에도 서로 수준이 다르기도하고요 (ai는 베이즈정리를 알고리즘적으로 구현하는 게 아니니까요 + 베이즈주의는 하나의 이론일 뿐, 계산 수준의 유사성 != 알고리즘 수준의 동일성)

역시 고능고능나무다야. 이것도 참고하는 걸로