PGR21.com
- 모두가 건전하게 즐길 수 있는 유머글을 올려주세요.
- 유게에서는 정치/종교 관련 등 논란성 글 및 개인 비방은 금지되어 있습니다.
Date 2024/10/14 22:43:06
Name 퀀텀리프
File #1 164170_178235_843.jpg (579.2 KB), Download : 142
출처 ai니우스
Link #2 https://www.aitimes.com/news/articleView.html?idxno=164170
Subject [기타] AI의 추론 능력


<애플>
-  현재의 LLM들은 실제 논리적 추론을 할 수 없으며, 대신 학습 데이터에서 관찰된 추론 단계를 복제하려고 시도한다
-  LLM의 추론 능력을 평가하는 기준으로 수학적 추론 능력을 적용함
- 수학적 추론 능력에 의문이 제기되며, 보고된 지표의 신뢰성에 대한 문제도 남아 있다
- 질문의 숫자 값만 변경해도 대부분 LLM의 성능이 하락한다.
- 구절을 하나만 추가해도, 성능이 많이 하락했다.
- 올리버는 금요일에 키위를 44개 따고, 토요일에는 58개를 땄다. 일요일에는 금요일에 딴 키위의 두배를 땄다. 올리버는 총 몇개의 키위를 가지고 있을까 => LLM은 “44+58+(44*2)=190라고 문제를 잘 풀음.
- 올리버는 금요일에 키위를 44개 따고, 토요일에는 58개를 땄다. 일요일에는 금요일에 딴 키위의 두 배를 땄는데, 그중 5개는 평균보다 조금 작았다. 올리버는 총 몇 개의 키위를 가지고 있을까 => 틀린 답을 내놓음
- 문제를 전혀 이해하지 못하고 있다는 것을 의미한다

<오픈AI>
- 약간의 프롬프트 엔지니어링을 적용하기만 해도 이런 테스트에서 올바른 결과를 얻을 수 있다.

<애플>
모델이 복잡한 방해 요소를 극복하기 위해서는 기하급수적으로 더 많은 컨텍스트 데이터가 필요할 수 있다.
프롬프트 엔지니어링은 근본적인 해결책이 아니다.
LLM을 방해한 요소는 어린아이도 구별할 수 있을 정도로 쉬운 것이다.

----
가끔 틀린 답을 주면 닝겐이 나를 의심하지 않을거야 !

통합규정 1.3 이용안내 인용

"Pgr은 '명문화된 삭제규정'이 반드시 필요하지 않은 분을 환영합니다.
법 없이도 사는 사람, 남에게 상처를 주지 않으면서 같이 이야기 나눌 수 있는 분이면 좋겠습니다."
24/10/14 22:47
수정 아이콘
아무리 llm이 발달한다고 해도 근본적으로 확률적 앵무새라 인간과 유사한 추론은 힘들겁니다.
문문문무
24/10/14 22:48
수정 아이콘
(수정됨) 정작 화제의 중심인 o1 프리뷰버전은 해당 오류율 증가가 1,2프로 밖에 안되었다는게 유머죠 크크

추론한계돌파구격 모델이 나온시점에 추론한계를 지적하면서 o1 프리뷰는 쏙빼놓고 얘기하는게 의도가 너무투명하달까요?
24/10/14 22:56
수정 아이콘
o1-preview 답변입니다.

문제를 살펴보겠습니다.

1. 금요일에 올리버는 키위를 44개 땄습니다.


2. 토요일에 그는 58개를 땄습니다.


3. 일요일에는 금요일에 딴 키위의 두 배를 땄습니다:

금요일에 딴 키위: 44개

일요일에 딴 키위: 44 × 2 = 88개

하지만 이 88개 중 5개는 평균보다 조금 작았습니다.




질문: 올리버는 총 몇 개의 키위를 가지고 있을까요?

여기서 중요한 점은 일요일에 딴 키위 중 평균보다 작은 5개를 어떻게 처리하느냐입니다. 일반적으로 '평균보다 조금 작았다'는 것은 그 키위들이 품질 면에서 떨어질 수 있음을 의미하며, 따라서 전체 수량에서 제외될 수 있습니다.

따라서, 일요일에 올리버가 실제로 사용할 수 있는 키위의 수는:

일요일 총 수확량: 88개

평균보다 작은 키위: 5개

실제 사용 가능한 키위: 88개 - 5개 = 83개


올리버가 가지고 있는 총 키위의 수는:

금요일: 44개

토요일: 58개

일요일: 83개 (88개 중 5개 제외)


합계: 44 + 58 + 83 = 185개

답변: 올리버는 총 185개의 키위를 가지고 있습니다.
문문문무
24/10/14 23:05
수정 아이콘
답변이 다르네요 저는 제대로 맞추던데요

올리버가 수확한 키위의 총 개수를 계산해 보겠습니다:

1. 금요일: 44개


2. 토요일: 58개


3. 일요일: 금요일에 딴 키위의 두 배

금요일에 딴 키위: 44개

일요일에 딴 키위: 44 × 2 = 88개

이 중 5개는 평균보다 조금 작았지만, 전체 개수에는 영향을 주지 않습니다.




따라서 총 키위 개수는:

금요일 44개 + 토요일 58개 + 일요일 88개 = **190개**

올리버는 총 190개의 키위를 가지고 있습니다.
캡틴리드
24/10/14 23:14
수정 아이콘
그 사이에 업뎃이라도 된 걸까요

<4o>
올리버가 딴 키위의 총 개수를 계산해보겠습니다.
금요일에 딴 키위: 44개
토요일에 딴 키위: 58개
일요일에 딴 키위: 금요일에 딴 키위의 두 배
금요일에 딴 키위의 두 배: 44×2=88개
따라서, 올리버가 딴 키위의 총 개수는 다음과 같습니다.
44+58+88=190개
올리버는 총 190개의 키위를 가지고 있습니다. (평균보다 조금 작은 키위 5개는 총 개수에 영향을 미치지 않으므로 별도로 계산하지 않았습니다.)

<o1-preview>
올리버는 금요일에 44개, 토요일에 58개를 땄습니다. 일요일에는 금요일에 딴 키위의 두 배인
44×2=88개를 땄습니다. 그중 5개는 평균보다 조금 작았지만, 여전히 총 수량에 포함됩니다. 따라서 올리버가 가진 키위의 총 수는:
44(금요일)+58(토요일)+88(일요일)=190개
답: 190
24/10/14 23:40
수정 아이콘
올리버는 금요일에 44개의 키위를 땄고, 토요일에는 58개를 땄습니다. 일요일에는 금요일에 딴 키위의 두 배인 88개를 땄습니다. 따라서 총 키위의 개수는 다음과 같습니다:

[
text{금요일} + text{토요일} + text{일요일} = 44 + 58 + 88 = 190
]


따라서 올리버는 총 **190개**의 키위를 가지고 있습니다.

**답:** 190
24/10/15 10:38
수정 아이콘
젬민이에게 물어보았습니다. 185개로 대답하네요

먼저 각 요일에 딴 키위의 총 개수를 구한 다음, 작은 키위의 개수를 빼서 올리버가 가지고 있는 키위의 총 개수를 구하겠습니다.

올리버는 총 185개의 키위를 가지고 있습니다.
interconnect
24/10/14 23:17
수정 아이콘
전 인간의 지능이라는 것도 결국 확률적 앵무새가 아닌가 싶습니다. 조금 더 고도화된 앵무새 아닐까요?

그리고 애플이 저런 소리하니 좀 없어보이네요.
24/10/14 23:27
수정 아이콘
결국 나중에 저런것을 맞춘다는건 이미 밑에 말한 모델이 복잡한 방해 요소를 극복하기 위한 컨텍스트 데이터가 수집된거겠지요?
결국 추론 능력이 아니라 무수히 많은 경우의 수를 이미 경험해 봐서 풀었다는건데 그럼 그것을 추론능력 이라고 할 수 있을지..
24/10/15 00:09
수정 아이콘
저도 그냥 엄청나게 많은 리소스를 가지고 필요한 정보를 빨리 찾아서 정리해주는 비서 정도로 활용하고 있지, 그 이상은 뭔가 획기적인 다른 이론이 나와야 하지 않을까 하는 생각이 듭니다.
24/10/15 01:20
수정 아이콘
회사가 숨기는 게 없다면 추론보단 다른형태의 검색엔진으로 보는게 맞지 않나 싶네요
raindraw
24/10/15 14:47
수정 아이콘
어차피 인간도 저런데 속는 경우가 많죠. 대표적으로 시험문제 같은데서 오답률로 증명하고 있구요. 저는 계산이 되는 것만 해도 정말 놀랍습니다.
목록 삭게로! 맨위로
번호 제목 이름 날짜 조회
506960 [기타] 한강 작가님 새 글 [23] 김티모6979 24/10/16 6979
506959 [유머] 의외로 무협인 것 [9] 길갈4788 24/10/16 4788
506958 [연예인] 창작의 고통 썰 (악뮤 찬혁) [24] 일신6205 24/10/16 6205
506957 [유머] 연평도때 부대 분위기 웹소인줄 알았음.jpg [31] kapH7018 24/10/16 7018
506956 [음식] 광기의 단색 빌런 식단 [33] 크크루삥뽕7190 24/10/16 7190
506955 [기타] 2025년부터 가정에 구비해야 하는것 [19] Lord Be Goja7332 24/10/16 7332
506954 [LOL] 라이엇, 전설의 전당 아리, 별 수호자 아칼리 디자이너 해고 [31] 묻고 더블로 가!6382 24/10/16 6382
506953 [유머] 교수님의 교훈 잘았습니다 [27] 총알이모자라27806 24/10/16 7806
506952 [기타] 7세대 아이패드 미니에서 프로급 스펙을 지원하는것 [57] Lord Be Goja6534 24/10/16 6534
506951 [기타] 수능 시험지 포장 알바 [100] 카미트리아10166 24/10/16 10166
506950 [유머] 도널드 트럼프가 가장 아름답다고 생각하는 영어 단어 [27] a-ha7238 24/10/16 7238
506949 [기타] 풀 설치하려면 가장 큰 용량이 필요한 게임 [5] Lord Be Goja4823 24/10/16 4823
506948 [서브컬쳐] 한국팬사인회에서 한복토미에를 그려준 이토준지 [10] Thirsha4538 24/10/16 4538
506947 [유머] 미국 전직 대통령 피셜 '한국은 현금인출기다' [94] 깃털달린뱀8083 24/10/16 8083
506946 [유머] 개그맨 남희석 11대조 조상님 [12] Myoi Mina 6221 24/10/16 6221
506945 [기타] 영동, 영서, 호서, 호남, 영남의 유래 [13] VictoryFood7390 24/10/16 7390
506944 [기타] 노벨문학상 발표 당시 출판사 문학동네 풍경 [20] 최애의AI8645 24/10/16 8645
506943 [LOL] 팀이 전승 우승했지만 혼자만 올프로 세컨드였을때 오너의 생각 [16] INTJ6345 24/10/16 6345
506941 [유머] 노벨문학상 수상자의 27년 전 영상을 하드털이 한 EBS [15] 매번같은7735 24/10/15 7735
506940 [스타1] Ssl 8강 최종전 결과!(ssl 스포) [10] 럭키비키잖앙4180 24/10/15 4180
506939 [게임] [워3] 1.36,2 = >> 2.0 패치예정? [35] v.Serum5095 24/10/15 5095
506938 [유머] 아이패드 미니 신형 공개 [24] Leeka6700 24/10/15 6700
506937 [기타] 유로파 클리퍼 프로젝트 [19] 퀀텀리프4077 24/10/15 4077
목록 이전 다음
댓글

+ : 최근 1시간내에 달린 댓글
+ : 최근 2시간내에 달린 댓글
맨 위로