핫게 실시간 커뮤니티 인기글
종합 (5160693)  썸네일on   다크모드 on
루리웹-3.. | 13:02 | 추천 35 | 조회 0

ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고? +14 [22]

루리웹 원문링크 https://m.ruliweb.com/best/board/300143/read/76585557

ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?


ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_1.webp





ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_2.webp





ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_3.webp


와우.. 이틀 전에 출시한 챗지피티 6.0 성능이 굉장한걸?




ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_4.webp



오픈AI : 챗지피티 6.0은 AGI입니다!! AGI 시대를 개막합니다!!









ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_5.webp


비관론자: 니미 또 61023981번째 호들갑 아가리털기 시작됐네.





ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_6.webp




젠슨황: 내가봤는데 저거 AGI 맞음 ㅇㅇ 인정인정






ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_7.webp

특숭이: 아아... 난 틀리지 않았어.. AGI가 도래했구나..





ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_8.webp


ㅋㅋㅋㅋ 비관론자쉑 꼴이 아주 좋아~~?
빨리 항복문서에 서명해라



ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_9.webp






ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_10.webp


잠깐. 분명 엄청난 발전인 건 맞아. 발전속도는 더더욱 놀랍고. 하지만 AGI는 아니라고 생각해.



ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_11.webp

뭐!!!!!!!!!!! 저 성능과 이 벤치마크 점수들이 보이지 않더냐!!!!!!





ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_12.webp




벤치마크 GPT-5.6 Sol GPT-6 Astra 의미 ARC-AGI-3 7.8% 98.6%* 규칙을 알아내고 계획을 세우는 문제해결능력 (!!가장 충격적!!) Terminal-Bench Science 22.4% 64.6% 과학 작업 agent 능력 약 3배 AutomationBench 18.1% 41.4% 실제 업무 자동화 능력 2배+ FrontierMath Tier 4 83.0% 97.6% 최상급 수학 거의 포화 BenchCAD 83.3% 95.9% CAD/공학 작업 상당한 상승 Agents' Last Exam 52.7% 59.3% 실제 소프트웨어 작업도 상승






ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_13.webp

와우;; 이 벤치마크 상승은 진짜 레전드가 맞긴해;; 하지만..







ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_14.webp



위 이미지의 98.6% ARC-AGI-3는 OpenAI에 최적화된 Provider Adapter 환경에서 나온 수치야. 쉽게 말하면, 
오픈에이아이의 추론상태 유지+컨텍스트 시스템이 합쳐져야만 98.6%가 나왔다는 거지.
모든 회사에 공통된 Standard harness로 테스트하면 Astra 최고 점수는 62.7%였어.







ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_15.webp



엑... 진짜...?







ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_16.webp


븅신







ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_17.webp


사실 이건 AGI, Artificial General Intelligence (일반인공지능, 강인공지능이라고도 함)의 정의가 워낙 모호해서 생긴 일이기도 해.








ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_18.webp

어... 그게 뭐임?







ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_19.webp

....






ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_20.webp


야이 특숭아 그걸 모르면서 특이점을 빨고 있으면 어떡하니










ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_21.webp

정말 쉽게 설명하자면, 특정한 업무만 잘할 수 있는 약인공지능과는 달리,

모든 분야에서 인간수준 혹은 인간수준 이상의 능력을 발휘하는 인공지능을 말해.










ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_22.webp


예를 들어, 알파고는 바둑에 있어서는 세계 최강을 상대로 압도적인 기량을 보여줬지만,
알파고는 약인공지능이야. 알파고가 수학난제를 푼다거나, AI고양이귀미소녀안드로이드를 개발하는 건 불가능하기 때문이야.







ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_23.webp


문제는 이 인간 수준의 범용능력 부분에서 아직도 학계에서 의견이 분분하다는거야.








인물 대표적인 기준 핵심 차이 샘 알트만 여러 분야에서 점점 복잡해지는 문제를 인간 수준으로 해결. OpenAI 헌장은 경제적으로 가치 있는 업무 대부분에서 인간을 능가하는 고도로 자율적인 시스템으로 정의 폭넓은 업무 능력과 경제적 유용성에 초점. 알트만, 2025년 2월, OpenAI 헌장 다리오 아모데이 대부분의 주요 분야에서 노벨상 수상자보다 뛰어나고, 수시간∼수주짜리 일을 자율적으로 수행하며, 수백만 개를 병렬로 가동할 수 있는 AI 최상위 전문가를 넘는 능력 + 장기 자율성 + 대규모 복제. 본인은 AGI 대신 powerful AI라는 용어를 사용. 2024년 10월 에세이 데미스 하사비스 인간이 발휘할 수 있는 모든 인지 능력을 갖춘 시스템. 최고 수준의 과학·예술적 창의성과 신체 지능까지 포함 인간 능력의 전체 범위를 요구. 2026년 1월 29일 공개 인터뷰



인물 기준·판정 방식 해석할 때 주의할 점 출처 레이    커즈와일 인간 수준 지능의 판정 수단으로 엄격한 튜링 테스트를 중시. 유능한 심사자가 폭넓게 질문해도 AI를 인간과 신뢰성 있게 구분하지 못해야 함 그의 내기 규칙은 심사자 3명이 컴퓨터와 인간 후보들을 각각 2시간씩 인터뷰하는 구조. 짧은 대화에서 사람처럼 느껴지는 것과는 조건이 다름 본인의 논거와 내기 규칙, 2002년 얀  르쿤 인간 수준 AI에 필요한 핵심 능력으로 물리 세계 이해·지속적 기억·추론·계획을 제시 이것은 ‘몇 점이면 AGI’라는 완성된 합격선보다는 필요한 기능에 대한 설명. 2024년 당시 언어모델에 대한 평가를 현재 모델 전체에 그대로 적용해서도 안 됨 Lex Fridman 인터뷰, 2024년 3월, 2:47 부근 젠슨  황 2026년 인터뷰에서 진행자가 10억 달러가 넘는 가치를 지닌 기술 회사를 창업·성장·운영할 수 있는 AI라는 조건을 제시하자, 이미 AGI에 도달했다고 답함 이 기준은 진행자가 제시한 가정이야. 황은 잠깐 크게 성공했다가 사라지는 앱도 포함했고, 같은 대화에서 에이전트들이 엔비디아를 만드는 가능성은 0%라고 말했어. 보편적인 능력 검증 완료 선언으로 읽으면 안 됨 Lex Fridman 인터뷰, 2026년 3월, 1:55∼




레이 커즈와일은 튜링 테스트를 통과하는 정도를 AGI라고 부르는 반면,

데미스 하사비스는 19세기까지만큼의 지식을 넣어줬을때 스스로 상대성 이론을 발견하는 정도가 되어야 한다고 AGI라고 부른다고 말했지.
(아니 근데 그정도면 ASI 아닌가?)







ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_24.webp
그런데 특숭이는 재귀개선을 통한 지능폭발이 만드는 기술적 특이점을 원하는거잖아?
그럼 적어도 다리오 아모데이, 데미스 하사비스가 생각하는 수준이 되어야 AGI라고 부르는게 맞아.
왜냐? 그정도가 되어야만 AI가 더 똑똑한 AI를 생산하고, 그 AI가 더 똑똑한 AI를 생산하는
재귀개선 루프가 가능하기 때문이야.






ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_25.webp

시..시발...






ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_26.webp

그럼 그렇지. 역시 그냥 AI 거품이 빠지는게 두려운 딸깍팔이들의 허풍이었구만.






ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_27.webp



 또 그렇지만은 않은게, 8% 남짓했던 ARC-AGI 벤치마크에서 67%까지 넘버링 한단계만에 뛰어오른건 말도안되는 엄청난 발전속도가 맞아.
Agents' Last Exam 벤치가 굉장히 올라서 일반인에게도 엄청난 에이전트 툴이 생긴것도 맞고.









ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_28.webp


뭐여 님 내편 아니었음..?





ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_29.webp


최대한 중립적으로 이야기해야 하니까. 
오늘의 검증 결론은
챗지피티 6.0 (아스트라)는 AGI는 아니다.
하지만 엄청난 발전속도는 맞다. 

정도가 되겠네.







ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_30.webp


ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_31.webp


ㅋㅋㅋ뭐 다 호들갑 떠는데 모델링 해달라고 했더니 이정도 퀄로 나오는구만.








ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_32.webp


윌스미스가 스파게티를 손으로 처먹던게 2년 전인거 기억나냐?

챗지피가 대중에 공개된지 3년 9개월밖에 안지났다.
AI의 진짜 무서운 점은 발전속도에 있다..
나머지 벤치마크도 내년쯤엔 전부 포화될거야.






ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_33.webp

너희 비관론자들은 항상 똑같지.

번역은 AI가 할 수 없다-> 그림과 예술은 인간 고유의 창의성이다 -> 영상만큼은 AI가 할 수 없을 것이다 -> 코딩만큼은 AI가 할 수 없을 것이다


골대 옮기기가 지겹지도 않나?







ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_34.webp

지랄하네. AGI 재귀개선 해내고 나서 그런말을 좀 하던가 해라.





ai를 검증해보자- 챗지피티 6.0이 인간 수준의 강인공지능이라고?_35.webp

자자 싸우지들 말고. 어차피 시간은 지나가니까, 미래는 곧 오게 되어있어.
누구의 말이 맞았는지 확인해보자구.




[신고하기]

댓글(22)

1 2

이전글 목록 다음글

12 3 4 5
제목 내용