TGViewer
ST Asian Parser ST Asian Parser @asian_parser · 1.61K subscribers
Post #523816 16

Forwarded from 피린이 (피린이)

✔️AI 직관력 테스트, 인간 93% vs GPT-6 53%

Scale Labs가 인간의 직관적 시각 추론 능력을 평가하는 새로운 벤치마크 HSS를 공개했습니다.
트윗원문

- 이미지·비디오 기반 522개 과제로 구성
- 인간 평균 점수 93.1%
- 최고 성능 AI GPT-6 Astra 53.6%
- 중간 수준 AI 모델은 30.9%

이번 결과가 의미하는 3가지
1. AI의 추론 능력에는 여전히 한계가 있음
2. AI 에이전트의 신뢰성 문제
3. 다음 AI 경쟁은 현실 세계에 대한 이해

✍️AI가 엄청 똑똑해진 건 맞지만, 인간처럼 직관적으로 상황을 이해하는 능력은 아직 부족해 보이네요. AI의 다음 단계는 단순히 정답을 잘 찾는 것을 넘어, 실제 상황에서 얼마나 올바른 판단을 내릴 수 있느냐가 중요해질 것 같습니다.
More from @asian_parser
  1. Oct 8, 2026미나라 TGE 빠르게 했으면 좋겠네요 스파크 많이 쌓아둠
  2. Oct 8, 2026🕺 빗썸 X 미나라 이벤트 큰거왔다 이번에 빗썸과 미나라 에서 재미있는 대회를 하나 준비하고 있다고 합니다! 바로 AI vs 인간 실전 투자 대결 빗썸 AI 트…
  3. Oct 8, 2026메인행사장 방문 및 견학중. 컨텐츠는 안샘이 0G 까고 0G가 방어하는 세션
  4. Oct 8, 2026대구 수성구 20평 14억 🔥 전국구급 학군지 + 재개발 기대감
  5. Oct 8, 2026지갑에 1달러도 안되던 폐지가 10달러가 되어있음
  6. Oct 8, 2026당신이 OKX를 열심히 써도되는 8가지 이유✔️ 1. 맨체스터 시티 경기를 초청해준다 2. 맥라렌 F1 경기를 초청해준다 3. 위 모두 비행기와 호텔이 포함이다…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →