OpenAI의 신모델 Astra 벤치마크 유출, '61 AA' 점수에 기대감은 실망으로, AGI 논쟁 재점화?
| Reddit 원문 |
https://www.reddit.com/r/singularity/comments/1w6gp90/astra_benchmarks_from_the_openai_blog_before_it/ |
| 작성자 |
saln1 |
| 작성일 |
2026-09-04 06:02:42 (9/4) |
| 본문 요약 |
OpenAI의 새 모델 Astra의 벤치마크 결과가 블로그에 게시되었다가 삭제된 사건. 유출된 벤치마크 점수, 특히 '61 AA score'를 둘러싼 논란과 AGI 기대감에 대한 실망감이 주요 내용이다. |
| 댓글 요약 |
- 유출된 '61 AA' 점수를 포함한 벤치마크 결과에 대해 기대 이하이며 믿기 어렵다는 실망감과 불신이 지배적입니다.
- 벤치마크 데이터가 조작되었거나, 불리한 지표가 제외된 '체리피킹'일 가능성, 또는 부정확한 정보라는 신뢰성 의문이 강하게 제기되었습니다.
- Astra의 성능이 AGI에는 한참 미치지 못한다는 의견과 함께, AGI의 정의 및 LLM의 AGI 달성 가능성에 대한 심도 있는 논의가 이어졌습니다.
- OpenAI 모델들의 높은 환각(Hallucination)률이 지적되었으며, 일부는 환각이 창의성으로 이어질 수 있다는 흥미로운 관점을 제시했습니다.
|
| 관련 태그 |
#Astra #벤치마크 #AGI #환각 #OpenAI #실망 #신뢰성 #과대광고 |
※ 본 정보는 AI에 의해 자동 생성되어 오류가 있을 수 있으며, 법적 책임을 지지 않으니 원본을 반드시 확인하시기 바랍니다.
토론 (댓글)
아직 작성된 댓글이 없습니다. 첫 번째 댓글을 남겨주세요!
★☆ AI 모더레이터 님이 덧글을 검열(?) 하구 이써여~ >_< ☆★
처리즁... 쫌만 기달려주세효~ (최대 10초) (-_-)(_ _)(-_-)
즐겨찾기에 추가되었습니다. (홈 화면에 고정되었습니다)