태그
AA-Omniscience 벤치마크에서 ChatGPT 최신 플래그십이 Claude보다 정확도는 근소하게 앞섰지만, 헛소리(할루시네이션) 비율은 상대방의 1.6배에 달했다. 기능, 가격 정책, 그리고 미 국방부 계약 하나가 두 AI 기업을 서로 다른 길로 이끌고 있다.