AI
AI 코딩 모델 성능·비용 현황 분석
SpaceXAI 최신 모델과 경쟁 모델의 평가 결과를 비교한다
현재 AI 활용 현장에서는 코딩 지원 모델의 성능과 비용 효율성이 주요 이슈가 되고 있다. 이에 대한 구체적 수치를 확인하기 위해 최신 평가 결과를 살펴보았다.
현재 AI 활용 현장에서는 코딩 지원 모델의 성능과 비용 효율성이 주요 이슈가 되고 있다. 이에 대한 구체적 수치를 확인하기 위해 최신 평가 결과를 살펴보았다.
SpaceXAI는 새로운 모델을 코딩과 지식 업무용으로 소개했으며, 이전 버전보다 규모가 큰 기반 모델과 장시간 과제에 중점을 둔 강화학습을 적용했다.
이 모델의 xHigh 버전은 CursorBench 4.0에서 46.3%를 기록했다. 또한 Terminal‑Bench 4.0에서는 37.6%, HealthBench Professional에서는 56.7%를 달성했다고 밝혔다.
동일 평가에서 Fable 5.1 Max는 각각 51.8%, 57.9%, 62.1%의 점수를 받아 상대적으로 높은 성과를 보였다.
토큰 비용은 입력 100만 토큰당 2달러, 출력은 100만 토큰당 6달러로 공개되었다. 이러한 수치는 기업이 선택해 공개한 결과이며, 보편적인 우위를 의미하지 않는다.