aiZDNet Korea· 2026. 7. 20. 오전 9:30:308.0

팀스파르타 초경량 언어모델, 'K-AI 리더보드' 초고난도 추론 1위

[지디넷코리아]팀스파르타(대표 이범규)가 자체 개발한 초경량 언어모델 ‘K-AX 스파르탄 1.8B’가 과학기술정보통신부와 한국지능정보사회진흥원(NIA)이 운영하는 ‘K-AI 리더보드’의 초고난도 추론 평가인 ‘HLE(Ko)’ 분야에서 1위를 차지했다.이번 성과에 대해 회사는 "대형 모델 중심의 AI 시장에서 독자적인 초경량 모델의 압도적인 효율성과 고난도 추론 성능을 입증했다는 점에서 의의가 크다"고 밝혔다.HLE(Humanity’s Last Exam)는 미국 AI안전센터와 스케일AI가 공동 개발한 초고난도 AI 추론 벤치마크다. 수학, 과학, 인문학 등 100여 개 분야 전문가가 출제한 2500개 문항으로 구성돼 최상위 AI 모델조차 통과가 까다로운 평가로 알려져 있으며, K-AI 리더보드의 핵심 평가 지표 중 하나다.HLE(Ko)에서 평가에서 ‘K-AX 스파르탄 1.8B’는 0.123점을 기록하며 2위 모델(0.077점) 대비 4.6%포인트, 약 60% 높은 성능을 보였다. 10위권 모델 대부분이 0.068~0.077점대에 분포한 가운데 단독 선두에 오른 것이다. 18억 개 파라미터의 초경량 모델이 수백억에서 수천억 개 규모의 대형 모델들을 제친 결과로, 상위 10개 모델의 평균(약 38.7B)과 비교하면 20분의 1 크기로 거둔 성과다. 특히 236B급 모델 대비 파라미터는 131분의 1에 불과하지만, 점수는 두 배 이상 높았다.메모리 요구량도 약 256M에 불과해 CCTV나 초소형 컴퓨터인 라즈베리 파이(Raspberry PI)처럼 고도로 제한된 환경에서도 고난도 추론을 한다. 236B급 대형 모델을 구동하려면 수백 GB 메모리의 멀티 GPU 클러스터가 필요한 데 반해 하드웨어 요구량이 100분의 1 이하다. 즉, 거대 모델이 데이터센터의 GPU 서버 한 대가 필요할 때 K-AX 스파르탄 1.8B는 초소형 컴퓨터 한 대에 들어가는 셈으로, 고난도 추론 성능은 유지하면서 AI 인프라 비용을 90% 이상 낮출 수 있는 구조다.비결은 자체 개발한 학습 방법론 ‘SGT·SSGT’에 있다. 문장 전체 토큰을 고르게 학습하는 기존 방식과 달리, 추론의 방향을 좌우하는 핵심 토큰을 선별해 학습을 집중하고, 답변 과정에서 오류 가능성을 점검해 스스로 경로를 수정하는 자기 교정 학습을 결합했다.팀스파르타는 검증된 방법론을 대형화해 주력 프런티어 모델 'K-AX 스파르탄 122B'를 완성했다. 양자화(경량화) 기술을 적용해 기업 내부 장비에서도 운용된다. 122B를 엔진으로 쓰는 'AX 포트리스'는 인터넷과 분리된 폐쇄망에서 작동하는 AI 코딩 에이전트다. 소스코드와 내부 데이터를 외부로 보내지 않고 코드 생성, 자동완성, 검토부터 빌드, 테스트, 배포 도구 호출까지 수행하며, 자동완성 응답 속도는 워크스테이션 한 대 기준 0.3초 미만으로 실측됐다.주요 대상은 금융·공공·국방·제조 등 외부 생성형 AI 사용이 제한되는 분야다. AX 포트리스를 사용하면, 정보 유출 우려로 클라우드 기반 코딩 도구를 도입하지 못한 기업도 사내망에서 AI 개발 환경을 구축할 수 있다. 보안관제 분야에서는 도메인 특화 학습과 내부 관제 시스템 연동 검증을 마쳤으며, 향후 법률 문서 검토, 금융 규제 해석, 의료 가이드라인 분석 등 복합적인 판단이 필요한 업무로 적용 범위를 넓힐 계획이다.이범규 팀스파르타 대표는 “이번 1위는 팀스파르타의 독자적인 설계와 학습 기술만으로 세계적 수준의 추론 성능을 구현할 수 있음을 입증한 결과”라며 “검증된 기술을 적용한 K-AX 스파르탄 122B와 AX 포트리스를 기반으로 보안과 생산성이 함께 필요한 기업의 실질적인 AX를 적극 지원하겠다”고 밝혔다.

💡 AI 분석: 초경량 언어모델이 고난도 추론 벤치마크에서 대형 모델을 넘어선 기술적 성과로 전략적 신호로 분류됨
원문 보기 (ZDNet Korea) →