이 소식은 무엇인가요?
배경부터 차근차근 살펴보기
과학기술정보통신부는 한국의 AI 기술 주권을 확보하기 위해 '독자 AI 파운데이션 모델(독파모)' 개발 사업을 추진 중입니다. 이 사업은 글로벌 대형 AI 모델에 의존하지 않고 국내에서 개발한 기초 모델을 확보하기 위한 정책입니다.
과기부는 8월 27일 독파모 프로젝트 2차 단계평가의 세부 점수를 처음으로 공개했습니다. 이는 모티프테크놀로지스가 투명성을 요청했고 다른 참여 기업들도 동의한 데에 따른 조치로, 정부 정책의 투명성을 크게 높인 결정입니다.
평가는 국제 벤치마크(AAII, NIA), AI 전문가 평가, 일반 사용자 평가(AI 전문가 및 일반국민) 세 가지 방식으로 진행되었습니다. 주목할 점은 일부 기업이 국제 벤치마크에서는 경쟁사를 크게 앞섰으나 전문가와 사용자 평가에서 점수가 대폭 깎이는 결과가 나타났다는 것입니다.
이 같은 결과는 AI 모델 평가가 객관적 성능 지표만으로 결정되지 않으며, 실제 사용 경험과 전문가 판단이 얼마나 중요한지를 보여줍니다. 독자가 AI 도구를 선택할 때도 기술 지표만 믿지 말고 사용자 평가와 전문가 의견을 함께 고려해야 함을 시사합니다.
이번 공개는 향후 평가 결과 추적을 통해 한국 AI 생태계의 발전 방향을 객관적으로 관찰할 수 있는 기반을 마련했습니다. 다음 평가 단계에서도 이런 투명성이 유지되고, 기업들이 사용자 만족도를 높이기 위해 어떻게 개선되는지 살펴볼 필요가 있습니다.

공식 발표에서 확인된 내용
구체적으로 무엇이 달라졌나
- 01
평가는 국제 벤치마크, 전문가 평가, 사용자 평가(AI 전문가 및 일반국민) 세 가지 방식으로 진행되었으며, 각 항목에서 기업별로 상이한 성과가 나타났습니다.
- 02
모티프테크놀로지스는 AAII 글로벌 벤치마크에서는 다른 기업들을 크게 앞섰으나, 전문가 평가와 사용자 평가에서는 점수가 대폭 깎여 종합 순위에서 하위권으로 밀려났습니다.
- 03
정부가 세부 평가 점수를 공개함으로써 정책 집행의 투명성과 책임성이 강화되었으며, 기업들이 개선 방향을 객관적으로 파악할 수 있는 기반이 마련되었습니다.
- 04
벤치마크 점수의 우수성이 실제 사용자 만족도로 이어지지 않는 경우가 있다는 점은, AI 평가 체계 설계 시 다양한 관점의 중요성을 강조합니다.
사용자에게 미치는 영향
누구에게 어떤 의미가 있나
AI 도구 선택 기준의 재검토
기술 지표(벤치마크)만으로는 실제 사용 적합성을 판단할 수 없다는 점을 깨닫게 되며, 앞으로 도구를 선택할 때 사용자 평가와 전문가 의견을 더 비중 있게 고려하는 습관을 기를 수 있습니다.
한국 AI 생태계의 현주소 파악
국내 주요 AI 기업들의 개발 수준을 객관적 데이터로 확인할 수 있게 되었으며, 향후 한국 AI 시장의 발전 추이를 기준점을 가지고 추적할 수 있습니다.
정책 투명성 향상의 선례 형성
정부 사업의 평가 결과가 공개되면서 정책 집행의 객관성이 높아졌으며, 이는 다른 정부 AI 정책의 평가에서도 투명성을 기대하는 선례가 될 수 있습니다.
실제 활용 장면
어디에 어떻게 써볼 수 있나
기업 담당자의 개선 우선순위 결정
평가 결과의 벤치마크와 사용자 평가 격차를 분석하여 자사 모델의 약점을 파악하고, 투자 방향을 결정할 때 참고할 수 있습니다.
- 예를 들면
- A 기업 담당자가 평가 결과를 보고 '우리 모델은 기술 성능은 우수하지만 실제 사용자 인터페이스와 응답 속도에서 뒤떨어진다'는 인사이트를 얻음
- 확인할 결과
- 사용자 경험 중심의 개선을 통해 다음 평가에서 전문가 및 사용자 평가 점수 상향
연구자의 모델 선택 기준 설정
자신의 연구 필요에 맞는 AI 모델을 벤치마크만이 아니라 실제 사용자 평가 점수도 함께 고려하여 선택할 수 있습니다.
- 예를 들면
- 논문 작성 보조 AI를 찾는 연구자가 벤치마크 순위가 낮아도 사용자 평가가 높은 모델부터 직접 테스트해보기로 결정
- 확인할 결과
- 실제 연구 작업에 더 적합한 도구를 발견하고 생산성 향상
정책 담당자의 지원 정책 조정
각 기업의 평가 결과를 분석하여 정부 지원 프로그램(컨설팅, 개발비 등)의 방향을 조정할 수 있습니다.
- 예를 들면
- 부처 담당자가 '사용자 만족도가 낮은 기업에 대해서는 UX/UI 개선 컨설팅 지원을 우선적으로 제공하자'는 의사결정을 함
- 확인할 결과
- 정책의 효과성을 높이고 기업들의 실제 개선을 촉진
직접 적용해 보기
처음부터 무리하지 말고, 이 순서로 확인하세요
공개된 평가 결과 확인
과기부 보도자료 또는 AI타임스 원문을 통해 각 기업의 벤치마크, 전문가 평가, 사용자 평가 점수 등을 정리하고, 어느 항목에서 점수 편차가 큰지 파악합니다.
확인: 각 기업의 세 가지 평가 항목별 점수를 기록했으며, 어느 항목의 점수가 가장 크게 다른지 확인했는가?
자신의 판단 기준에 적용
AI 모델을 선택해야 할 때 이번 결과를 참고하여, 벤치마크 점수만 보지 말고 사용자 평가와 전문가 의견도 함께 검토하는 습관을 기릅니다.
확인: 자신이 평소 사용하거나 고민하던 AI 도구의 벤치마크 점수와 사용자 평가를 분리하여 생각할 수 있는가?
추가 정보 수집
필요하다면 각 기업의 공식 발표, 사용자 리뷰, 전문가 평가 영상 등을 찾아보며 더 깊이 있는 판단을 합니다. 한 가지 평가나 지표만 신뢰하지 않는 태도를 유지합니다.
확인: 벤치마크 순위 외에 실제 사용자 의견이나 전문가 평가를 추가로 찾아보았는가?
향후 평가 결과 추적 계획
3차, 4차 평가가 있을 것으로 예상되므로, 각 기업이 이번 평가 후 어떻게 개선되는지 추적합니다. 한국 AI 생태계의 발전을 관찰하는 기준점으로 이 결과를 기억해 두세요.
확인: 향후 평가 결과가 공개될 때 이번 결과와 비교 분석할 준비(예: 노트 기록, 캘린더 알림 설정)를 했는가?
해석할 때 주의할 점
확인된 범위와 아직 모르는 내용을 구분하세요
공개된 사실: 과학기술정보통신부가 2026년 8월 27일 독파모 2차 단계평가의 세부 점수를 처음 공개했으며, 평가는 국제 벤치마크(AAII, NIA), AI 전문가 평가, 사용자 평가(AI 전문가 및 일반국민) 세 가지 방식으로 진행되었습니다. 모티프테크놀로지스는 AAII 벤치마크에서는 우수했으나 전문가·사용자 평가에서 점수가 크게 깎여 종합 순위에서 하위권으로 밀려났습니다. / 아직 공개되지 않은 내용: 평가에 참여한 모든 기업명, 각 항목별 정확한 점수 수치, 평가 방식의 기준과 정의, 가중치 산출 방식, 3차 평가 일정, 이번 결과가 실제 정책 결정과 정부 지원에 어떻게 구체적으로 반영될 계획인지는 원문에서 확인할 수 없습니다.
- 원문 요약이 불완전하여 평가에 참여한 모든 기업의 이름, 각 항목별 정확한 점수, 평가 방식의 상세한 정의를 확인할 수 없습니다.
- 벤치마크, 전문가, 사용자 평가의 각 항목이 최종 순위에 어떤 가중치로 반영되었는지 명확하지 않아, 점수 도출 방식을 정확히 이해하기 위해서는 추가 확인이 필요합니다.
- 공개된 평가는 2차 단계평가 결과일 뿐 최종 평가가 아니며, 추후 평가 방식이나 가중치가 조정될 수 있습니다.
- 각 기업의 모델이 실제 사용 환경에서는 평가 당시와 다른 성능을 보일 수 있으므로, 이 결과를 절대적 기준으로 삼지 말아야 합니다.
- 평가 대상 기업 수, 평가된 모델의 버전, 평가 시점의 세부 시간정보 등이 명확하지 않아 정확한 맥락 파악에 제한이 있습니다.
출처와 확인일
원문에서 다시 확인하기
이 글은 AI타임스의 공식 발표를 바탕으로 정리했습니다. 기능 범위와 제공 조건은 바뀔 수 있으므로 실제로 적용하기 전에는 원문을 다시 확인해 주세요.
- 마지막 확인
- 2026-08-27
- 다음 검토
- 2026-09-26