국산 AI ‘모티프’, 독파모 프리뷰로 AAII 44점…딥시크-V4급 성능 냈다

국산 AI '모티프', 독파모 프리뷰로 AAII 44점…딥시크-V4급 성능 냈다

국내 AI 스타트업이 내놓은 새 모델이 세계적인 딥시크와 맞먹는 성적표를 받았다는 소식, 들어보셨나요? 🤖 국산 AI ‘모티프’의 신모델 ‘독파모’ 프리뷰 버전이 AAII라는 벤치마크(AI 모델 성능을 평가하는 시험 같은 것)에서 44점을 받아 딥시크의 최신 모델과 동급 평가를 받았다고 합니다. 아직 정식 출시 전 프리뷰(미리보기) 단계인데도 이런 성적이 나왔다니, 업계에서 주목할 만한 소식이죠.

🤖 모티프가 도대체 뭔가요?

먼저 모티프가 어떤 회사인지 궁금하실 텐데요, 모티프는 대형언어모델(LLM, 사람처럼 글을 이해하고 생성하는 AI 프로그램)을 개발하는 국내 AI 스타트업입니다. 오픈AI의 챗GPT나 구글의 제미나이처럼 해외 빅테크가 주도하는 AI 시장에서, 국내 기업이 독자적인 언어모델을 만든다는 것 자체가 쉽지 않은 도전이에요. 그동안 국내에서는 네이버나 카카오 같은 대기업들이 자체 AI 모델을 개발해왔지만, 상대적으로 작은 스타트업이 세계적 수준의 성능을 내는 모델을 만들었다는 점에서 이번 소식이 눈길을 끄는 겁니다.

🖼️ AI 언어모델 성능을 나타내는 벤치마크 그래프 이미지 · 이해를 돕기 위한 자료 이미지예요(기사 속 인물·상황과 다를 수 있어요)

AI 언어모델 성능을 나타내는 벤치마크 그래프 이미지

사진 출처: Google DeepMind (Pexels License) · 원본

📊 AAII 44점, 이게 얼마나 대단한 거예요?

이번에 화제가 된 건 모티프가 새롭게 공개한 ‘독파모’라는 이름의 프리뷰(정식 출시 전 미리 공개하는 버전) 모델입니다. 이 모델이 AAII라는 벤치마크 테스트에서 44점을 기록했다고 하는데요, 벤치마크란 쉽게 말해 여러 AI 모델들이 같은 문제를 풀어보고 점수를 비교하는 ‘모의고사’ 같은 개념이에요. 사람들이 수능 점수로 실력을 가늠하듯, AI 업계에서는 이런 벤치마크 점수로 모델의 성능을 비교합니다. 그런데 이 44점이라는 결과가 놀라운 이유는, 중국의 딥시크가 내놓은 최신 고성능 모델인 ‘딥시크-V4 프로’와 동급 점수로 평가됐다는 점이에요. 딥시크는 이미 세계적으로 성능이 검증된 모델로 유명한데, 이제 막 프리뷰 단계인 모티프의 모델이 이런 강자와 어깨를 나란히 했다는 게 의미가 큽니다.

🚀 왜 이 소식이 중요할까요?

사실 AI 언어모델 경쟁은 이미 오픈AI, 구글, 앤트로픽, 메타 같은 미국 빅테크와 중국의 딥시크, 알리바바 같은 기업들이 치열하게 벌이고 있는 판이에요. 이 시장에 한국 기업이 명함을 내밀기가 쉽지 않은 상황이었죠. 그런데 모티프가 정식 버전도 아닌 프리뷰만으로 세계적 모델과 비슷한 점수를 냈다는 건, 앞으로 정식 버전이 나왔을 때 더 좋은 성능을 기대해볼 수 있다는 신호이기도 합니다. 국내 AI 생태계 입장에서는 자체 기술력으로 해외 모델에 의존하지 않고 경쟁력 있는 서비스를 만들 수 있다는 가능성을 보여준 사례로 해석될 수 있어요. 특히 AI 주권(자국 기술로 AI를 개발해 외국 기술 의존도를 낮추는 것)이 국가적으로도 중요한 화두가 되고 있는 요즘, 이런 성과는 더 큰 의미를 가집니다.

💡 앞으로 어떻게 될까요?

다만 아직 독파모는 프리뷰 단계인 만큼, 정식 출시까지는 추가적인 개선과 검증이 필요할 것으로 보입니다. 벤치마크 점수 하나만으로 실제 사용성이나 안정성을 완전히 판단하기는 어렵기 때문에, 실제 서비스에 적용됐을 때 사용자들이 얼마나 만족할지가 중요한 관전 포인트가 될 거예요. 그럼에도 국산 AI 모델이 해외 최신 모델과 견줄 만한 성적을 냈다는 소식 자체가, 침체된 것처럼 보였던 국내 AI 산업에 활력을 불어넣는 계기가 될 수 있을 것 같습니다. 앞으로 모티프가 정식 버전을 언제 어떻게 공개할지, 그리고 실제 서비스에서는 어떤 평가를 받을지 계속 지켜볼 필요가 있어요.

❓ 자주 묻는 질문

Q. 독파모는 언제 정식 출시되나요?
A. 현재는 프리뷰 단계로 공개된 상태이며, 정식 출시 일정은 아직 명확히 알려지지 않았습니다.

Q. AAII 벤치마크는 다른 벤치마크와 뭐가 다른가요?
A. AI 모델의 종합적인 성능을 평가하는 지표 중 하나로, 여러 과제를 종합해 점수를 산출하는 방식입니다. 벤치마크 종류에 따라 평가 기준이 다르기 때문에 여러 벤치마크를 함께 참고하는 것이 일반적입니다.

Q. 딥시크-V4 프로와 정확히 같은 성능이라는 뜻인가요?
A. AAII 점수가 동일한 수준이라는 의미로, 이는 특정 평가 기준에서의 비교이며 모든 영역에서 완전히 동일한 성능을 의미하지는 않습니다.

▶ 동풍뉴스 경제 뉴스 더 보기


※ 이 글은 AI타임스 등의 보도를 동풍뉴스가 여러 매체를 종합해 알기 쉽게 요약·해설한 것입니다. 원문 기사 보기 →

📚 참고한 매체: AI타임스

📮 매일 아침, 외신이 본 한국을 받아보세요
세계가 주목한 한국 뉴스를 카카오톡으로 편하게 — 무료예요.

💬 카카오톡 채널 추가하기

위로 스크롤