2조 4천억 개의 파라미터? 알리바바의 새로운 AI 모델 'Qwen3.8-Max'는 무엇이 다를까?

거대한 데이터의 연결망을 시각화한 그래픽 이미지
AI Summary

알리바바의 신규 AI 모델 Qwen3.8-Max는 2조 4천억 개의 파라미터를 가진 거대 모델로, 모든 답변에 '생각하는 모드'를 필수적으로 적용하여 추론 능력을 극대화했습니다.

상상해보세요. 우리가 평소 사용하는 인공지능(AI)에게 복잡한 수학 문제를 질문하거나, 아주 긴 보고서 작성을 부탁했을 때 AI가 답변을 내놓기 전 잠시 고민하는 시간을 갖는다면 어떨까요? 마치 사람이 어려운 문제를 풀기 전 골똘히 생각에 잠기는 것처럼 말이죠. 최근 알리바바가 공개한 새로운 AI 모델 ‘Qwen3.8-2.4T(Qwen3.8-Max)’가 바로 그런 방식으로 작동합니다.

왜 주목받고 있을까요?

일상생활에서 AI 비서의 성능이 좋아진다는 것은 우리가 더 복잡한 업무를 AI에게 맡길 수 있다는 뜻입니다. 단순히 날씨를 묻는 것을 넘어, 이제 AI는 논리적인 추론이 필요한 연구나 복잡한 프로그래밍 작업을 더 정확하게 처리할 수 있게 되었습니다. 알리바바는 이번 모델이 현재 업계에서 가장 강력한 모델 중 하나이며, 세계 최고의 성능을 자랑하는 ‘Fable 5’ 모델에 견줄만한 능력을 갖추었다고 자신하고 있습니다 [출처 4]. 특히 이 모델은 ‘오픈 웨이트(Open-weights, 누구나 모델 가중치를 내려받아 사용할 수 있도록 공개함)’ 모델이라는 점에서 개발자들에게 큰 의미가 있습니다 [출처 2].

‘파라미터’와 ‘생각하는 모드’ 쉽게 알아보기

‘파라미터’라는 말을 들어보셨나요? 쉽게 말해 AI의 두뇌 크기를 측정하는 단위라고 생각하시면 됩니다. 파라미터가 많을수록 AI가 더 많은 지식을 담을 수 있고 더 복잡한 관계를 학습할 수 있습니다. 이번 모델은 무려 2조 4천억(2.4T) 개의 파라미터를 가지고 있는데, 이는 한국 전체 인구의 약 3만 배가 넘는 엄청난 규모입니다 [출처 2].

하지만 이토록 방대한 파라미터를 전부 다 작동시키려면 엄청난 에너지가 듭니다. 이를 해결하기 위해 모델은 ‘희소 전문가 혼합(Sparse Mixture-of-Experts)’이라는 똑똑한 방식을 사용합니다.

AD

비유하자면 학교에 512명의 선생님이 계신다고 상상해 보세요. 수학 질문을 하면 수학 선생님만, 역사 질문을 하면 역사 선생님만 호출해서 답변을 듣는 것이 훨씬 효율적이겠죠? 이 모델도 마찬가지입니다. 총 512개의 ‘전문가(Expert)’를 두고, 질문이 들어오면 그와 관련된 10개의 전문가와 1명의 공통 전문가만 활성화하여 답변을 만들어냅니다 [출처 5]. 이렇게 하면 실제 답변할 때 사용하는 파라미터는 전체의 일부인 약 950억 개 수준으로 유지하면서도, 방대한 지식을 모두 활용할 수 있는 것입니다 [출처 5].

또한, 이 모델은 모든 질문에 대해 ‘생각하는 모드’를 반드시 거칩니다. AI가 답변하기 전 스스로 논리를 점검하고 추론하는 과정을 필수적으로 수행함으로써 더 깊이 있고 정교한 답변을 끌어내도록 설계되었습니다 [출처 1].

현재 어떤 상태일까요?

Qwen3.8-2.4T는 강력한 능력을 자랑하지만, 사용 전 알아두어야 할 점이 있습니다.

첫째, 이 모델은 ‘텍스트 전용’입니다. 최근 많은 AI가 이미지나 비디오를 같이 이해하는 ‘멀티모달’ 기능을 갖춘 것과 달리, 이 모델은 오로지 텍스트를 읽고 쓰는 능력에 집중했습니다 [출처 1].

둘째, 규모가 매우 큽니다. 손실 없이 구동하려면 4.9TB라는 막대한 저장 공간이 필요할 정도로 거대합니다 [출처 8]. 따라서 일반 사용자 개인이 내 컴퓨터에 설치하기보다는, 주로 기업이나 연구소에서 서버를 통해 활용하게 될 모델입니다.

앞으로의 전망

알리바바는 이번 Qwen3.8-Max를 시작으로, 더 작고 효율적인 모델들도 지속해서 공개할 예정입니다 [출처 14]. AI 업계에서는 이번 모델의 성능을 다른 주요 모델들과 비교·검증하는 작업이 활발히 이어질 것으로 보입니다 [출처 17]. 앞으로 이 모델이 복잡한 코딩이나 연구, 논리적인 업무 수행에 있어 얼마나 사람들의 시간을 아껴줄 수 있을지 지켜보는 것이 관전 포인트입니다.

MindTickleBytes의 AI 기자 시선

알리바바가 다시 한번 기술력을 과시하며 AI 오픈 생태계에 중요한 화두를 던졌습니다. 단순히 파라미터 수만 늘리는 것에 그치지 않고, 추론 능력을 극대화하기 위해 ‘생각하는 모드’를 필수적으로 적용했다는 점은 향후 AI 모델 설계의 중요한 기준점이 될 것입니다.

참고자료

  1. Qwen/Qwen3.8-2.4T-A95B · Hugging Face
  2. [Serve Qwen3.8-2.4T-A95B, a 2.4T-Parameter Model, with Configurable Reasoning on NVIDIA GB300 NVL72 NVIDIA Technical Blog](https://developer.nvidia.com/blog/serve-qwen3-8-2-4t-a95b-a-2-4t-parameter-model-with-configurable-reasoning-on-nvidia-gb300-nvl72/)
  3. Qwen/Qwen3.8-2.4T-A95B-FP8 · Hugging Face
  4. Qwen on X: “Qwen3.8 is launching and going open-weight soon!
  5. [Qwen/Qwen3.8-2.4T-A95B vLLM Recipes](https://recipes.vllm.ai/Qwen/Qwen3.8-2.4T-A95B)
  6. RadixArk/Qwen3.8-2.4T-A95B-NVFP4 · Hugging Face
  7. Qwen/Qwen3.8-2.4T-A95B · OMG
  8. [Qwen3.8- How to Run Locally Unsloth Documentation](https://unsloth.ai/docs/models/qwen3.8)
  9. Qwen38Max: Alibaba’s New AI Model Is Coming for the AI… - YouTube
  10. [Qwen3.82.4TA95B - API Pricing & Providers OpenRouter](https://openrouter.ai/qwen/qwen3.8-2.4t-a95b)
  11. Kimi K3 vsQwen3.8-Max: Benchmarks, Pricing & API Access
  12. Qwen3.8-27B Is Almost Here, And It’s About to Reset the… - Banandre
  13. Qwen3.8 Preview: 2.4T Params, Open Weights, Release
  14. Qwen3.8-Max: A New Bar for Coding and Cowork
  15. [Qwen3.8 OpenLM.ai](https://openlm.ai/qwen3.8/)
  16. [AINews] Qwen 3.8 Max(2.4T) and 27B, new open weights models …
  17. Alibaba Launches Qwen 3.8 With 2.4 Trillion Parameters …
  18. Qwen 3.8 & Qwen 3.8 27B Open Source: Official Alibaba …
  19. Qwen 3.8 Preview — 2.4T Multimodal, and What’s Not Yet Public
AD
이 글을 얼마나 이해했나요?
Q1. Qwen3.8-2.4T 모델의 '생각하는 모드'에 대한 설명으로 올바른 것은?
  • 사용자가 필요에 따라 끄고 켤 수 있다.
  • 모든 상호작용에서 강제로 사용되어야 한다.
  • 이미지 분석을 할 때만 자동으로 켜진다.
Qwen3.8-2.4T는 모든 상호작용에서 '생각하는 모드'가 강제되며 이를 비활성화할 수 없습니다.
Q2. 이 모델은 2조 4천억 개의 총 파라미터를 가지고 있지만, 실제 답변 생성 시 한 번에 활성화되는 파라미터 수는 얼마인가요?
  • 약 270억 개
  • 약 950억 개
  • 2조 4천억 개 전체
총 2조 4천억 개의 파라미터 중 토큰당 약 950억 개의 파라미터가 활성화되는 구조를 가지고 있습니다.
Q3. Qwen3.8-2.4T 모델의 입력 방식에 대한 설명으로 옳은 것은?
  • 텍스트와 이미지를 동시에 처리하는 멀티모달 모델이다.
  • 텍스트 전용 모델이다.
  • 비디오 분석 기능이 포함되어 있다.
Qwen3.8-2.4T는 텍스트 전용 모델로 멀티모달 입력을 지원하지 않습니다.