Qwen 3.8 공개, 2.4조 파라미터보다 먼저 확인할 것

Alibaba Qwen이 2.4조 파라미터 규모의 Qwen 3.8을 공개했어요. 지금은 Qwen3.8-Max-Preview를 일부 서비스에서 써 볼 수 있고, 오픈 웨이트는 추후 공개할 예정이에요. 모델 크기는 눈에 띄지만 개발자가 당장 판단할 수 있는 정보와 아직 기다려야 할 정보를 나눠 볼 필요가 있어요. 1
핵심 요약
| 구분 | 공개된 내용 | 확인이 필요한 부분 |
| 모델 규모 | 총 2.4조 파라미터로 소개됐어요 | 활성 파라미터 수와 구조는 공개 자료를 더 봐야 해요 |
| 이용 방법 | Token Plan, Qoder, QoderWork에서 Max Preview를 제공해요 | 일반 API의 지역별 접근성과 실제 사용 한도를 확인해야 해요 |
| 오픈 웨이트 | 곧 공개할 예정이라고 밝혔어요 | 라이선스, 체크포인트 구성, 배포 시점은 아직 기다려야 해요 |
| 성능 주장 | Qwen은 최상위 모델군과 비교할 만하다고 설명했어요 | 독립 벤치마크와 실제 코딩 작업 검증이 필요해요 |
| 요금제 | 국제 사용자용 Lite, Standard, Pro 구성이 소개됐어요 | 크레딧 소모 방식과 초과 비용을 작업별로 계산해야 해요 |
1. Qwen 3.8은 어떤 모델인가요
Qwen 공식 발표는 Qwen 3.8의 규모를 2.4조 파라미터로 적었어요. Qwen은 이 모델이 계속 학습되고 있으며, 자사 기준으로 현재 가장 강한 모델 가운데 하나라고 설명했어요. 공개 직후부터 모든 가중치를 내려받을 수 있는 형태는 아니에요. 먼저 Qwen3.8-Max-Preview를 Alibaba의 Token Plan과 Qoder 계열 서비스에서 제공하고, 오픈 웨이트는 뒤이어 공개할 계획이에요. 2
2.4조라는 숫자만으로 추론 비용을 계산하기는 어려워요. 혼합 전문가 구조를 쓰는지, 요청마다 몇 개의 파라미터가 활성화되는지, 지원하는 컨텍스트 길이와 출력 한도가 얼마인지에 따라 필요한 하드웨어와 응답 속도가 크게 달라져요. 공식 모델 카드와 체크포인트가 나와야 로컬 실행 가능성도 구체적으로 따질 수 있어요.
Qwen은 다른 프런티어 모델과 비교할 만한 성능이라고 소개했지만, 발표 문구만으로 작업별 우위를 확인할 수는 없어요. 코딩, 도구 호출, 긴 문맥 처리, 다국어 추론처럼 사용 목적을 나누고 같은 조건에서 비교해야 해요. Preview 단계의 응답 품질이 오픈 웨이트 버전과 같을지도 아직 확인할 부분이에요.
지금 바로 쓸 수 있는 경로
Qwen3.8-Max-Preview는 Qoder와 QoderWork, Token Plan에서 먼저 만날 수 있어요. GeekNews에 정리된 국제 요금제는 Lite, Standard, Pro 세 단계예요. 프로모션 가격은 월 6달러, 18달러, 68달러로 소개됐어요. 7일 단위 크레딧과 5시간 단위 크레딧, 동시 에이전트 수가 요금제마다 달라요. 1
OpenAI나 Anthropic 프로토콜을 지원하는 도구에서는 API 키와 Base URL을 넣어 연결할 수 있다고 안내됐어요. 다만 크레딧이 어떤 요청에서 얼마나 줄어드는지 먼저 작은 작업으로 확인하는 편이 안전해요. 멤버십에 포함된 엔드포인트와 일반 종량제 API를 혼동하면 예상과 다른 비용이 생길 수 있어요.
오픈 웨이트 공개 뒤 확인할 항목
가중치가 공개되면 파일 크기와 라이선스부터 봐야 해요. 상업적 사용 범위, 재배포 조건, 파생 모델 공개 의무가 제품 적용 가능성을 좌우해요. 전체 체크포인트 외에 양자화본이나 더 작은 변형 모델이 함께 나오는지도 중요해요. 2.4조 파라미터 전체를 직접 운영하기 어려운 팀에는 소형 모델과 호스팅 선택지가 더 현실적일 수 있어요.
성능표에서는 평균 점수보다 실제 업무와 가까운 항목을 골라야 해요. 코딩 에이전트라면 저장소 탐색, 여러 파일 수정, 테스트 복구, 도구 호출 성공률을 함께 보는 편이 좋아요. 한국어 서비스라면 한국어 지시 이해와 긴 대화에서의 일관성도 별도로 확인해야 해요. 공급사가 공개한 점수와 독립 평가가 같은 방향을 가리키는지도 비교해야 해요.
왜 중요한가요
이번 발표는 초대형 모델 경쟁과 오픈 웨이트 전략이 함께 움직이고 있다는 점에서 볼 만해요. Qwen이 약속한 가중치와 라이선스가 실제로 공개되면 연구자와 모델 호스팅 업체는 같은 체크포인트를 직접 평가할 수 있어요. 기업도 특정 클라우드 화면에서 본 결과만 믿지 않고 자체 데이터와 보안 조건에 맞춰 검토할 여지가 생겨요. 2
개발팀에는 모델 이름보다 운영 조건이 더 직접적인 문제예요. Preview API가 좋아 보여도 가격, 속도, 동시 요청 수, 데이터 처리 정책이 맞지 않으면 제품에 넣기 어려워요. 반대로 오픈 웨이트가 나오더라도 2.4조 파라미터의 배포 비용이 크면 관리형 API가 더 저렴할 수 있어요. 공식 모델 카드가 공개된 뒤 품질과 총비용을 같은 테스트 세트로 재는 과정이 필요해요.
현재 단계에서 확정할 수 있는 내용은 발표된 모델 규모, Preview 이용 경로, 오픈 웨이트 공개 예고예요. 세부 구조와 독립 성능 검증, 최종 라이선스는 후속 자료를 기다려야 해요. 이 구분을 지키면 큰 숫자나 공급사의 비교 문구에 끌리지 않고 실제 도입 가능성을 판단할 수 있어요.
참고 자료
- Qwen 3.8 출시 — GeekNews
- Qwen3.8 is launching and going open-weight soon — Alibaba Qwen 공식 X
'IT & AI' 카테고리의 다른 글
| Claude Code 안에 Rust판 Bun이 들어갔어요 (1) | 2026.07.20 |
|---|---|
| MIDI 레코더 2,500대가 보여준 작은 하드웨어 사업의 조건 (1) | 2026.07.20 |
| 버튼 하나로 돌아본 프론트엔드 20년 (0) | 2026.07.20 |
| Codex 한도 리셋 35회, 다음 초기화는 언제 올까요 (0) | 2026.07.20 |
| AI로 만든 고객은 실제 시장조사에 어디까지 쓸 수 있을까요 (0) | 2026.07.20 |