본문 바로가기

IT & AI

Qwen 3.8 공개, 2.4조 파라미터보다 먼저 확인할 것

728x90

Qwen 3.8 공개, 2.4조 파라미터보다 먼저 확인할 것

AI 뉴스 썸네일
AI 뉴스 썸네일

Alibaba Qwen이 2.4조 파라미터 규모의 Qwen 3.8을 공개했어요. 지금은 Qwen3.8-Max-Preview를 일부 서비스에서 써 볼 수 있고, 오픈 웨이트는 추후 공개할 예정이에요. 모델 크기는 눈에 띄지만 개발자가 당장 판단할 수 있는 정보와 아직 기다려야 할 정보를 나눠 볼 필요가 있어요. 1

핵심 요약

구분공개된 내용확인이 필요한 부분
모델 규모총 2.4조 파라미터로 소개됐어요활성 파라미터 수와 구조는 공개 자료를 더 봐야 해요
이용 방법Token Plan, Qoder, QoderWork에서 Max Preview를 제공해요일반 API의 지역별 접근성과 실제 사용 한도를 확인해야 해요
오픈 웨이트곧 공개할 예정이라고 밝혔어요라이선스, 체크포인트 구성, 배포 시점은 아직 기다려야 해요
성능 주장Qwen은 최상위 모델군과 비교할 만하다고 설명했어요독립 벤치마크와 실제 코딩 작업 검증이 필요해요
요금제국제 사용자용 Lite, Standard, Pro 구성이 소개됐어요크레딧 소모 방식과 초과 비용을 작업별로 계산해야 해요

1. Qwen 3.8은 어떤 모델인가요

Qwen 공식 발표는 Qwen 3.8의 규모를 2.4조 파라미터로 적었어요. Qwen은 이 모델이 계속 학습되고 있으며, 자사 기준으로 현재 가장 강한 모델 가운데 하나라고 설명했어요. 공개 직후부터 모든 가중치를 내려받을 수 있는 형태는 아니에요. 먼저 Qwen3.8-Max-Preview를 Alibaba의 Token Plan과 Qoder 계열 서비스에서 제공하고, 오픈 웨이트는 뒤이어 공개할 계획이에요. 2

2.4조라는 숫자만으로 추론 비용을 계산하기는 어려워요. 혼합 전문가 구조를 쓰는지, 요청마다 몇 개의 파라미터가 활성화되는지, 지원하는 컨텍스트 길이와 출력 한도가 얼마인지에 따라 필요한 하드웨어와 응답 속도가 크게 달라져요. 공식 모델 카드와 체크포인트가 나와야 로컬 실행 가능성도 구체적으로 따질 수 있어요.

728x90

Qwen은 다른 프런티어 모델과 비교할 만한 성능이라고 소개했지만, 발표 문구만으로 작업별 우위를 확인할 수는 없어요. 코딩, 도구 호출, 긴 문맥 처리, 다국어 추론처럼 사용 목적을 나누고 같은 조건에서 비교해야 해요. Preview 단계의 응답 품질이 오픈 웨이트 버전과 같을지도 아직 확인할 부분이에요.

지금 바로 쓸 수 있는 경로

Qwen3.8-Max-Preview는 Qoder와 QoderWork, Token Plan에서 먼저 만날 수 있어요. GeekNews에 정리된 국제 요금제는 Lite, Standard, Pro 세 단계예요. 프로모션 가격은 월 6달러, 18달러, 68달러로 소개됐어요. 7일 단위 크레딧과 5시간 단위 크레딧, 동시 에이전트 수가 요금제마다 달라요. 1

OpenAI나 Anthropic 프로토콜을 지원하는 도구에서는 API 키와 Base URL을 넣어 연결할 수 있다고 안내됐어요. 다만 크레딧이 어떤 요청에서 얼마나 줄어드는지 먼저 작은 작업으로 확인하는 편이 안전해요. 멤버십에 포함된 엔드포인트와 일반 종량제 API를 혼동하면 예상과 다른 비용이 생길 수 있어요.

오픈 웨이트 공개 뒤 확인할 항목

가중치가 공개되면 파일 크기와 라이선스부터 봐야 해요. 상업적 사용 범위, 재배포 조건, 파생 모델 공개 의무가 제품 적용 가능성을 좌우해요. 전체 체크포인트 외에 양자화본이나 더 작은 변형 모델이 함께 나오는지도 중요해요. 2.4조 파라미터 전체를 직접 운영하기 어려운 팀에는 소형 모델과 호스팅 선택지가 더 현실적일 수 있어요.

성능표에서는 평균 점수보다 실제 업무와 가까운 항목을 골라야 해요. 코딩 에이전트라면 저장소 탐색, 여러 파일 수정, 테스트 복구, 도구 호출 성공률을 함께 보는 편이 좋아요. 한국어 서비스라면 한국어 지시 이해와 긴 대화에서의 일관성도 별도로 확인해야 해요. 공급사가 공개한 점수와 독립 평가가 같은 방향을 가리키는지도 비교해야 해요.

왜 중요한가요

이번 발표는 초대형 모델 경쟁과 오픈 웨이트 전략이 함께 움직이고 있다는 점에서 볼 만해요. Qwen이 약속한 가중치와 라이선스가 실제로 공개되면 연구자와 모델 호스팅 업체는 같은 체크포인트를 직접 평가할 수 있어요. 기업도 특정 클라우드 화면에서 본 결과만 믿지 않고 자체 데이터와 보안 조건에 맞춰 검토할 여지가 생겨요. 2

개발팀에는 모델 이름보다 운영 조건이 더 직접적인 문제예요. Preview API가 좋아 보여도 가격, 속도, 동시 요청 수, 데이터 처리 정책이 맞지 않으면 제품에 넣기 어려워요. 반대로 오픈 웨이트가 나오더라도 2.4조 파라미터의 배포 비용이 크면 관리형 API가 더 저렴할 수 있어요. 공식 모델 카드가 공개된 뒤 품질과 총비용을 같은 테스트 세트로 재는 과정이 필요해요.

현재 단계에서 확정할 수 있는 내용은 발표된 모델 규모, Preview 이용 경로, 오픈 웨이트 공개 예고예요. 세부 구조와 독립 성능 검증, 최종 라이선스는 후속 자료를 기다려야 해요. 이 구분을 지키면 큰 숫자나 공급사의 비교 문구에 끌리지 않고 실제 도입 가능성을 판단할 수 있어요.

참고 자료

  1. Qwen 3.8 출시 — GeekNews
  2. Qwen3.8 is launching and going open-weight soon — Alibaba Qwen 공식 X
728x90