본문 바로가기

728x90

Qwen3.8Max

(2)
Qwen3.8 Max가 에이전트 평가에서 보여준 것 Qwen3.8 Max가 에이전트 평가에서 보여준 것AI 뉴스 썸네일Qwen3.8 Max가 에이전트형 작업 평가에서 최상위권에 올랐어요. 단순 문답 점수보다 도구 사용과 계획, 여러 단계를 잇는 능력을 따로 측정했다는 점이 더 눈에 들어와요. 다만 순위표는 평가 추가와 모델 업데이트에 따라 바뀌므로, 1위라는 숫자만 떼어 보면 판단을 놓치기 쉬워요. 1핵심 요약구분핵심왜 볼 만한가요에이전트 성능Qwen3.8 Max가 Agentic Index 최상위권에 올랐어요도구 사용과 계획을 포함한 실제 작업형 평가예요일반 지능공식 모델 페이지의 Intelligence Index 점수는 58점이에요에이전트 순위와 일반 지능 순위는 같은 지표가 아니에요운영 비용입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러예요..
Qwen3.8-Max가 겨냥한 다음 단계, 며칠짜리 일을 끝내는 AI Qwen3.8-Max가 겨냥한 다음 단계, 며칠짜리 일을 끝내는 AIAI 뉴스 썸네일Qwen이 2.4조 파라미터 규모의 Qwen3.8-Max를 공개했어요. 짧은 코드 생성보다 여러 날 이어지는 개발과 연구를 끝까지 수행하는 능력에 초점을 맞췄고, Max급 모델 가중치도 처음으로 공개할 예정이에요. 1핵심 요약구분핵심왜 볼 만한가요모델 규모전체 2.4조, 추론 때 활성화되는 파라미터는 950억 개예요큰 모델을 필요한 부분만 쓰는 구조로 성능과 실행 비용의 균형을 노려요장기 작업개발, 논문 재현, 경진대회를 24시간에서 16일 동안 수행한 사례를 공개했어요코딩 AI의 평가 기준이 함수 작성에서 프로젝트 완수로 옮겨가고 있어요공개 계획Qwen Max 계열 가중치를 다음 주 공개할 예정이에요API뿐 아니라 직접..

728x90