BankingBenchmark (1) 썸네일형 리스트형 Qwen3.8 Max가 에이전트 평가에서 보여준 것 Qwen3.8 Max가 에이전트 평가에서 보여준 것AI 뉴스 썸네일Qwen3.8 Max가 에이전트형 작업 평가에서 최상위권에 올랐어요. 단순 문답 점수보다 도구 사용과 계획, 여러 단계를 잇는 능력을 따로 측정했다는 점이 더 눈에 들어와요. 다만 순위표는 평가 추가와 모델 업데이트에 따라 바뀌므로, 1위라는 숫자만 떼어 보면 판단을 놓치기 쉬워요. 1핵심 요약구분핵심왜 볼 만한가요에이전트 성능Qwen3.8 Max가 Agentic Index 최상위권에 올랐어요도구 사용과 계획을 포함한 실제 작업형 평가예요일반 지능공식 모델 페이지의 Intelligence Index 점수는 58점이에요에이전트 순위와 일반 지능 순위는 같은 지표가 아니에요운영 비용입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러예요.. 이전 1 다음