본문 바로가기

728x90

fable5

(4)
Kimi K3와 Fable 5, 작업별 라우팅이 더 나았어요 Kimi K3와 Fable 5, 작업별 라우팅이 더 나았어요Kimi K3와 Fable 5 모델 라우팅 비교Fireworks AI가 Kimi K3와 Fable 5를 약 1,030개 작업에서 비교했어요. 두 모델의 전체 성능은 비슷했지만 잘 푸는 문제가 달랐고, 작업마다 적합한 모델을 고른 이론적 조합은 정확도 93%를 기록했어요. 1핵심 요약구분핵심왜 볼만한가요비교 규모소프트웨어 수정, 터미널, 알고리듬, 다중 언어, 법률 등 약 1,030개 작업을 비교했어요단일 코딩 점수가 아니라 여러 실제 작업 유형을 함께 봤어요성능대표 소프트웨어 작업에서 K3는 92.4%, Fable은 92.6%였어요평균은 비슷해도 세부 영역의 우위는 달랐어요라우팅정답을 낸 모델 중 더 저렴한 선택지를 고르는 오라클 방식이 정확도 ..
Claude Fable 5가 Max·Team Premium 기본 한도에 들어와요 Claude Fable 5가 Max·Team Premium 기본 한도에 들어와요AI 뉴스 썸네일Claude Fable 5를 쓰려면 별도 크레딧을 챙겨야 했던 일부 사용자의 조건이 바뀌어요. Anthropic은 7월 20일부터 Max와 Team Premium 요금제에 Fable 5 사용량을 기본으로 넣어요. 다만 요금제 전체 한도를 Fable 5에 쓸 수 있는 건 아니고, 한도의 50%까지 이용할 수 있어요. 1핵심 요약구분바뀌는 내용확인할 점Max·Team Premium7월 20일부터 Fable 5가 요금제에 포함돼요요금제 사용 한도의 50%까지 쓸 수 있어요Pro·Team Standard기존처럼 Usage 크레딧으로 이용해요구독 기본 한도에는 Fable 5 사용량이 들어가지 않아요일회성 지원Pro·Te..
Claude Code와 OpenCode, 첫 요청 토큰이 4.7배 벌어진 이유 Claude Code와 OpenCode, 첫 요청 토큰이 4.7배 벌어진 이유Claude Code와 OpenCode 토큰 비교AI 코딩 도구의 비용은 사용자가 입력한 글자 수만으로 계산하기 어려워요. 도구가 모델에 함께 보내는 시스템 지시문과 기능 정의가 첫 요청부터 수천~수만 토큰을 차지하기 때문이에요. Claude Code와 OpenCode를 같은 조건에서 측정한 결과는 이 숨은 비용이 제품마다 얼마나 크게 다른지 보여줘요. 1핵심 요약구분측정 결과확인할 점첫 요청 고정 비용Sonnet 4.5에서 Claude Code 약 32,800토큰, OpenCode 약 6,900토큰이었어요짧은 질문도 도구 자체의 기본 데이터 때문에 큰 요청이 될 수 있어요가장 큰 차이도구 정의가 각각 약 24,000토큰과 4,..
CursorBench 3.1은 코딩 모델 비교를 더 실무 쪽으로 당겼어요 CursorBench 3.1은 코딩 모델 비교를 더 실무 쪽으로 당겼어요AI 뉴스 썸네일AI 코딩 도구를 고를 때 이제 “코드를 얼마나 잘 쓰나”만 보면 부족해요. 긴 코드베이스를 읽고, 버그를 찾고, 리뷰 의견을 내고, 비용까지 감당할 수 있는지가 같이 중요해졌어요. CursorBench 3.1은 그 기준을 숫자로 보여주려는 평가표예요. 2핵심 요약구분핵심왜 볼 만한가요모델 순위Fable 5 Max가 72.9%로 1위를 기록했어요코딩 모델 상위권의 기준선이 다시 올라갔어요상위권 구조Fable 5 계열이 1~4위를 모두 차지했어요같은 모델군 안에서도 추론 강도와 비용 선택지가 갈려요평가 범위코드베이스 이해, 버그 찾기, 계획, 코드 리뷰 과제가 추가됐어요단순 수정보다 실제 개발 흐름에 가까운 비교로 이동..

728x90