본문 바로가기

728x90

DeepSeekV4

(3)
DeepSeek V4 Flash, 추론 강도에 따라 ARC-AGI-2 점수가 15.4%p 갈렸어요 DeepSeek V4 Flash, 추론 강도에 따라 ARC-AGI-2 점수가 15.4%p 갈렸어요AI 뉴스 썸네일DeepSeek V4 Flash 0731이 ARC-AGI 평가에서 추론 강도별 결과를 공개했어요. 가장 높은 Max 설정은 ARC-AGI-1에서 89.0%, 더 어려운 ARC-AGI-2에서 61.4%를 기록했어요. Low 설정과 비교하면 ARC-AGI-2 점수가 15.4%포인트 벌어져, 같은 모델도 답을 생각하는 데 쓰는 계산량에 따라 성능과 비용이 크게 달라질 수 있다는 점을 보여줘요. 2핵심 요약구분핵심왜 볼 만한가요최고 점수Max에서 ARC-AGI-1 89.0%, ARC-AGI-2 61.4%를 기록했어요추론 강도를 높였을 때 복잡한 규칙 문제를 얼마나 더 풀 수 있는지 숫자로 비교할 수 ..
DeepSeek V4 Flash 0731, 50점 성능과 낮은 API 가격의 조건 DeepSeek V4 Flash 0731, 50점 성능과 낮은 API 가격의 조건AI 뉴스 썸네일DeepSeek V4 Flash 0731은 성능 점수와 API 가격을 함께 봐야 성격이 드러나요. Artificial Analysis 평가에서는 상위권에 올랐고, 입력과 출력 가격은 비교군 중앙값보다 낮았어요. 다만 많은 출력 토큰을 쓴 만큼 실제 서비스 비용과 응답 시간은 업무별로 따져봐야 해요. 1핵심 요약구분확인된 내용실무에서 볼 부분지능 평가Intelligence Index v4.1에서 50점, 101개 모델 중 3위한 개 종합지수이므로 실제 업무와 맞는 세부 평가도 확인해야 해요모델 구조전체 2,840억 파라미터 중 토큰마다 130억 개를 활성화하는 MoE전체 규모와 실제 추론 연산량을 구분해 봐야 ..
DeepSeek V4 Flash 공개, 코딩 에이전트와 Codex 연동을 앞세웠어요 DeepSeek V4 Flash 공개, 코딩 에이전트와 Codex 연동을 앞세웠어요AI 뉴스 썸네일DeepSeek이 V4 Flash API 정식 버전을 공개 베타로 내놨어요. 기존 API 주소와 호출 방식을 바꾸지 않고 모델 이름만 `deepseek-v4-flash`로 지정하면 새 버전을 쓸 수 있어요. 코딩 에이전트 벤치마크와 Responses API 지원이 이번 업데이트의 중심이에요. 1핵심 요약구분핵심왜 볼 만한가요출시DeepSeek V4 Flash 정식 API가 공개 베타로 나왔어요기존 연동에서 모델 이름만 바꿔 시험할 수 있어요성능Terminal Bench 2.1에서 82.7점을 기록했어요터미널 작업과 도구 사용 성능을 강조한 업데이트예요연동Responses API를 기본 지원하고 Codex 설..

728x90