본문 바로가기

728x90

openaiAPI

(4)
GPT-5.6 Sol Ultrafast, 초당 750 토큰이 바꾸는 대기 시간 GPT-5.6 Sol Ultrafast, 초당 750 토큰이 바꾸는 대기 시간GPT-5.6 Sol Ultrafast 썸네일GPT-5.6 Sol이 Cerebras 인프라에서 초당 최대 750개 출력 토큰을 내는 Ultrafast Mode로 제공돼요. OpenAI API의 새 서비스 계층으로 일부 고객에게 먼저 열렸어요. 빠른 출력이 실제 작업 시간까지 얼마나 줄이는지는 모델 밖의 도구와 시스템 속도에 따라 달라져요. 1핵심 요약구분확인된 내용실제로 볼 부분제공 방식OpenAI API에서 제한 공개됐어요용량이 늘면 접근 대상도 넓어질 예정이에요출력 속도초당 최대 750개 출력 토큰을 제시했어요최대치와 실제 요청의 지속 속도는 구분해서 봐야 해요HLE 평가2,500문항을 11시간 11분에 처리했어요Cerebr..
GPT-5.6 가격 인하, 기업 AI는 모델보다 작업 배치가 중요해졌어요 GPT-5.6 가격 인하, 기업 AI는 모델보다 작업 배치가 중요해졌어요IT & AI 뉴스 썸네일OpenAI가 GPT-5.6 Luna의 API 가격을 80%, Terra는 20% 내렸어요. Sol에는 최대 2.5배 빠른 Fast mode를 추가했어요. 이제 기업은 모든 작업에 가장 강한 모델을 붙이기보다, 계획과 구현처럼 단계가 다른 일을 어느 모델에 맡길지 더 세밀하게 정할 수 있어요. 1핵심 요약구분핵심왜 볼 만한가요가격Luna는 100만 토큰당 입력 0.20달러, 출력 1.20달러예요반복 작업과 대량 처리를 적은 예산으로 시험할 수 있어요모델 선택Terra는 균형형, Luna는 빠르고 저렴한 실행형, Sol은 복잡한 추론형으로 나뉘어요한 업무 안에서도 단계별로 다른 모델을 배치할 근거가 생겨요속도S..
GPT-5.6 정식 공개, 성능보다 비용 구조가 더 크게 바뀌었어요 GPT-5.6 정식 공개, 성능보다 비용 구조가 더 크게 바뀌었어요AI 뉴스 썸네일OpenAI가 GPT-5.6 패밀리를 정식 공개했어요. 이름만 보면 또 하나의 고성능 모델처럼 보이지만, 이번 발표에서 더 눈에 띄는 건 성능을 올리면서도 토큰 사용량과 작업당 비용을 줄이려는 방향이에요.핵심 요약구분핵심왜 볼 만한가요모델 구성Sol, Terra, Luna 3개 티어로 나뉘어요최고 성능 모델 하나가 아니라 작업 난도와 비용에 맞춰 고르는 구조예요코딩Sol은 Artificial Analysis Coding Agent Index 80점을 기록했다고 공개됐어요에이전트 코딩 도구가 성능 경쟁에서 비용 경쟁으로 넘어가는 흐름이 보여요비용API 가격은 Sol 기준 입력 100만 토큰당 5달러, 출력 100만 토큰당 3..
Kokoro TTS, 로컬 CPU만으로 음성 합성이 현실적인 이유 Kokoro TTS, 로컬 CPU만으로 음성 합성이 현실적인 이유AI 뉴스 썸네일로컬 AI를 돌릴 때 GPU는 늘 부족해요. 그래서 음성 합성까지 GPU를 차지하면 로컬 LLM과 함께 쓰기 어려웠어요. Kokoro 사례는 작은 TTS 모델과 OpenAI 호환 API를 조합하면 CPU만으로도 개인용 음성 인터페이스를 만들 수 있다는 쪽에 가까워요. 1핵심 요약구분핵심왜 봐야 하나요로컬 음성 합성Kokoro 82M 모델을 CPU로 실행해 TTS를 처리해요GPU를 로컬 LLM 추론에 남겨둘 수 있어요실행 방식Kokoro-FastAPI 컨테이너가 OpenAI speech API와 비슷한 인터페이스를 제공해요기존 음성 API 기반 코드를 로컬 엔드포인트로 옮기기 쉬워요성능 감각짧은 문단 합성에서 i7-4770K ..

728x90