본문 바로가기

728x90

OpenAI

(45)
GPT-5.6 Sol API 가격 인하, 긴 컨텍스트 할증까지 따져봐야 해요 GPT-5.6 Sol API 가격 인하, 긴 컨텍스트 할증까지 따져봐야 해요AI 뉴스 썸네일OpenAI가 GPT-5.6 Sol의 API 가격을 낮췄어요. 100만 토큰당 입력은 4달러, 출력은 20달러로 바뀌었어요. 다만 입력이 272K 토큰을 넘으면 요청 전체에 별도 배수가 붙어요. 긴 문서를 한 번에 넣는 서비스라면 기본 단가만 보고 비용을 잡기 어려워요. 1핵심 요약구분바뀐 내용실무에서 확인할 점기본 API 가격입력 100만 토큰당 4달러, 출력 20달러이전보다 입력은 20%, 출력은 33% 낮아졌어요캐시 입력100만 토큰당 0.40달러반복되는 시스템 지시나 공통 문맥의 캐시 활용도를 봐야 해요프로모션 기간최소 2026년 11월 21일까지장기 예산은 프로모션 이후 단가 변동도 염두에 둬야 해요긴 컨..
GPT-5.6 Sol 비전 성능, 탐지는 뛰었지만 OCR은 제자리였어요 GPT-5.6 Sol 비전 성능, 탐지는 뛰었지만 OCR은 제자리였어요AI 뉴스 썸네일GPT-5.6 Sol은 객체 탐지와 계수에서 GPT-5.5보다 나은 결과를 냈어요. 하지만 OCR과 특정 정보 추출 점수는 이전 모델을 넘지 못했어요. 화면을 이해하는 AI 기능을 만들 때는 모델 이름보다 작업별 성능, 이미지 크기, 처리 비용을 함께 봐야 해요. 2핵심 요약구분내용객체 탐지Sol의 mAP@50은 46.2로, GPT-5.5의 13.8보다 32.4포인트 높았어요.객체 계수Sol은 73.0%를 기록해 GPT-5.5의 64.9%를 앞섰어요.OCR·추출OCR은 90.7%, 텍스트 추출은 82.5%로 GPT-5.5보다 각각 0.5포인트와 5.1포인트 낮았어요.대형 이미지약 2,000×2,000픽셀 이상에서는 경계..
Stripe의 OpenRouter 인수 합의 보도, AI 모델 선택과 결제가 만나요 Stripe의 OpenRouter 인수 합의 보도, AI 모델 선택과 결제가 만나요AI 뉴스 썸네일Stripe가 AI 모델 게이트웨이 OpenRouter를 70억~80억 달러 이상에 인수하기로 합의했다는 보도가 나왔어요. 거래가 마무리되면 Stripe는 결제와 청구를 넘어 어떤 AI 모델에 요청을 보낼지 정하는 구간까지 사업 범위를 넓힐 수 있어요. 다만 두 회사가 아직 공식 인수 발표를 내놓지 않아 최종 금액과 조건은 더 확인해야 해요. 1핵심 요약구분확인된 내용독자가 볼 지점거래 보도Bloomberg는 70억 달러 이상, Axios는 현금과 주식을 합쳐 80억 달러 이상이라고 보도했어요.보도 금액이 다르고 공식 발표도 나오지 않았어요.OpenRouter여러 회사의 AI 모델과 추론 공급자를 하나의 A..
Codex에서 GPT-5.6 Sol 100만 토큰 컨텍스트를 켜는 방법 Codex에서 GPT-5.6 Sol 100만 토큰 컨텍스트를 켜는 방법AI 뉴스 썸네일Codex에서 GPT-5.6 Sol의 100만 토큰 컨텍스트 윈도우를 직접 켤 수 있어요. 긴 코딩 세션에서 코드와 도구 출력이 일찍 압축되는 상황을 줄이고 싶을 때 쓸 수 있는 설정이에요. 다만 기본값보다 더 많은 컨텍스트가 언제나 빠르거나 저렴한 선택은 아니에요. 1핵심 요약구분내용지원 범위GPT-5.6 Sol은 최대 1,050,000토큰 컨텍스트 윈도우를 지원해요.적용 값Codex가 1,000,000토큰을 쓰도록 지정하고 900,000토큰 부근에서 기록 압축을 시작해요.적용 시점설정을 저장한 뒤 Codex 클라이언트를 재시작하고 새 세션을 열어야 해요.주의점큰 컨텍스트는 더 많은 기록을 유지하지만 성능과 비용이 늘..
공식 가격보다 90% 싼 AI API, 크레딧 재판매 시장의 구조와 위험 공식 가격보다 90% 싼 AI API, 크레딧 재판매 시장의 구조와 위험AI 뉴스 썸네일OpenAI와 Anthropic API를 공식 가격보다 훨씬 싸게 파는 별도 유통망이 커지고 있어요. 남은 크레딧을 거래하는 중개상부터 여러 계정과 API 키를 하나의 주소로 묶는 릴레이까지 공급 방식도 여러 갈래예요. 가격만 보고 연결하면 회사 코드와 고객 데이터가 제삼자의 서버를 그대로 지나갈 수 있어요.핵심 요약구분핵심왜 볼 만한가요크레딧 중개스타트업이 쓰지 못한 AI 크레딧을 사서 다시 파는 시장이 생겼어요정당하게 받은 크레딧도 양도와 재판매가 약관에 맞는지는 따로 확인해야 해요릴레이여러 계정과 API 키를 한곳에 모아 OpenAI 호환 API로 제공해요기존 SDK에서 API 주소만 바꾸면 쓸 수 있어 확산이 ..
AI가 편해진 만큼 기준도 높아졌어요: Stripe Staff Engineer의 2026년 AI가 편해진 만큼 기준도 높아졌어요: Stripe Staff Engineer의 2026년AI 뉴스 썸네일AI 코딩 도구가 개발자의 일을 줄여 줄 거라는 기대가 커졌어요. Stripe의 한 Staff Engineer가 겪은 변화는 조금 달라요. 도구가 빨라진 만큼 동시에 맡는 프로젝트와 결과물의 기준도 함께 높아졌어요. 관리해야 할 작업과 판단도 함께 늘었어요. 1핵심 요약구분핵심왜 볼 만한가요AI 활용최신 모델과 사내 코딩 도구를 빠르게 제공해요도구 접근성이 좋아질수록 활용 능력이 역할 평가에 더 직접적으로 연결돼요업무 방식여러 AI 코딩 에이전트를 병렬로 운용해요코드를 직접 작성하는 시간보다 작업 상태와 품질을 관리하는 시간이 늘 수 있어요Staff 역할자기 프로젝트 밖의 사람과 결과물까지 돕는 책임..
GPT-5.6 Sol Ultrafast, 초당 750 토큰이 바꾸는 대기 시간 GPT-5.6 Sol Ultrafast, 초당 750 토큰이 바꾸는 대기 시간GPT-5.6 Sol Ultrafast 썸네일GPT-5.6 Sol이 Cerebras 인프라에서 초당 최대 750개 출력 토큰을 내는 Ultrafast Mode로 제공돼요. OpenAI API의 새 서비스 계층으로 일부 고객에게 먼저 열렸어요. 빠른 출력이 실제 작업 시간까지 얼마나 줄이는지는 모델 밖의 도구와 시스템 속도에 따라 달라져요. 1핵심 요약구분확인된 내용실제로 볼 부분제공 방식OpenAI API에서 제한 공개됐어요용량이 늘면 접근 대상도 넓어질 예정이에요출력 속도초당 최대 750개 출력 토큰을 제시했어요최대치와 실제 요청의 지속 속도는 구분해서 봐야 해요HLE 평가2,500문항을 11시간 11분에 처리했어요Cerebr..
리눅스에도 Codex 데스크톱 앱이 나왔어요 리눅스에도 Codex 데스크톱 앱이 나왔어요AI 뉴스 썸네일OpenAI가 리눅스용 ChatGPT 데스크톱 앱을 프리뷰로 공개했어요. ChatGPT와 Codex를 같은 화면에서 쓰고, 프로젝트와 파일을 다루거나 브라우저 작업을 이어갈 수 있는 개발자용 워크스페이스예요. 1핵심 요약구분내용공개 단계리눅스용 ChatGPT 데스크톱 앱이 프리뷰로 나왔어요.주요 기능ChatGPT 옆에서 Codex를 실행하고 프로젝트, 파일, 브라우저 작업을 한곳에서 다룰 수 있어요.지원 환경Ubuntu 24.04·26.04 LTS, Debian 13, Fedora 43·44를 지원해요.패키지x64와 ARM64용 `.deb`, `.rpm` 패키지를 제공해요.확인할 점Windows판과 Linux판의 공식 기능 비교표는 아직 공개되지..
OpenAI 유일한 전담 윤리학자 퇴사, 안전 조직은 어떻게 움직이나요 OpenAI 유일한 전담 윤리학자 퇴사, 안전 조직은 어떻게 움직이나요AI 뉴스 썸네일OpenAI에서 AI 윤리를 전담하던 Chloé Bakalar가 입사 1년도 되지 않아 회사를 떠났어요. 퇴사 이유는 공개되지 않았지만, 안전과 정렬을 맡았던 주요 인력의 이탈이 이어진 시점이라 조직의 책임 구조를 다시 보게 해요. 1핵심 요약구분핵심왜 볼 만한가요인사Chloé Bakalar가 2026년 7월 OpenAI를 떠났어요회사 내 유일한 전담 윤리학자였고 현재 공개된 후임자가 없어요조직최근 안전 시스템과 미션 정렬 관련 책임자도 퇴사했어요안전 업무가 일부 개인에게 집중됐는지 살펴볼 계기예요운영Bakalar는 윤리를 한 명의 담당자에게 맡기지 말아야 한다고 말했어요모델 출시 전 검토와 출시 후 대응을 제품 조직 ..
암호화된 LLM 추론이 다른 모델에서 풀렸다 암호화된 LLM 추론이 다른 모델에서 풀렸다AI 뉴스 썸네일OpenAI, Anthropic, Google의 추론 API가 돌려주는 암호화 블록에서 내부 추론을 복원한 연구가 나왔어요. 연구진은 강한 모델의 블록을 같은 업체의 방어가 약한 모델에게 넘긴 뒤 탈옥해 평문을 얻었어요. 공개된 에이전트 로그에는 API 키와 비밀번호 같은 정보도 남아 있었어요. 2핵심 요약구분핵심왜 볼 만한가요공격 방식강한 모델의 암호화된 추론 블록을 같은 업체의 약한 모델이 읽게 했어요암호문 자체보다 블록을 다른 문맥에서 재사용할 수 있었던 설계가 공격 경로가 됐어요확인 범위공개 로그 6,708개에서 추론 블록 315,320개를 복원했어요화면에 보이는 대화만 지워서는 민감정보가 남을 수 있어요현재 상태공급자에게 사전 신고한 뒤..

728x90