본문 바로가기

728x90

GPT5.6

(8)
GPT-5.6 Sol 비전 성능, 탐지는 뛰었지만 OCR은 제자리였어요 GPT-5.6 Sol 비전 성능, 탐지는 뛰었지만 OCR은 제자리였어요AI 뉴스 썸네일GPT-5.6 Sol은 객체 탐지와 계수에서 GPT-5.5보다 나은 결과를 냈어요. 하지만 OCR과 특정 정보 추출 점수는 이전 모델을 넘지 못했어요. 화면을 이해하는 AI 기능을 만들 때는 모델 이름보다 작업별 성능, 이미지 크기, 처리 비용을 함께 봐야 해요. 2핵심 요약구분내용객체 탐지Sol의 mAP@50은 46.2로, GPT-5.5의 13.8보다 32.4포인트 높았어요.객체 계수Sol은 73.0%를 기록해 GPT-5.5의 64.9%를 앞섰어요.OCR·추출OCR은 90.7%, 텍스트 추출은 82.5%로 GPT-5.5보다 각각 0.5포인트와 5.1포인트 낮았어요.대형 이미지약 2,000×2,000픽셀 이상에서는 경계..
AI 코딩 모델 11개를 같은 조건으로 돌려보니 비용과 결과가 달랐어요 AI 코딩 모델 11개를 같은 조건으로 돌려보니 비용과 결과가 달랐어요AI 뉴스 썸네일Netlify가 AI 코딩 모델 11개에 같은 커피숍 웹사이트 제작 지시를 주고, 모델마다 3번씩 실행했어요. 가장 비싼 실행이 늘 가장 나은 결과를 내지는 않았고, 같은 모델 안에서도 비용과 디자인 편차가 컸어요. 1핵심 요약구분확인된 결과실무에서 볼 점비용실행당 2.4~1,055 크레딧으로 차이가 컸어요모델 이름보다 작업별 예산 범위를 먼저 정해야 해요결과물같은 모델을 3번 실행해도 디자인과 콘텐츠가 달라졌어요한 번의 결과만으로 모델을 평가하기 어려워요고가 모델Claude Opus 5가 풍부한 화면을 만들었지만 비용 변동도 컸어요높은 비용이 같은 비율의 품질 향상을 보장하지 않아요저가 모델GLM 5.2, Kimi K..
GPT-5.6 가격 인하, 기업 AI는 모델보다 작업 배치가 중요해졌어요 GPT-5.6 가격 인하, 기업 AI는 모델보다 작업 배치가 중요해졌어요IT & AI 뉴스 썸네일OpenAI가 GPT-5.6 Luna의 API 가격을 80%, Terra는 20% 내렸어요. Sol에는 최대 2.5배 빠른 Fast mode를 추가했어요. 이제 기업은 모든 작업에 가장 강한 모델을 붙이기보다, 계획과 구현처럼 단계가 다른 일을 어느 모델에 맡길지 더 세밀하게 정할 수 있어요. 1핵심 요약구분핵심왜 볼 만한가요가격Luna는 100만 토큰당 입력 0.20달러, 출력 1.20달러예요반복 작업과 대량 처리를 적은 예산으로 시험할 수 있어요모델 선택Terra는 균형형, Luna는 빠르고 저렴한 실행형, Sol은 복잡한 추론형으로 나뉘어요한 업무 안에서도 단계별로 다른 모델을 배치할 근거가 생겨요속도S..
ChatGPT Health, 의료 기록이 일반 대화로 들어왔어요 ChatGPT Health, 의료 기록이 일반 대화로 들어왔어요ChatGPT Health 뉴스 썸네일식사 메뉴를 묻다가 알레르기를 다시 설명하고, 검사 결과를 볼 때마다 예전 수치를 찾아 올리는 일이 줄어들 수 있어요. OpenAI가 공개한 ChatGPT Health는 Apple Health와 지원 의료 기록을 연결해 개인 건강 정보를 대화 맥락에 활용하는 기능이에요. 미국의 만 18세 이상 로그인 사용자를 대상으로 웹과 iOS에서 순차 제공돼요. 1핵심 요약구분핵심확인할 점데이터 연결Apple Health와 지원 의료 기록을 ChatGPT에 연결해요연결 정보가 오래됐거나 빠졌을 수 있어요대화 방식별도 Health 공간뿐 아니라 일반 대화에서도 건강 맥락을 불러올 수 있어요기본 설정에서는 건강 정보 사용..
AI 모델 교체가 코드 한 줄로 끝나지 않는 이유 AI 모델 교체가 코드 한 줄로 끝나지 않는 이유AI 뉴스 썸네일Ploy가 웹사이트 제작 AI 에이전트의 기본 모델을 Claude Opus 4.8에서 GPT-5.6 Sol로 바꿨어요. 같은 홈페이지 재구축 작업에서 평균 실행 시간은 8분에서 3분 42초로 줄었고, 평균 비용도 3.06달러에서 2.22달러로 낮아졌어요. 다만 이 수치는 모델 이름만 바꿔 얻은 결과가 아니에요. 평가 기준과 도구 스키마, 입력 캐시, 턴 간 추론 전달 방식을 새 모델에 맞게 손본 뒤 나온 값이에요. 1핵심 요약구분확인된 변화운영할 때 볼 점속도와 비용평균 8분에서 3분 42초, 3.06달러에서 2.22달러로 개선됐어요완료된 빌드가 Opus 11건, GPT-5.6 10건이라 작업 특성과 표본을 함께 봐야 해요도구 호출선택 필드..
코딩 모델 12개에 같은 앱을 시켰더니, 과제마다 승자가 달랐어요 코딩 모델 12개에 같은 앱을 시켰더니, 과제마다 승자가 달랐어요코딩 AI 모델 비교 썸네일코딩 모델의 실력은 순위표 한 줄로 설명하기 어려워요. 12개 모델에 같은 앱 4개를 과제별로 5번씩 만들게 한 비교에서도 GPT-5.6 Sol과 Claude Fable 5가 서로 다른 과제에서 앞섰어요. 비용이 적게 드는 모델도 익숙한 문제에서는 꽤 좋은 결과를 냈어요. 1핵심 요약구분핵심왜 볼 만한가요비교 규모12개 모델이 앱 4개를 각각 5번씩 만들었어요한 번의 성공보다 실행 간 편차를 확인할 수 있어요복잡한 과제레이캐스터는 GPT-5.6 Sol, 3D 큐브는 Claude Fable 5가 5번 모두 성공했어요모델마다 잘 다루는 구현 문제가 다르다는 점이 드러났어요비용Grok 4.5와 일부 오픈 웨이트 모델이 ..
ChatGPT Work 공개, AI가 채팅창 밖 업무 흐름까지 들어와요 ChatGPT Work 공개, AI가 채팅창 밖 업무 흐름까지 들어와요AI 뉴스 썸네일OpenAI가 ChatGPT Work를 공개했어요. 이번 발표의 핵심은 더 똑똑한 답변보다, ChatGPT가 파일과 앱, 브라우저를 오가며 실제 업무 결과물을 만드는 방향으로 이동했다는 점이에요.핵심 요약구분핵심왜 볼 만한가요업무 에이전트ChatGPT가 문서, 시트, 슬라이드, 웹 앱 같은 결과물을 만들 수 있어요대화형 AI가 업무 실행 도구로 넘어가는 흐름을 보여줘요앱 연결Google Drive, Microsoft 365, 이메일, 캘린더, CRM 같은 도구를 연결해요회사 안에 흩어진 업무 맥락을 한 대화 안으로 끌어오는 방식이에요데스크톱 앱새 ChatGPT 데스크톱 앱에 Codex와 Work가 합쳐져요개발자용 코딩 ..
GPT-5.6 정식 공개, 성능보다 비용 구조가 더 크게 바뀌었어요 GPT-5.6 정식 공개, 성능보다 비용 구조가 더 크게 바뀌었어요AI 뉴스 썸네일OpenAI가 GPT-5.6 패밀리를 정식 공개했어요. 이름만 보면 또 하나의 고성능 모델처럼 보이지만, 이번 발표에서 더 눈에 띄는 건 성능을 올리면서도 토큰 사용량과 작업당 비용을 줄이려는 방향이에요.핵심 요약구분핵심왜 볼 만한가요모델 구성Sol, Terra, Luna 3개 티어로 나뉘어요최고 성능 모델 하나가 아니라 작업 난도와 비용에 맞춰 고르는 구조예요코딩Sol은 Artificial Analysis Coding Agent Index 80점을 기록했다고 공개됐어요에이전트 코딩 도구가 성능 경쟁에서 비용 경쟁으로 넘어가는 흐름이 보여요비용API 가격은 Sol 기준 입력 100만 토큰당 5달러, 출력 100만 토큰당 3..

728x90