API (12) 썸네일형 리스트형 MCP 새 로드맵, 장기 작업과 권한 위임에 집중해요 MCP 새 로드맵, 장기 작업과 권한 위임에 집중해요AI 뉴스 썸네일MCP가 다음 명세 릴리스와 이후 수개월 동안 다룰 개발 방향을 공개했어요. 오래 걸리는 작업을 제어하는 메시징 구조, 에이전트 신원과 권한 위임, 많은 도구를 효율적으로 찾는 방식이 우선 과제에 들어갔어요. 1핵심 요약구분내용메시징서버가 결과를 먼저 보내고 실행 중인 작업을 제어할 수 있도록 Tasks, 구독, 진행 알림을 정리해요.전송 방식원격 서버에서 쓰는 Streamable HTTP 모델을 로컬 실행 환경까지 넓혀요.신원과 권한클라우드에서 동작하는 에이전트와 하위 에이전트의 신원·권한 위임 방식을 표준화해요.도구 탐색처음부터 모든 도구 정의를 읽지 않고 필요한 목록을 점차 공개하는 방식을 추진해요.SDK언어별 API와 문서를 다듬.. Claude 에이전트가 화면 조작부터 파일 반환까지 맡는 방법 Claude 에이전트가 화면 조작부터 파일 반환까지 맡는 방법AI 뉴스 썸네일Claude Platform의 Computer Use, Skills API, Files API가 정식 제공 단계에 들어갔어요. 화면을 조작하고 조직의 업무 규칙을 적용한 뒤 결과 파일까지 돌려주는 작업을 하나의 흐름으로 묶을 수 있어요. 1핵심 요약구분핵심왜 볼 만한가요화면 조작Computer Use가 화면을 보고 클릭, 입력, 스크롤해요전용 API가 없는 오래된 업무 시스템도 다룰 수 있어요웹 조작Browser Use Tool이 페이지 구조를 읽고 필드와 버튼을 찾아요화면 좌표만 쓰는 방식보다 웹 요소를 구체적으로 지정할 수 있어요업무 지식Skills API가 지침, 스크립트, 템플릿을 묶어 관리해요여러 요청에서 같은 절차와 .. OpenRouter가 Stripe에 합류해도 모델 중립성은 유지될까요 OpenRouter가 Stripe에 합류해도 모델 중립성은 유지될까요AI 뉴스 썸네일여러 AI 모델을 한 API로 연결해 주는 OpenRouter가 Stripe에 합류해요. OpenRouter는 이름과 제품, 로드맵, 기존 연동 방식을 유지하겠다고 밝혔어요. 거래는 아직 통상적인 종결 조건을 남겨 두고 있으며, 양사는 몇 주 안에 마무리될 것으로 보고 있어요. 1핵심 요약구분핵심왜 볼 만한가요거래OpenRouter가 Stripe에 합류해요결제 인프라 기업이 AI 추론 유통망까지 사업 범위를 넓혀요서비스기존 API와 제품 로드맵을 유지해요당장 연동을 바꿀 필요는 없다는 게 회사의 설명이에요규모400개 넘는 모델에서 하루 10조 개 넘는 토큰을 처리해요모델 선택과 비용 관리가 큰 인프라 사업으로 성장했어요쟁.. Stripe의 OpenRouter 인수 합의 보도, AI 모델 선택과 결제가 만나요 Stripe의 OpenRouter 인수 합의 보도, AI 모델 선택과 결제가 만나요AI 뉴스 썸네일Stripe가 AI 모델 게이트웨이 OpenRouter를 70억~80억 달러 이상에 인수하기로 합의했다는 보도가 나왔어요. 거래가 마무리되면 Stripe는 결제와 청구를 넘어 어떤 AI 모델에 요청을 보낼지 정하는 구간까지 사업 범위를 넓힐 수 있어요. 다만 두 회사가 아직 공식 인수 발표를 내놓지 않아 최종 금액과 조건은 더 확인해야 해요. 1핵심 요약구분확인된 내용독자가 볼 지점거래 보도Bloomberg는 70억 달러 이상, Axios는 현금과 주식을 합쳐 80억 달러 이상이라고 보도했어요.보도 금액이 다르고 공식 발표도 나오지 않았어요.OpenRouter여러 회사의 AI 모델과 추론 공급자를 하나의 A.. Grok 4.6, 모델 크기보다 사후 학습으로 코딩 성능을 높였어요 Grok 4.6, 모델 크기보다 사후 학습으로 코딩 성능을 높였어요AI 뉴스 썸네일xAI가 장시간 코딩 작업과 지식 노동에 초점을 맞춘 Grok 4.6을 공개했어요. 새 기반 모델을 크게 키우기보다 추가 학습, 지도 미세조정(SFT), 강화학습(RL)을 다듬어 성능을 끌어올린 점이 눈에 띄어요. 1핵심 요약구분핵심왜 볼 만한가요학습Grok 4.5보다 긴 추가 학습과 새 SFT 궤적을 적용했어요파라미터 수 확대 외에도 학습 데이터와 후처리 방식이 모델 품질을 바꿀 수 있다는 사례예요코딩CursorBench 3.2에서 69.9%, FrontierCode 1.1 Extended에서 61.3%를 기록했어요여러 단계가 이어지는 코딩 작업과 초기 제품 구현에 초점을 맞췄어요한계DeepSWE 1.1은 65.9%, T.. AI가 앞당긴 제로데이, 사이버보안 도구는 어떻게 바뀌나 AI가 앞당긴 제로데이, 사이버보안 도구는 어떻게 바뀌나AI 뉴스 썸네일취약점이 공개된 뒤 패치를 준비하던 시간표가 무너지고 있어요. Insight Partners는 공격 자동화가 빨라진 환경에서 보안팀의 역할과 제품 구조가 함께 달라질 것으로 봤어요. 보안 담당자가 여러 화면을 오가는 대신, 에이전트가 API와 MCP로 도구를 연결하고 사람이 정책과 우선순위를 관리하는 구조예요. 1핵심 요약구분핵심왜 볼만한가요공격 속도취약점 공개 전에 악용이 시작되는 사례가 늘고 있어요패치 주기보다 노출 탐지와 우선순위 판단 속도가 더 중요해져요보안 운영분석가는 도구 화면을 직접 다루는 일보다 에이전트의 권한과 결과를 관리하게 돼요자동화가 늘수록 승인 경계와 감사 기록을 함께 설계해야 해요제품 구조보안 SaaS가 AP.. DeepSeek V4 Flash 공개, 코딩 에이전트와 Codex 연동을 앞세웠어요 DeepSeek V4 Flash 공개, 코딩 에이전트와 Codex 연동을 앞세웠어요AI 뉴스 썸네일DeepSeek이 V4 Flash API 정식 버전을 공개 베타로 내놨어요. 기존 API 주소와 호출 방식을 바꾸지 않고 모델 이름만 `deepseek-v4-flash`로 지정하면 새 버전을 쓸 수 있어요. 코딩 에이전트 벤치마크와 Responses API 지원이 이번 업데이트의 중심이에요. 1핵심 요약구분핵심왜 볼 만한가요출시DeepSeek V4 Flash 정식 API가 공개 베타로 나왔어요기존 연동에서 모델 이름만 바꿔 시험할 수 있어요성능Terminal Bench 2.1에서 82.7점을 기록했어요터미널 작업과 도구 사용 성능을 강조한 업데이트예요연동Responses API를 기본 지원하고 Codex 설.. Claude Opus 5 출시, Fable급 성능을 절반 비용에 겨냥했어요 Claude Opus 5 출시, Fable급 성능을 절반 비용에 겨냥했어요AI 뉴스 썸네일Anthropic이 Claude Opus 5를 공개했어요. 회사는 코딩과 지식 업무에서 Fable 5에 가까운 성능을 작업당 절반 비용으로 제공한다고 설명해요. 입력 100만 토큰당 5달러, 출력 100만 토큰당 25달러로 이전 Opus 4.8과 가격도 같아요. 다만 공개 수치는 Anthropic 내부 평가가 적지 않아 실제 업무에서는 비용과 정확도를 함께 확인해야 해요. 1 2핵심 요약구분핵심왜 볼 만한가요성능Frontier-Bench와 지식 업무 평가에서 높은 점수를 제시했어요긴 코딩 작업과 컴퓨터 사용 능력을 중심으로 개선 폭을 확인할 수 있어요비용입력 5달러, 출력 25달러로 Opus 4.8과 같아요기존 Op.. 중국 오픈 가중치 AI가 배포 경쟁에서 유리한 이유 중국 오픈 가중치 AI가 배포 경쟁에서 유리한 이유AI 뉴스 썸네일중국 AI 기업들이 모델 가중치를 공개하며 배포 범위를 넓히고 있어요. 미국 기업이 중앙 서버의 유료 API로 최상위 성능을 파는 동안, 공개 가중치 모델은 기업이 원하는 인프라에 직접 올리고 공급자를 바꿀 선택지를 줘요. 다만 공개 전략이 장기적인 우위로 이어질지는 성능, 운영비, 라이선스와 정책까지 함께 봐야 해요.핵심 요약구분핵심왜 볼 만한가요배포 방식공개 가중치 모델은 여러 클라우드와 자체 서버에서 운영할 수 있어요모델 개발사가 모든 추론 인프라를 직접 확보하지 않아도 사용처가 늘어날 수 있어요기업 도입실제 전환 비용은 모델보다 계약, 데이터 연결, 권한 관리와 운영 도구에서 생겨요기업은 업무 시스템을 유지한 채 모델 공급자를 교체.. Qwen 3.8 공개, 2.4조 파라미터보다 먼저 확인할 것 Qwen 3.8 공개, 2.4조 파라미터보다 먼저 확인할 것AI 뉴스 썸네일Alibaba Qwen이 2.4조 파라미터 규모의 Qwen 3.8을 공개했어요. 지금은 Qwen3.8-Max-Preview를 일부 서비스에서 써 볼 수 있고, 오픈 웨이트는 추후 공개할 예정이에요. 모델 크기는 눈에 띄지만 개발자가 당장 판단할 수 있는 정보와 아직 기다려야 할 정보를 나눠 볼 필요가 있어요. 1핵심 요약구분공개된 내용확인이 필요한 부분모델 규모총 2.4조 파라미터로 소개됐어요활성 파라미터 수와 구조는 공개 자료를 더 봐야 해요이용 방법Token Plan, Qoder, QoderWork에서 Max Preview를 제공해요일반 API의 지역별 접근성과 실제 사용 한도를 확인해야 해요오픈 웨이트곧 공개할 예정이라고 밝.. 이전 1 2 다음