본문 바로가기

728x90

Codex

(39)
Orca, 병렬 코딩 에이전트를 worktree로 나눠 관리해요 Orca, 병렬 코딩 에이전트를 worktree로 나눠 관리해요AI 뉴스 썸네일코딩 에이전트를 여러 개 띄우면 작업 속도보다 먼저 격리와 추적 문제가 생겨요. Orca는 각 에이전트를 별도의 git worktree에서 실행하고, 진행 상황과 변경 내용을 한 화면에서 다루는 오픈소스 개발 도구예요. 데스크톱과 원격 서버에서 작업하고 휴대폰으로 상태를 확인하는 흐름까지 한 제품에 묶었어요. 1핵심 요약구분핵심왜 볼 만한가요병렬 실행같은 작업 지시를 최대 5개 에이전트에 나눠 보내고 각각을 별도 worktree에서 실행해요한 에이전트의 변경이 다른 작업 폴더를 덮어쓰는 문제를 줄일 수 있어요도구 선택터미널에서 실행되는 CLI 에이전트와 기존 구독을 그대로 연결해요특정 모델이나 단일 서비스에 작업 방식을 맞출 ..
Warp Agent CLI, 쓰던 터미널에서 코딩 에이전트를 이어 써요 Warp Agent CLI, 쓰던 터미널에서 코딩 에이전트를 이어 써요AI 뉴스 썸네일Warp가 터미널 앱에 넣어 두었던 코딩 에이전트를 독립형 CLI로 꺼냈어요. Ghostty, iTerm2, VS Code 터미널처럼 이미 쓰는 환경을 바꾸지 않아도 실행할 수 있어요. 셸 상태를 오래 유지하고 원격 환경을 오가는 개발자에게 어떤 차이가 생기는지 살펴볼 만해요. 1핵심 요약구분핵심왜 볼 만한가요실행 환경Warp Terminal 밖에서도 같은 코딩 에이전트를 쓸 수 있어요터미널을 교체하지 않고 기존 작업 흐름에 붙일 수 있어요셸 연동PTY 연결과 터미널 입출력을 멀티플렉싱 구조로 관리해요디렉터리 변경, SSH, REPL 같은 상태 있는 작업을 이어 가기 쉬워요모델 선택작업 복잡도에 따라 모델을 자동으로 고..
Pi가 보여준 코딩 도구의 비용 공식, 기능보다 컨텍스트가 먼저예요 Pi가 보여준 코딩 도구의 비용 공식, 기능보다 컨텍스트가 먼저예요AI 뉴스 썸네일AI 코딩 도구의 성능을 모델 이름만으로 비교하기 어려워졌어요. Databricks가 실제 코드 작업으로 측정한 결과, 같은 모델과 같은 추론 강도를 써도 실행 도구에 따라 작업당 비용이 2배 넘게 벌어졌어요. Pi는 기본 기능을 4개로 줄이고 매번 모델에 다시 보내는 정보를 아껴, 적은 비용으로 높은 통과율을 기록했어요. 1핵심 요약구분핵심왜 볼 만한가요기본 구성Pi는 4개 도구와 1,000 토큰 미만의 기본 지시·도구 정의로 시작해요처음부터 많은 기능을 넣는 방식이 비용을 키울 수 있다는 비교 기준을 줘요비용Databricks 실험에서 실행 도구에 따라 같은 모델의 작업당 비용이 2배 넘게 달랐어요모델 단가보다 실제 작..
코딩 에이전트 시대, 개발 도구의 오픈소스 가치가 커지는 이유 코딩 에이전트 시대, 개발 도구의 오픈소스 가치가 커지는 이유IT & AI 뉴스 썸네일개발 도구의 소스가 열려 있으면 코딩 에이전트가 설정 메뉴 밖의 기능까지 직접 바꿀 수 있어요. 로컬 수정본을 업스트림과 계속 맞추는 일도 자동화할 수 있어서, 개인용 포크를 만들고 유지하는 비용이 예전보다 낮아졌어요.핵심 요약구분내용달라진 점코딩 에이전트가 코드 탐색, 기능 수정, 빌드, 업스트림 동기화를 이어서 처리할 수 있어요.오픈소스의 가치정해진 설정 항목이나 플러그인 API에 없는 기능도 소스를 고쳐 구현할 수 있어요.실제 사례Shelley에 meat.dev를 붙여 커밋 직후 diff 전처리를 시작하고 검토 대기 시간을 줄였어요.주의할 점자동 리베이스와 자동 교체는 병합 충돌, 회귀 버그, 보안 문제를 만들 수..
코딩 에이전트가 모바일 앱을 직접 확인하는 CLI, agent-device 코딩 에이전트가 모바일 앱을 직접 확인하는 CLI, agent-deviceAI 뉴스 썸네일코딩 에이전트가 앱 코드를 고친 뒤 실제 화면까지 확인하려면 별도의 연결 도구가 필요해요. Callstack이 공개한 `agent-device`는 iOS와 Android 앱을 열고, 화면 상태를 읽고, 버튼을 누르고, 결과 증거까지 남기는 과정을 하나의 CLI로 묶었어요. 2핵심 요약구분핵심왜 볼 만한가요작동 방식접근성 트리에서 화면 요소를 읽고 명령 결과에 따라 다음 동작을 고를 수 있어요코드를 수정한 에이전트가 실행 중인 앱에서 결과를 바로 확인할 수 있어요지원 범위iOS, Android, tvOS, Android TV, web, macOS, Linux 등을 다뤄요모바일뿐 아니라 TV와 데스크톱 앱까지 같은 흐름..
qm, 팀이 함께 쓰는 격리형 AI 작업 공간 공개 qm, 팀이 함께 쓰는 격리형 AI 작업 공간 공개AI 뉴스 썸네일AI 도구를 회사 전체로 넓히면 개인용 챗봇과는 다른 문제가 생겨요. 직원마다 접근할 수 있는 자료가 다르고, 여러 명이 같은 업무를 이어서 처리할 때는 기록과 권한의 경계도 필요해요. 오픈소스 프로젝트 qm은 사람과 대화 공간마다 작업 환경을 분리하는 방식으로 이 문제를 풀려고 해요. 1핵심 요약구분핵심왜 볼 만한가요협업 구조개인 공간과 공유 공간을 나눠 여러 사람이 같은 AI와 일할 수 있어요개인용 도구를 조직 단위로 확장할 때 필요한 권한 경계를 제품 구조에 넣었어요실행 환경메모리, 파일, 자격 증명 보기, 예약 작업, 영구 샌드박스를 공간별로 분리해요한 사람의 작업과 다른 팀의 작업이 섞이는 위험을 줄이는 설계예요모델 선택Pi, O..
DeepSeek V4 Flash 공개, 코딩 에이전트와 Codex 연동을 앞세웠어요 DeepSeek V4 Flash 공개, 코딩 에이전트와 Codex 연동을 앞세웠어요AI 뉴스 썸네일DeepSeek이 V4 Flash API 정식 버전을 공개 베타로 내놨어요. 기존 API 주소와 호출 방식을 바꾸지 않고 모델 이름만 `deepseek-v4-flash`로 지정하면 새 버전을 쓸 수 있어요. 코딩 에이전트 벤치마크와 Responses API 지원이 이번 업데이트의 중심이에요. 1핵심 요약구분핵심왜 볼 만한가요출시DeepSeek V4 Flash 정식 API가 공개 베타로 나왔어요기존 연동에서 모델 이름만 바꿔 시험할 수 있어요성능Terminal Bench 2.1에서 82.7점을 기록했어요터미널 작업과 도구 사용 성능을 강조한 업데이트예요연동Responses API를 기본 지원하고 Codex 설..
GPT-5.6 가격 인하, 기업 AI는 모델보다 작업 배치가 중요해졌어요 GPT-5.6 가격 인하, 기업 AI는 모델보다 작업 배치가 중요해졌어요IT & AI 뉴스 썸네일OpenAI가 GPT-5.6 Luna의 API 가격을 80%, Terra는 20% 내렸어요. Sol에는 최대 2.5배 빠른 Fast mode를 추가했어요. 이제 기업은 모든 작업에 가장 강한 모델을 붙이기보다, 계획과 구현처럼 단계가 다른 일을 어느 모델에 맡길지 더 세밀하게 정할 수 있어요. 1핵심 요약구분핵심왜 볼 만한가요가격Luna는 100만 토큰당 입력 0.20달러, 출력 1.20달러예요반복 작업과 대량 처리를 적은 예산으로 시험할 수 있어요모델 선택Terra는 균형형, Luna는 빠르고 저렴한 실행형, Sol은 복잡한 추론형으로 나뉘어요한 업무 안에서도 단계별로 다른 모델을 배치할 근거가 생겨요속도S..
Vision Pro로 도면 속 집에 먼저 들어가 본 개발자 Vision Pro로 도면 속 집에 먼저 들어가 본 개발자AI 뉴스 썸네일평면도의 숫자는 방이 얼마나 넓게 느껴지는지 알려주지 못해요. 개발자 Christian Selig는 완공 전 주택을 3D로 만들고 Vision Pro에서 실물 크기로 둘러보면서 복도 폭, 가구 배치, 현관에서 보이는 풍경을 미리 확인했어요. 1핵심 요약구분핵심왜 볼 만한가요설계 검토Fusion 360으로 평면도를 입체화하고 가구와 재질을 배치했어요치수표만으로 놓치기 쉬운 공간감과 동선을 완공하기 전에 확인할 수 있어요파일 흐름가구 모델을 OBJ로 변환해 배치한 뒤 전체 주택을 USDZ로 내보냈어요서로 다른 3D 도구 사이에서 파일 형식 변환이 여전히 큰 작업이에요탐색 도구Claude와 Codex로 Vision Pro용 뷰어 Pros..
ChatGPT와 Claude, 업무에 맞는 AI 도구는 어떻게 고를까요 ChatGPT와 Claude, 업무에 맞는 AI 도구는 어떻게 고를까요AI 뉴스 썸네일AI 도구를 고를 때 모델 순위만 비교하면 실제 업무에서는 답이 잘 나오지 않아요. 짧은 질문을 주고받을지, 자료를 조사할지, 내 컴퓨터의 파일까지 다룰지에 따라 필요한 제품과 권한이 달라져요. 에단 몰릭 와튼스쿨 교수는 2026년 여름 가이드에서 ChatGPT와 Claude를 중심으로 이 차이를 나눠 설명했어요. 1핵심 요약업무먼저 볼 선택지확인할 점가벼운 질문과 글쓰기무료 대화형 모델비용을 내기 전에 답변 품질이 충분한지 확인해요조사·자료 제작·이메일 초안회사가 제공하는 가상 작업 환경연결할 메일과 문서 범위를 좁혀요파일 수정·명령 실행·테스트Codex 또는 Claude Code 같은 로컬 도구변경 기록과 테스트 결..

728x90