본문 바로가기

728x90

GrokBuild

(4)
Grok 4.6, 모델 크기보다 사후 학습으로 코딩 성능을 높였어요 Grok 4.6, 모델 크기보다 사후 학습으로 코딩 성능을 높였어요AI 뉴스 썸네일xAI가 장시간 코딩 작업과 지식 노동에 초점을 맞춘 Grok 4.6을 공개했어요. 새 기반 모델을 크게 키우기보다 추가 학습, 지도 미세조정(SFT), 강화학습(RL)을 다듬어 성능을 끌어올린 점이 눈에 띄어요. 1핵심 요약구분핵심왜 볼 만한가요학습Grok 4.5보다 긴 추가 학습과 새 SFT 궤적을 적용했어요파라미터 수 확대 외에도 학습 데이터와 후처리 방식이 모델 품질을 바꿀 수 있다는 사례예요코딩CursorBench 3.2에서 69.9%, FrontierCode 1.1 Extended에서 61.3%를 기록했어요여러 단계가 이어지는 코딩 작업과 초기 제품 구현에 초점을 맞췄어요한계DeepSWE 1.1은 65.9%, T..
Grok Build 오픈 소스 공개, Rust로 만든 코딩 에이전트의 내부가 열렸어요 Grok Build 오픈 소스 공개, Rust로 만든 코딩 에이전트의 내부가 열렸어요AI 뉴스 썸네일SpaceXAI가 터미널 기반 AI 코딩 에이전트 Grok Build의 Rust 소스와 런타임을 공개했어요. 코드 탐색과 파일 수정, 셸 명령, 웹 검색을 한 화면에서 다루며 대화형 TUI와 헤드리스 실행, Agent Client Protocol 연동을 지원해요. 1핵심 요약구분공개된 내용개발자가 볼 부분실행 방식전체 화면 TUI, 헤드리스 모드, ACP 연동을 지원해요터미널 사용부터 CI·편집기 통합까지 한 런타임으로 이어갈 수 있어요코드 구조TUI, 런타임, 도구, 워크스페이스를 Rust 크레이트로 나눴어요에이전트가 파일과 명령을 다루는 경계를 소스에서 확인할 수 있어요설치와 빌드macOS·Linux·..
Grok Build CLI, 읽지 않은 저장소까지 전송했어요 Grok Build CLI, 읽지 않은 저장소까지 전송했어요Grok Build CLI 데이터 전송 분석 썸네일AI 코딩 도구에 저장소 접근 권한을 주면 모델이 읽은 파일만 서버로 갈 거라고 생각하기 쉬워요. Grok Build CLI 0.2.93의 통신을 직접 캡처한 분석에서는 모델 요청과 별도로 저장소 전체를 묶어 올리는 경로가 관찰됐어요. 비밀값과 Git 이력까지 포함될 수 있어 도입 전에 전송 범위를 따로 확인해야 해요.핵심 요약확인된 항목관찰 결과실무에서 볼 부분모델 요청도구가 읽은 파일과 `.env`의 테스트 비밀값이 마스킹 없이 포함됐어요실제 비밀값이 있는 작업 폴더를 그대로 열지 않는 편이 안전해요저장소 업로드읽지 말라고 지정한 파일과 Git 이력이 담긴 bundle이 별도 저장 경로로 전송..
Grok 4.5, 코딩 에이전트 경쟁을 속도와 토큰 효율로 밀어붙여요 Grok 4.5, 코딩 에이전트 경쟁을 속도와 토큰 효율로 밀어붙여요AI 뉴스 썸네일AI 모델 경쟁은 이제 “답을 잘하느냐”만으로 설명하기 어려워졌어요. 코딩 에이전트가 실제 저장소를 고치고, 터미널을 다루고, 긴 작업을 여러 단계로 끝내야 하기 때문이에요. Grok 4.5는 이 시장에서 성능 수치보다 속도와 토큰 효율을 전면에 둔 모델로 나왔어요. 1핵심 요약구분핵심왜 봐야 하나요모델 방향Grok 4.5는 코딩, 에이전트형 작업, 지식 업무를 겨냥한 최상위 모델이에요범용 챗봇보다 개발 작업 실행 능력을 앞세운 출시예요벤치마크Terminal Bench 2.1 83.3%, SWE Bench Pro 64.7%, DeepSWE 1.0 62.0%를 제시했어요터미널 작업과 소프트웨어 수정 과제에서 어느 정도 위치..

728x90