본문 바로가기

IT & AI

Claude Code의 긴 설명을 로컬 LLM으로 줄이는 Vomit

728x90

Claude Code의 긴 설명을 로컬 LLM으로 줄이는 Vomit

AI 뉴스 썸네일
AI 뉴스 썸네일

Claude Code의 답변이 길어져 필요한 내용만 찾기 어려울 때가 있어요. Vomit은 화면에 표시될 답변을 로컬 LLM에 한 번 더 보내고, 읽기 쉬운 문장으로 줄여 주는 작은 개발자 도구예요. 1

핵심 요약

구분내용
하는 일Claude Code가 사용자에게 보여 줄 최종 메시지를 로컬 LLM으로 다시 써요.
처리 범위작업 파일이나 실행 내역에는 접근하지 않고 표시용 텍스트만 읽어요.
실행 환경Llama.app, Ollama, OpenAI API 호환 로컬 서버를 연결할 수 있어요.
사용 방식Hook으로 기존 출력을 바꾸거나 원문 옆에서 별도로 따라갈 수 있어요.
주의점로컬 모델이 작업 맥락을 몰라 중요한 내용을 빼거나 잘못 요약할 수 있어요.

1. Claude Code의 답변을 별도 모델이 다시 써요

Vomit은 Claude Code의 메시지를 모은 뒤 로컬 LLM에 전달해요. 로컬 모델이 문장을 다시 쓰면 Claude Code 세션에는 정리된 결과가 표시돼요. 제작자는 `MessageDisplay` Hook을 이용해 원래 표시될 답변을 교체한다고 설명해요. 2

설치와 초기 설정도 CLI에서 처리해요. Go 환경이 있다면 `go install github.com/zachahn/vomit@latest`로 바이너리를 설치할 수 있어요. 이어서 `vomit init`으로 로컬 모델 연결 정보를 설정해요. Claude Code Hook 연결 방법은 `vomit scrub -claude`에서 확인할 수 있어요.

728x90

원문을 바꾸지 않고 옆에서 정리본만 보고 싶을 때는 비침습 모드를 쓸 수 있어요. `vomit list`는 Claude 세션 식별자를 보여 줘요. `vomit tail`은 특정 세션이나 가장 최근 세션의 메시지를 따라가며 정리해요. 긴 답변을 항상 교체하기가 부담스럽다면 이 방식이 더 안전해요.

로컬 처리 범위는 좁고 분명해요

저장소 설명에 따르면 텔레메트리가 없고 외부 의존성도 두지 않았어요. Llama.app이나 Ollama처럼 OpenAI API 형식을 지원하는 로컬 서버와 연결할 수 있어요. 제작자는 로컬 모델을 처음 구성한다면 Llama.app과 GPT-OSS 20B 조합을 예로 들어요. 2

여기서 로컬 모델이 보는 정보는 Claude가 사용자에게 전달하려던 텍스트뿐이에요. 수정한 파일, 실행한 명령, 전체 대화 맥락은 알지 못해요. 작업 데이터에 대한 접근을 줄이는 대신 요약 정확도도 제한돼요.

짧아진 문장이 항상 더 정확한 건 아니에요

제작자는 로컬 모델이 일부 내용을 지어내거나 중요한 경고를 놓칠 수 있다고 밝혔어요. 처리 속도도 빠르지 않고, 현재는 Mac에서만 시험했어요. 프로젝트 자체도 가볍게 만든 실험 단계에 가까워요. 3

특히 파일 삭제, 강제 푸시, 배포, 권한 변경처럼 되돌리기 어려운 작업에서는 원문을 함께 확인하는 편이 좋아요. 요약본에 성공 결과만 남고 예외 조건이 빠지면 다음 판단이 달라질 수 있어요. Vomit의 비침습 모드나 원문 세션 뷰어를 함께 쓰면 이런 누락을 확인하기 쉬워요.

왜 중요한가요

AI 코딩 도구의 출력 품질은 모델 성능만으로 결정되지 않아요. 작업은 제대로 끝났어도 결론, 변경 파일, 남은 위험이 긴 설명 안에 섞이면 개발자가 다시 읽고 추려야 해요. Vomit은 이 마지막 읽기 비용을 별도 로컬 모델로 줄이려는 접근이에요. 3

구조가 단순해서 용도도 분명해요. 주 모델은 코딩 작업을 맡고, 작은 로컬 모델은 사용자에게 보여 줄 문장을 다듬어요. 출력 후처리를 로컬에서 맡기므로 원문 메시지를 외부 요약 서비스에 한 번 더 보내지 않아도 돼요.

대신 요약본을 사실 기록으로 믿으면 안 돼요. 로컬 모델에는 작업 맥락이 없어서 세부 사항을 복원할 수 없어요. 일상적인 진행 메시지는 정리본으로 빠르게 읽고, 명령 결과와 위험 안내는 원문에서 확인하는 방식이 현실적이에요. 저장소는 Go로 작성됐고 GNU GPLv3 라이선스로 공개돼 있어요. 2

참고 자료

  1. Vomit - Claude의 장황한 출력을 로컬 LLM으로 짧게 정리해주는 도구 — GeekNews
  2. zachahn/vomit — GitHub
  3. How to fix Claude 5's token vomit — Zach Ahn
728x90