내 컴퓨터에서 음성 AI를 돌리는 Hugging Face Speech To Speech
내 컴퓨터에서 음성 AI를 돌리는 Hugging Face Speech To SpeechAI 뉴스 썸네일말을 듣고 답하는 AI를 만들려면 음성 감지, 받아쓰기, 답변 생성, 음성 합성을 차례로 연결해야 해요. Hugging Face의 Speech To Speech는 이 과정을 한 파이프라인으로 묶고, 각 부품을 원하는 모델로 바꿀 수 있게 만든 오픈소스 프로젝트예요. 1핵심 요약구분내용처리 구조VAD, STT, LLM, TTS가 각각 별도 스레드에서 움직이고 큐로 데이터를 넘겨요.연결 방식OpenAI Realtime의 핵심 이벤트를 WebSocket과 WebRTC로 제공해요.모델 선택STT, LLM, TTS를 하드웨어와 언어에 맞춰 교체할 수 있어요.로컬 실행llama.cpp, vLLM, MLX LM 같은..
Unsloth Desktop, 로컬 AI 실행부터 학습까지 한 앱에 담았어요
Unsloth Desktop, 로컬 AI 실행부터 학습까지 한 앱에 담았어요AI 뉴스 썸네일로컬 AI 모델을 쓰려면 모델 실행기와 학습 도구, 서빙 환경을 따로 맞추는 일이 많았어요. Unsloth Desktop은 이 과정을 데스크톱 앱 하나로 묶은 베타 버전이에요. 모델을 내려받아 대화하는 데서 끝나지 않고 파인튜닝, 미디어 생성, 도구 연결까지 같은 화면에서 다뤄요. 1핵심 요약구분핵심왜 볼만한가요실행 환경macOS, Windows, Linux, WSL에서 로컬 AI 모델을 실행해요운영체제별로 여러 도구를 조합하던 부담을 줄일 수 있어요모델 학습LoRA, 전체 파인튜닝, 사전 학습을 앱에서 시작할 수 있어요데이터 준비부터 학습 결과 내보내기까지 한곳에서 이어져요개발 도구Claude Code, Code..