본문 바로가기

728x90

TDD

(2)
AI가 코드를 빨리 써도 엔지니어링 기본기가 필요한 이유 AI가 코드를 빨리 써도 엔지니어링 기본기가 필요한 이유AI 뉴스 썸네일AI 코딩 도구는 기능을 만드는 시간을 줄였어요. 하지만 오래 쓸 소프트웨어의 경계와 구조를 정하는 일은 여전히 개발자의 경험과 판단에 기대고 있어요.핵심 요약구분핵심왜 볼 만한가요구현AI 코딩 도구는 작동하는 코드를 빠르게 만들어요구현 속도와 시스템 품질을 따로 봐야 해요검증테스트와 타입 검사는 결과의 오류를 구체적으로 알려줘요반복 수정의 기준을 만들 수 있어요설계API와 모듈 경계에는 하나의 정답이 없어요변경 비용과 팀의 인지 부하가 여기서 갈려요운영유지보수성과 디버깅 가능성은 시간이 지나야 드러나요처음 만든 뒤의 비용까지 계산해야 해요1. 코드 생성 속도보다 경계를 정하는 판단이 오래 남아요Joseph Heck은 최근 1년 사이..
AI 제품 품질을 출시하기 전에 증명하는 평가 주도 개발 AI 제품 품질을 출시하기 전에 증명하는 평가 주도 개발AI 뉴스 썸네일생성형 AI 제품은 같은 입력에도 답이 달라질 수 있어요. 정답의 경계도 모호해서 기존 단위 테스트만으로 품질을 설명하기 어려워요. Airbnb Engineering은 실제 오류를 평가 기준으로 바꾸고, 출시 전부터 운영 단계까지 계속 확인하는 평가 주도 개발을 제안했어요. 1핵심 요약구분핵심왜 볼 만한가요시작점약 100개 사례의 출력과 실행 과정을 사람이 직접 읽어요실제 사용자가 만날 실패 유형부터 평가 기준으로 만들 수 있어요평가 구조프로그램 검사, LLM 심판, 인간 평가를 순서대로 조합해요비용을 줄이면서도 주관적 품질과 고위험 판단을 놓치지 않아요보정 기준실패 사례를 포함한 50~100개 골든 데이터셋으로 LLM 심판을 맞춰요..

728x90