문제는 단순했다
매주 50~100장의 PDF 송장 파일이 도착한다. 각 파일에는 이름, 수량, 배송지, 특이사항이 섞여 있다. 이걸 일일이 읽고 구글 시트에 입력하는 데 매일 약 1시간이 소비되고 있었다.
손이 아프고, 눈도 피로했다. 그리고 가끔 입력 오류도 발생했다.
Before: 수동의 반복
PDF 파일을 연다 → 내용을 읽는다 → 구글 시트에 옮긴다 → 다음 파일을 반복한다
이 과정이 하루에 여러 번 반복되었다.
작은 실험의 시작
어느 날 Claude Code에 물었다.
「PDF에서 텍스트를 추출해서 구조화된 데이터로 만들 수 있을까?」
Claude는 매우 간단한 접근법을 제시했다.
import PyPDF2
import json
with open('shipping_label.pdf', 'rb') as f:
reader = PyPDF2.PdfReader(f)
text = reader.pages[0].extract_text()
print(text)
3줄이면 충분했다.
After: 자동화의 순간
이제 Windows 디바이스에서 PDF 폴더를 감시하는 간단한 스크립트를 실행하면, 새 파일이 들어올 때마다 자동으로 처리된다.
• PDF가 폴더에 들어온다
• Claude Code가 텍스트를 자동으로 추출한다
• 구조화된 데이터가 구글 시트에 바로 입력된다
• 원본 PDF는 「완료」 폴더로 이동한다
이제 1시간이 5분으로 줄었다.
예상 밖의 발견
가장 놀라웠던 점은 입력 오류가 거의 0이 되었다는 것이다. 사람의 손이 빠질수록 정확도는 올라갔다.
또한 같은 방식으로 인보이스, 통관 서류 같은 다른 문서도 자동화할 수 있겠다는 깨달음이 생겼다.
비개발자도 할 수 있다
코드는 복잡하지 않다. Claude에게 물어보면 설명해 준다. Python 설치도 어렵지 않다. 그 이상은 필요 없다.
드림팀 햄스터즈는 이런 작은 자동화들을 하나씩 쌓아가고 있다. 모든 시작은 「왜 이걸 매번 손으로 해야 할까?」라는 질문에서 시작된다.