問題很簡單
每週收到 50~100 份 PDF 運單檔案。每份檔案裡混雜著收貨人名字、數量、配送地址和特殊說明。將這些內容一份份讀完,再手動輸入到 Google Sheets,每天要花約 1 小時。
手指酸痛,眼睛疲勞,有時還會輸入錯誤。
Before: 手動的重複
打開 PDF 檔案 → 閱讀內容 → 轉移到試算表 → 重複下一份檔案
這個流程每天重複多次。
小實驗的開始
某天我問 Claude Code。
「能從 PDF 自動提取文字,轉成結構化資料嗎?」
Claude 給出了非常簡潔的方法。
import PyPDF2
import json
with open('shipping_label.pdf', 'rb') as f:
reader = PyPDF2.PdfReader(f)
text = reader.pages[0].extract_text()
print(text)
3 行程式碼就夠了。
After: 自動化的時刻
現在在 Windows 桌面環境中執行一個簡單的監控腳本,新 PDF 檔案一進入資料夾,就自動處理。
• PDF 進入監控資料夾
• Claude Code 自動提取文字
• 結構化資料立即寫入 Google Sheets
• 原始 PDF 移到「已完成」資料夾
從 1 小時縮短到 5 分鐘。
意外的發現
最令人驚喜的是,輸入錯誤率幾乎降到零。人手接觸越少,準確度反而越高。
同時發現用同樣方式也能自動化發票、通關文件等其他類型檔案。
非開發者也能做到
代碼不複雜,問 Claude 就會解釋。Python 安裝也不難,不需要更多。
夢想團隊的 Hamsters 就這樣一點一滴堆積小自動化。所有開始都源自一個問題:「為什麼每次都要手動做這件事?」