이 글의 핵심
수천 개 단어와 예문을 엑셀에서 검수하고 중복·오타·ID를 관리한 뒤 앱 데이터로 변환하는 실무 방법을 정리합니다.
한 행에는 한 학습 항목
한 행에 표현 하나를 두고 ID, 카테고리, 원문, 발음, 뜻, 예문1~10, 번역 같은 열을 일정하게 유지합니다. 병합 셀은 보기에는 좋지만 프로그램 변환에는 불편하므로 원본 데이터 시트에서는 피하는 편이 안전합니다.
ID와 표시 순서를 분리
001 같은 표시 번호와 내부 고유 ID를 구분하면 나중에 가나다순이나 난이도순으로 정렬해도 즐겨찾기 키가 바뀌지 않습니다. ID는 한 번 정한 뒤 되도록 변경하지 않는 것이 좋습니다.
중복은 의미 기준으로 확인
철자가 완전히 같은 중복뿐 아니라 뜻과 기능이 거의 같은 항목도 검수해야 합니다. 숙어나 구동사 목록에서는 표현은 다르지만 예문이 사실상 반복되는 경우도 있으므로 예문 유사도와 뜻을 함께 봅니다.
변환 전 자동 검사
빈 제목, 누락된 번역, 예문 수 부족, 잘못된 언어 코드, 중복 ID를 스크립트로 검사한 뒤 JSON으로 변환합니다. 오류 목록을 별도 시트로 만들어 수정하고 다시 검사하면 전체 데이터 품질을 일정하게 유지할 수 있습니다.