검색어 수집을 머릿속 연상으로 시작하면 이미 익숙한 표현만 반복됩니다. 먼저 이용자가 실제로 남긴 말, 내부 안내에서 쓰는 말, 검색 화면에서 관찰한 표현을 서로 다른 출처로 구분합니다. 이 단계에서는 맞춤법과 띄어쓰기를 고치지 않고 발견된 원형을 보존합니다.
수집 대장에는 표현, 발견 위치, 확인 날짜, 관찰 또는 추정 상태, 개인정보 제거 여부를 적습니다. 문의나 리뷰에서 가져온 말은 개인을 식별할 내용과 분리합니다. 검색 화면의 연관어는 수요나 성과를 보장하는 근거가 아니며 한 시점의 관찰로만 기록합니다.
가상의 항목이 담당자의 아이디어라면 실제 유입 표현과 같은 표시에 두지 않습니다. 추정 후보로 분리하고 나중에 자료가 발견되면 상태를 갱신합니다. 오타처럼 보여도 원형을 남긴 뒤 표준형과 연결합니다. 이는 실제 검색 성과 사례가 아닙니다.
한 회차는 새 출처가 더 이상 나오지 않거나 중복 비중이 커졌을 때 닫되 임의 숫자를 보편 기준으로 삼지 않습니다. 어느 출처가 비어 있는지 기록해 다음 회차의 조사 범위를 정합니다.
첫 수집의 산출물은 정리된 키워드 묶음이 아니라 출처가 붙은 원형 목록입니다. 분류와 제목 작성은 다음 단계로 미루어야 관찰한 말이 편집자의 익숙한 언어로 바뀌는 일을 막고, 나중에 변형과 오타를 왜 포함했는지 되짚을 수 있습니다.
수집한 표현을 합칠 때는 표준형 하나 아래에 원형을 연결하고 원형 자체를 삭제하지 않습니다. 같은 말처럼 보여도 사용 위치와 질문 목적이 다르면 별도 항목으로 유지합니다. 검수자는 개인정보 제거 과정에서 검색 의도를 나타내는 핵심 표현까지 사라지지 않았는지 확인하고, 이용할 수 없는 자료는 수집 대장에서 제외 이유와 함께 보관 상태로 표시합니다.