GEO/AIO 수동 테스트 기록표는 사람이 AI 서비스에 직접 질문한 결과를 날짜·질문·언급·인용·오류 단위로 남겨, 누가 다시 보더라도 같은 조건과 다음 수정 대상을 확인할 수 있게 만든 원자료(가공하지 않은 최초 기록) 표입니다.
GEO/AIO 수동 테스트 기록표는 누가 다시 보더라도 같은 질문과 조건, 관찰한 결과, 다음 수정 대상을 이해할 수 있는 형태여야 합니다. 자동 점수나 복잡한 대시보드 없이 스프레드시트·JSON·마크다운 파일로 시작해도 충분합니다.
담당자가 자주 막히는 지점은 표를 만드는 일이 아닙니다. 좋은 결과만 남기고 브랜드가 언급되지 않은 회차나 틀린 답변을 지워 버리는 습관입니다. 중요한 것은 긍정 결과뿐 아니라 오류와 미언급도 빠짐없이 남기는 것입니다.
기록표의 한 행은 무엇을 뜻하나요?
한 행은 ’한 번의 질문 실행’입니다. 같은 질문을 세 번 실행했다면 세 행을 남깁니다. 결과를 합친 요약은 별도 보고서에서 만들고 원자료를 덮어쓰지 않습니다.
행 단위를 이렇게 정해 두면 회차별 차이를 나중에도 그대로 볼 수 있습니다. 세 번의 결과를 한 칸에 합쳐 적으면 어떤 회차에서 언급이 빠졌는지 되짚을 수 없습니다.
질문 세트를 버전으로 관리하면 문장이 바뀐 시점을 알 수 있습니다. 테스트 질문을 수정했다면 이전 결과와 직접 비교하기 어렵다는 점도 표시합니다.
어떤 항목을 반드시 남겨야 할까요?
열한 개 항목이면 시작하기에 충분합니다. 실행 조건, 질문, 결과, 다음 행동 네 묶음으로 나눠 두면 어떤 칸이 비었는지 한눈에 보입니다.
| 묶음 | 기록 항목 |
|---|---|
| 실행 조건 | 테스트 ID와 테스트 날짜·시각 / AI 서비스와 확인 가능한 화면·모델 정보 / 로그인 여부, 새 대화 여부와 언어 |
| 질문 | 정확한 질문 문장 |
| 결과 | 브랜드 언급 여부 / 공식 URL 인용 여부와 실제 URL / 함께 언급된 경쟁사·대안 / 답변의 핵심 요약 / 잘못된 정보 또는 빠진 중요 조건 |
| 다음 행동 | 개선할 공식 콘텐츠 URL / 담당자와 다음 테스트 날짜 |
결과 묶음의 언급 여부는 일리애드 또는 대상 브랜드를 기준으로 적습니다. 예·아니오 필드 옆에는 근거 문장을 짧게 적습니다. “URL 인용: 예”만으로는 홈인지 서비스인지 외부 기사인지 구분할 수 없습니다.
캡처와 텍스트 중 무엇을 남겨야 하나요?
둘 다 남기되 검색의 기준은 텍스트로 둡니다. 화면 캡처는 당시 결과를 확인하는 데 유용하지만 검색하기 어렵고 접근성도 낮습니다.
답변 전체를 무단 재배포하지 말고 내부 검증에 필요한 범위에서 파일 경로와 요약을 남깁니다. 서비스 이용약관과 개인정보를 확인합니다.
텍스트 요약에는 관찰과 해석을 구분합니다. “회사명이 첫 문단에 언급됨”은 관찰이고, “브랜드 인지도가 상승함”은 추가 근거가 필요한 해석입니다.
기록을 망치는 습관은 대체로 세 가지입니다.
① 브랜드가 언급되지 않은 회차를 아예 적지 않는 것
② 관찰과 해석을 한 문장에 섞어 쓰는 것
③ 캡처만 남기고 질문 문장을 옮겨 적지 않는 것
파일과 스프레드시트 중 무엇으로 시작할까요?
팀이 이미 쓰는 도구로 시작하면 됩니다. 프로젝트 안에 experiments 같은 폴더를 두고 날짜 또는 테스트 ID별 JSON 파일을 만들 수 있습니다. 공통 필드 이름과 참·거짓 형식을 고정하고, 자유 서술은 답변 요약과 오류 항목에 제한합니다.
마케팅 담당자가 코드 파일을 다루기 어렵다면 CSV나 스프레드시트에서 먼저 기록하고 정기적으로 보관본을 내보낼 수 있습니다. 데이터베이스를 새로 만들 필요는 없습니다. 중요한 것은 담당자만 아는 개인 문서가 되지 않도록 저장 위치와 백업 기준을 정하는 것입니다.
질문 목록과 실행 결과는 왜 나눠야 하나요?
덮어쓰기로 이력을 잃지 않기 위해서입니다. 질문 목록에는 질문의 목적, 고객 단계와 관련 서비스만 둡니다. 실행 결과에는 당시 답변을 둡니다. 하나의 셀을 계속 최신 결과로 덮어쓰면 변화 이력을 잃습니다.
콘텐츠를 수정한 날도 별도 변경 기록으로 연결합니다. “FAQ 추가 뒤 다음 테스트”처럼 관계를 볼 수 있지만, 결과 변화가 그 수정 때문이라고 즉시 확정하지 않습니다.
보고서에서는 어디까지 계산할 수 있나요?
단순 건수와 비율까지입니다. 전체 질문 수를 분모로 언급 건수, 공식 URL 인용 건수, 오류 건수를 셀 수 있습니다. 다만 서로 다른 서비스와 질문 세트를 한 비율로 합치면 의미가 약해집니다. 기간, 서비스, 질문 유형을 함께 표시합니다.
임의 가중치를 더한 ‘AI 노출 점수’는 숫자가 정교해 보여도 근거가 불명확할 수 있습니다. 원자료와 단순 건수, 실제 오류 문장을 우선 보여줍니다.
품질 검수는 무엇을 확인하나요?
빈칸, 링크, 날짜, 중복 네 가지를 봅니다. 필수 칸이 비어 있지 않은지, URL이 실제로 열리는지, 다음 테스트 날짜가 과거가 아닌지 자동 검사할 수 있습니다. 브랜드명 표기와 질문 ID의 중복도 점검합니다. 사람이 답변 요약과 오류 판단을 최종 확인합니다.
일리애드 GEO/AIO 서비스와 자체 실험 리포트는 자동으로 AI를 조회하지 않고 사람이 결과를 직접 기록하는 MVP 방식을 사용합니다. 이 구조는 향후 도구가 바뀌어도 원자료를 유지할 수 있습니다.
오늘 바로 할 한 가지
질문 세 개를 골라 날짜, 서비스, 정확한 질문, 언급, 공식 URL, 오류, 개선 URL, 다음 날짜 여덟 칸으로 첫 표를 만드세요. 오늘 결과를 그대로 남기면 기준선과 기록 방식 검증을 동시에 시작할 수 있습니다.
첫 회차는 30분 안에 끝내는 것을 목표로 하세요.
① 질문 세 개를 문장 그대로 적어 둡니다
② AI 서비스 한 곳에서만 실행합니다
③ 마지막 칸에 다음 테스트 날짜를 먼저 적어 둡니다