AI가 사진을 보고 “11개”라고 답했는데 실제로는 12개라면, 다시 “몇 개야?”라고 묻는 것만으로는 같은 실수를 반복하기 쉽습니다. 더 빠른 방법은 어느 칸을 놓쳤는지 찾을 수 있게 사진을 작은 구역으로 나누고, 구역별 목록과 종류별 합계를 함께 대조하는 것입니다.
이 글에서는 파란 컵·민트 공·노란 연필·코랄 책이 놓인 12칸 가상 문제판으로 직접 연습합니다. 문제판, 빈 CSV, 정답 CSV, 복사용 요청문, 3쪽 워크북, 일부러 틀리게 만든 실패 화면을 모두 제공합니다. 실제 계정 화면이나 실제 회사 자료는 쓰지 않았습니다.
3쪽 실습 PDF 내려받기 · 12행 빈 CSV 내려받기 · 복사용 요청문 TXT 내려받기 · 정답 CSV 내려받기
먼저 결론: 합계를 묻기 전에 12칸 위치표를 만드세요
사진 속 물건 개수를 검산하는 순서는 간단합니다. ① 범위를 A1~D3으로 나누고 ② 각 칸의 물건을 적고 ③ 종류별 위치 목록을 만들고 ④ 종류별 합과 전체 합을 대조합니다. 전체 숫자만 물으면 “11개”와 “12개” 중 무엇이 틀렸는지는 알 수 있지만, 빠진 물건이 C2의 파란 컵이라는 사실은 찾기 어렵습니다.
이 실습의 성공 기준은 네 가지입니다. A1~D3의 12칸이 빠짐없이 기록되어야 하고, 전체는 12개여야 하며, 종류별 합 4+3+3+2가 12와 같아야 하고, 파란 컵 위치가 A1·B2·C2·D3으로 기록되어야 합니다.
누가 따라 하면 좋은가요
사진 속 상품 수, 부품 수, 준비물 수를 ChatGPT로 처음 확인해 보는 입문자를 위한 글입니다. 이미지 첨부 자체가 처음이라면 ChatGPT 이미지 입력과 이미지 생성의 차이를 먼저 읽어도 좋습니다. 이번 작업은 새 그림을 만들어 달라는 요청이 아니라, 첨부한 그림에서 관찰 가능한 항목을 정리하는 작업입니다.
필요한 입력과 도구
- 이 글의 12칸 문제판 이미지 또는 3쪽 PDF
- 복사용 요청문 TXT
- 12행 빈 CSV와 정답 CSV
- CSV를 열 수 있는 스프레드시트 프로그램 또는 메모장
실제 업무 자료는 필요하지 않습니다. 처음에는 반드시 이 가상 자료로 흐름을 익히고, 업무에 적용할 때는 개인 정보·고객 정보·계약 내용·출입증·얼굴이 보이는 사진을 올리지 마세요.
판정에 쓰는 다섯 가지 표현
- 이미지 입력
- 사진이나 화면 캡처를 대화에 첨부해 내용을 살펴보게 하는 방식입니다. 이 글에서는 물건 종류와 위치를 읽는 데 사용합니다.
- 물체 개수 세기
- 사진에 보이는 대상을 종류별 또는 전체로 세는 작업입니다. 겹침, 작은 물체, 잘린 가장자리 때문에 오차가 날 수 있습니다.
- 위치 좌표
- 큰 사진을 A1, A2처럼 작은 칸으로 나누어 “무엇을 어디에서 봤는지” 기록하는 표식입니다.
- 검산
- 한 번 얻은 답을 다른 계산이나 목록으로 다시 확인하는 과정입니다. 여기서는 셀 목록, 종류별 위치, 종류별 합, 전체 합을 비교합니다.
- REVIEW
- 대상이 모호할 때 억지로 추측하지 않고 사람이 다시 볼 항목으로 남기는 표시입니다.
가장 쉬운 예: 세 칸만 먼저 세어 보기
A1에는 파란 컵, A2에는 민트 공, A3에는 노란 연필이 있습니다. 이 세 칸만 보면 전체는 3개이고 종류별로 각각 1개입니다. 여기서 중요한 점은 “3개”라는 합계와 함께 “A1=파란 컵, A2=민트 공, A3=노란 연필”이라는 위치 기록을 남기는 것입니다.
cell_id,observed_object,verification
A1,BLUE_CUP,MATCH
A2,MINT_BALL,MATCH
A3,YELLOW_PENCIL,MATCH
성공 확인: 세 행이 모두 있고, A1부터 A3까지 순서가 이어지며, 각 행에 물건 이름이 하나씩 들어 있으면 됩니다. 이 작은 예가 이해되면 같은 방법을 12칸으로 넓힐 수 있습니다.
실습 원본: 12칸 물건판

그림을 내려받거나 PDF 첫 페이지를 사용하세요. ChatGPT에 첨부하기 전에 A1과 D3가 모두 보이는지, 가장자리가 잘리지 않았는지 확인합니다. 글자가 너무 작아졌다면 화면을 억지로 확대해 읽게 하기보다 원본 이미지를 다시 첨부하는 편이 안전합니다.
15분 실습: 물건 12개를 위치까지 검산하는 7단계
1단계: 문제판 범위를 먼저 확인합니다
위에서 아래로 A행, B행, C행, D행이 있고 각 행에 1·2·3열이 있습니다. 따라서 검사할 셀은 A1부터 D3까지 총 12개입니다. 아직 물건 종류를 세지 말고 칸 수만 확인합니다.
성공 확인: A1, A2, A3, B1, B2, B3, C1, C2, C3, D1, D2, D3를 종이에 한 번 적을 수 있습니다.
2단계: 이미지를 첨부하고 첫 답을 받아 봅니다
입력창에 문제판 이미지를 첨부한 뒤 “사진 속 물건의 전체 개수와 종류별 개수를 알려 줘”라고 간단히 물어봅니다. 이 답은 최종 정답이 아니라 검산 전의 첫 답입니다. 계정이나 화면 구성에 따라 첨부 위치는 달라질 수 있으므로 특정 버튼 이름보다 이미지 미리보기가 입력창에 보이는지를 확인합니다.
성공 확인: 전송 전에 문제판 미리보기가 보이고, 답변에 전체 개수와 최소 한 가지 종류별 개수가 나타납니다.
3단계: 셀별 목록을 다시 요청합니다
이제 내려받은 TXT의 요청문을 사용합니다. 핵심은 “A1부터 D3까지 한 칸씩 기록하라”는 범위, CSV 열 순서, 모호하면 REVIEW라고 표시하라는 경계 조건입니다.
[목표]
첨부한 문제판에서 A1부터 D3까지 셀별 물건을 기록해 줘.
[세는 순서]
A행 1열→3열, B행 1열→3열, C행 1열→3열, D행 1열→3열 순서로 확인해.
[출력]
cell_id,row,column,observed_object,verification 순서의 CSV로 보여 줘.
[경계]
모호한 셀은 추측하지 말고 REVIEW라고 표시해.
[대조 요청]
셀 목록을 만든 뒤 종류별 개수와 위치 목록을 다시 계산해.
성공 확인: 답변에 12개 셀 ID와 CSV 헤더가 모두 있습니다. 11행이나 13행이라면 계산 전에 누락·중복부터 찾습니다.
4단계: 빈 CSV에 셀별 답을 옮깁니다
빈 CSV에는 A1~D3가 미리 들어 있습니다. 답변을 바로 믿고 정답 파일을 열지 말고, 먼저 관찰 결과를 observed_object 열에 옮깁니다. 파란 컵은 BLUE_CUP, 민트 공은 MINT_BALL, 노란 연필은 YELLOW_PENCIL, 코랄 책은 CORAL_BOOK으로 통일하면 철자 차이로 개수가 갈리는 일을 줄일 수 있습니다.
성공 확인: 빈칸이 0개이고 셀 ID가 12개이며 중복 셀이 없습니다. 자신 없는 셀은 REVIEW로 남겨도 됩니다.
5단계: 종류별 개수를 따로 셉니다
observed_object 열에서 BLUE_CUP, MINT_BALL, YELLOW_PENCIL, CORAL_BOOK을 각각 셉니다. 정답은 아직 보지 않습니다. 네 종류의 개수를 더한 값이 전체 행 수 12와 같은지 계산합니다.
성공 확인: 종류별 합과 전체 행 수가 모두 12입니다. 합이 11이면 누락, 13이면 중복 또는 한 셀에 두 종류를 적었는지 확인합니다.
6단계: 개수가 아니라 위치 목록을 대조합니다
파란 컵이 있는 셀만 모아 A1·B2·C2·D3처럼 적습니다. 같은 방식으로 민트 공, 노란 연필, 코랄 책도 위치를 적습니다. 전체 개수가 우연히 맞아도 서로 다른 두 물건을 바꿔 적으면 위치 목록에서 오류가 드러납니다.
성공 확인: 파란 컵 4개=A1·B2·C2·D3, 민트 공 3개=A2·B3·D1, 노란 연필 3개=A3·C1·D2, 코랄 책 2개=B1·C3으로 정리됩니다.
7단계: 정답 CSV로 마지막 검산을 합니다
이제 정답 CSV를 열고 셀별로 비교합니다. 같으면 MATCH, 다르면 REVIEW로 표시합니다. 이 실습 자료에서는 12개 행이 모두 MATCH이고 종류별 합 4+3+3+2도 전체 12와 일치합니다.
성공 확인: MATCH 12건, REVIEW 0건입니다. 다른 값이 있으면 정답을 그대로 덮어쓰지 말고 해당 셀을 문제판에서 다시 찾아 수정 이유를 기록합니다.
실패 화면 재현: 11개라고 답했을 때 어디부터 볼까요

실패 답변은 전체를 11개, 파란 컵을 3개라고 적었습니다. 파란 컵 위치도 A1·B2·D3만 기록해 C2를 빠뜨렸습니다. 코랄 책의 위치는 B1·D3라고 적었지만 D3은 파란 컵이고 실제 코랄 책은 C3에 있습니다.
- 누락: C2의 파란 컵을 세지 않았습니다.
- 위치 오기: 코랄 책 위치를 C3이 아니라 D3으로 적었습니다.
- 합계 오류: 누락 때문에 종류별 합과 전체 합이 11로 줄었습니다.
수정 요청: “A1부터 D3까지 셀별 물건을 먼저 기록한 뒤 종류별 개수와 위치를 다시 계산해 줘. 모호하면 REVIEW라고 표시해 줘.”라고 범위를 좁혀 요청합니다. 수정 답변도 사람이 문제판과 다시 비교해야 합니다.
정답을 네 겹으로 검산하는 방법
1. 셀 수 검산
헤더를 제외한 행이 12개인지 확인합니다. A1~D3 중 하나라도 없으면 개수를 계산하기 전에 목록부터 고칩니다.
2. 종류별 합 검산
파란 컵 4, 민트 공 3, 노란 연필 3, 코랄 책 2를 더하면 12입니다. 종류별 합과 전체 행 수가 다르면 누락 또는 중복이 있습니다.
3. 위치 목록 검산
종류별 개수가 맞더라도 위치가 바뀌었을 수 있습니다. 특히 C2 파란 컵과 C3 코랄 책처럼 가까운 칸은 셀 ID를 함께 확인합니다.
4. 원본 눈검산
정답 CSV도 참고 자료일 뿐 마지막 판단은 문제판 원본과 사람이 합니다. 중요한 재고·안전·비용 판단에는 사진 한 장의 AI 답을 단독 근거로 사용하지 않습니다.
여섯 가지 오류의 수정 기준
| 실패 | 왜 생기나요 | 수정 요청 또는 확인 |
|---|---|---|
| 전체 개수만 답함 | 출력 형식이 너무 넓습니다. | A1~D3 셀별 목록을 먼저 요청합니다. |
| 한 칸 누락 | 가장자리나 반복 물체를 건너뛸 수 있습니다. | 12개 셀 ID가 모두 있는지 먼저 확인합니다. |
| 인접 칸 위치 교환 | 공간 위치를 정밀하게 구분하기 어려울 수 있습니다. | C2와 C3처럼 해당 구역만 다시 지정해 비교합니다. |
| 작은 물건 오인 | 축소되거나 흐린 대상은 특징이 사라집니다. | 원본 해상도를 쓰고 중요한 구역을 잘라 별도로 확인합니다. |
| 회전된 대상 오인 | 방향이 달라지면 같은 종류를 다르게 볼 수 있습니다. | 사진 방향을 바로잡고 종류 이름을 미리 제시합니다. |
| 모호한데 단정함 | 추측 금지 조건이 없습니다. | 불확실하면 REVIEW라고 표시하도록 경계를 적습니다. |
공식 OpenAI 문서가 강조하는 점
OpenAI의 이미지 입력 안내는 작업이 시각 맥락에 의존할 때 이미지를 첨부하고, 무엇을 살펴볼지와 원하는 결과를 함께 설명하도록 안내합니다. 그래서 이 글의 요청문에도 검사 범위 A1~D3, 세는 순서, CSV 출력, 모호한 값 처리, 마지막 대조를 나누어 적었습니다.
또한 OpenAI의 이미지·비전 개발자 가이드는 작은 글자, 회전된 이미지, 정확한 공간 위치 파악, 잘못된 설명, 물체 개수 세기에 한계가 있을 수 있다고 설명합니다. 이 가이드는 비전 모델의 한계를 이해하기 위한 공식 근거이며, 특정 ChatGPT 화면이나 계정에서 언제나 똑같은 결과가 나온다는 뜻은 아닙니다.
따라서 “AI가 12개라고 했으니 끝”이 아니라 셀 목록→종류별 합→위치 목록→사람의 원본 확인 순서로 마무리합니다. 답변이 틀렸을 때는 ChatGPT 오답을 고치는 5단계도 함께 참고할 수 있습니다.
실제 사진에 적용할 때의 안전 기준
- 고객 이름, 전화번호, 주소, 얼굴, 사번이 보이면 먼저 가리거나 가상 자료로 바꿉니다.
- 회사 내부 문서나 계약서, 출입증, 의료·금융 자료는 조직의 승인 없이 올리지 않습니다.
- 대상의 일부가 잘렸다면 “0개”로 단정하지 말고 촬영 범위를 다시 확인합니다.
- 재고 주문, 안전 점검, 비용 집행처럼 영향이 큰 판단은 담당자가 원본과 실물을 다시 확인합니다.
- 다운로드한 CSV를 공유하기 전 개인 정보와 내부 식별자가 들어갔는지 다시 봅니다.
AI 답변을 입력 내용, 모델의 추론, 외부 근거로 나눠 검산하는 방법은 ChatGPT 답변의 입력·추론·외부 확인 실습에서 더 자세히 볼 수 있습니다. 사진의 표를 CSV로 옮기는 다음 실습은 사진 속 표를 CSV로 옮기기로 이어집니다.
판정이 애매할 때 보는 질문
전체가 12개라고 맞히면 위치 검산은 생략해도 되나요?
아니요. 서로 다른 두 물건의 종류나 위치를 바꿔 적어도 전체 합은 12가 될 수 있습니다. 중요한 작업일수록 위치 목록까지 확인하세요.
격자를 꼭 12칸으로 나눠야 하나요?
아닙니다. 사진 크기와 물건 밀도에 맞춰 4칸, 9칸, 16칸으로 바꿀 수 있습니다. 다만 모든 칸에 고유한 ID가 있어야 누락 위치를 찾기 쉽습니다.
사진을 자르면 개수가 달라지지 않나요?
경계에 걸친 물건이 두 번 세어지지 않도록 원본 범위를 유지하고, 부분 이미지는 확인용으로만 사용하세요. 경계 물건은 별도 표시가 좋습니다.
정답 CSV를 먼저 열어도 되나요?
가능하지만 연습 효과는 줄어듭니다. 먼저 빈 양식에 자신의 답을 적고, 마지막에 정답과 대조하는 순서를 권합니다.
AI 답변이 계속 바뀌면 어떤 값을 쓰나요?
반복 횟수로 다수결하지 말고 원본에서 각 셀을 사람이 확인합니다. 모호한 대상은 REVIEW로 남기고 더 선명한 사진을 준비하세요.
끝내기 전 확인표
- A1부터 D3까지 12개 셀을 모두 기록했습니다.
- 종류별 개수 4·3·3·2의 합이 12와 같습니다.
- 파란 컵 위치 A1·B2·C2·D3를 확인했습니다.
- 모호한 값은 추측하지 않고 REVIEW로 남겼습니다.
- 정답 CSV를 보기 전에 스스로 빈 양식을 채웠습니다.
- 문제판 원본과 결과를 사람이 마지막으로 대조했습니다.
- 실제 사진을 쓸 때 개인 정보와 내부 정보를 제거했습니다.
작성 기준과 책임
작성: AI플레이집 편집팀
검수: AI플레이집 실습 검수
최종 확인: 2026-08-19
AI 사용 공개: 초안 구성과 대표 이미지 생성에 AI를 사용했고, 편집자가 공식 문서, CSV 12행, 종류별 합계, PDF 3쪽, 이미지의 글자와 배치를 검수했습니다. 실패 화면은 실제 ChatGPT 캡처가 아니라 직접 만든 교육용 재현입니다.
내용이나 파일에서 오류를 발견했다면 정정 정책에 따라 알려 주세요.
출처로 사용한 안내
- OpenAI, Image inputs (확인: 2026-08-19)
- OpenAI, Images and vision guide (확인: 2026-08-19)
