AI
AI에 이미지를 보내기 전에 준비하는 방법
GPT-4o나 Claude 같은 비전 모델에 업로드하기 전에 내 기기에서 이미지를 크기 조정하고, 변환하고, 정리하세요 — 처리도 빨라지고, 무엇을 공유할지 정확히 내가 통제할 수 있습니다.
최종 수정 2026년 8월 1일
왜 이미지를 준비해야 할까
사진을 비전 모델 — GPT-4o, Claude, Gemini 등 — 에 넣으면, 원본 파일에는 모델이 필요로 하는 것보다, 그리고 여러분이 공유하고 싶은 것보다 더 많은 정보가 담겨 있는 경우가 많습니다. 업로드 전에 기기에서 간단히 정리해 두면 주고받는 속도가 빨라지고, 무엇이 기기 밖으로 나가는지 여러분이 통제할 수 있습니다.
“준비”가 무엇을 뜻하는지는 이미지가 어디로 가느냐에 따라 다릅니다. 그림을 읽거나 설명해 달라고 맡기는 채팅 모델, 레퍼런스나 img2img 입력으로 쓰는 이미지 생성 모델, 혹은 나중을 위해 모으는 레퍼런스 세트 중 하나겠지요. 기본은 언제나 같은 세 단계입니다 — 적절한 크기로 줄이고, 표준 포맷으로 만들고, 개인 메타데이터를 제거하는 것. 여기에 목적지에 따라 챙겨 두면 좋은 몇 가지 단계가 더해집니다. 이 모든 작업은 무엇이 어디로든 전송되기 전에 브라우저 안에서 이루어질 수 있습니다.

비전 모델에 이미지를 보내기 전, 브라우저에서 끝내는 세 단계.
적절한 크기로 줄이기
대부분의 비전 모델은 아주 큰 이미지를 내부적으로 축소하기 때문에, 휴대폰이나 카메라에서 바로 나온 6000픽셀짜리 사진은 도움이 되는 경우가 드뭅니다 — 업로드만 느려지고, 사용량 기반 과금 API에서는 이미지가 클수록 처리 비용이 더 들 수도 있습니다. 긴 변을 1024~2048 픽셀 범위로 줄이면 보통 모델이 실제로 활용할 수 있는 디테일은 그대로 유지하면서 파일은 훨씬 가벼워집니다.
모델이 글자만 읽거나 사물만 식별하면 되는 경우라면 더 작게 줄여도 됩니다. 도구마다 큰 이미지를 다루는 방식은 다르지만, 거의 모두가 모델이 픽셀을 보기 전에 사진을 먼저 축소합니다 — 그러니 거대한 파일은 결국 느린 업로드만 사는 셈입니다.
| 목적지 | 큰 이미지를 어떻게 다루나 | 적당한 긴 변 |
|---|---|---|
| ChatGPT / GPT-4o | 긴 변을 약 2048 px로 자른 뒤 512 px 타일로 읽음 | 1024~2048 px |
| Claude | 긴 변이 ~1568 px를 넘으면 처리 전에 축소 | 최대 1568 px |
| Gemini | 큰 이미지를 타일로 나눠 각 타일을 낮은 해상도로 표본화 | 1024~1536 px |
| 이미지 생성 모델 (SDXL 등) | 고정된 기본 해상도로 작동하며 그 크기에 맞춰 자르거나 여백을 채움 | 모델에 맞춤(대개 1024 px) |
정확한 수치는 도구가 업데이트되면서 바뀌지만, 패턴 — 어차피 축소되니 미리 줄이는 게 낫다 — 은 바뀌지 않습니다.
가로세로 비율을 적절히 유지하기
채팅 모델에서는 가로세로 비율이 엄격하지 않지만, 극단적인 비율은 손해입니다. 아주 긴 스크린샷은 타일 격자에 맞춰 눌려 들어가면서 작은 글자가 뭉개집니다. 좁고 긴 한 장으로 보내지 말고, 읽을 수 있는 몇 조각으로 나누세요. 이미지 생성 모델에서는 비율이 더 까다롭습니다 — 대부분의 디퓨전 모델은 8이나 64의 배수인 치수를 기대하고, 기본 크기(SDXL의 경우 1024×1024) 근처에서 학습됩니다. 어정쩡한 모양을 넣으면 도구가 잘라내거나 여백을 채우면서 주제의 일부가 날아갈 수 있습니다. 모델에 맡기지 말고 크기 조정에서 치수를 직접 정하거나, 원하는 모양으로 자르기를 하세요.
표준 포맷으로 만들기
비전 모델은 일반적인 JPG, PNG, WebP를 가장 편하게 다룹니다. 이미지가 덜 흔한 포맷이라면, 업로드가 거부되거나 조용히 잘못 처리되지 않도록 먼저 변환하세요. 아이폰이 HEIC로 저장한 사진이 자주 걸리는 함정입니다 — 많은 AI 도구가 이 포맷을 아예 받지 않으므로 무엇보다 먼저 JPG나 PNG로 변환하세요. JPG나 WebP로 변환하면 큰 사진의 용량도 줄어들어 업로드가 빨라집니다.
→ 포맷 변환하기
주제를 깔끔하게 정리하기
이미지가 레퍼런스일 때 — 생성 모델에 재현시키고 싶은 제품이나, 학습 세트에 넣을 사물일 때 — 주제 주변의 배경은 도움이 되기보다 모델을 헷갈리게 하기 쉽습니다. 복잡한 배경은 생성 모델을 엉뚱한 디테일로 끌고 가고, 주제만 또렷이 남기고 싶은 데이터셋에는 잡음을 더합니다. 배경을 먼저 제거하면 모델에게 투명 배경 위의 깔끔한 주제를 건네줄 수 있습니다. 채팅 모델에서는 덜 중요하지만, 실제로 묻고 싶은 대상에 바짝 잘라 두면 더 또렷하고 덜 얼버무리는 답을 얻습니다.
→ 배경 제거하기
파일 용량 한도 살피기
업로드마다 상한이 있습니다 — ChatGPT는 약 20 MB까지 이미지를 받고, Claude와 Gemini는 각각 몇 메가바이트 수준입니다 — 이 한도를 넘으면 업로드가 실패하거나 조용히 거부됩니다. 크기 조정만으로 대개 한도 아래로 내려가지만, 고해상도 PNG는 끈질기게 무거울 수 있습니다. 그럴 때는 압축하세요. WebP로 바꾸거나 JPG 품질을 한 단계 낮추면, 모델이 읽는 크기에서는 눈에 띄는 차이 없이 파일을 절반 이하로 줄일 수 있습니다. 먼저 크기를 줄이고, 그 작아진 결과를 압축하면 가장 가벼운 파일이 됩니다.
→ 파일 압축하기
개인 메타데이터 제거하기
사람들이 잊어버리는 단계가 바로 이것입니다. 휴대폰이나 카메라로 찍은 사진에는 EXIF 메타데이터가 담겨 있습니다 — 기기 모델, 정확한 촬영 시각, 카메라 설정, 그리고 흔히 사진을 찍은 위치의 GPS 좌표까지요. 그 이미지를 제3자 AI 서비스에 업로드하면 이 모든 정보가 함께 딸려 갑니다.
메타데이터를 먼저 제거하면 어디에 있었는지나 어떤 기기를 썼는지를 슬그머니 공유하지 않고 사진만 공유할 수 있습니다. Ruah는 이 작업을 무손실로 처리합니다 — 이미지를 다시 압축하지 않고 메타데이터만 제거하므로 픽셀은 그대로 유지됩니다.
왜 로컬에서 해야 할까
핵심은 통제권입니다. 다른 온라인 서비스로 이미지를 정리한다면, “정리된” 버전을 돌려받기 위해 이미 원본을 — GPS 태그까지 전부 — 업로드한 셈입니다. 내 기기에서 처리하면, AI에 도달하는 것은 오직 여러분이 보내기로 선택한, 다듬고 크기를 줄이고 메타데이터를 제거한 이미지뿐입니다.
간단 체크리스트
- 긴 변을 1024~2048 px로 크기 조정합니다 — 작업이 단순하면 더 작게, 생성 모델이면 모델 크기에 맞춰서.
- JPG, PNG, WebP로 변환하고, HEIC는 무엇보다 먼저 변환합니다.
- 중요한 부분이 잘리거나 눌리지 않도록 가로세로 비율을 확인합니다.
- 이미지가 레퍼런스거나 데이터셋 주제라면 배경을 제거합니다.
- 도구의 업로드 한도에 가깝다면 압축합니다.
- GPS와 기기 정보를 없애도록 메타데이터를 제거합니다.
- 그런 다음 업로드합니다 — 정확히 무엇을 넘겼는지 알고서.