간단한 답변
Whizi는 이미지, PDF, Word 문서, Excel 스프레드시트, PowerPoint 슬라이드, 그리고 약 40가지 일반 텍스트 및 소스 코드 형식을 지원합니다. 파일 업로드는 Starter를 포함한 모든 플랜에서 제공되며, 파일을 업로드해도 크레딧이 소모되지 않습니다.
네 가지 그룹과 각각에 일어나는 일은 다음과 같습니다:
| 그룹 | 확장자 | Whizi의 처리 방식 |
|---|---|---|
| 이미지 | .png, .jpg, .jpeg | 이미지 형태로 모델에 전달되어 모델이 직접 확인합니다 |
| 문서 | .pdf, .docx, .doc | 브라우저에서 텍스트로 추출된 뒤 텍스트로 전송됩니다 |
| 스프레드시트 | .xlsx, .xls | 셀 내용이 추출되어 구조화된 텍스트로 전송됩니다. 예전 .xls 형식은 .xlsx로 다시 저장하라는 안내가 표시됩니다 |
| 프레젠테이션 | .pptx, .ppt | 슬라이드 텍스트, 표, 발표자 노트가 슬라이드별로 추출됩니다. 예전 .ppt 형식은 .pptx로 다시 저장하라는 안내가 표시됩니다 |
| 텍스트 및 코드 | 아래에 나열된 40여 개 확장자 | 텍스트 그대로 전송됩니다 |
전체 확장자 목록
이미지. .png, .jpg, .jpeg
문서, 스프레드시트, 슬라이드. .pdf, .docx, .doc, .xlsx, .xls, .pptx, .ppt. 최신 zip 기반 형식은 브라우저에서 파싱됩니다. 예전 바이너리 .xls나 .ppt 파일은 선택은 가능하지만, .xlsx나 .pptx로 다시 저장한 뒤 다시 업로드하라는 안내가 표시됩니다.
소스 코드. .js, .ts, .jsx, .tsx, .py, .java, .cpp, .c, .cs, .rb, .php, .go, .rs, .swift, .kt, .kts, .scala, .lua, .pl, .pm, .r, .m, .sql, .graphql
마크업과 스타일. .html, .css, .scss, .sass, .less, .xml, .md
설정과 데이터. .json, .yaml, .yml, .env, .ini, .conf, .csv, .txt
셸 스크립트. .sh, .bash, .zsh, .fish
목록에 없는 형식이라면 가장 빠른 방법은 대개 PDF, CSV, 또는 일반 텍스트로 내보내거나 저장하는 것입니다. Google Docs 문서는 .docx나 PDF가 되고, Keynote 슬라이드는 .pptx나 PDF가 되며, 거의 모든 데이터 내보내기는 .csv가 됩니다.
추출이 실제로 작동하는 방식
PDF, Word, Excel, PowerPoint 파일의 경우 전송되기 전에 브라우저에서 텍스트가 추출됩니다. 모델은 원본 바이너리 파일이 아니라 추출된 텍스트를 받습니다. 여기에는 알아둘 만한 두 가지 결과가 있습니다.
첫 번째는 스캔된 PDF에는 추출할 텍스트 레이어가 없다는 점입니다. Whizi는 페이지에서 추출되는 텍스트가 얼마나 적은지를 보고 이미지 위주의 PDF를 감지하며, 대신 서버 측 비전 처리를 한 번 거쳐 페이지별 텍스트를 얻은 뒤 이를 추출된 텍스트와 동일한 경로로 전달합니다. 이 처리로도 텍스트를 얻지 못하면, 항상 통하는 대안은 페이지를 이미지로 업로드하는 것입니다. 비전을 지원하는 모델은 페이지 이미지를 직접 읽을 수 있기 때문입니다.
두 번째는 레이아웃이 일부 손실된다는 점입니다. 추출은 단어와 읽는 순서는 보존하지만 시각적 배치는 보존하지 않으므로, 복잡한 다단 보고서나 서식이 많은 표는 화면에서 보이는 것보다 평평하게 전달될 수 있습니다. 특히 표의 경우 .csv나 .xlsx 업로드가 PDF 안에 있는 같은 표보다 훨씬 깔끔한 구조를 모델에 제공합니다. 스프레드시트가 업로드된 뒤 어떻게 활용할지는 그 자체로 하나의 작업 방식이며, AI로 스프레드시트 분석하는 법에서 다룹니다.
이미지는 다릅니다. 추출되지 않고 모델에 그대로 전달되므로, 선택한 모델이 이미지를 볼 수 있는 한 차트, 다이어그램, 스크린샷, 손글씨 모두 잘 작동합니다.
보관과 삭제
업로드한 첨부 파일과 생성된 미디어는 최대 30일 후 만료되도록 설정되어 있습니다. 더 일찍 직접 삭제할 수도 있으며, 계정을 삭제하면 다른 모든 데이터와 함께 제거됩니다.
Whizi는 회원님의 프롬프트, 파일, 대화, 음성 스크립트, 생성된 콘텐츠를 Whizi 소유 AI 모델 학습에 사용하지 않으며, 해당 콘텐츠를 학습 데이터로 판매하지도 않습니다. 자세한 내용은 Whizi가 데이터를 다루는 방식에서 확인할 수 있습니다.
- 이미지, PDF, Word, Excel, PowerPoint 및 40여 개 텍스트/코드 형식을 지원합니다
- 파일 업로드는 Starter를 포함한 모든 플랜에서 제공됩니다
- 업로드해도 크레딧이 소모되지 않습니다
- PDF, Word, Excel, PowerPoint는 먼저 브라우저에서 텍스트로 추출됩니다
- 스캔된 PDF는 서버 측 비전 처리를 통해 페이지별로 텍스트화됩니다
- 표는 PDF보다 .csv나 .xlsx로 업로드할 때 훨씬 잘 작동합니다
- 업로드 파일은 최대 30일 후 만료됩니다
자주 묻는 질문
Whizi에 PDF를 업로드할 수 있나요?
네, Starter를 포함한 모든 플랜에서 가능하며 크레딧도 소모되지 않습니다. 텍스트는 브라우저에서 추출되어 선택한 모델로 전송되므로, GPT에 PDF 관련 질문을 한 다음 같은 대화를 Claude로 전환해 다시 질문해도 재업로드가 필요 없습니다. 스캔되었거나 이미지 위주인 PDF는 페이지에서 추출되는 텍스트가 적다는 점으로 감지되어, 대신 서버 측 비전 처리를 통해 페이지별로 텍스트화됩니다.
Whizi가 Excel 파일을 읽을 수 있나요?
네, .xlsx는 가능합니다. 예전 바이너리 형식인 .xls는 브라우저에서 파싱할 수 없으므로, Whizi는 .xlsx로 다시 저장한 뒤 다시 업로드하도록 안내합니다. 셀 내용이 추출되어 구조화된 텍스트로 전송되며, 이는 같은 표를 메시지에 붙여넣거나 PDF에 넣은 경우보다 훨씬 깔끔한 데이터를 모델에 제공합니다. 분석 작업이라면 스프레드시트 업로드가 가장 신뢰할 수 있는 답변을 만들어내는 형식입니다.
파일 크기 제한이 있나요?
실질적인 제약은 고정된 업로드 한도가 아니라 선택한 모델의 컨텍스트 창입니다. 아주 긴 문서는 모델이 다른 용도로 쓸 수 있었던 컨텍스트를 소모하므로, 매우 큰 파일은 실제로 분석하고 싶은 부분으로 나누는 편이 좋습니다. 선택한 모델에 문서가 너무 길다면, 같은 대화에서 컨텍스트가 더 큰 모델로 전환하면 대개 해결됩니다.
한 번에 파일을 여러 개 업로드할 수 있나요?
네, 이는 멀티 모델 워크스페이스에서 특히 유용한 활용법 중 하나입니다. 스프레드시트와 그 원본인 PDF 보고서를 함께 업로드하고, 모델에게 둘을 대조해 달라고 요청해 보세요. 드래그 앤 드롭은 첨부 버튼뿐 아니라 채팅 창 어디서든 작동합니다.
업로드한 파일이 AI 모델 학습에 사용되나요?
Whizi는 회원님의 프롬프트, 파일, 대화, 음성 스크립트, 생성된 콘텐츠를 Whizi 소유 AI 모델 학습에 사용하지 않으며, 해당 콘텐츠를 학습 데이터로 판매하지도 않습니다. 업로드 파일은 최대 30일 후 만료되도록 설정되어 있으며, 더 일찍 삭제하거나 계정 삭제를 통해 모두 제거할 수 있습니다.