Как загружать документы в ИИ в Whizi

Краткий ответ

Прикрепите файл в поле ввода, перетащив его или нажав на значок скрепки, а затем задайте свой вопрос. Whizi принимает PDF, документы Word, таблицы, изображения и файлы кода или обычного текста. То, что получает модель, зависит от типа файла: извлечённый текст для документов, значения ячеек для таблиц и само изображение для картинок.

Поддерживаемые типы файлов и что на самом деле происходит с каждым

Прикрепите файл, перетащив его в поле ввода или нажав на значок скрепки, а затем задайте свой вопрос. То, что получает модель, зависит от типа файла, и понимание этого объясняет большинство неожиданных результатов.

ТипРасширенияС чем работает модель
Текстовые PDF.pdfИзвлечённый текст в порядке чтения, включая таблицы как текст
Сканированные PDF.pdfПостраничная расшифровка после серверной обработки зрением
Документы Word.docxТекст документа, извлечённый в вашем браузере
Таблицы.xlsx, .csvЗначения ячеек как текст, а не действующие формулы
Изображения.png, .jpg, .jpegСамо изображение, которое читает мультимодальная модель
Код и обычный текст.py, .js, .ts, .go, .md, .txt и подобныеСодержимое файла дословно

Стоит запомнить два следствия. Во первых, таблица приходит как значения, а не как рабочая книга, поэтому модель видит результат вашей формулы, но не может выполнить её заново. Во вторых, сканированный PDF прошёл через распознавание зрением, а не обычное извлечение текста, и необычный шрифт, рукописная пометка или низкое разрешение скана всё ещё могут привести к неверно распознанному символу в числе. Сверяйте цифры из сканированных документов с оригиналом. Отдельно об изображениях: поле ввода не принимает файлы GIF и просит заменить их на PNG или JPEG.

Подготовьте файл, прежде чем что либо спрашивать

Пять минут здесь экономят потом запутанный разговор.

  • Назовите файл так, чтобы было понятно, что это. Модель видит имя файла, и 2025-q3-vendor-contract-acme.pdf даёт полезный контекст, которого нет у document(3).pdf. Это особенно важно, когда в переписке уже несколько файлов.
  • Отправляйте исходник, а не версию для презентации. Особенно для таблиц: версия с объединёнными ячейками, промежуточными итогами внутри данных и пометками на полях вызывает намного больше ошибок, чем большой обычный файл.
  • Разбивайте огромные документы по смыслу, а не по размеру. Если вам нужны только раздел методологии и результатов, лучше загрузить именно их, чем загружать все 400 страниц в надежде, что внимание модели попадёт куда нужно.
  • Удаляйте личные данные, которые вам не нужны. Имена, адреса почты и идентификаторы редко требуются для анализа, и убрать их быстрее, чем выяснять, имели ли вы право их загружать.
  • Проверьте, действительно ли PDF текстовый. Попробуйте выделить текст в вашей программе для чтения PDF. Если не получается, это скан: Whizi расшифрует его с помощью зрения, и цифры стоит сверить с оригиналом.

Выбор модели под файл

Этот выбор важнее промпта, когда речь идёт о работе с документами.

  • Gemini для всего длинного. Модели Gemini в Whizi работают с контекстным окном в 1 000 000 токенов, а значит отчёт на 200 страниц, полный пакет договоров или десяток статей могут находиться в контексте целиком, а не обрабатываться по частям. Вопросы сразу по нескольким документам работают правильно, только когда всё действительно в контексте.
  • Claude для нюансов. Юридический язык, программные документы, всё, где смысл зависит от оговорок и уточнений. Также он лучше всех умеет сказать, чего документ НЕ говорит, а это часто и есть настоящий вопрос.
  • GPT для извлечения данных. Счета, формы, структурированные данные, всё, где нужна строгая таблица или JSON и одинаковые названия полей по сотне строк.
  • Любая мультимодальная модель для изображений, диаграмм, скриншотов и схем. Попросите её сначала описать, что она видит, прежде чем просить интерпретацию: это позволяет рано заметить неверные распознавания.

Вы можете переключать модели прямо посреди переписки без повторной загрузки, в этом и смысл работы в одном рабочем пространстве. Прочитайте с Gemini, извлеките данные с GPT и попросите Claude написать резюме, всё по одному и тому же приложенному файлу. См. переключение моделей посреди разговора.

Работа с несколькими документами одновременно

Вопросы по одному документу полезны. Вопросы сразу по нескольким документам это момент, когда удобство превращается в возможность, которой у вас раньше не было.

Промпт: сравнить

Сравни contract-a.pdf и contract-b.pdf. Верни таблицу с каждым пунктом, который отличается: пункт, что говорит A, что говорит B, и что выгоднее для нас и почему. Игнорируй различия в форматировании и нумерации. Отдельно перечисли пункты, которые есть в одном документе, но отсутствуют в другом.

Промпт: свести воедино

По всем приложенным файлам собери одну таблицу с ответом на [вопрос]. Одна строка на документ, название документа в первом столбце. Если документ не затрагивает вопрос, напиши НЕ ЗАТРОНУТО. Не объединяй документы с разными определениями без пометки об этом.

Промпт: найти противоречие

В чём эти документы противоречат друг другу? Приведи оба отрывка рядом и укажи, из какого файла каждый взят. Отдели настоящие противоречия от различий в объёме или дате.

Как только файлов больше одного, всегда указывайте их по имени в промпте. Фраза "В договоре с поставщиком, какой срок уведомления?" однозначна, а "какой срок уведомления?" заставляет модель выбирать самой, и она не скажет вам, что именно выбрала.

Когда ответ выглядит неверным

Короткая последовательность диагностики решает большинство проблем.

Модель говорит, что не видит файл. Убедитесь, что вложение действительно загрузилось, а затем сошлитесь на него явно: "В приложенном report.pdf". Особенно для изображений фраза "посмотри на приложенное изображение" гарантирует, что используется мультимодальный путь, а не ответ только по тексту вашего вопроса.

Ответ не о том документе. Называйте файл в каждом вопросе, как только в переписке их несколько.

Цифры чуть неверны в сканированном документе. Это ошибка расшифровки скана, а не рассуждения. Попросите модель дословно процитировать соответствующую строку, чтобы увидеть, что она распознала, а затем сверьте с оригиналом.

Пропущено что то, что точно есть в документе. Сначала задайте вопрос на поиск: Приведи отрывок, где обсуждается [тема], и укажи страницу или раздел. Если модель не находит его, проблема в извлечении текста, а не в рассуждении. Попробуйте другую модель или загрузите нужные страницы отдельно.

Модель пересказывает, а не отвечает. Попросите доказательство вместо вывода: Процитируй точный текст, который подтверждает твой ответ. Это также ловит случай, когда ответ был выведен из общих знаний, а не из вашего документа, а это самая важная ошибка, которую нужно поймать.

Последняя проверка заслуживает особого внимания. Модель, которую спросили про известный тип договора, распространённое регулирование или знаменитую статью, может ответить правдоподобно из обучающих данных, вообще не заглядывая в ваш файл. Требование цитаты заставляет ответ опираться на документ, который действительно перед ней.

Приватность и о чём подумать перед загрузкой

Загруженные вложения настроены на удаление максимум через 30 дней, а вы можете удалить файл или всю переписку раньше сами. Whizi не использует ваши промпты, файлы, переписки, голосовые расшифровки или сгенерированный контент для обучения собственных моделей ИИ и не продаёт этот контент как обучающие данные. Провайдер, обслуживающий выбранную вами модель, получает то, что нужно для ответа, и может хранить временные кэши по своим правилам.

Решение, которое остаётся за вами: разрешено ли вам вообще передавать этот документ стороннему сервису. Категории, о которых стоит задуматься: личные данные других людей, всё, что покрыто конкретной оговоркой о конфиденциальности, существенная непубличная информация, а также регулируемые данные вроде медицинских или финансовых записей с особыми правилами обращения.

Практичный средний путь для большинства это не отказ от загрузки, а редактирование. Имена, заменённые на роли, цифры, приведённые к индексу, а не к абсолютным значениям, и удалённые идентификаторы сохранят всё, что нужно для анализа, убрав при этом почти всё, что делает документ чувствительным.

Чек-лист
  • Называйте файлы понятно, ведь модель видит имя файла
  • Проверяйте, текстовый PDF или скан, прежде чем доверять извлечённым цифрам
  • Загружайте исходную таблицу, а не оформленную версию для презентации
  • Выбирайте Gemini для длинных файлов, Claude для нюансов, GPT для извлечения данных
  • Указывайте файлы по имени, как только их больше одного
  • Просите подтверждающую цитату, чтобы ответы опирались на документ
  • Убирайте личные данные, не нужные для анализа

Частые вопросы

Мои загрузки приватны?

Загрузки хранятся в вашем аккаунте, настроены на удаление максимум через 30 дней и могут быть удалены раньше в любой момент по вашему желанию. Whizi не использует ваши промпты, файлы, переписки, голосовые расшифровки или сгенерированный контент для обучения собственных моделей ИИ и не продаёт этот контент как обучающие данные. За вами остаётся решение, разрешено ли вам отправлять конкретный документ стороннему сервису, а это обычно определяют ваши собственные договоры или внутренние правила, а не наши.

Каков максимальный размер файла?

Каждый файл ограничен 10 МБ, а одно сообщение может нести до 6 файлов. В рамках этих ограничений главным становится контекстное окно модели: для длинных договоров, отчётов и наборов из нескольких документов выбирайте модель с большим контекстом, например Gemini, или загружайте нужные разделы вместо всего файла, ведь целевой контекст обычно и так даёт лучший ответ.

Можно ли удалить файл после переписки?

Да, файлы можно удалить в любой момент, а оставленные без внимания загрузки настроены на удаление сами по себе максимум через 30 дней. Учтите, что удаление файла не стирает задним числом то, что уже обсуждалось в переписке, поэтому, если содержимое достаточно чувствительное, чтобы удалять файл, удалите и саму переписку.

Работает ли это со сканированными PDF?

Да. Whizi определяет насыщенный изображениями или сканированный PDF по тому, как мало текста дают его страницы, и один раз пропускает его через серверную обработку зрением, которая возвращает постраничную расшифровку. Точность высокая на чистых сканах и падает при низком разрешении, необычных шрифтах, почерке и сложных таблицах. Поскольку неверно распознанный символ в числе незаметен в гладком ответе, сверяйте любую цифру из сканированного документа с оригиналом.

Можно ли загрузить несколько документов в один разговор?

Да, и именно здесь скрыта основная ценность. Сравнение двух договоров пункт за пунктом, сведение выводов по набору отчётов или поиск противоречий между документами, всё это требует, чтобы всё было в контексте одновременно. Указывайте файлы по имени в промптах, как только их больше одного, иначе модель выберет сама, не сказав, какой именно выбрала.