Cómo subir documentos a la IA en Whizi

Respuesta rápida

Adjunta el archivo en el compositor, arrastrándolo o haciendo clic en el clip, y luego haz tu pregunta. Whizi acepta PDF, documentos de Word, hojas de cálculo, imágenes y archivos de código o texto plano. Lo que recibe el modelo cambia según el tipo: texto extraído para documentos, valores de celdas para hojas de cálculo, y la imagen misma para fotos.

Tipos de archivo compatibles, y qué ocurre realmente con cada uno

Adjunta el archivo arrastrándolo al compositor o haciendo clic en el clip, y luego haz tu pregunta. Lo que recibe el modelo cambia según el tipo de archivo, y saber cuál es cuál explica la mayoría de los resultados sorprendentes.

TipoExtensionesCon qué trabaja el modelo
PDF de texto.pdfEl texto extraído, en orden de lectura, incluidas las tablas como texto
PDF escaneados.pdfUna transcripción por página de un análisis de visión en el servidor
Documentos de Word.docxEl texto del documento, extraído en tu navegador
Hojas de cálculo.xlsx, .csvValores de celda como texto, no fórmulas activas
Imágenes.png, .jpg, .jpegLa imagen misma, leída por un modelo multimodal
Código y texto plano.py, .js, .ts, .go, .md, .txt y similaresEl contenido del archivo tal cual

Vale la pena interiorizar dos consecuencias. Primero, una hoja de cálculo llega como valores y no como un libro funcional, así que el modelo puede leer lo que produjo tu fórmula pero no puede volver a ejecutarla. Segundo, un PDF escaneado pasó por una transcripción de visión y no por una extracción de texto simple, y una fuente inusual, una anotación manuscrita o un escaneo de baja resolución todavía pueden producir un carácter mal leído en un número. Verifica las cifras de documentos escaneados contra el original. Una nota sobre imágenes: el compositor rechaza archivos GIF y pide un PNG o JPEG en su lugar.

Prepara el archivo antes de preguntar nada

Cinco minutos aquí ahorran una conversación confusa más adelante.

  • Nombra el archivo según lo que es. El modelo ve el nombre del archivo, y 2025-q3-contrato-proveedor-acme.pdf le da un contexto útil que documento(3).pdf no da. Esto importa aún más cuando hay varios archivos en el hilo.
  • Envía la fuente, no la versión de presentación. En hojas de cálculo especialmente, la versión con celdas combinadas, subtotales dentro de los datos y notas al margen causa muchos más errores que un archivo grande y simple.
  • Divide documentos enormes por propósito, no por tamaño. Si solo necesitas la metodología y los resultados, subir esas secciones es mejor que subir 400 páginas y esperar que la atención caiga en el lugar correcto.
  • Elimina los datos personales que no necesitas. Los nombres, correos e identificadores rara vez son necesarios para el análisis, y quitarlos es más rápido que decidir si tenías permiso para subirlos.
  • Comprueba que un PDF sea realmente texto. Intenta seleccionar texto en tu lector de PDF. Si no puedes, es un escaneo, Whizi lo transcribirá con un análisis de visión, y las cifras merecen una verificación contra el original.

Elegir el modelo para el archivo

Esta elección importa más que el prompt en el trabajo con documentos.

  • Gemini para cualquier cosa larga. Los modelos Gemini en Whizi tienen una ventana de contexto de 1.000.000 de tokens, lo que significa que un informe de 200 páginas, un conjunto completo de contratos o una docena de artículos pueden estar presentes a la vez en lugar de procesarse por partes. Las preguntas entre varios documentos solo funcionan bien cuando todo está realmente en el contexto.
  • Claude para los matices. Lenguaje legal, documentos de políticas, cualquier caso donde el significado dependa de matizaciones. También es el mejor para decirte qué no dice un documento, que suele ser la pregunta real.
  • GPT para extracción. Facturas, formularios, datos estructurados, cualquier caso donde quieras una tabla estricta o JSON con nombres de campo consistentes en cien filas.
  • Cualquier modelo multimodal para imágenes, gráficos, capturas de pantalla y diagramas. Pídele que describa lo que ve antes de pedirle que interprete, lo que detecta lecturas erróneas a tiempo.

Puedes cambiar de modelo a mitad del hilo sin volver a subir el archivo, que es el sentido de hacer esto en un solo espacio de trabajo. Lee con Gemini, extrae con GPT y deja que Claude escriba el resumen, todo contra el mismo archivo adjunto. Consulta cambiar de modelo a mitad de conversación.

Trabajar con varios documentos a la vez

Las preguntas sobre un solo documento son útiles. Las preguntas sobre varios documentos son donde esto deja de ser una comodidad y se convierte en una capacidad que antes no tenías.

Prompt: comparar

Compara contrato-a.pdf y contrato-b.pdf. Devuelve una tabla de cada cláusula que difiere: cláusula, qué dice A, qué dice B, y cuál es más favorable para nosotros y por qué. Ignora las diferencias de formato y numeración. Enumera por separado las cláusulas presentes en uno y ausentes en el otro.

Prompt: consolidar

En todos los archivos adjuntos, construye una tabla que responda a [pregunta]. Una fila por documento, con el nombre del documento en la primera columna. Donde un documento no lo trate, escribe NO TRATADO. No combines documentos que usen definiciones distintas sin señalarlo.

Prompt: encontrar la contradicción

¿Dónde se contradicen estos documentos entre sí? Cita ambos pasajes uno junto al otro y nombra el archivo del que viene cada uno. Distingue las contradicciones genuinas de las diferencias de alcance o fecha.

Referencia siempre los archivos por nombre en tu prompt en cuanto haya más de uno. "En el acuerdo con el proveedor, ¿cuál es el plazo de aviso?" es inequívoco; "¿cuál es el plazo de aviso?" obliga al modelo a elegir, y no te dirá cuál eligió.

Cuando la respuesta parece incorrecta

Una breve secuencia de diagnóstico que resuelve la mayoría de los problemas.

El modelo dice que no puede ver el archivo. Confirma que el adjunto realmente se subió, y luego menciónalo explícitamente: "En el informe.pdf adjunto". Para imágenes especialmente, decir "mira la imagen adjunta" asegura que se use la vía multimodal en lugar de que el modelo responda solo a partir del texto de tu pregunta.

La respuesta trata sobre el documento equivocado. Nombra el archivo en cada pregunta en cuanto el hilo tenga varios.

Los números están sutilmente mal en un documento escaneado. Esto es la transcripción del escaneo, no el razonamiento. Pídele al modelo que cite textualmente la línea de alrededor para que puedas ver qué leyó, y luego revisa el original.

Se le pasó algo que sabes que está ahí. Haz primero una pregunta de localización: Cita el pasaje que trata sobre [tema] y da su página o sección. Si no lo encuentra, el problema es la extracción, no el razonamiento. Prueba con otro modelo o sube las páginas relevantes por separado.

Está resumiendo en lugar de responder. Pide la evidencia en lugar de la conclusión: Cita el texto exacto que respalda tu respuesta. Esto también detecta el caso en que la respuesta se infirió del conocimiento general y no de tu documento, que es el fallo más importante que hay que detectar.

Esa última comprobación merece énfasis. Un modelo al que se le pregunta sobre un tipo de contrato conocido, una regulación común o un artículo famoso puede responder de forma verosímil a partir de datos de entrenamiento sin consultar tu archivo en absoluto. Exigir una cita obliga a que la respuesta se ancle al documento que realmente tiene delante.

Privacidad y qué pensar antes de subir un archivo

Los adjuntos subidos están configurados para expirar a los 30 días como máximo, y puedes eliminar un archivo o toda una conversación antes tú mismo. Whizi no usa tus prompts, archivos, conversaciones, transcripciones de voz ni contenido generado para entrenar modelos de IA propios de Whizi, y no vende ese contenido como datos de entrenamiento. El proveedor que ejecuta el modelo que seleccionaste recibe lo que necesita para responder y puede conservar cachés temporales bajo su propia política.

El juicio que sigue siendo tuyo es si el documento es uno que tienes permitido procesar con un servicio de terceros en absoluto. Las categorías que merecen una pausa: datos personales de otras personas, cualquier cosa cubierta por una cláusula de confidencialidad específica, información material no pública, y datos regulados como registros médicos o financieros sujetos a normas de manejo particulares.

El camino intermedio práctico para la mayoría de la gente es redactar en lugar de abstenerse. Los nombres sustituidos por roles, las cifras indexadas en lugar de absolutas, y los identificadores eliminados conservarán todo lo que necesita el análisis mientras se elimina la mayor parte de lo que hace sensible a un documento.

Lista de comprobación
  • Nombra los archivos de forma descriptiva, ya que el modelo ve el nombre del archivo
  • Comprueba si un PDF es texto o un escaneo antes de confiar en los números extraídos
  • Sube la hoja de cálculo de origen, no la versión de presentación con formato
  • Elige Gemini para archivos largos, Claude para matices, GPT para extracción
  • Referencia los archivos por nombre en cuanto haya más de uno adjunto
  • Pide una cita de respaldo para que las respuestas se mantengan ancladas al documento
  • Elimina los datos personales que no necesitas para el análisis

Preguntas frecuentes

¿Mis archivos subidos son privados?

Los archivos subidos se guardan en tu cuenta, están configurados para expirar a los 30 días como máximo, y puedes eliminarlos antes cuando quieras. Whizi no usa tus prompts, archivos, conversaciones, transcripciones de voz ni contenido generado para entrenar modelos de IA propios de Whizi, y no vende ese contenido como datos de entrenamiento. Lo que sigue siendo tu decisión es si un documento en particular es uno que tienes permitido enviar a un servicio de terceros, algo que suele regirse por tus propios contratos o políticas internas y no por las nuestras.

¿Cuál es el tamaño máximo de archivo?

Cada archivo tiene un límite de 10 MB, y un mensaje puede llevar hasta 6 archivos. Dentro de esos límites, la restricción vinculante es la ventana de contexto del modelo: para contratos largos, informes y conjuntos de varios documentos, elige un modelo de contexto amplio como Gemini, o sube las secciones relevantes en lugar del archivo completo, ya que un contexto acotado suele producir de todos modos una mejor respuesta.

¿Puedo eliminar un archivo después de conversar con él?

Sí, los archivos se pueden eliminar en cualquier momento, y los que dejas sin tocar están configurados para expirar por sí solos a los 30 días como máximo. Ten en cuenta que eliminar un archivo no borra retroactivamente lo que ya se habló en la conversación, así que si el contenido es lo bastante sensible como para justificar eliminar el archivo, elimina también la conversación.

¿Funciona con PDF escaneados?

Sí. Whizi detecta un PDF con muchas imágenes o escaneado por lo poco texto que sus páginas producen, y lo envía una vez a través de un análisis de visión en el servidor que devuelve una transcripción por página. La precisión es alta en escaneos limpios y baja con resoluciones bajas, fuentes inusuales, escritura a mano y tablas complejas. Como un carácter mal leído en un número es invisible dentro de una respuesta fluida, verifica cualquier cifra de un documento escaneado contra el original.

¿Puedo subir varios documentos a la misma conversación?

Sí, y es ahí donde está la mayor parte del valor. Comparar dos contratos cláusula por cláusula, consolidar hallazgos de un conjunto de informes o encontrar contradicciones entre documentos son cosas que requieren que todo esté en el contexto a la vez. Referencia los archivos por nombre en tus prompts en cuanto haya más de uno, o el modelo elegirá por ti sin decir cuál eligió.