El mismo prompt, respondido por ChatGPT y Claude uno al lado del otro.
Elige uno de 3 prompts, mira cómo responden los dos modelos a la vez y quédate con la respuesta que enviarías de verdad. Aquí nada llama a un modelo: las respuestas son transcripciones fijas, así que la página es gratis y es idéntica siempre.
Cómo funciona
Cada prompt se puntúa sobre 100 en lo único que ese prompt está midiendo de verdad, y el ganador no siempre es el mismo modelo. Ese es el punto: ChatGPT estructura mejor, Claude decide mejor qué importa, y cuál quieres depende de la tarea que tengas delante.
Son respuestas de ejemplo fijas, escritas para mostrar en qué se diferencian los dos modelos por tipo y no por calidad. No son salida en vivo de un modelo ni un benchmark.
Resume este contrato de 40 páginas
Evaluado por precisión y foco
ChatGPT (OpenAI), 92/100
Aquí tienes un desglose de los términos clave:
Partes: Meridian Corp (cliente) y Halcyon Ltd (proveedor)
Plazo: 24 meses, se renueva solo salvo cancelación con 60 días de antelación
Importes: 12.400 USD al mes con una subida anual del 4%
Responsabilidad: limitada a 12 meses de cuotas
Resolución: cualquiera de las partes, con 90 días de preaviso por escrito
Dime si quieres una tabla cláusula por cláusula.
Claude Sonnet (Anthropic), 96/100
Es un contrato de servicios de 24 meses entre Meridian Corp y Halcyon Ltd por 12.400 USD al mes, con una subida del 4% cada año.
Tres cosas merecen tu atención antes de firmar: el contrato se renueva solo si no cancelas 60 días antes del vencimiento, la responsabilidad está limitada a un año de cuotas, y el preaviso de 90 días es más largo de lo habitual.
Todo lo demás es texto estándar.
Veredicto: Claude gana, 96 a 92. Los dos acertaron los datos, pero Claude te dijo qué debía preocuparte en vez de enumerarlo todo por igual.
Rechaza una reunión sin romper el puente
Evaluado por tono y por si está listo para enviar
ChatGPT (OpenAI), 88/100
Asunto: Re: Conversación sobre la colaboración
Hola, [Nombre]:
¡Muchísimas gracias por escribirme! Por desgracia no voy a poder encajarlo en mi agenda actual. Te agradezco de verdad que hayas pensado en mí y me encantaría dejar la puerta abierta para futuras oportunidades.
¡Te deseo todo lo mejor con el proyecto!
Un saludo, [Tu nombre]
Claude Sonnet (Anthropic), 95/100
Hola, Dana:
Gracias por la invitación. Voy a pasar del jueves, tengo la semana demasiado cargada y prefiero no ir antes que aparecer a medias.
Si te sirve, puedo revisar el dossier por mi cuenta y mandarte comentarios el viernes. Si no, cuenta conmigo en la siguiente ronda.
Noura
Veredicto: Claude gana, 95 a 88. Sin huecos por rellenar, un motivo real y una alternativa sobre la mesa. Podrías enviarlo tal cual.
Convierte estas notas en una lista de lanzamiento
Evaluado por estructura y responsables
ChatGPT (OpenAI), 94/100
Lista de lanzamiento, ordenada por fecha límite:
Congelar el alcance (lun), responsable: PM
Última pasada de QA en pagos (mar), responsable: Ingeniería
Kit de prensa y capturas (mié), responsable: Diseño
Programar los materiales de Product Hunt (jue), responsable: Marketing
Sala de control el día del lanzamiento (vie), todo el equipo
¿Lo quieres como tabla con columnas de estado?
Claude Sonnet (Anthropic), 90/100
Cinco cosas separan estas notas del viernes: cerrar el alcance el lunes para que QA tenga una build estable, pasar la regresión de pagos el martes, sacar el kit de prensa de Diseño para el miércoles, programar los materiales de Product Hunt el jueves por la noche y dejar el viernes libre para el lanzamiento en sí.
Las notas también mencionan precios localizados. Yo lo quitaría de este lanzamiento, no es imprescindible.
Veredicto: ChatGPT gana, 94 a 90. Responsables, fechas y una lista numerada que puedes pegar directamente en un gestor de tareas.
Preguntas
¿Esto llama a los modelos reales?
No. Las respuestas son transcripciones fijas, por eso la página carga al instante y no cuesta nada de ejecutar. Para enviar tu propio prompt a los dos modelos a la vez, abre Whizi.
¿Qué modelo es mejor, ChatGPT o Claude?
Ninguno de los dos para todo. En estos tres prompts Claude gana el resumen del contrato y el correo porque decide qué importa, y ChatGPT gana la lista porque estructura el trabajo. Elegir uno solo para todo es justo el error del que habla esta página.
¿Puedo compartir una comparación concreta?
Sí. Copia el enlace para compartir y la página se abre con el mismo prompt para quien se lo envíes.