Cùng một câu lệnh, được ChatGPT và Claude trả lời cạnh nhau.

Chọn một trong 3 câu lệnh, xem hai mô hình trả lời cùng lúc, và giữ lại câu bạn thật sự sẽ gửi đi. Ở đây không có gì gọi tới mô hình cả: các câu trả lời là bản ghi cố định, nên trang này chạy miễn phí và lần nào cũng như nhau.

Cách hoạt động

Mỗi câu lệnh được chấm trên thang 100 cho đúng một thứ mà câu lệnh đó thật sự kiểm tra, và bên thắng không phải lúc nào cũng là cùng một mô hình. Vấn đề nằm chính ở đó: ChatGPT sắp xếp công việc tốt hơn, Claude quyết định điều gì quan trọng tốt hơn, còn bạn cần cái nào thì tùy việc đang có trước mắt.

Đây là các câu trả lời mẫu cố định, viết ra để cho thấy hai mô hình khác nhau về kiểu chứ không phải về chất lượng. Chúng không phải kết quả mô hình chạy trực tiếp và cũng không phải một phép đo chuẩn.

Tóm tắt bản hợp đồng 40 trang này

Chấm theo độ chính xác và trọng tâm

ChatGPT (OpenAI), 92/100

Đây là bản tóm các điều khoản chính:

  • Các bên: Meridian Corp (khách hàng) và Halcyon Ltd (nhà cung cấp)
  • Thời hạn: 24 tháng, tự động gia hạn trừ khi hủy trước 60 ngày
  • Phí: 12.400 USD mỗi tháng, tăng 4% mỗi năm
  • Trách nhiệm: giới hạn ở 12 tháng phí
  • Chấm dứt: bên nào cũng được, báo trước bằng văn bản 90 ngày

Cho tôi biết nếu bạn muốn một bảng theo từng điều khoản.

Claude Sonnet (Anthropic), 96/100

Đây là hợp đồng dịch vụ 24 tháng giữa Meridian Corp và Halcyon Ltd với mức 12.400 USD mỗi tháng, tăng 4% mỗi năm.

Ba điểm đáng để bạn lưu ý trước khi ký: hợp đồng tự gia hạn nếu bạn không hủy trước khi hết hạn 60 ngày, trách nhiệm giới hạn ở một năm phí, và thời hạn báo trước khi chấm dứt 90 ngày dài hơn thông lệ.

Phần còn lại là điều khoản mẫu.

Kết luận: Claude thắng, 96 so với 92. Cả hai đều đúng dữ kiện, nhưng Claude nói cho bạn biết cần lo điều gì thay vì liệt kê mọi thứ ngang nhau.

Từ chối một cuộc họp mà không cắt đứt quan hệ

Chấm theo giọng điệu và mức sẵn sàng gửi

ChatGPT (OpenAI), 88/100

Chủ đề: Re: Trao đổi về hợp tác

Chào [Tên],

Cảm ơn bạn rất nhiều vì đã liên hệ! Tiếc là tôi không thu xếp được việc này trong lịch hiện tại. Tôi thật sự trân trọng việc bạn nghĩ đến tôi, và rất mong vẫn để ngỏ cơ hội cho những dịp sau.

Chúc dự án của bạn mọi điều tốt đẹp!

Trân trọng,
[Tên của bạn]

Claude Sonnet (Anthropic), 95/100

Chào Dana,

Cảm ơn lời mời. Thứ Năm tôi xin phép bỏ qua, tuần này của tôi đã kín quá rồi và tôi thà vắng mặt còn hơn đến mà chuẩn bị nửa vời.

Nếu hữu ích, tôi có thể tự đọc bộ slide và gửi ghi chú trước thứ Sáu. Nếu không thì hẹn bạn ở vòng sau.

Noura

Kết luận: Claude thắng, 95 so với 88. Không có chỗ trống phải điền, có lý do thật và có đề xuất thay thế. Bạn có thể gửi đúng như vậy.

Biến mấy ghi chú này thành danh sách việc trước khi ra mắt

Chấm theo cấu trúc và người phụ trách

ChatGPT (OpenAI), 94/100

Danh sách trước khi ra mắt, xếp theo hạn chót:

  1. Chốt phạm vi (Thứ Hai), phụ trách: quản lý sản phẩm
  2. Vòng kiểm thử cuối cho thanh toán (Thứ Ba), phụ trách: kỹ thuật
  3. Bộ tài liệu báo chí và ảnh chụp màn hình (Thứ Tư), phụ trách: thiết kế
  4. Lên lịch tài nguyên cho Product Hunt (Thứ Năm), phụ trách: tiếp thị
  5. Phòng trực chiến ngày ra mắt (Thứ Sáu), cả nhóm

Bạn có muốn cái này dưới dạng bảng có cột trạng thái không?

Claude Sonnet (Anthropic), 90/100

Năm việc nằm giữa mấy ghi chú này và thứ Sáu: chốt phạm vi vào thứ Hai để kiểm thử có bản dựng ổn định, chạy hồi quy thanh toán vào thứ Ba, lấy bộ tài liệu báo chí từ thiết kế trước thứ Tư, lên lịch tài nguyên Product Hunt vào tối thứ Năm, và để trống thứ Sáu cho chính buổi ra mắt.

Ghi chú còn nhắc đến giá theo từng thị trường. Tôi sẽ cắt phần đó khỏi lần ra mắt này, nó không phải phần chịu lực.

Kết luận: ChatGPT thắng, 94 so với 90. Có người phụ trách, có hạn chót, và một danh sách đánh số dán thẳng vào công cụ theo dõi được.

Câu hỏi

Trang này có gọi mô hình thật không?

Không. Các câu trả lời là bản ghi cố định, nên trang mở ra tức thì và chạy không tốn gì. Muốn gửi câu lệnh của riêng bạn tới cả hai mô hình cùng lúc thì hãy mở Whizi.

Mô hình nào tốt hơn, ChatGPT hay Claude?

Không mô hình nào hơn ở mọi mặt. Trên ba câu lệnh này Claude thắng phần tóm tắt hợp đồng và email vì nó quyết được điều gì quan trọng, còn ChatGPT thắng phần danh sách việc vì nó sắp xếp công việc. Chọn một cái cho mọi thứ chính là sai lầm mà trang này nói tới.

Tôi chia sẻ được một so sánh cụ thể không?

Được. Sao chép liên kết chia sẻ, trang sẽ mở đúng câu lệnh đó cho người bạn gửi.

Bước tiếp theo

Đọc trọn bài so sánh ChatGPT và Claude, hoặc tính chi phí cho cùng công việc đó trên mọi mô hình bằng Công cụ tính chi phí token.