簡潔な回答
Whiziは画像、PDF、Wordファイル、Excelの表計算、PowerPointのスライド、そして約40種類のプレーンテキストおよびソースコード形式に対応しています。ファイルのアップロードはStarterを含む全プランに含まれており、アップロード自体にクレジットはかかりません。
4つのグループと、それぞれで何が起きるか。
| グループ | 拡張子 | Whiziが行うこと |
|---|---|---|
| 画像 | .png, .jpg, .jpeg | モデルに画像としてそのまま渡され、モデルが直接見られます |
| 文書 | .pdf, .docx, .doc | ブラウザ内でテキストが抽出され、テキストとして送信されます |
| 表計算 | .xlsx, .xls | セルの内容が抽出され、構造化テキストとして送信されます。古い形式の.xlsは.xlsxとして保存し直すよう案内されます |
| プレゼンテーション | .pptx, .ppt | スライドのテキスト、表、発表者メモがスライドごとに抽出されます。古い形式の.pptは.pptxとして保存し直すよう案内されます |
| テキストとコード | 以下に挙げる40種類以上の拡張子 | そのままテキストとして送信されます |
拡張子の完全なリスト
画像。 .png、.jpg、.jpeg
文書、表計算、スライド。 .pdf、.docx、.doc、.xlsx、.xls、.pptx、.ppt。ZIPベースの新しい形式はブラウザ内で解析されます。古いバイナリ形式の.xlsや.pptもピッカーでは選択できますが、.xlsxや.pptxとして保存し直して再アップロードするよう案内されます。
ソースコード。 .js、.ts、.jsx、.tsx、.py、.java、.cpp、.c、.cs、.rb、.php、.go、.rs、.swift、.kt、.kts、.scala、.lua、.pl、.pm、.r、.m、.sql、.graphql
マークアップとスタイル。 .html、.css、.scss、.sass、.less、.xml、.md
設定とデータ。 .json、.yaml、.yml、.env、.ini、.conf、.csv、.txt
シェルスクリプト。 .sh、.bash、.zsh、.fish
このリストにない形式の場合、まずPDF、CSV、プレーンテキストとしてエクスポートまたは保存するのが一番早い方法です。Googleドキュメントは.docxやPDFに、Keynoteのスライドは.pptxやPDFになり、ほとんどのデータエクスポートは.csvになります。
抽出が実際にどう機能するか
PDF、Word、Excel、PowerPointのファイルは、何かが送信される前にブラウザ内でテキストが抽出されます。モデルは元のバイナリファイルではなく、抽出されたテキストを受け取ります。ここには知っておくべき2つの影響があります。
1つ目は、スキャンされたPDFにはその抽出が読み取れるテキスト層が存在しないという点です。Whiziはページから得られるテキストの少なさから画像中心のPDFを検知し、代わりにサーバー側のビジョン処理を一度通します。これによりページごとの書き起こしが得られ、その後は抽出テキストと同じ経路をたどります。この処理で書き起こしが得られない場合、常に有効なフォールバックはページを画像としてアップロードすることです。画像に対応したモデルであればページ画像を直接読み取れます。
2つ目は、レイアウトが一部失われることです。抽出は単語と読み順を保持しますが、視覚的な配置は保持しないため、複雑な多段組みのレポートや装飾の多い表は画面で見るより平坦になって届くことがあります。特に表については、.csvや.xlsxでアップロードした方が、同じ表をPDFの中に入れるよりもモデルにとってはるかに構造がきれいになります。表計算を取り込んだ後どう扱うかは別のワークフローで、AIで表計算を分析する方法に詳しくまとめています。
画像は事情が異なります。抽出されるのではなくモデルに直接渡されるため、選んだモデルが画像を認識できる限り、図表、ダイアグラム、スクリーンショット、手書き文字もすべて機能します。
保存期間と削除
アップロードされた添付ファイルと生成されたメディアは、最大30日で期限切れになるよう設定されています。自分でそれより早く削除することもでき、アカウントを削除すれば他のすべてと一緒に消去されます。
Whiziはあなたのプロンプト、ファイル、会話、音声の書き起こし、生成されたコンテンツをWhizi独自のAIモデルの学習には使用せず、学習データとして販売することもありません。詳細はWhiziがあなたのデータをどう扱うかにまとめています。
- 画像、PDF、Word、Excel、PowerPoint、そして40種類以上のテキストおよびコード形式に対応
- ファイルのアップロードはStarterを含む全プランで利用可能
- アップロードにクレジットはかからない
- PDF、Word、Excel、PowerPointはまずブラウザ内でテキストに抽出される
- スキャンされたPDFはサーバー側のビジョン処理でページごとに書き起こされる
- 表は.csvや.xlsxの方がPDF内よりはるかによく機能する
- アップロードは最大30日で期限切れになる
よくある質問
WhiziにPDFをアップロードできますか?
はい、Starterを含む全プランで可能で、クレジットもかかりません。テキストはブラウザ内で抽出され、選んだモデルに送信されるため、GPTにPDFについて質問し、そのまま同じ会話でClaudeに切り替えて再アップロードなしで質問できます。スキャンされた、あるいは画像中心のPDFはページから得られるテキストの少なさから検知され、代わりにサーバー側のビジョン処理でページごとに書き起こされます。
WhiziはExcelファイルを読めますか?
はい、.xlsxであれば可能です。古いバイナリ形式の.xlsはブラウザ内で解析できないため、Whiziは.xlsxとして保存し直して再アップロードするよう案内します。セルの内容は抽出され、構造化テキストとして送信されるため、同じ表をメッセージに貼り付けたりPDFに埋め込んだりするよりもモデルにとってはるかにきれいなデータになります。分析的な用途では、表計算のアップロードが最も信頼できる回答を生む形式です。
ファイルサイズの上限はありますか?
実際の制約は固定のアップロード上限ではなく、選んだモデルのコンテキストウィンドウです。非常に長い文書はコンテキストを消費してしまい、モデルが他の用途に使えなくなるため、極端に大きなファイルは実際に分析したいセクションごとに分割した方がよい結果になります。選んだモデルにとって文書が長すぎる場合、同じ会話内でコンテキストの大きいモデルに切り替えれば大抵は解決します。
一度に複数のファイルをアップロードできますか?
はい、これはマルチモデルのワークスペースで特に役立つ使い方の一つです。表計算とその元になったPDFレポートを一緒にアップロードし、モデルに両者を照合させることができます。ドラッグ&ドロップは添付ボタンの上だけでなく、チャットウィンドウのどこでも機能します。
アップロードしたファイルはAIモデルの学習に使われますか?
Whiziはあなたのプロンプト、ファイル、会話、音声の書き起こし、生成されたコンテンツをWhizi独自のAIモデルの学習には使用せず、学習データとして販売することもありません。アップロードは最大30日で期限切れになるよう設定されており、それより早く削除することも、アカウント削除によってすべてを消去することもできます。