貼り付けた秘密情報は実際どこへ行くのか
このページの話題にハッカーは一切関係ありません。貼り付けた秘密情報は、チャット製品の普通の、文書化された仕組みを通じてコピーを生み、そのコピーこそが問題です。
その仕組みは4つあります。1つ目は保存です。貼り付けた内容は、文書化されたスケジュールに沿って保存された会話の一部になります。たとえばOpenAIは、削除したチャットを30日以内に完全に削除する予定を組んでおり、GoogleのGeminiのアクティビティは既定で18か月の自動削除設定の下にあります。これを変更する方法はGeminiアカウントの削除方法で扱っています。2つ目は学習の初期設定です。OpenAI、Anthropic、Googleの消費者向けティアは、設定をオフにしない限り会話をモデル改善に使う可能性があり、ビジネスティアとAPIティアは既定でオフです。3つ目はレビューです。3社とも、フラグの立った会話は人間が読むことがあると明言しており、これは通常の安全対策ですが、それでも人間があなたの貼り付けた内容を見ることになりえます。4つ目は共有です。リンクとして共有した会話には、誰かに見せたかった部分の3メッセージ前にアップロードした書類まで含めて、すべてがついてきます。
これらはどれもスキャンダルではありません。すべてを合わせるとひとつのことを意味します。チャット欄はテキストが保存され、ときに学習に使われ、ときに人の目に触れる場所だということです。それを踏まえて貼り付けましょう。このページの残りは、この一文を具体的なケースに当てはめたものにすぎず、AIは安全に使えるかではその周辺のより広い安全性の問いを扱っています。
絶対に避けるリスト:伏せ字1つでただで守れる6項目
これらの項目がチャット欄に入る正当な理由はありません。モデルはあなたを助けるためにそれらを必要としていないからです。どれも伏せ字に置き換えても、得られる答えは変わりません。
| 絶対に貼らないもの | 他のデータと違う理由 | 代わりにすること |
|---|---|---|
| パスワード、APIキー、アクセストークン、二要素認証コード | 認証情報は、それを見た人なら誰にとっても価値があり、漏れたものをローテーションする手間は避けられるものです | 入る場所にPASSWORDやKEYと入力する。答えは変わりません |
| カード番号、口座番号、金融機関コードの全桁 | 決済詐欺には、まさにこの文字列だけがあれば十分です | お金に関するどんな質問でも「自分のカード」「自分の口座」で問題なく通じます |
| 政府発行の識別番号:社会保障番号、パスポート、国民ID、税番号 | なりすましはこうした番号から組み立てられ、パスワードのようにローテーションもできません | フォームや手続きを説明するのに、モデルが本物の番号を必要とすることは一切ありません |
| 他人の個人データ:住所付きの氏名、健康情報、人事記録 | それは他人の情報であり、多くの地域のプライバシー法は、それを共有する行為をチャットボットではなくあなたの行為として扱います | 貼り付ける前に、実名を「人物A」「人物B」に置き換えます |
| NDAや勤務先の機密保持方針の対象となる書類 | この問いは契約上のものであり、「チャットボットに貼り付けた」という事実は、そのあと何も悪いことが起きなくても開示にあたります | 保護された具体的な内容を除いた、書類の構造だけで質問します |
| 契約なしの外部コンサルタントにメールしないであろうもの | これは、上の行がすべて見逃したものまで捕まえるテストです | 答えがノーなら、イエスになるまで伏せ字にします |
最後の行は、この表全体を凝縮したものです。AIチャットとは、あなたが何も契約を交わしていない外部の相手が、親切にしてくれているだけの存在です。それに対するのとまったく同じ感覚で判断してください。
誰も気づかない項目
上の禁止リストは、項目がいかにも機密そうに見えるので守りやすいものです。実際に慎重な人がひっかかる貼り付けは、そう見えないもののほうです。
- スクリーンショット。 共有したかったエラーメッセージには、通知トレイ、開いているタブ、誰か他の人からのメール件名、隅にあるカレンダーのリマインダーまで一緒に写り込みます。聞きたいことだけが写るようにトリミングしましょう。
- 秘密情報が入ったコードファイル。 GitGuardianは2024年に、公開GitHubコミットで2,380万件の新しい秘密情報の漏えいを数えました。生きたキーの入った設定ファイルや.envファイルを貼り付けるのは、チャット窓版の同じ失敗です。ファイルを貼る前に、key、secret、token、passwordといった単語で検索しましょう。
- 会議の書き起こしや録音。 その会議で話した全員は、その場にいた人たちに向けて話しており、誰もチャットへのアップロードに同意していません。自分で書いた要約であれば、この問題は起きません。
- 顧客の列があるスプレッドシート。 聞きたいのは計算式についてなのに、貼り付けにはシート内のすべての顧客メールアドレスが含まれてしまいます。先に識別できる列を削除するか、シート全体ではなく構造だけの10行を貼り付けましょう。
- 取引先名の入った契約書。 条項を理解するには条項そのものが必要で、誰が署名したかはほとんど必要ありません。AIで書類を要約するは、伏せ字にしたファイルでもまったく同じように機能します。
- 書き出したカレンダーや受信トレイ。 1つのファイルに、何百人もの他人の名前、時間、件名が入っています。スケジュールの問題だけを尋ね、1週間の形だけを貼り付けて、書き出したファイル自体は手元に残しておきましょう。
この6つすべてに共通するパターンがあります。機密なのはたいてい、あなたが必要としているものの周りの文脈であり、必要なものだけに絞り込めばそれは取り除かれます。その絞り込みにかかる時間は30秒です。
本当に大丈夫なもの
短い禁止リストの意図は、そこに含まれないものはすべて使ってよいということです。日常的な貼り付けの大半には何の問題もありません。自分の下書きやメモ、公開されている情報、どれほど個人的な話題であれ一般的な質問、秘密情報を含まない自分のコード、そして質問に必要な範囲まで伏せ字にした書類です。
それを可能にする習慣が、貼り付ける前に伏せ字にすることで、これがうまくいくのはモデルが個人の識別ではなく構造で考えるからです。一度自分で試してみてください。壊れた暖房についての大家宛ての手紙を、名前を入れたバージョンと、代わりに[大家様]を入れたバージョンの両方で頼んで比較してみましょう。「この契約条項を説明して」という依頼は、モデルがどの会社が署名したかを知っていても良くはなりません。名前が本当に重要なまれなケースでは、出力にあとから自分で加えればよいだけで、それは取り消せない伏せ字なしの貼り付けをする代わりになります。
仕上げに必要なのは2つの設定です。消費者向けの初期設定はあなたに有利ではないので、チャットアプリの学習トグルを一度確認し、そのアプリの保存期間の数字を把握しておきましょう。提供元が公開すべき内容の見本がWhiziのデータページです。何が、どれくらいの期間保存され、削除すると何が消えるか。Whizi自身の答えはこうです。アップロードは最長30日で失効し、あなたのコンテンツはWhizi所有のモデルの学習には使われず、学習データとして販売されることもありません。日常的に使うどのツールも、同じ問いに引用できる場所で答えているべきです。まさにこの軸でサブスクリプションを選んでいるなら、サードパーティ製AIサブスクリプションは安全かがこのカテゴリー全体で同じ基準を確認しています。
習慣になれば、このページ全体の代わりになるルールがひとつあります。契約なしの外部コンサルタントにメールしないであろうものは、貼り付けないことです。それ以外はすべて、名前だけ入れ替えて自由に貼り付けて構いません。
- パスワード、APIキー、二要素認証コードは、どのプランでも、どの提供元でも、すべてのチャットから締め出す。
- カード番号、口座番号、政府発行IDは伏せ字に置き換える。答えは変わらない。
- 他人について何か貼り付ける前に、実名を人物A、人物Bに置き換える。
- NDAと勤務先の機密情報は、判断の問題ではなく契約上の禁止事項として扱う。
- スクリーンショットは、聞きたいことだけが写るようにトリミングする。
- ファイルを貼り付ける前に、コード内をkey、secret、token、passwordで検索する。
- アプリに設定があるなら、会話の学習利用をオフにする。
- アプリの保存期間と削除の数字を把握し、それを公開しているツールを選ぶ。
よくある質問
AIチャットボットに絶対に教えてはいけないことは何ですか。
あらゆる種類の認証情報(パスワード、APIキー、二要素認証コード)、支払いと口座の番号の全桁、政府発行の識別番号、他人の個人情報、そしてNDAや勤務先の機密保持方針の対象になるものです。それ以外を判断するテストはこうです。契約なしの外部コンサルタントにメールしないであろうものは、貼り付けないことです。
業務資料をAIに貼り付けても安全ですか。
質問に必要な範囲まで伏せ字にした、自分自身の業務であれば、たいてい問題なく非常に役立ちます。はっきりした2つの限界は、技術的なものではなく契約上のものです。NDAの対象となる資料と、勤務先の方針で制限されているものです。それ以外は、先に取引先名、顧客データ、埋め込まれた認証情報を取り除けば、モデルは伏せ字版に対しても同じ仕事をしてくれます。
AIチャットに入力した内容を、他人が見ることはありますか。
気軽に見られることはありませんが、コピーは現実に存在します。会話は提供元の方針のもとで保存され、オプトアウトしない限り消費者向けティアは学習に使うことがあり、フラグの立った会話は人間がレビューすることがあり、リンクで共有した会話の中身はすべてそのリンクとともに移動します。禁止リストが存在するのは、この4つのコピーがあるからで、そのそれぞれが文書化された提供元の挙動です。
チャットを削除すると、実際に消えるのですか。
提供元によります。だからこそ、保存期間の数字は、必要になる前に読めるデータページに載っているべきなのです。削除するとたいてい、あなたのアカウントからは速やかに会話が消え、システムからは明記されたスケジュールに沿って、限定的な法的保存期間を除いて消えます。スケジュールについては提供元の方針を確認し、それを明記しているツールを選びましょう。
機密性の高いテキストは、有料プランに貼り付けたほうが安全ですか。
大手提供元の有料ティアは月$20前後で、無料の消費者向けティアより厳しい学習の初期設定を持つのが普通なので、方向性としては正しいですが、どのティアであっても禁止リストは変わりません。この世でいちばん法人向けのプランに貼り付けた認証情報でも、それはあなたが開示した認証情報であることに変わりありません。初期設定のためにアップグレードしつつ、それとは関係なく伏せ字にしましょう。