Llama 3とは何か
Llamaは、FacebookとInstagramを運営するMetaが作ったAIモデルの一群です。ChatGPTやClaudeと同じで、質問を打ち込むと答えが返ってきます。おもしろいのは何をするかではなく、どう配られているかです。
たいていのAIモデルは、作り手の製品の中に閉じ込められています。ChatGPTはOpenAIを通して使い、モデル自体が彼らのサーバーから出ることはありません。Metaは、学習済みモデルの中身である数値、つまりLlamaの重みを公開し、誰でもダウンロードして動かせるようにしています。
わかりやすいたとえがあります。多くのAIはレストランで、注文すれば向こうが作ってくれます。Llamaはレシピを公開することに近いです。レストランで食べることもできますし、自分で作ることも、手を加えることも、自分の店を開くこともできます。
ネット上で議論になる点をひとつ補足します。Llamaはよくオープンソースと説明されますが、厳密には「オープンウェイト」であり、ライセンスにはいくつかの条件が付いています。非常に大規模な商用利用への制限などです。個人にとっては実質的な違いはありません。これを使って製品を作る企業にとっては、ライセンスを読む価値があります。
何もダウンロードしなくても、これが効いてくる理由
ふつうの利用者にまで届く影響が3つあります。
安いので、あちこちにあります。 誰でもホストできるため、競争で価格が下がります。Llamaのモデルは、名前を出さないまま、あなたが他の製品で出会うAIのかなりの部分を動かしています。サービスが「高速」や「経済的」な枠と呼ぶものは、たいていこれです。
インターネットなしで動きます。 自分のパソコンの中のモデルは、飛行機の中でも、外部と切り離された環境でも、データを社外に出せない場所でも動きます。ホスト型のサービスには真似できません。
市場を健全に保ちます。 実力のある無料の選択肢があると、閉じたモデルが請求できる金額に上限ができます。あなたが何を使っていようと、これはありがたいことです。
実際のところ何が得意なのか
ここは熱意より正直さのほうが役に立ちます。Llamaにはいくつかのサイズがあり、トレードオフは一貫しています。小さいモデルは非常に速くて安く、大きいモデルは能力が高いものの、動かす費用はもう安くはありません。
| タスク | Llama | 他のほうが良い |
|---|---|---|
| 事実の短い質問 | 速くて十分 | いいえ |
| 短いリスト、アイデア出し、簡単な書き直し | とても得意で、即答 | いいえ |
| 大量の項目を繰り返し処理 | 1件あたりの費用が効くので最適 | いいえ |
| オフラインや非公開で動かしたい | 事実上これ一択 | いいえ |
| 人が通して読む文章 | 使えはする | Claudeが明確に上 |
| 複雑な多段階の推論 | 最上位より劣る | GPTかClaude |
| とても長い書類 | 限界がある | Gemini |
| ここ数週間の出来事 | 知りません | ウェブ検索つきのモデル |
傾向はこうです。量と速さでは優秀、日常の質問では十分に戦え、難しい推論と磨かれた文章では最上位のモデルに及びません。無料のものとしては妥当な取引ですし、「どちらが優れているか」という問いが的外れな理由でもあります。速さと費用が効く場面で使い、タスクが難しくなったら切り替えましょう。
使う方法は3つ
1. ワークスペース経由で、設定なしに。 いちばん簡単な方法です。LlamaはWhiziにGPT、Claude、Geminiと並んで含まれているので、手早い質問はLlamaに送り、内容が難しくなったら同じ会話の中でより強いモデルに切り替えられます。インストールするものはありません。
2. 自分のパソコンで。 OllamaやLM Studioのようなツールが、モデルをダウンロードしてローカルで動かします。現実的な期待としては、ある程度新しくメモリに余裕のあるマシンが必要で、快適に動くのは小さめのモデル、そして良いGPUがなければホスト型サービスより回答は遅くなります。その代わり、打ち込んだ内容は一切マシンの外に出ず、インターネットを切っていても動きます。プライバシーやオフライン利用が要件なら本当に価値がありますし、そうでなければ不要です。
3. API経由で。 ソフトウェアを作っているなら、各社が非常に低いトークン単価でLlamaをホストしています。大量処理のタスクで最上位モデルではなくこちらを選ぶ理由は、たいていこれです。
よい回答を引き出すには
小さめのモデルは、最上位のモデルとは違う書き方のプロンプトに応えます。3つの習慣で大きく変わります。
率直に、具体的に。 カフェの名前の案を10個、1行ずつ、説明なしで挙げてください のほうが、会話調の依頼よりうまくいきます。小さめのモデルは、単純で明示的な指示にはよく従い、凝った指示では脱線します。
一度に1つだけ。 最上位のモデルは1つのプロンプトで6つの条件を扱えます。小さめのモデルは、単一の依頼を順に重ねるほうが結果が良くなります。
形式を指定する。 一文で答えてください や 番号付きリストだけを返してください は、自信がないときに小さめのモデルが出しがちな水増しを防ぎます。
そして、切り替えどきを知っておきましょう。答えが曖昧だったり、自己矛盾していたり、明らかなことを見落としていたら、それは言い換えを続けるのではなく、同じ質問をより強いモデルに移す合図です。複数のモデルを持つワークスペースなら、これはクリック1回で、会話もそのまま引き継がれます。
気をつけたいこと
最近何が起きたかは知りません。 知識は学習した時点で止まっており、検索につながっていない限り、先月の出来事についての質問にも一般知識から、自信ありげに答えます。
どのモデルとも同じく、作り話をします。 小さめのモデルはやや多めです。具体的な事実、日付、数字は確認してください。
ホストされている場合、無料はプライベートを意味しません。 自分のマシンで動かすLlamaはプライベートです。誰かのサービス経由で使うなら、ほかのモデルとまったく同じく、その提供元のデータ方針が適用されます。
バージョンの混同。 Llama 3はある世代であり、その後さらに新しい版が出ています。重要な場面では、どのバージョンを使っているかたずねましょう。世代ごとの性能差は大きいからです。
- 手早い質問、短いリスト、速さが効く繰り返し作業に使う
- 丁寧な推論や磨かれた文章が必要になったら、より強いモデルに切り替える
- プロンプトは率直に、一度に1つの依頼で、出力形式を明示する
- オフラインや非公開の利用が本当に必要なときだけ、ローカルで動かす
- ほかのモデルと同じく、具体的な事実、日付、数字は確認する
- 世代差が大きいので、どのバージョンを使っているかたずねる
よくある質問
Llama 3を使うにはソフトのダウンロードが必要ですか?
いいえ。ダウンロードしてローカルで動かすのは選択肢の1つで、オフラインや完全に非公開での利用が必要なら正解ですが、それなりに高性能なマシンが要りますし、ホスト型サービスより回答は遅くなります。多くの人はブラウザ上のプラットフォーム経由で使っていて、そこではほかのモデルと並んでいて、設定は一切いりません。
Llama 3はChatGPTより速いですか?
小さめのLlamaモデルは明らかに速く、短い質問、手早いリスト作り、繰り返しの作業にとても向いています。引き換えになるのは能力です。複雑な推論と磨かれた文章では、最上位のモデルが明確に上です。現実的なやり方は、速さのためにLlamaを使い、思ったより難しい質問だとわかった時点で切り替えることです。
Llamaは本当に無料ですか?
モデルの重みは無料でダウンロードでき、ライセンスはほとんどの用途を許可しています。条件はありますが、主に非常に大規模な商用展開に関わるものです。動かすこと自体は現実には無料ではありません。自分のハードウェアと電気代か、ホスティング提供元のトークン単価がかかります。ただしその単価は、最上位モデルの請求額よりずっと低いだけのことです。
自分のパソコンで動かせばプライベートですか?
はい。それこそがローカルで動かす最大の理由です。打ち込んだ内容は一切マシンの外に出ず、インターネットを切っていても動き、提供元が介在しないので提供元の方針も適用されません。代償は、設定の手間、十分なメモリを積んだマシン、良いGPUがなければ遅い応答、そして快適に動く小さめのモデルに限られることです。
ChatGPTやClaudeの代わりにLlamaを使うべきですか?
代わりに、はまれです。併用は、よくあります。速くて単純な質問、大量の繰り返し作業、非公開やオフラインで動かす必要があるものには適した選択です。誰かが丁寧に読む文章、難しい多段階の推論、とても長い書類では、最上位のモデルのほうがはっきり優れています。両方を手元に置けば、決め打ちではなくタスクごとに選べます。