【オラマ】

Ollama とは?

最終更新:
💡 モデルを選んで、手元のAIを動かす

LLMなどのモデルを取得・管理し、自分のPCで実行したりアプリから呼び出したりできるツール。ローカル実行に加えてクラウドモデルも利用できるため、どこで処理するかを確認して使う。

📌 このページのポイント
Ollama:選ぶモデルで実行場所が変わる 利用者CLI / APIOllamaモデルを選ぶローカルクラウドモデル取得:pullモデル実行:run連携先も確認ローカル用のAPI経由でもクラウドモデルは使える処理場所は、モデルと機能の選択で変わる
ローカルモデルは手元で、クラウドモデルは外部サービスで処理する。モデルの取得や連携アプリ、Web検索などの通信も別に確認する。
ひよこ ひよこ
Ollamaって何ができるの?
ペンギン先生 ペンギン先生
LLMなどのモデルを取得して、自分のPCで動かせるよ。コマンドやAPIでモデルを使えるので、自作アプリとの連携にも使うんだ。Ollama自体が一つの言語モデルというわけではないよ。
ひよこ ひよこ
使い始めるには?
ペンギン先生 ペンギン先生
インストール後、使うモデル名を指定して「ollama pull」で取得し、「ollama run」で実行できるよ。選べるモデルや利用条件はモデルごとに確認しよう。初回の取得や更新には通常ネット接続が必要なんだ。
ひよこ ひよこ
会話は必ず自分のPCの中だけ?
ペンギン先生 ペンギン先生
ローカル実行時のプロンプトや応答をOllama側が受け取ることはないとFAQにあるよ。一方、クラウドモデルを選ぶとサービス側で処理する。連携アプリやWeb検索なども含めて、送信先を確認しよう。ローカルだけにする設定もあるんだ。
ひよこ ひよこ
どのくらいのスペックのPCが必要なの?
ペンギン先生 ペンギン先生
モデルの大きさだけでは決まらないよ。量子化の設定や文脈の長さ、同時実行数でも必要なメモリが変わる。CPUだけで動かす構成も、対応するGPUを使う構成もあるけれど、動くことと快適な速度で使えることは別なんだ。
ひよこ ひよこ
プログラムからも呼び出せる?
ペンギン先生 ペンギン先生
ローカルサーバーのAPIは通常「http://localhost:11434/api」で使えるよ。PythonやJavaScriptの公式ライブラリもある。ただし接続先がローカルでも、クラウドモデルを指定すれば推論はクラウドで行われるので、APIのURLだけで判断しないでね。
ペンギン
まとめ:ざっくりこれだけ覚えればOK!
「Ollama」って出てきたら「LLMなどを手元で動かし、アプリからも使えるツール」と思えばだいたいOK!
📖 おまけ:英語の意味
「Ollama」 = オラマ(製品名)
💬 モデルを動かすツールの名前だよ。個々のモデルの名前とは区別しよう。

参考資料

← 用語集にもどる