コマンド1つでオープンウェイトモデルをローカル実行できるランタイム。OpenAI互換のローカルAPIサーバーとしても動作する。
ローカルLLMは、推論を自分の端末で完結させる方式です。入力が外部へ送信されないため、プライバシーの観点では構造的に有利です。
一方で、動かせるモデルの規模はメモリとVRAMで決まります。「一番賢いモデル」ではなく「自分のマシンで動く範囲で用途を満たすモデル」を選ぶのが現実的です。
🔴 注意点がひとつあります。2026-08-22時点で、Ollama と LM Studio は同じアプリからクラウドモデルも選べます(Ollama は無料プランでも1本)。つまり「ローカル実行ツールを使っている」ことは「ローカルで動いている」ことを意味しません。機密を扱うなら、どちらの経路で動いているかを確認してください。
広告について: 本ページには広告・アフィリエイトリンクが含まれます。掲載順位や評価は報酬額だけで決定せず、編集方針に基づいて作成しています。 広告掲載ポリシー
3件。編集部で確認できていない項目は「未確認」と表示しています。
コマンド1つでオープンウェイトモデルをローカル実行できるランタイム。OpenAI互換のローカルAPIサーバーとしても動作する。
GUIでモデルを検索・ダウンロードし、ローカルで実行できるデスクトップアプリ。OpenAI互換のローカルサーバー機能を持つ。
オープンソースのローカルAIデスクトップアプリ。ローカルモデルの実行と、外部APIの接続の両方に対応する。
小さめのモデルであれば動作します。ユニファイドメモリの容量が上限を決めるため、搭載メモリの範囲に収まる量子化モデルを選ぶことになります。具体的な必要量はモデルと量子化方式によって変わるため、実行ツールが表示する要件を確認してください。
推論の入力については外部送信されません。ただしモデルのダウンロード時は通信が発生します。また、端末そのものの紛失・マルウェア・共有設定などのリスクは残るため、「完全に安全」ではありません。