コマンド1つでオープンウェイトモデルをローカル実行できるランタイム。OpenAI互換のローカルAPIサーバーとしても動作する。
ローカルLLMは、推論を自分の端末で完結させる方式です。入力が外部へ送信されないため、プライバシーの観点では構造的に有利です。
一方で、動かせるモデルの規模はメモリとVRAMで決まります。「一番賢いモデル」ではなく「自分のマシンで動く範囲で用途を満たすモデル」を選ぶのが現実的です。
広告について: 本ページには広告・アフィリエイトリンクが含まれます。掲載順位や評価は報酬額だけで決定せず、編集方針に基づいて作成しています。 広告掲載ポリシー
3件。編集部で確認できていない項目は「未確認」と表示しています。
コマンド1つでオープンウェイトモデルをローカル実行できるランタイム。OpenAI互換のローカルAPIサーバーとしても動作する。
GUIでモデルを検索・ダウンロードし、ローカルで実行できるデスクトップアプリ。OpenAI互換のローカルサーバー機能を持つ。
オープンソースのローカルAIデスクトップアプリ。ローカルモデルの実行と、外部APIの接続の両方に対応する。
小さめのモデルであれば動作します。ユニファイドメモリの容量が上限を決めるため、搭載メモリの範囲に収まる量子化モデルを選ぶことになります。具体的な必要量はモデルと量子化方式によって変わるため、実行ツールが表示する要件を確認してください。
推論の入力については外部送信されません。ただしモデルのダウンロード時は通信が発生します。また、端末そのものの紛失・マルウェア・共有設定などのリスクは残るため、「完全に安全」ではありません。