Featherless AIとは|無検閲LLM2万件を実測した
無検閲モデルを正式カテゴリとして扱うOpenAI互換API。公開APIからカタログ21,745件と基準モデルの単価を実測し、定額制の並列上限とプライバシーの限界を検証。
- 公開:
- 著者:
- Private AI Navi 編集部
- 読了目安:
- 約12分
Featherless AIとは
Featherless AI は、Hugging Face 上のオープンウェイトモデルをサーバレスで叩ける推論APIです。運営は米デラウェア州の Featherless, LLC で、利用規約の準拠法はニューヨーク州法。エンドポイントは https://api.featherless.ai/v1/chat/completions で、OpenAI互換のクライアントからベースURLを差し替えるだけで動きます。
特徴は取り扱いモデルの選び方にあります。公式ドキュメントは「Hugging Face の公開モデルはダウンロード100件以上あれば自動的に Featherless で推論可能になる」と述べており、カタログは事業者が選んだ数十モデルではなく、コミュニティが上げた派生モデルごと取り込む方針です。その結果として、無検閲系のモデルがカタログの正規の住人になっています。
カタログを実測する
トップページは「45,900+ models」と表記し、ドキュメントの対応表は「4,000以上のテキスト生成モデル」と書いています。公開APIが返すカタログ全件は 21,745件でした(うち gated が80件)。
この食い違いは、たぶん不正確というより数え方の違いです。ダウンロード100件以上の公開モデルが自動で入る仕様である以上、「使えるモデル数」は在庫ではなく流量に近く、どの時点で何を母数にするかで数字が変わります。引き写すと当日から古くなる種類の数字なので、このサイトでは取得日とセットでしか扱いません。
無検閲系がどれだけあるかも数えました。モデルIDの文字列一致で 788件です。
| 数え方 | 件数 |
|---|---|
公式サイトのフィルタ(?training=uncensored) | 1,146 |
| API上のモデルID一致(uncensored / abliterated / heretic / dolphin / nsfw / unfiltered) | 788 |
内訳は uncensored 269・heretic 251・abliterated 247・dolphin 97・nsfw 34・unfiltered 8。公式フィルタの方が多いのは、モデル名に語が入っていなくても提供元がタグ付けしているためと考えられます。どちらが正しいという話ではなく、母数が違うので両方出しています。
コンテキスト長は最大262,144トークン、入力単価は $0.01〜$12/100万トークンの幅がありました。
料金は2階建てになっている
ここが他社と比較するときに一番間違えやすい点です。Featherless の主力は定額プランで、トークン単価という概念がありません。
| プラン | 価格 | 並列ユニット | 備考 |
|---|---|---|---|
| Premium(チャット) | $25/月 | 4 | 全モデル・トークン無制限 |
| Business(トークン課金) | $25〜/月 | 8 | 最大256Kコンテキスト |
| Business(GPU) | 個別見積 | 8 | 専有GPU |
| Per-Request | 前払い$25〜 | 100 | 従量課金・モデルサイズ上限なし |
トークン単価が効くのは Per-Request だけです。基準モデルの deepseek-ai/DeepSeek-V4-Pro は $1.60/$3.20(100万トークンあたり入力/出力)、コンテキスト262,144でした。他社と横並びで見るならこの数字ですが、定額プランを使うなら比較の土俵が変わります。
| サービス | 入力 / 100万トークン | 出力 / 100万トークン | 最終確認 |
|---|---|---|---|
| Featherless AI | $1.6 | $3.2 | 2026-08-20 |
| OpenRouter | $0.7903 | $1.5806 | 2026-08-04 |
| DeepInfra | $1.3 | $2.6 | 2026-08-03 |
| Venice AI | $1.65 | $3.3 | 2026-08-04 |
単価は共通の基準モデルで揃えています(基準モデル名は各サービスページに記載)。モデルによって単価は大きく変わります。 料金は変更される場合があります。最新の価格は必ず各公式サイトでご確認ください。
定額プランで注意すべきは並列ユニットです。1リクエストが占有するユニット数はモデルサイズで決まり、16B未満が1・34B未満が2・70B以上が4。Premium の4ユニットは「70B級なら同時1本」を意味します。超過分は 429 で拒否されるので、エージェントのように並列で叩く用途では実質的な上限になります。実測したカタログでは、4ユニット消費するモデルが614件ありました。
プライバシー:何を言っていて、何を言っていないか
ドキュメントの記述は明快です。
Featherless does not log chats, prompts, or completions sent through our API. Requests made via the API are processed in real time and are not stored on our servers.
プライバシーポリシー側も「We do not collect or store prompts or completions.」とし、収集するのはメールアドレス・支払い情報と、利用量(プロンプト数・入出力トークン数)だけだと書いています。保存しないのだから学習にも使えない、という建て付けです。宣言の強さとしては、ZDRを掲げる他社と同等です。
言っていないことの方が重要です。編集部でドキュメント全節と公開APIを確認した範囲で、TEE(Trusted Execution Environment)もリモートアテステーションもクライアント側暗号化も提供していません。推論をどのインフラで、自社GPUか外部クラウドかも公開されていません。つまり「保存しない」を利用者が確かめる方法がなく、事業者を信用するかどうかの一点に収束します。
| サービス | プライバシー方式 | 提供形態 | 総合スコア | 情報の状態 |
|---|---|---|---|---|
| Featherless AI | ZDR | api / chat | 59.1/100 | 一部検証・9日前 |
| Venice AI | E2EE + TEE | chat / api | 61.5/100 | 一部検証・25日前 |
| Phala | TEE | api / confidential-ai / gpu-cloud | 64/100 | 一部検証・15日前 |
スコアの算出方法は編集方針に記載しています。料金・機能は変更される場合があります。
無検閲の扱い
利用規約には、出力内容そのものを制限する条項がありません。禁止されているのは他者の権利侵害・違法行為・リバースエンジニアリング・妨害行為、そして「生成物を人間が書いたものと偽ること」です。成人向け表現については「モデルが未成年に不適切な内容を生成しうる」と注意する書き方にとどまり、禁止はしていません。
無検閲モデルを「隠しカテゴリ」ではなく検索フィルタとして公開している事業者は多くありません。一方で、無検閲は免責ではないという原則は変わりません。モデルが拒否しないことと、その利用が適法であることは無関係です。手法そのものについては Abliteratedモデルの仕組み を参照してください。
向いている用途・向いていない用途
メリット
- 無検閲・派生モデルを片っ端から試したい(カタログの広さが直接効く)
- 出力が長い用途を定額で回したい(トークン無制限)
- Hugging Faceで見つけたモデルをそのままAPIで叩きたい
- OpenAI互換のまま tool calling・JSONモード・画像入力を使いたい
デメリット・注意点
- 入力の秘匿を技術的に保証したい(TEE・アテステーションが無い)
- 70B級を高い並列度で叩きたい(1本あたり4ユニット消費する)
- 72Bを超える非公開モデルを持ち込みたい(上限72B・組織あたり10枠)
- GGUFやLoRA単体を持ち込みたい(safetensors・fp16が条件)
機密性の要求が高い入力であれば、アテステーションを返す事業者か、そもそも端末で動かす方が要件に近くなります。判断軸は 機密データを送る前に確認すること にまとめています。
よくある質問
Featherless AI は OpenAI 互換ですか?
はい。ベースURLを https://api.featherless.ai/v1 に差し替えれば OpenAI のクライアントがそのまま使えます。tool calling は公式ドキュメントで「OpenAI互換の関数呼び出し」と説明されており、画像入力も image_url 形式で送れます。
本当に何モデル使えるのですか?
2026-08-20に公開APIから取得したカタログは21,745件でした。トップページの45,900+、ドキュメントの4,000+とは数え方が違います。Hugging Faceの公開モデルがダウンロード100件以上で自動的に追加される仕様のため、件数は日々変動します。
プロンプトは保存されますか?
公式ドキュメントとプライバシーポリシーは、プロンプトと応答を記録も保存もしないと明記しています。ただしTEEやリモートアテステーションは提供されていないため、その通りに運用されていることを利用者側で検証する手段はありません。
定額プランと従量プランのどちらが安いですか?
出力量で決まります。トークン単価が発生するのは従量のPer-Requestプランだけで、定額プランはトークン無制限です。呼び出し回数が少ないなら従量、長い出力を継続的に生成するなら定額が有利になります。
出典
カタログ件数・単価・プラン・プライバシーの記述の最終確認日: 2026-08-20(9日前)
出典
- https://featherless.ai/
- https://featherless.ai/docs
- https://featherless.ai/docs/privacy-and-logging
- https://featherless.ai/legal/privacy-policy
- https://featherless.ai/terms
- https://featherless.ai/docs/plans
- https://featherless.ai/docs/concurrency
- https://featherless.ai/docs/model-compatibility
- https://api.featherless.ai/v1/models
- #無検閲AI
- #Featherless
- #LLM API
- #Abliterated
本記事の内容は執筆時点の公開情報にもとづきます。料金・機能・ポリシーは変更される場合があります。 誤りを見つけた場合はお問い合わせからご連絡ください。確認のうえ修正し、更新日を明記します。