運営: Hashforest Technology
TEE(Trusted Execution Environment)上でAIワークロードを実行することを中核に据えたクラウド。推論API・コンテナ実行の両方を提供している。
一部の項目のみ一次情報で確認済み。残りは未確認。
ここに書いているのは公式サイト・公式ドキュメントで確認できた内容です。確認できていない項目は「未確認」と表示しています。
| プライバシーレベルTEE | TEE 推論が保護された実行環境(TEE)で行われ、アテステーションによって「その環境で動いたこと」を検証できる。 |
|---|---|
| TEE(保護された実行環境) | あり |
| E2EE(端末側暗号化) | 未確認 |
| Zero Data Retention | あり |
| リモートアテステーション | あり |
| GPUメモリ保護 | あり |
| 上の保護が適用される範囲 | 既定で適用 特別な設定・申請なしに、すべてのリクエストへ適用される。 |
| 学習への利用 | 未確認 |
| プロンプトの保存 | 保存しない |
プライバシーポリシーに「TEE本番モードでデプロイされたモデルの利用では、ユーザーのプロンプト・入力・リクエストを収集も保存もしない」と明記(IPログはアンチスパム目的で6ヶ月保持。非本番=デバッグモードではリモートシェルを含むデバッガアクセスがあり得る)。推論APIはZDR機能を持ち、provider.zdr:true でZDRルートのみに限定できる(フォールバックなしのfail-closed)。ゲートウェイ自体はZDR設定に関わらずリクエスト/レスポンス本文を保存せず、レシートにはハッシュのみ残る。GPU TEEはNVIDIA H100/H200/B200 + Intel TDXで、アテステーションはAPI・署名付きレシート・NVIDIA公式検証ツールで検証できる。注意点1: アテステーションが証明するのはゲートウェイであってモデルホストではない。公式のTrust Boundary文書自身が「アテステーションレポートで、ゲートウェイが本物のTEEで動く特定のワークロードであることを検証する」と書いている。編集部が2026-08-14に /v1/attestation/report を model パラメータを変えて叩いたところ、どのモデルを指定しても workload_keyset_digest・署名アドレス・Intel TDX quote が同一で、応答には serving:"aggregator" が入っていた。注意点2: 推論カタログ25モデルのうち Phala 自身がホストしているのは6モデルで、残りは Chutes・NEAR AI・Tinfoil など別のTEE事業者が提供している(各モデルの providers フィールドで判別できる)。注意点3: routed model(非アテステーションのアップストリーム)ではプロンプトが第三者プロバイダに平文で見える(ZDRは保存を制約するが閲覧は制約しない)。学習利用については記載を確認できず未確認。SOC 2 Type I取得済み。
アテステーションの適用範囲を、編集部がどう確かめたか
2026-08-14〜15に編集部が /v1/attestation/report を model を変えて複数回取得。どのモデルでも署名アドレスが 0x79a5061e… で一致し、inference.phala.com と api.redpill.ai でも一致した。is_tee:false のモデルを指定しても同じ証明が返る。
| 無検閲・Abliterated系 | あり |
|---|---|
| 任意モデルの持ち込み | あり |
| Hugging Faceからの取り込み | 未確認 |
| 確認できた取り扱いモデル | DeepSeek V4 Flash 0731GLM-5.2Kimi K3Qwen3.6-35B-A3B-UncensoredGemma-4-26B-A4B-Uncensored |
| OpenAI互換API | あり |
|---|---|
| ストリーミング | あり |
| Tool calling | あり |
| JSONモード | 未確認 |
| 画像入力 | 未確認 |
| 公式ドキュメント | https://docs.phala.com/ |
| 入力 / 100万トークン | 未確認 |
|---|---|
| 出力 / 100万トークン | 未確認 |
| 月額(最低) | 未確認 |
| GPU時間単価(最低) | $3.5/時〜 |
単価は公式モデルAPI(inference.phala.com/v1/models)で公開されている。2026-08-14に取得した時点で25モデルが並び、すべて is_tee: true。ただし基準モデルのDeepSeek V4 Proはこの25モデルに含まれなくなったため、本サイトの単価比較・単価ランキングの対象外にしている(8月4日時点ではrouted modelとして存在し$1.50/$5.25だったが、8月14日の取得では消えていた)。参考までに同日時点の実額は、DeepSeek V4 Flash 0731 が入力$0.20・出力$0.40・キャッシュ読み$0.07(いずれも100万トークンあたり)、自社ホストの無検閲モデルが Qwen3.6-35B-A3B $0.30/$1.50、Gemma-4-26B-A4B $0.15/$0.70。GPU TEEはH200オンデマンド$3.50/時(24時間ミニマム・$84前払い)、コミットで$2.56〜$2.30/時、B200 $3.80/時。一般CVMは分単位課金(tdx.large $0.232/時)。
総合スコアは以下の配点から自動計算しています。手作業で総合点だけを動かすことはしません。 判定材料が確認できない項目は加点0(未確認)としています。
| 評価項目 | 配点 | 獲得 | 根拠 |
|---|---|---|---|
| 入力秘匿性 | 25 | 19 | レベルC = 19点 |
| アテステーション・検証可能性 | 15 | 15 | リモートアテステーション +9 / TEE +3 / GPUメモリ保護 +3 |
| モデルの自由度 | 15 | 11 | 無検閲/Abliterated系の提供 +6 / 任意モデルの持ち込み +5 |
| モデル性能 | 15 | 11 | 最上位クラス: frontier +9 / 取り扱い 5 モデル +2 |
| 料金 | 10 | 0 | GPU時間単価 $3.50/時〜(サイト内 最安$0.27〜最高$3.50) |
| 開発者体験 | 10 | 8 | OpenAI互換 +4 / ストリーミング +2 / Tool calling +2 |
| 安定性 | 10 | 未確認 | 稼働実績・ステータス公開が未確認 |
| 合計 | 100 | 64 | 情報の確度 90% |
ここから下は編集部の見解です。事実の記載とは分けています。実際に何が起きるかは、利用者の環境と用途によって変わります。
メリット
注意点
掲載内容に誤りを見つけた場合はお問い合わせからご連絡ください。確認のうえ修正し、修正日を明記します。