ツール手順 · 2026-08-30

Warp のカスタム推論
OpenAI Chat Completions、公開 URL

2026-10-07 時点、Warp 公式は OpenAI 互換のカスタム推論(POST /v1/chat/completions)を記載。次は Settings で inference endpoint を検索し、https://api.qcode.cc/openai/v1 と QCode key を入れ、モデル id は /models から GPT か GLM / Kimi / DeepSeek / Qwen を選ぶ(Claude はこの経路では動かない)。そのモデルを選ぶ。Auto は選ばない。

更新日 2026-10-07

このツールを QCode エンドポイントに接続。Claude・GPT・中国系モデルを 1 キーで。

#warp#custom inference#BYOK#OpenAI 互換

要点

/v1/chat/completions

エンドポイントが実装すべきプロトコル

公式:カスタム推論は OpenAI Chat Completions API を実装する必要がある。

0

そのモデル選択時の Warp AI credits

公式:エンドポイント経由のモデルを選ぶと Warp AI credits は消費しない。推論料金はエンドポイント側。Auto は Warp credits を消費する。

公開 HTTPS

ネットワーク要件

公式:リクエストは Warp サーバ経由。localhost / プライベート URL は拒否。QCode の https://api.qcode.cc/openai/v1 は公開 HTTPS。

2026-10-07

ドキュメント取得日

docs.warp.dev の custom-inference-endpoint は 2026-08-30 に取得、2026-10-07 に再確認(ページ表記 Last updated Oct 6, 2026)。BYOK ページは 2026-08-30 取得。

カスタム推論とは

Warp は Agent 付きターミナル。公式のカスタム推論エンドポイントは、OpenAI Chat Completions を実装した、自分で制御する公開 URL(OpenRouter、LiteLLM、z.ai、社内ゲートウェイ)へ Agent を向けること。OpenAI / Anthropic / Google の公式アカウント用 BYOK とは別ウィジェット。Cloud Agents は端末に保存したカスタムエンドポイントを使えない。

いま検索されていること

2026-08 も公式アカウントは BYOK とカスタム推論を説明。Warp のエンジニアは 2026-08-13 に「ターミナル内 agent は custom inference URL 済み、CLI は作業中」と書いた。当サイトに Warp 専ページはなかった。本ページは公式の足し方と、QCode を貼ったあと Auto を選ばないこと。

タイムライン

2026-05-20

Warp ブログが Free での BYOK と、OpenAI Chat Completions 互換のカスタム推論を発表。

ドキュメント現状

Settings で inference endpoint を検索。/v1/chat/completions を出す base URL、資格情報、モデル id。そのモデルを選ぶと Warp AI credits を使わない。

2026-08-30

本取得でも公開到達性が必須。localhost は拒否。Auto は常に Warp credits。キーはローカルのキーチェーン、リクエスト時に Warp バックエンドを通過し、公式はサーバに保存しないと書く。

確認済み vs 注意

確認済み

カスタム推論は Free と対象の有料プラン(個人 / 10 人以下は公式条項)。プロトコルは OpenAI Chat Completions。そのモデル選択時は Warp AI credits を使わない。2026-10-07 再確認。

注意

公式:Auto は Warp credits を使う。localhost 不可。Cloud Agents はローカルのカスタムエンドポイントを使えず Warp credits を消費。ChatGPT / Claude の消費者サブスクは Warp BYOK にできない。API key を使う。

カスタムか公式プロバイダの BYOK か

カスタム推論(本ページ)

公開の OpenAI 互換 URL。QCode は https://api.qcode.cc/openai/v1 で GPT と GLM / Kimi / DeepSeek / Qwen 用。

公式プロバイダの BYOK

OpenAI / Anthropic / Google の公式アカウントのみ。ゲートウェイ、LiteLLM、QCode はカスタム推論ウィジェット。

次にすること

① Warp の Settings で inference endpoint を検索。② Endpoint URL は https://api.qcode.cc/openai/v1(公式は /v1/chat/completions を出す base URL を求めており、公式例も /v1 で終わる)。API key は QCode key。モデル id は /models から GPT か GLM / Kimi / DeepSeek / Qwen(例:gpt-6-sol、glm-5.3)。③ 保存したらピッカーでそのモデルを選ぶ。Auto は選ばない。Claude のモデルはこの OpenAI 互換エンドポイントでは使えない。Claude は Warp のターミナルで Claude Code を動かし、ANTHROPIC_BASE_URL を https://api.qcode.cc/api にする。

QCode では

https://api.qcode.cc/openai/v1 は QCode の公開 OpenAI 互換エンドポイントで、Warp の「公開到達必須」に合う。対象は GPT と GLM / Kimi / DeepSeek / Qwen で、Claude は Anthropic エンドポイント https://api.qcode.cc/api でしか動かない。モデル id は /models。Business/Enterprise のローカル agent は Warp の platform credits を使う場合がある。それは Warp のプラットフォーム課金であり QCode の表価ではない。

FAQ

Warp は QCode のようなゲートウェイに繋げますか?

はい、GPT と GLM / Kimi / DeepSeek / Qwen に限る。公式カスタム推論は OpenRouter、LiteLLM、社内ゲートウェイなどの OpenAI 互換 URL 向けで、QCode は https://api.qcode.cc/openai/v1。Claude はこのエンドポイントでは使えない。

localhost は使えますか?

公式は localhost とプライベート URL を拒否。リクエストが Warp サーバ経由のため。先に公開 HTTPS が必要。

なぜ Auto は Warp credits を使いますか?

公式:Auto は Warp のルーティングに依存し、カスタムエンドポイントがあっても Warp credits を使う。自分のエンドポイントを使うならピッカーでそのモデルを選ぶ。

ChatGPT Plus を Warp に繋げますか?

公式 BYOK:ChatGPT や Claude の消費者サブスクは Warp に繋げない。API key で提供元に払う。

Warp は key を保管しますか?

公式:ローカルのキーチェーン。リクエストの飛行中にバックエンドを通りエンドポイントを呼び、破棄。サーバには保存しない。

モデル id はどこ?

/models のライブ一覧。

出典

Warp Custom inference endpoint(docs.warp.dev/agents/inference/custom-inference-endpoint/、ページ表記 Last updated Oct 6, 2026)、2026-08-30 取得・2026-10-07 再確認。BYOK ページは 2026-08-30 取得。発表は warp.dev/blog/bring-your-own-inference-to-warp(2026-05-20)。QCode のエンドポイントは docs.qcode.cc のエンドポイント・API 形式ページ(2026-10-07 取得)に基づく。

Warp にカスタムエンドポイントを足す

公開 URL https://api.qcode.cc/openai/v1 で GPT・GLM。そのモデルを選ぶ。Auto は選ばない。

まず試して、それから決める

どのプランか迷ったら、まずスターター($8.57/月)から。満足したらアップグレードし、旧プランの残り価値は按分で残高に戻ります。