ダッシュボード
利用の概要 — 直近 24 時間の呼び出し記録と、前払いクレジットの残高から。
ダッシュボードを見るにはサインインしてください。
サインイントークン支出
前払いクレジット—
現在の付与分から消費した額(無料枠は $0)
総トークン
入力 + 出力—
直近 24 時間
リクエスト
—
直近 24 時間
平均レイテンシ
—
完了した呼び出し、直近 24 時間
リクエストの推移
1 時間ごとの呼び出し数(直近 24 時間)
トークンの内訳
入力と出力、モデル別(直近 24 時間)
- 入力 —
- 出力 —
ツールを接続
クライアントを選ぶと設定ブロックが出ます。下の「API キー」でトークンを発行すると、このページを開いている間はコピーに実トークンが入ります(表示はマスク)。
export KOTOBA_API_BASE="https://api.kotoba.cloud"
export KOTOBA_API_TOKEN="kc_pat_<your-token>"
export KOTOBA_MODEL="qwen3.8-flash-next-whitehacker"
# test the connection
claude -p "Reply with exactly: OK"
注意: api.kotoba.cloud は Anthropic Messages API の wire(POST /v1/messages)をまだ提供していません(2026-09-15 実測 405)。Claude Code から使うには、Anthropic 形式を OpenAI 形式に変換するローカルプロキシ(LiteLLM など)を挟み、ANTHROPIC_BASE_URL をそのプロキシに向けます。詳細は Anthropic SDK のページ。
export KOTOBA_API_BASE="https://api.kotoba.cloud/v1"
export KOTOBA_API_TOKEN="kc_pat_<your-token>"
# test the connection
codex exec "Reply with exactly: OK"
OpenAI 互換 — ベース URL は /v1 込み。
Base URL: https://api.kotoba.cloud/v1
API Key: kc_pat_<your-token>
Model ID: qwen3.8-flash-next-whitehacker
Provider ID: kotobacloud (lowercase)
Base URL: https://api.kotoba.cloud/v1
API Key: kc_pat_<your-token>
Model ID: qwen3.8-flash-next-whitehacker
~/.config/opencode/opencode.json:
{
"provider": {
"kotobacloud": {
"baseUrl": "https://api.kotoba.cloud/v1",
"apiKey": "kc_pat_<your-token>",
"models": {"qwen3.8-flash-next-whitehacker": {}}
}
}
}
reasoning モデルは temperature 400 を返すことがあります (既知の注意点)。
export OPENAI_API_BASE="https://api.kotoba.cloud/v1"
export OPENAI_API_KEY="kc_pat_<your-token>"
# the openai/ prefix stacks on our model id
aider --model openai/qwen3.8-flash-next-whitehacker
# ~/.hermes/config.yaml (or a profile's config.yaml)
model:
provider: kotoba
default: qwen3.8-flash-next-whitehacker
max_tokens: 8192
providers:
kotoba:
api: ${KOTOBA_API_BASE}/v1
key_env: KOTOBA_API_TOKEN
transport: chat_completions
request_timeout_seconds: 900
models:
qwen3.8-flash-next-whitehacker:
context_length: 1000000
# ~/.hermes/.env
KOTOBA_API_BASE=https://api.kotoba.cloud
KOTOBA_API_TOKEN=kc_pat_<your-token>
hermes chat -Q --oneshot -q "Reply with exactly: OK"
auxiliary の title 生成は 1 回ごとに無料枠を 1 件使います(`auxiliary.title_generation.enabled: false` で止められます)。長い応答は同期呼び出しで最大 14 分待つので request_timeout_seconds は 900 に。
docker run -d -p 3000:8080 \
-e OPENAI_API_BASE_URL="https://api.kotoba.cloud/v1" \
-e OPENAI_API_KEY="kc_pat_<your-token>" \
ghcr.io/open-webui/open-webui:main
# then open http://localhost:3000 and pick the model
Base URL: https://api.kotoba.cloud/v1
API Key: kc_pat_<your-token>
Model: qwen3.8-flash-next-whitehacker
Cursor Pro が必要です。リクエストは到達しますが、返信が描画されない Cursor 側の制限が報告されています。
from openai import OpenAI
client = OpenAI(
base_url="https://api.kotoba.cloud/v1",
api_key="kc_pat_<your-token>",
)
r = client.chat.completions.create(
model="qwen3.8-flash-next-whitehacker",
messages=[{"role": "user", "content": "Reply with exactly: OK"}],
)
API キー
接続トークンの発行と失効。表示は一度だけです。
CLI / IDE から使う
ローカルの CLI / IDE エージェント用の接続トークンを発行します。表示は一度だけです。