Playground

任意の AI model に対してカスタム prompt をテストできます。リアルタイムのレスポンス整形、トークン追跡、コスト指標、永続的な履歴を備えています。

概要

Playground は自由形式のプロンプトテスト環境です。スキーマ駆動のエンリッチメントワークフローとは異なり、任意のシステムプロンプトとユーザープロンプトをモデルに送信し、生の応答を確認できます。プロンプトエンジニアリングの実験、モデル機能のテスト、または単発のクエリの実行に使用してください。

モデル
任意
言語
40
履歴
永続
コスト追跡
呼び出しあたり

インターフェースレイアウト

Playground は分割ペインのレイアウトを採用しています。入力内容はすべてローカルストレージに保存され、セッションをまたいで保持されます。

  1. 13つの入力は1つのペインのタブです
  2. 2ソースドキュメントは同じ呼び出しで送信されます
  3. 3実行ごとに時間、トークン、コストが記録されます
  4. 4履歴は、対応する回答の下に表示されます
左側にプロンプト、右側にモデルが返した内容をすべて表示します。3つの入力が1つのタブ付きペインを共有するため、プロンプトは3分の1に押し込められることなく、ウィンドウの高さいっぱいを使えます。

System Prompt

モデルの動作とペルソナを設定します。これはシステムメッセージとして送信され、実行間で保持されるため、コンテキストを再入力することなくユーザープロンプトを繰り返し調整できます。

ユーザープロンプト

モデルに送信されるメインのプロンプト。ここにクエリ、指示、またはテストケースを記述します。

出力 schema

返してほしい JSON の例を貼り付けると、プロバイダーへ送信される実際の構造化出力コントラクトにコンパイルされます。エンリッチメントで使われているものと同じ仕組みです。スキーマを組み立てる前に、モデルが指定の出力形式を維持できるかどうかを試すことができます。

レスポンス

モデルの応答を、自動検出された書式で表示します。JSON応答はMonacoエディタでシンタックスハイライトされ、プレーンテキストはそのまま表示されます。ワンクリックでクリップボードにコピーできます。

履歴

すべての実行は、このブラウザーだけでなくアカウントに保存されます。モデルで絞り込み、プロンプトのプレビューを確認し、エントリをクリックすれば呼び出し全体を復元できます。履歴内のどのレコードも、プロンプトと添付ファイルごとここに再読み込みできるため、パイプライン全体を実行し直してコストを払うことなく、実際の実行の文言を練り直せます。

設定

サイドバーで呼び出しの内容を設定します:

オプション説明
モデル設定済みの任意のプロバイダーから1つのAIモデルを選択します。仮想化されたドロップダウンには料金とプロバイダー情報が表示されます。
言語対応している40言語から選択できます。modelに送信されるpromptの言語指示に影響します。
添付ファイル呼び出しにドキュメントを添付します。モデル一覧は添付した内容を実際に読み取れるモデルだけに絞り込まれるため、対応していない組み合わせは非推奨どころか選択自体ができません。

4つ目の設定項目はサイドバーにはありません。プロンプトペインのOutput Schemaタブです。取得したいJSONのサンプルを貼り付けると、そこから推論された構造化出力の取り決め(フィールド名と、値が示す型)がリクエストに付加されます。

  1. 1プロンプトペインの3番目のタブです
  2. 2JSON Schema ではなく、回答のサンプルです
  3. 3ネストと配列はそのままコントラクトに引き継がれます
ここではサンプルがヒントになります。すべてのキーが必須フィールドになり、null 値のものは任意フィールドになります。応答スキーマに従わせられないモデルを選ぶと、その旨がアンバー色の注意書きで表示されます。その場合、スキーマは中途半端に適用されるのではなく無視されます。

実行とメトリクス

各実行後、レスポンスパネルに詳細なメトリクスが表示されます:

処理時間— ネットワーク遅延とモデル推論を含む、ミリ秒単位の総往復時間。
入力トークン— modelによってカウントされた、システムprompt + ユーザーpromptのトークン数。
出力トークン— modelの応答に含まれるトークン数。
コスト— モデルのトークン単価に基づく USD での推定コストです。
  1. 1入力トークン、続いて出力トークン — プロバイダーがカウントした値です
  2. 2この1回の呼び出しにかかったコストです
  3. 3コピーではメトリクスは含まれず、回答のみが対象になります
この行はその下の回答に対応しており、次の実行で置き換えられます。だからこそ Playground はモデル選定を安価に決着させる手段になります。同じプロンプト、2つのモデル、比較すべき3つの数値です。

実行履歴

すべての実行はプロンプトレコードとしてアカウントに保存され(履歴ページに一覧表示されるものと同じレコードです)、応答の下のパネルからそれらを読み返せます:

モデルフィルター— リストを 1 つのモデルに絞り込みます。履歴に複数のモデルが含まれると、セレクターが表示されます。
promptプレビュー— 各エントリには、ユーザー prompt の先頭50文字、タイムスタンプ、モデル名が表示されます。
成功インジケーター— 緑のチェックまたは赤のバツ — 失敗した呼び出しも保持されるため、拒否やタイムアウトも成功した実行の隣に表示されたままになります。
セッションを復元— エントリをクリックすると、システムプロンプト、ユーザープロンプト、出力スキーマ、モデル、言語が復元されます — 生成された回答とその呼び出しのメトリクスも合わせて、費用をかけずに確認できます。
履歴をクリア— ワンクリックでプロンプトレコードをゴミ箱に移動し、パネルを空にします。ゴミ箱に入ったレコードは履歴ページから復元できます。
  1. 1リストを 1 つのモデルに絞り込みます
  2. 2パネル全体をクリアします
  3. 3失敗した呼び出しも保持され、再実行できます
クリアしても完全に削除されるわけではありません。各エントリはアカウント上のレコードであり、クリアすると履歴ページから復元できるゴミ箱に移動します。

一般的なユースケース

promptエンジニアリング

エンリッチメントスキーマに組み込む前に、システムプロンプトや指示を繰り返し調整して、モデルの動作を洗練させます。

モデル比較

同じプロンプトを異なるモデルに対して実行し、エンリッチメント用のモデルを選択する前に、出力の品質・速度・コストを比較します。

クイッククエリ

完全なスキーマとエンリッチメントパイプラインを設定することなく、単発のナレッジ抽出クエリを実行します。

次のステップ