任意の数のエンティティを並列にエンリッチメントし、リアルタイムの進捗追跡、自動マルチモデルフュージョン、JSON または Excel へのエクスポートを行えます。固定のバッチサイズではなく、プランの利用クォータによってのみ制限されます。
行はグリッド上部のソースストリップから読み込みます。タブは3つあり、一度に開けるのは1つだけです。行を読み込むとストリップは1行(“貼り付け / CSV · 12 行を読み込み済み”)に折りたたまれ、グリッドの高さが保たれます。別のデータを読み込むには、その行をクリックしてください。
Excel、Google スプレッドシート、CSV エクスポートから行をそのまま貼り付けられます。カンマ、タブ、セミコロンはいずれも区切り文字として認識され、引用符で囲まれたセルには区切り文字を含められます。数値以外の名前が並ぶ先頭行は列ヘッダーとして扱われます。
.csv、.tsv、.json ファイルをタブにドロップするか、ディスクから選択してください。JSON ファイルはオブジェクトの配列でも単一のオブジェクトでもかまいません。列はそれらのキーの和集合になるため、項目のそろっていないレコードでも読み込めます。
任意の REST エンドポイントからエンティティを取得します。返された内容は自由形式のオブジェクトのリストとして読み取られ、列はそれらのキーの和集合になります。
対応している認証方式:
APIがオブジェクトを返す場合、システムはdata、results、itemsなどのキーに埋め込み配列がないか確認します。
エンティティを読み込むと、検証ステータスとともに選択可能なリストに表示されます。バッチに含めるエンティティを選択できます:
サイドバーは、単一 enrichment の設定オプションを反映しています。
| オプション | 説明 |
|---|---|
| スキーマ | enrichment 出力の構造を定義する対象 schema |
| 戦略 | シングルパス、専門ドメイン、またはマルチエキスパティーズ(ドメインごとの並列呼び出し) |
| モデル | エンティティごとに実行する1つ以上の AI モデル。複数のモデルを指定すると自動フュージョンが有効になります。 |
| 言語 | 多言語フィールドのエンリッチメント用の言語(例: 英語+フランス語) |
| classification | エンリッチメント前のエンティティ型検証のための任意の高速モデル |
| アービトレーション | fusion 中の LLM ベースの競合解決に使用するモデル。未設定の場合は、ルールベースのマージが使用されます。 |
推定コストは、実行バー内のコストを消費するボタンの隣に表示されます。スキーマのプロパティ数、選択したモデルのトークン料金、選択したエンティティの数から算出されます。モデルの自動選択では、実行の開始時にはじめてモデルが決まるため、表示される数値は選択され得るモデルの中央値です。確認ダイアログは毎回の実行時ではなく、実行に実際のリスクがある場合 — リンクされたデータベースへの書き込み、推定額が大きい、選択された行がスキップされる — にのみ表示されます。
選択したすべてのエンティティが同時に処理されます。各エンティティは、完全なエンリッチメントパイプラインを独立して通過します:
すべてのエンティティは、API キーとモデルごとのレート予算を共有します。これは、プロバイダーがそのキーに割り当てる毎分のリクエスト数とトークン数で、レスポンスから読み取るか、拒否から学習します。エンティティ 20 件・モデル 2 つの場合、毎分 15 リクエストまでのモデルへの呼び出しは 1 分間に分散され、もう一方のモデルは独自のペースで実行されるため、429 エラーを発生させずにバッチが完了します。
実行を開始すると、ツールバーとグリッドの間に実行ストリップが表示され、Server-Sent Events (SSE) によって更新されます。バッチ全体の進捗バー、完了 / 失敗 / スキップをひとまとめの数値ではなく個別のカウンターとして表示し、経過時間とすでに確定した行から算出した完了予測、さらに事前見積もりに対する現在までの消費額が並びます。グリッドの上に何かが重なることはありません。行は元の位置に残り、各行は所要時間とコストの隣にある Status 列に自身の状態を保持します。
この行はまだ実行されていません。Status セルは同じ表示を列内で繰り返す代わりに、ダッシュを表示します。
バッチに受け付けられ、キーのレート予算に空きが出るのを待っています。
ラベルが切り替わり、完了した専門領域のステップ数と全体数を示すインラインバーが表示されます。
すべてのモデルから応答が返りました。時間とコストが入力され、結果の列が読み取れるようになります。
この行では、どのモデルも結果を生成できませんでした。バッチが停止すると、失敗した行だけを再試行するオプションがストリップに表示されます。
エンリッチメント前に破棄されました(例:分類が明確に不一致)。そのため、この行には一切コストがかかっていません。
ツールバーの「完了」「失敗」「スキップ」のチップはグリッドを該当する行に絞り込み、「入力/両方/結果」の切り替えは同じ行を、送信した内容、返ってきた内容、またはその両方を並べて表示します。
実行中のバッチはいつでもキャンセルできます。キャンセルは協調的です — すでに処理中のエンティティは現在の LLM 呼び出しを完了しますが、新しい呼び出しは開始されません。完了したエンティティの部分的な結果は保持されます。
バッチ処理は耐障害性を備えて設計されています。個々の失敗によってbatchが停止することはありません。
バッチ完了後、結果を3つの形式でエクスポートできます。各エンティティについて、フュージョン結果が利用可能な場合はそれが優先され、そうでない場合は最良のモデル結果が使用されます。
すべてのエンティティデータ、モデル出力、フュージョンのメタデータを含む構造化された JSON ファイルとして、完全な結果をダウンロードできます。
JSON の結果を直接クリップボードにコピーして、他のツールやスクリプトに貼り付けられます。
3シート構成のワークブック:Results(エンティティごとに1行、プロパティをフラット化)、Summary(バッチのメタデータ、モデル、コスト)、Conflicts(エンティティごとの競合の詳細と解決の根拠)。
| 上限 | 値 |
|---|---|
| バッチあたりの最大エンティティ数 | 固定上限なし — プランの利用クォータによって制限されます |
| エンティティデータの最大サイズ | 50,000文字 |
| 最大プロンプト長 | 100,000文字 |
| URLフェッチのタイムアウト | 30秒 |