Workflow Editor - Entity Enricher ドキュメント

ワークフローエディター

1つのエンリッチメントをエンドツーエンドで構築するページです。サンプルデータ、スキーマ、モデル、結果までを扱えます。中心にあるのはスキーマツリーで、ドラッグ&ドロップでの並べ替え、インライン編集、キーボード操作、AIによる編集支援を備えたビジュアルエディターです。

概要

スキーマツリーを使えば、JSON を手書きせずにエンリッチメントスキーマを表示・変更できます。プロパティは専門ドメインごとにグループ化されたインタラクティブなツリーとして表示されるため、どのフィールドがどの専門領域に属するかが一目で分かります。すべての変更は元に戻す/やり直しの履歴として記録され、2 秒のデバウンス後に自動保存されます。

主な機能

専門知識のグループ化

プロパティはexpertise domainごとに折りたたみ可能なセクションでグループ化されます。グループ化のオン/オフを切り替えられます。

ドラッグ&ドロップ

ソート表示をオフにすると、グループ内またはグループ間でプロパティをドラッグして並べ替えられます。並び順はスキーマに保存されます。ドロップ先のインジケーターが、項目が配置される位置を視覚的に示します。

インライン編集

任意のプロパティをクリックすると、その名前、型、説明、例をツリー内で直接編集できます。

キーボードナビゲーション

矢印キーで移動および折りたたみ/展開、Enter で編集、Delete で削除、Ctrl+A ですべて選択します。取り消しとやり直しはツールバーのボタンで行い、履歴はスキーマを切り替えてもページを再読み込みしても保持されます。

検索とフィルター

大規模な schema 内のフィールドを見つけるためのテキスト検索です。まずプロパティ名を対象とし、名前が一致しない場合は説明や例にフォールバックします。ネストされた一致は、そこに至るパスのみを表示して示されます。

元に戻す / やり直し

手動編集の完全な履歴スタックです。AI が生成した変更は、元に戻すエントリを追加せずに置き換えられます。

型と値セット

上部のタブにはスキーマの名前付き型が並びます。+ ボタンで、オブジェクト(独自のプロパティを持つネストされたエンティティ)または Enum(任意のテキストプロパティから参照できる許可値の閉じたリスト)を作成できます。

ダイアグラムビュー

SCHEMA と JSON の横にある DIAGRAM ビューは、スキーマをエンティティ図として描画します。名前付きエンティティはタイトル付きのカード、ネストされたオブジェクトはリレーション名を付けた通常のカードとして表示され、参照 (1–1) とリンク (1–N) は破線のエッジで示されます。編集内容はリアルタイムに反映され、エンティティカードをクリックすると SCHEMA ビューで開きます。

プロパティツリー

エディター内の各行は、主要な属性が一目で分かる schema プロパティを表します。

選択プロパティ名説明
□company_name
🔍
string法人正式名称
□revenuenumber米ドル建ての年間収益
□headquartersobject本社所在地
□ citystring市区町村名
□ country
🔍
string本社が所在する国
□gmp_statusbooleanGMP 認証ステータス

ネストされたプロパティ(headquarters配下のcityなど)は階層を示すためにインデントされます。虫めがねアイコンは検索キー(entityの識別に使用されるフィールド)を示します。

値セット(Enum)

値セットは、テキストプロパティを固定された許可値のリスト(ステータス、評価、分類コードなど)に制限します。これによりエンリッチメントはそのリストにない値を返せなくなり、同じ概念が実行のたびに異なる表記で届くことを防ぎます。

値セットの操作

作成する

型タブの + を押し、Enum を選択して名前を付けてください。新しいタブがメンバーリストを開きます。

メンバーを編集

値の追加、名前の変更、並べ替え、削除ができます。名前から意味が分かりにくいメンバーにはメモを付けてください。

使用する

型ドロップダウンの「値セット」グループから、任意のテキストプロパティの型を値セット(またはその配列)に設定してください。

元に戻す

プロパティの型を文字列に戻すか、値セットを削除してください。これを使用しているプロパティは通常のテキストプロパティに戻ります。

リストを完全に列挙できる語彙にのみ値セットを使用してください。実際のエンティティに含め忘れた値が必要な場合、モデルは問題を報告する代わりに最も近い誤った値を選ばざるを得なくなります。そのため、自由記述のフィールド(名前、説明、フリーテキストのカテゴリなど)はプレーンテキストのままにしてください。スキーマ生成が同じ理由で値セットを控えめに提案し、提案されたものはすべてここで編集できます。

プロパティの編集

プロパティの行をクリックするか、Enter キーを押して編集モードに切り替えます。編集モードでは、次の項目を変更できます。

名前JSON 出力におけるプロパティキー。一貫性のため snake_case を使用してください。
string、number、integer、boolean、array、objectから選択します。タイプを変更するとエンリッチメントの出力形式が更新されます。
説明enrichment 中に AI を導く文脈的な説明です。詳細であるほど、より良い結果が得られます。
現実的な例の値を2〜3個。AIが期待される形式や内容を理解するのに役立ちます。
専門知識この値を提供するドメインエキスパートを示します。複数のexpertise domainによるエンリッチメントでのグループ化を決定します。
Null許容実際のインスタンスがこの値を本当に持たない可能性があるかどうかを示します。null非許容のフィールドはデータベースへの登録に必須であり、それを埋められないエンリッチメントは品質ゲートによって拒否されます。データベースキー(null値はどのレコードも識別できません)および保持フィールド(入力が常に提供します)では使用できません。
多言語対応フィールドを複数の言語でエンリッチメントするかどうかです。
保持元の入力値を変更せずに保持するかどうかを指定します。データベースID、内部SKU、顧客参照など、自社システムが管理する値に使用します。enrichment が代わりに検索できる公開識別子(CAS、ISBN、EAN、ティッカー)には使用しません。その場合、すべての enrichment でこの値を指定する必要があります。

キーボードショートカット

スキーマエディターは、効率的な編集のためにキーボード操作による完全なワークフローをサポートしています。

ショートカットアクション
Arrow Up / Downプロパティ間を移動します (Shift を押しながらで選択範囲を拡張)
Arrow Left / Right選択したオブジェクトを折りたたむ/展開する
Home / End最初または最後のプロパティへ移動します
Enter選択したプロパティの編集モードを切り替える
Delete / Backspace選択したプロパティを削除
Ctrl+A / Cmd+Aすべてのプロパティを選択
Escape編集モードを終了するか選択を解除します

ドラッグ&ドロップによる並べ替え

手動で並べ替えるには、Sorted トグルをオフにする必要があります。エディターは既定でプロパティをアルファベット順に表示し、その状態ではドラッグが無効です。表示設定によって黙って上書きされてしまう手動の並び順には、ほとんど意味がないからです。Sorted のチェックを外すとスキーマ自体の並び順に切り替わり、ドラッグが有効になります。挿入位置を示すラインでプロパティの移動先が正確に分かり、変更後の並び順はスキーマとともに保存されます。専門ドメインのグループ内でも、グループをまたいでもドラッグでき、グループをまたぐとドメインの割り当てが変わります。

expertise domain のグループ化が有効な場合、プロパティを別のグループにドロップすると、その expertise domain の割り当てが自動的に更新されます。これにより大規模な schema の再編成が直感的になります。フィールドを「Financial Analyst」から「Regulatory Expert」にドラッグするだけで、その expertise domain が適切に更新されます。

AI編集ペイン

プロパティツリーの下にあるAI編集ペインでは、自然言語を使ってschemaを変更できます。「parent_company リファレンスを追加して」のような指示を入力すると、AIが既存の構造を保ちながら変更を適用します。

AIによる提案

生成または編集のたびに、AIはクリック可能なチップとして表示される5つの改善提案を提供します。提案をクリックすると、編集入力欄に自動的に入力され、適用されます。提案は、データの完全性、品質、関係性、国際化、およびドメイン固有の拡張をカバーします。

AIによるスキーマ編集について詳しくは、AIスキーマ生成ガイドをご覧ください。

曖昧性バッジ

プロパティ名を親オブジェクトの文脈で読んでみてください。尋ね得る対象はいくつありますか。ちょうど1つなら明確です。2つ以上あると、そのプロパティには曖昧バッジが付きます。解釈がほぼ重なり、境界的なケースだけが異なる場合は琥珀色、実質的に異なるデータになる場合は赤になります。バッジにカーソルを合わせると、その名前が許容する競合する解釈と、そのうち1つだけに意味を固定する書き換え済みの説明文を確認できます。親が答えるものを何も持たない名前にもフラグが付きます。その場合、ツールチップには検討のうえ却下された解釈が一覧され、修正はリネームか削除になります。エンティティが持っていないプロパティを説明文で与えることはできないからです。

再チェックボタン

ツールバーのシールドアイコンは、まだ注釈のないプロパティを分析し、すべてに注釈が付くと完全な再分析に切り替わります。各実行は少額課金されるAI呼び出しです。

この場合の対処法は説明の記述です

保存済みのスキーマでは、バッジはリネームではなく説明文の書き換えを提案します。スキーマが稼働しているため、説明文で意味を固定すればデータ契約はそのまま保てます。名前を言い換えただけの説明文は何も足さないため、そのプロパティは説明文がないものとして判定されます。

陳腐化した注釈

プロパティのリネームや説明の編集を行うと、その注釈は破棄されます。判定は両方に基づいて下されていたためです。エディターはこれらのプロパティをハイライトし、再チェックを提案します。

スキーマごとの切り替え

オーバーフローメニューからスキーマのチェックを無効にできます。バッジと警告が消え、一度も分析されていないスキーマで再度有効にすると、チェックが自動的に実行されます。

詳しい仕組み(2 種類の判定、それぞれの背後にある解釈、そしてスキーマ作成前は名前変更、公開後は説明が対処法となる理由)については、曖昧性チェックガイドで解説しています。

スキーマ管理

スキーマセレクターでは、schema の作成、読み込み、ピン留め、複製、削除ができます。schema は organization ごとに保存され、すべてのチームメンバーがアクセスできます。

自動保存

変更は 2 秒間の停止後に自動保存され、不要な書き込みを避けるためコンテンツハッシュによる重複排除が行われます。

スキーマをピン留め

よく使うスキーマをピン留めして、セレクターリストの先頭に表示します。

複製

任意のschemaのコピーを作成し、元のschemaに影響を与えずに変更を試すことができます。

論理削除

削除したschemaは復元できます。完全な削除は別の操作です。

次のステップ