배치 처리

실시간 진행 상황 추적, 자동 멀티 모델 융합, JSON 또는 Excel 내보내기를 통해 엔티티를 개수 제한 없이 병렬로 강화합니다 — 고정된 배치 크기가 아니라 플랜의 사용량 할당량으로만 제한됩니다.

입력 방법

행은 그리드 위의 소스 스트립을 통해 들어옵니다. 탭은 세 개이고 한 번에 하나만 열립니다. 행을 불러오면 스트립이 한 줄(“붙여넣기 / CSV · 12개 행 불러옴”)로 접혀 그리드가 높이를 유지합니다. 다른 데이터를 불러오려면 그 줄을 클릭하세요.

  1. 1붙여넣기 / CSV, 파일, URL — 한 번에 하나의 소스만 열립니다
  2. 2버튼은 행을 불러오기 전에 행 수를 셉니다
  3. 3감지된 열 개수와 헤더 행
구분자(쉼표, 탭, 세미콜론)와 헤더 행은 붙여넣는 즉시 브라우저에서 판별되므로, 잘못 인식된 경우 행을 하나라도 불러오기 전에 바로 확인할 수 있습니다.

붙여넣기 / CSV

Excel, Google Sheets 또는 CSV 내보내기에서 행을 그대로 붙여넣으세요. 쉼표, 탭, 세미콜론을 모두 인식하고, 따옴표로 묶인 셀에는 구분자가 포함될 수 있으며, 숫자가 아닌 이름으로 된 첫 행은 열 머리글로 처리됩니다.

파일

.csv, .tsv 또는 .json 파일을 탭에 끌어다 놓거나 디스크에서 선택하세요. JSON 파일에는 객체 배열이나 단일 객체를 담을 수 있으며, 열은 키의 합집합이므로 항목이 고르지 않은 레코드도 불러올 수 있습니다.

URL

모든 REST 엔드포인트에서 엔터티를 가져옵니다. 반환된 결과는 자유 형식 객체 목록으로 읽히며, 열 집합은 그 키들의 합집합입니다.

지원되는 인증:

없음Bearer 토큰API 키 헤더Basic Auth

API가 객체를 반환하면 시스템은 내장된 배열을 찾기 위해 data, results, items 같은 키를 확인합니다.

엔터티 선택 및 검증

엔터티를 불러오면 검증 상태와 함께 선택 가능한 목록에 표시됩니다. 배치에 포함할 엔터티를 선택할 수 있습니다:

다중 선택— 행을 하나씩 선택하거나 헤더의 체크박스로 전체를 선택할 수 있으며, Ctrl+A를 누르면 현재 필터에 표시된 모든 항목이 선택됩니다. 행을 클릭하면 선택이 바뀌는 대신 결과 창이 열립니다.
인라인 편집— 입력 셀을 더블클릭하면 값을 그 자리에서 수정할 수 있습니다. 스키마의 검색 키뿐 아니라 데이터가 가져온 모든 열을 편집할 수 있습니다.
검증— 행에 스키마의 필드 이름을 그대로 사용할 필요는 없습니다. 모델이 주어진 그대로 읽습니다. 그리드가 내리는 유일한 판정은 비어 있는지 여부입니다. 값이 전혀 없는 행은 표시된 뒤 회색으로 처리되어 실행에서 제외됩니다. 분류 모델을 선택하면 유형이 맞지 않는 엔터티가 자동으로 걸러집니다.
선택적 처리— 선택한 엔터티만 보강을 위해 전송됩니다. 처리하지 않을 엔터티는 선택을 해제하세요.
행별 계약 검사— 서버는 비용을 지출하기 전에 모든 행을 schema의 입력 계약과 대조해 검사하며, 첫 번째 오류에서 중단하지 않고 문제가 되는 행을 모두 보고합니다. 덕분에 batch 전체를 한 번에 수정할 수 있습니다.
  1. 1행별 체크박스로 이번 실행에서 비용을 쓸 대상을 결정합니다
  2. 2빈 행은 여기에 표시되며, 실행에서 제외됩니다
  3. 312개 선택됨 — 하지만 실행 가능한 항목은 11개뿐입니다
11번 행에는 이름 없이 국가와 티커만 있지만 그래도 보강됩니다. 검색 키가 없는 것은 모델이 우회할 수 있지만, 빈 행은 그럴 수 없습니다. 여기서는 입력, 검증, 실행 상태가 세 개의 목록으로 나뉘지 않고 한 행에 모여 있습니다.

구성

사이드바는 단일 보강 구성 옵션을 그대로 반영합니다:

옵션설명
스키마enrichment 출력 구조를 정의하는 대상 schema
전략단일 패스, 전문 영역, 또는 다중 전문성(영역별 병렬 호출)
모델엔터티마다 실행할 하나 이상의 AI 모델. 여러 모델을 사용하면 자동 융합이 가능합니다.
언어다국어 필드 강화를 위한 언어 (예: 영어 + 프랑스어)
분류enrichment 전에 entity 유형을 확인하기 위한 선택적 빠른 model
중재융합 중 LLM 기반 충돌 해결을 위한 모델입니다. 설정하지 않으면 규칙 기반 병합이 사용됩니다.

비용 추정

예상 비용은 실행 바에서 비용을 지출하는 버튼 옆에 표시됩니다. 스키마의 속성 수, 선택한 모델의 토큰 단가, 선택한 엔터티 수를 기준으로 계산됩니다. 자동 모델 선택을 사용하면 실행이 시작될 때 비로소 모델이 결정되므로, 표시되는 금액은 선택될 수 있는 모델들의 중앙값입니다. 확인 대화 상자는 모든 실행마다 표시되지 않고, 연결된 데이터베이스에 기록하거나 예상 비용이 크거나 선택한 행이 건너뛰어지는 등 실제 위험이 있는 실행에서만 표시됩니다.

  1. 1모델 두 개: 엔티티마다 각각 한 번씩 호출
  2. 2선택이 바뀔 때마다 다시 계산되는 견적
  3. 3불러온 12개가 아니라 엔티티 11개입니다 — 빈 행은 제외됩니다
버튼에 무엇을 실행할지가 표시되므로 건수와 가격을 함께 읽을 수 있습니다. 휴대폰 중단점 아래에서는 선택기가 “More options”로 접히고, 견적은 버튼 옆에 그대로 남습니다.

병렬 실행

선택한 모든 엔터티가 동시에 처리됩니다. 각 엔터티는 전체 강화 파이프라인을 독립적으로 거칩니다:

엔티티별 파이프라인

  1. 분류 (선택 사항) — 빠른 모델이 엔티티 유형을 확인합니다. 배치 모드에서는 불일치가 있어도 작업이 중단되지 않으며, 컨텍스트가 그대로 전달됩니다.
  2. 다중 모델 보강 — 선택한 각 모델이 엔터티를 병렬로 보강하며, 각각 해당 키의 속도 예산에 맞춰 조절됩니다.
  3. 자동 융합(2개 이상 모델 성공 시) — 충돌 감지 및 해결을 사용해 결과가 자동으로 병합됩니다.

속도 조절

모든 엔터티는 각 API 키와 모델의 속도 예산을 공유합니다. 즉, 제공업체가 해당 키에 허용하는 분당 요청 수와 토큰 수이며, 응답에서 읽어오거나 거부 응답에서 학습한 값입니다. 엔터티 20개와 모델 2개인 경우, 분당 15회 요청을 허용하는 모델의 호출은 1분에 걸쳐 분산되고 다른 모델은 자체 속도로 실행되므로 배치가 429 오류 없이 완료됩니다.

실시간 진행 상황

실행을 시작하면 툴바와 그리드 사이에 Server-Sent Events(SSE)로 갱신되는 실행 스트립이 열립니다. 배치 전체의 진행률 표시줄 하나, 완료/실패/건너뜀을 하나로 합치지 않고 따로 보여 주는 카운터, 이미 처리가 끝난 행을 기준으로 산출한 예상 완료 시간과 경과 시간, 그리고 사전 견적 대비 현재까지의 지출이 표시됩니다. 그리드 위로 열리는 것은 없습니다. 행은 있던 자리에 그대로 남고, 각 행은 소요 시간 및 비용과 함께 Status 열에 자체 상태를 표시합니다.

미실행

이 행은 아직 실행을 거치지 않았습니다. Status 셀에는 열을 따라 같은 값을 반복하는 대신 대시가 표시됩니다.

대기 중

배치에 등록되었으며, 키의 속도 예산에 여유가 생기기를 기다리는 중입니다.

실행 중

라벨 대신 전체 전문 영역 단계 중 완료된 단계 수를 세는 인라인 막대가 표시됩니다.

완료

모든 모델이 응답했습니다. 시간과 비용이 채워지고 결과 열을 읽을 수 있게 됩니다.

실패

이 행에 대해 결과를 생성한 모델이 없습니다. 배치가 중지되면 스트립에서 실패한 행만 재시도할 수 있습니다.

건너뜀

보강 전에 폐기되었습니다 — 예를 들어 분류가 확실하게 일치하지 않는 경우입니다 — 따라서 이 행에는 비용이 전혀 들지 않았습니다.

툴바의 완료/실패/건너뜀 칩은 해당 행만 남도록 그리드를 필터링하고, 입력/모두/결과 스위치는 같은 행을 보낸 내용, 돌아온 내용 또는 둘을 나란히 보여 줍니다.

취소 및 오류 처리

실행 중인 배치는 언제든지 취소할 수 있습니다. 취소는 협력적으로 이루어집니다 — 이미 진행 중인 엔티티는 현재 LLM 호출을 완료하지만 새 호출은 시작되지 않습니다. 완료된 엔티티의 부분 결과는 보존됩니다.

오류 복원력

배치 처리는 복원력을 갖도록 설계되었습니다. 개별 실패가 배치를 중단시키지 않습니다:

  • 한 엔티티에 대해 분류가 실패하면 컨텍스트 없이 보강이 진행됩니다
  • 한 모델이 실패해도 해당 엔티티의 다른 모델은 계속 진행됩니다
  • 모델이 둘 이상이면 모든 모델이 성공한 엔티티에 대해서만 자동 병합이 실행됩니다. 일부만 완료된 엔티티는 병합 결과를 만들지 않으며, 실패한 전문 분야를 재시도하여 누락된 모델을 복구하기 전까지는 데이터베이스에 아무것도 전달되지 않습니다
  • 한 엔티티에 대해 모든 모델이 실패하면 해당 엔티티는 실패로 표시되고 다른 엔티티는 계속 진행됩니다
  • “찾을 수 없음” 오류를 반환하는 모델은 자동으로 비활성화됩니다

내보내기 형식

배치가 완료되면 결과를 세 가지 형식으로 내보냅니다. 각 엔터티에 대해 퓨전 결과가 있으면 우선 사용하고, 없으면 가장 좋은 모델 결과를 사용합니다.

JSON 파일

모든 entity 데이터, model 출력, fusion 메타데이터가 포함된 구조화된 JSON 파일로 전체 결과를 다운로드합니다.

클립보드

JSON 결과를 클립보드에 바로 복사하여 다른 도구나 스크립트에 붙여넣으세요.

Excel

세 개의 시트로 구성된 워크북입니다: Results(엔터티당 한 행, 속성을 평탄화), Summary(배치 메타데이터, 모델, 비용), Conflicts(해결 근거가 포함된 엔터티별 충돌 세부 정보).

제한

제한값
배치당 최대 엔터티 수고정 상한 없음 — 플랜의 사용량 할당량으로 제한됩니다
최대 엔터티 데이터 크기50,000자
최대 프롬프트 길이100,000자
URL 가져오기 시간 초과30초

다음 단계