Procesamiento por lotes

Enriquezca cualquier cantidad de entidades en paralelo con seguimiento del progreso en tiempo real, fusión automática multimodelo y exportación a JSON o Excel — restringido únicamente por la cuota de uso de su plan, no por un tamaño de lote fijo.

Métodos de entrada

Las filas entran por la barra de origen situada encima de la cuadrícula: tres pestañas, una abierta a la vez. Al cargar filas, la barra se contrae a una sola línea («Pegar / CSV · 12 filas cargadas») para que la cuadrícula conserve la altura; haga clic en esa línea para cargar otro conjunto.

  1. 1Pegar / CSV, Archivo y URL: una sola fuente abierta a la vez
  2. 2El botón cuenta las filas antes de cargarlas
  3. 3Número de columnas y fila de encabezado detectados
El delimitador —coma, tabulación o punto y coma— y la fila de encabezado se deducen en el navegador mientras pega, de modo que un error de detección se ve antes de cargar una sola fila.

Pegar / CSV

Pegue filas directamente desde Excel, Google Sheets o una exportación CSV. Se admiten coma, tabulador y punto y coma; una celda entrecomillada puede contener el delimitador, y una primera fila con nombres no numéricos se toma como encabezados de columna.

Archivo

Arrastre un archivo .csv, .tsv o .json a la pestaña, o elija uno del disco. Un archivo JSON puede contener una matriz de objetos o un único objeto; las columnas son la unión de sus claves, por lo que los registros irregulares también se cargan.

URL

Obtenga entidades desde cualquier endpoint REST. Lo que se devuelva se lee como una lista de objetos de formato libre, y el conjunto de columnas es la unión de sus claves.

Autenticación admitida:

NingunoToken BearerEncabezado de la clave de APIAutenticación básica

Si la API devuelve un objeto, el sistema comprueba claves como data, results, items en busca de un array incrustado.

Selección y validación de entidades

Tras cargar las entidades, estas aparecen en una lista seleccionable con su estado de validación. Puede elegir qué entidades incluir en el lote:

Selección múltiple— Marque las filas de una en una o la casilla del encabezado para seleccionarlas todas; Ctrl+A selecciona todo lo que muestra el filtro actual. Al hacer clic en una fila se abre su panel de resultados en lugar de cambiar la selección.
Edición en línea— Haga doble clic en cualquier celda de entrada para corregir un valor sobre la marcha — todas las columnas que aportaron sus datos son editables, no solo las claves de búsqueda del esquema.
Validación— Sus filas no tienen por qué usar los nombres de campo del esquema — los modelos las leen tal cual. El único veredicto que emite la cuadrícula es el de vacío: una fila que no contiene ningún valor se marca, se atenúa y se excluye de la ejecución. Elija un modelo de clasificación para descartar automáticamente las entidades del tipo incorrecto.
Procesamiento selectivo— Solo se envían para enriquecimiento las entidades seleccionadas. Deseleccione las entidades que no desee procesar.
Verificación de contrato por fila— El servidor comprueba cada fila frente al contrato de entrada del esquema antes de gastar nada, e informa de todas las filas problemáticas en lugar de fallar en la primera, de modo que corrija el lote entero en una sola pasada.
  1. 1Las casillas de cada fila deciden en qué gasta la ejecución
  2. 2La fila vacía se señala aquí — y se excluye de la ejecución
  3. 312 seleccionadas, pero solo 11 se pueden ejecutar
La fila 11 no tiene nombre, solo un país y un ticker, y se enriquece igualmente: los modelos pueden sortear la falta de una clave de búsqueda, pero no una fila vacía. Aquí la entrada, la validación y el estado de ejecución son una sola fila, no tres listas separadas.

Configuración

La barra lateral refleja las opciones de configuración del enriquecimiento individual:

OpciónDescripción
EsquemaEsquema de destino que define la estructura de salida del enriquecimiento
EstrategiaPasada única, dominios expertos o multiespecialización (llamadas paralelas por dominio)
ModelosUno o más modelos de IA para ejecutar por entidad. Varios modelos habilitan la fusión automática.
IdiomasIdiomas para el enriquecimiento multilingüe de campos (p. ej., inglés + francés)
ClasificaciónModelo rápido opcional para la verificación del tipo de entidad antes del enriquecimiento
ArbitrajeModelo para la resolución de conflictos basada en LLM durante la fusion. Si no se establece, se utiliza la combinación basada en reglas.

Estimación de costos

El coste estimado se muestra en la barra de ejecución, junto al botón que lo consume. Se calcula a partir del número de propiedades de su esquema, el precio por tokens de los modelos seleccionados y la cantidad de entidades que haya seleccionado. Con la selección automática de modelo, el modelo solo se elige al iniciar la ejecución, por lo que la cifra mostrada es una mediana de los modelos que podría escoger. El cuadro de confirmación aparece cuando la ejecución conlleva un riesgo real — escribe en una base de datos vinculada, la estimación es elevada o se omitirán filas seleccionadas — y no en cada ejecución.

  1. 1Dos modelos: una llamada cada uno, por entidad
  2. 2La estimación, recalculada a medida que cambia la selección
  3. 311 entidades, no las 12 cargadas — se descarta la fila vacía
El botón indica lo que va a ejecutar, de modo que el recuento y el precio se leen juntos. Por debajo del punto de ruptura de móvil, los selectores se pliegan en «Más opciones» y la estimación permanece junto al botón.

Ejecución en paralelo

Todas las entidades seleccionadas se procesan de forma simultánea. Cada entidad recorre el flujo completo de enriquecimiento de manera independiente:

Flujo por entidad

  1. Clasificación (opcional) — Un modelo rápido verifica el tipo de entidad. En modo por lotes, las discrepancias no pausan el trabajo; el contexto se transfiere.
  2. Enriquecimiento multimodelo — Cada modelo seleccionado enriquece la entidad en paralelo, cada uno regulado según el presupuesto de tasa de su clave.
  3. Fusión automática (cuando 2 o más modelos tienen éxito): los resultados se combinan automáticamente mediante detección y resolución de conflictos.

Regulación de tasa

Todas las entidades comparten el presupuesto de tasa de cada clave API y modelo — las solicitudes y los tokens por minuto que el proveedor concede a esa clave, leídos de sus respuestas o aprendidos a partir de un rechazo. Con 20 entidades y 2 modelos, las llamadas a un modelo que permite 15 solicitudes por minuto se reparten a lo largo del minuto mientras el otro modelo avanza a su propio ritmo, de modo que el lote se completa sin errores 429.

Progreso en tiempo real

Al iniciar una ejecución se abre una franja de ejecución entre la barra de herramientas y la cuadrícula, alimentada por Server-Sent Events (SSE): una barra de progreso para el lote; completados / fallidos / omitidos como contadores independientes en lugar de una sola cifra combinada; el tiempo transcurrido con una estimación de finalización calculada a partir de las filas ya resueltas; y el gasto acumulado frente a la estimación previa. Nada se abre sobre la cuadrícula: las filas permanecen donde las dejó y cada una lleva su propio estado en la columna Estado, junto al Tiempo y el Coste que consumió.

Sin ejecutar

La fila aún no ha pasado por ninguna ejecución — la celda Estado muestra un guion en lugar de repetirse por toda la columna.

En cola

Admitida en el lote, a la espera de espacio en el presupuesto de tasa de la clave.

En ejecución

La etiqueta da paso a una barra en línea que cuenta los pasos de especialización completados sobre el total.

Listo

Todos los modelos han respondido. Tiempo y Coste se rellenan, y las columnas de Resultado pasan a ser legibles.

Fallido

Ningún modelo produjo un resultado para esta fila. Cuando el lote se detiene, la barra ofrece reintentar solo las filas fallidas.

Omitido

Descartado antes del enriquecimiento — una discrepancia de clasificación con alta confianza, por ejemplo — de modo que la fila nunca costó nada.

Los chips Completado / Fallido / Omitido de la barra de herramientas filtran la cuadrícula por esas filas, y el selector Entrada / Ambos / Resultado muestra esas mismas filas como lo que envió, lo que se devolvió o ambos en paralelo.

Cancelación y gestión de errores

Puede cancelar un lote en ejecución en cualquier momento. La cancelación es cooperativa: las entidades ya en curso completan su llamada actual al LLM, pero no se inician nuevas llamadas. Se conservan los resultados parciales de las entidades completadas.

Resiliencia ante errores

El procesamiento por lotes está diseñado para ser resiliente. Los fallos individuales no detienen el lote:

  • Si la clasificación falla para una entidad, el enriquecimiento continúa sin contexto
  • Si un modelo falla, los demás modelos de esa entidad continúan
  • Con dos o más modelos, la fusión automática solo se ejecuta para las entidades en las que todos los modelos han tenido éxito — una entidad parcial no produce ningún resultado fusionado y nada llega a su base de datos hasta recuperar el modelo que falta reintentando sus especialidades fallidas
  • Si todos los modelos fallan para una entidad, esta se marca como fallida mientras los demás continúan
  • Los modelos que devuelven errores de tipo «no encontrado» se desactivan automáticamente

Formatos de exportación

Tras completarse el lote, exporte los resultados en tres formatos. Para cada entidad, se prefiere el resultado de la fusión si está disponible; de lo contrario, se usa el resultado del mejor modelo.

Archivo JSON

Descargue los resultados completos como un archivo JSON estructurado con todos los datos de las entidades, las salidas de los modelos y los metadatos de fusión.

Portapapeles

Copie los resultados JSON directamente al portapapeles para pegarlos en otras herramientas o scripts.

Excel

Un libro de tres hojas: Results (una fila por entidad con propiedades aplanadas), Summary (metadatos del lote, modelos, costes) y Conflicts (detalles de conflictos por entidad con el razonamiento de resolución).

Límites

LímiteValor
Máximo de entities por batchSin límite fijo — restringido por la cuota de uso de su plan
Tamaño máximo de datos de la entity50 000 caracteres
Longitud máxima del prompt100.000 caracteres
Tiempo de espera de obtención de URL agotado30 segundos

Próximos pasos