Traitement par lot

Enrichissez un nombre illimité d'entités en parallèle avec suivi de progression en temps réel, fusion multi-modèle automatique et export au format JSON ou Excel — limité uniquement par le quota d'utilisation de votre forfait, et non par une taille de traitement par lot fixe.

Méthodes de saisie

Les lignes arrivent par le bandeau source au-dessus de la grille — trois onglets, un seul ouvert à la fois. Le chargement des lignes replie le bandeau sur une seule ligne (« Coller / CSV · 12 lignes chargées ») pour que la grille garde la hauteur ; cliquez sur cette ligne pour charger un autre jeu.

  1. 1Coller / CSV, Fichier et URL — une seule source ouverte à la fois
  2. 2Le bouton compte les lignes avant de les charger
  3. 3Nombre de colonnes et ligne d'en-tête détectés
Le délimiteur — virgule, tabulation ou point-virgule — et la ligne d'en-tête sont déterminés dans le navigateur au moment où vous collez, si bien qu'une détection erronée est visible avant même le chargement d'une seule ligne.

Coller / CSV

Collez des lignes directement depuis Excel, Google Sheets ou un export CSV. La virgule, la tabulation et le point-virgule sont tous reconnus, une cellule entre guillemets peut contenir le délimiteur, et une première ligne de noms non numériques est prise pour les en-têtes de colonnes.

Fichier

Déposez un fichier .csv, .tsv ou .json sur l'onglet, ou choisissez-en un sur le disque. Un fichier JSON peut contenir un tableau d'objets ou un objet unique ; les colonnes sont l'union de leurs clés, si bien que des enregistrements hétérogènes se chargent quand même.

URL

Récupérez des entités depuis n'importe quel point de terminaison REST. Ce qui revient est lu comme une liste d'objets libres, et l'ensemble des colonnes est l'union de leurs clés.

Authentification prise en charge :

AucunJeton BearerEn-tête de clé APIBasic Auth

Si l'API renvoie un objet, le système vérifie des clés comme data, results, items à la recherche d'un tableau imbriqué.

Sélection et validation des entités

Après le chargement des entités, celles-ci apparaissent dans une liste sélectionnable avec leur statut de validation. Vous pouvez choisir les entités à inclure dans le traitement par lot :

Sélection multiple— Cochez les lignes une à une, ou la case d'en-tête pour toutes les sélectionner ; Ctrl+A sélectionne tout ce qu'affiche le filtre en cours. Cliquer sur une ligne ouvre son tiroir de résultats au lieu de modifier la sélection.
Édition en ligne— Double-cliquez sur n'importe quelle cellule d'entrée pour corriger une valeur sur place — toutes les colonnes issues de vos données sont modifiables, pas seulement les clés de recherche du schéma.
Validation— Vos lignes ne sont pas tenues d'utiliser les noms de champs du schéma — les modèles les lisent telles quelles. Le seul verdict rendu par la grille porte sur le vide : une ligne ne contenant aucune valeur est signalée, grisée et exclue de l'exécution. Choisissez un modèle de classification pour que les entités du mauvais type soient écartées automatiquement.
Traitement sélectif— Seules les entités sélectionnées sont envoyées pour enrichissement. Désélectionnez les entités que vous ne souhaitez pas traiter.
Vérification du contrat pour chaque ligne— Le serveur vérifie chaque ligne au regard du contrat d'entrée du schéma avant toute dépense, et signale chaque ligne fautive au lieu de s'arrêter à la première — vous corrigez ainsi tout le traitement par lot en une seule passe.
  1. 1Les cases à cocher de chaque ligne déterminent sur quoi l'exécution dépense
  2. 2La ligne vide est signalée ici — et exclue de l'exécution
  3. 312 sélectionnées — mais 11 seulement sont exécutables
La ligne 11 n'a pas de nom, seulement un pays et un symbole boursier, et elle est enrichie quand même : une clé de recherche manquante, les modèles savent la contourner ; une ligne vide, non. Saisie, validation et état d'exécution tiennent ici sur une seule ligne, et non dans trois listes distinctes.

Configuration

La barre latérale reprend les options de configuration de l'enrichissement unitaire :

OptionDescription
SchémaSchéma cible qui définit la structure de sortie de l'enrichissement
StratégiePasse unique, domaines d'expertise ou multi-expertise (appels parallèles par domaine)
ModèlesUn ou plusieurs modèles IA à exécuter par entité. Plusieurs modèles permettent la fusion automatique.
LanguesLangues pour l'enrichissement de champs multilingues (p. ex. anglais + français)
ClassificationModèle rapide facultatif pour la vérification du type d'entité avant l'enrichissement
ArbitrageModèle utilisé pour la résolution des conflits par LLM lors de la fusion. Si non défini, une fusion basée sur des règles est utilisée.

Estimation des coûts

Le coût estimé s'affiche dans la barre d'exécution, à côté du bouton qui le dépense. Il est calculé à partir du nombre de propriétés de votre schéma, de la tarification au token des modèles sélectionnés et du nombre d'entités que vous avez sélectionnées. Avec la sélection automatique du modèle, celui-ci n'est choisi qu'au démarrage de l'exécution : le chiffre affiché est donc une médiane des modèles susceptibles d'être retenus. Une boîte de dialogue de confirmation apparaît lorsque l'exécution présente un risque réel — écriture dans une base de données liée, estimation élevée ou lignes sélectionnées qui seront ignorées — et non à chaque exécution.

  1. 1Deux modèles : un appel chacun, par entité
  2. 2L'estimation, recalculée à mesure que la sélection change
  3. 311 entités, et non les 12 chargées — la ligne vide est ignorée
Le bouton annonce ce qu'il va lancer, de sorte que le nombre et le prix se lisent ensemble. Sous le point de rupture mobile, les sélecteurs se replient dans « Plus d'options » et l'estimation reste à côté du bouton.

Exécution parallèle

Toutes les entités sélectionnées sont traitées simultanément. Chaque entité passe indépendamment par le pipeline d'enrichissement complet :

Pipeline par entité

  1. Classification (facultatif) — Un modèle rapide vérifie le type d'entité. En mode traitement par lot, les non-correspondances ne mettent pas la tâche en pause ; le contexte est transmis.
  2. Enrichissement multi-modèles — Chaque modèle sélectionné enrichit l'entité en parallèle, chacun cadencé selon le budget de débit de sa clé.
  3. Fusion automatique (lorsque 2 modèles ou plus réussissent) — Les résultats sont automatiquement fusionnés grâce à la détection et résolution des conflits.

Cadencement du débit

Toutes les entités partagent le budget de débit de chaque clé API et de chaque modèle — les requêtes et jetons par minute que le fournisseur accorde à cette clé, lus dans ses réponses ou appris à la suite d'un rejet. Avec 20 entités et 2 modèles, les appels vers un modèle qui autorise 15 requêtes par minute sont répartis sur la minute pendant que l'autre modèle avance à son propre rythme, si bien que le traitement par lot se termine sans erreur 429.

Progression en temps réel

Le lancement d'une exécution ouvre un bandeau d'exécution entre la barre d'outils et la grille, alimenté par Server-Sent Events (SSE) : une barre de progression pour le traitement par lot, des compteurs distincts pour terminé / échoué / ignoré plutôt qu'un chiffre global, le temps écoulé avec une estimation d'arrivée calculée à partir des lignes déjà stabilisées, et la dépense engagée face à l'estimation préalable. Rien ne s'ouvre par-dessus la grille : les lignes restent où vous les avez laissées, et chacune porte son propre état dans la colonne Statut, à côté du Temps et du Coût qu'elle a demandés.

Non exécuté

La ligne n'a pas encore été traitée — la cellule Statut affiche un tiret plutôt que de se répéter tout au long de la colonne.

En file d'attente

Admis dans le traitement par lot, en attente de place dans le budget de débit de la clé.

En cours d'exécution

Le libellé cède la place à une barre intégrée qui compte les étapes d'expertise terminées sur le total.

Terminé

Tous les modèles ont répondu. Les colonnes Durée et Coût se remplissent, et les colonnes Résultat deviennent lisibles.

Échec

Aucun modèle n'a produit de résultat pour cette ligne. Une fois le traitement par lot arrêté, le bandeau propose de relancer uniquement les lignes en échec.

Ignoré

Écarté avant l'enrichissement — une non-correspondance de classification avérée, par exemple — la ligne n'a donc rien coûté.

Les puces Terminé / Échoué / Ignoré de la barre d'outils filtrent la grille sur ces lignes, et le sélecteur Entrée / Les deux / Résultat affiche ces mêmes lignes sous la forme de ce que vous avez envoyé, de ce qui est revenu, ou des deux côte à côte.

Annulation et gestion des erreurs

Vous pouvez annuler un traitement par lot en cours à tout moment. L'annulation est coopérative — les entités déjà en cours terminent leur appel LLM actuel, mais aucun nouvel appel ne démarre. Les résultats partiels des entités terminées sont conservés.

Résilience aux erreurs

Le traitement par lot est conçu pour être résilient. Les échecs individuels n'interrompent pas le traitement par lot :

  • Si la classification échoue pour une entité, l'enrichissement se poursuit sans contexte
  • Si un modèle échoue, les autres modèles pour cette entité continuent
  • Avec deux modèles ou plus, la fusion automatique ne s'exécute que pour les entités pour lesquelles tous les modèles ont réussi — une entité partielle ne produit aucun résultat fusionné et rien n'arrive dans votre base de données tant que le modèle manquant n'a pas été récupéré en relançant ses expertises en échec
  • Si tous les modèles échouent pour une entité, celle-ci est marquée comme échouée tandis que les autres continuent
  • Les modèles qui renvoient des erreurs « introuvable » sont automatiquement désactivés

Formats d'export

Une fois le traitement par lot terminé, exportez les résultats dans trois formats. Pour chaque entité, le résultat de fusion est privilégié s'il est disponible ; sinon, le meilleur résultat de modèle est utilisé.

Fichier JSON

Téléchargez les résultats complets sous forme de fichier JSON structuré contenant toutes les données d'entité, les sorties des modèles et les métadonnées de fusion.

Presse-papiers

Copiez les résultats JSON directement dans votre presse-papiers pour les coller dans d'autres outils ou scripts.

Excel

Un classeur à trois feuilles : Results (une ligne par entité avec les propriétés aplaties), Summary (métadonnées du traitement par lot, modèles, coûts) et Conflicts (détails des conflits par entité avec le raisonnement de résolution).

Limites

LimiteValeur
Nombre max d'entités par traitement par lotAucune limite fixe — dans la limite du quota d'utilisation de votre forfait
Taille max des données d'entité50 000 caractères
Longueur max du prompt100 000 caractères
Délai de récupération d'URL dépassé30 secondes

Prochaines étapes