Enrichissez un nombre illimité d'entités en parallèle avec suivi de progression en temps réel, fusion multi-modèle automatique et export au format JSON ou Excel — limité uniquement par le quota d'utilisation de votre forfait, et non par une taille de traitement par lot fixe.
Les lignes arrivent par le bandeau source au-dessus de la grille — trois onglets, un seul ouvert à la fois. Le chargement des lignes replie le bandeau sur une seule ligne (« Coller / CSV · 12 lignes chargées ») pour que la grille garde la hauteur ; cliquez sur cette ligne pour charger un autre jeu.
Collez des lignes directement depuis Excel, Google Sheets ou un export CSV. La virgule, la tabulation et le point-virgule sont tous reconnus, une cellule entre guillemets peut contenir le délimiteur, et une première ligne de noms non numériques est prise pour les en-têtes de colonnes.
Déposez un fichier .csv, .tsv ou .json sur l'onglet, ou choisissez-en un sur le disque. Un fichier JSON peut contenir un tableau d'objets ou un objet unique ; les colonnes sont l'union de leurs clés, si bien que des enregistrements hétérogènes se chargent quand même.
Récupérez des entités depuis n'importe quel point de terminaison REST. Ce qui revient est lu comme une liste d'objets libres, et l'ensemble des colonnes est l'union de leurs clés.
Authentification prise en charge :
Si l'API renvoie un objet, le système vérifie des clés comme data, results, items à la recherche d'un tableau imbriqué.
Après le chargement des entités, celles-ci apparaissent dans une liste sélectionnable avec leur statut de validation. Vous pouvez choisir les entités à inclure dans le traitement par lot :
La barre latérale reprend les options de configuration de l'enrichissement unitaire :
| Option | Description |
|---|---|
| Schéma | Schéma cible qui définit la structure de sortie de l'enrichissement |
| Stratégie | Passe unique, domaines d'expertise ou multi-expertise (appels parallèles par domaine) |
| Modèles | Un ou plusieurs modèles IA à exécuter par entité. Plusieurs modèles permettent la fusion automatique. |
| Langues | Langues pour l'enrichissement de champs multilingues (p. ex. anglais + français) |
| Classification | Modèle rapide facultatif pour la vérification du type d'entité avant l'enrichissement |
| Arbitrage | Modèle utilisé pour la résolution des conflits par LLM lors de la fusion. Si non défini, une fusion basée sur des règles est utilisée. |
Le coût estimé s'affiche dans la barre d'exécution, à côté du bouton qui le dépense. Il est calculé à partir du nombre de propriétés de votre schéma, de la tarification au token des modèles sélectionnés et du nombre d'entités que vous avez sélectionnées. Avec la sélection automatique du modèle, celui-ci n'est choisi qu'au démarrage de l'exécution : le chiffre affiché est donc une médiane des modèles susceptibles d'être retenus. Une boîte de dialogue de confirmation apparaît lorsque l'exécution présente un risque réel — écriture dans une base de données liée, estimation élevée ou lignes sélectionnées qui seront ignorées — et non à chaque exécution.
Toutes les entités sélectionnées sont traitées simultanément. Chaque entité passe indépendamment par le pipeline d'enrichissement complet :
Toutes les entités partagent le budget de débit de chaque clé API et de chaque modèle — les requêtes et jetons par minute que le fournisseur accorde à cette clé, lus dans ses réponses ou appris à la suite d'un rejet. Avec 20 entités et 2 modèles, les appels vers un modèle qui autorise 15 requêtes par minute sont répartis sur la minute pendant que l'autre modèle avance à son propre rythme, si bien que le traitement par lot se termine sans erreur 429.
Le lancement d'une exécution ouvre un bandeau d'exécution entre la barre d'outils et la grille, alimenté par Server-Sent Events (SSE) : une barre de progression pour le traitement par lot, des compteurs distincts pour terminé / échoué / ignoré plutôt qu'un chiffre global, le temps écoulé avec une estimation d'arrivée calculée à partir des lignes déjà stabilisées, et la dépense engagée face à l'estimation préalable. Rien ne s'ouvre par-dessus la grille : les lignes restent où vous les avez laissées, et chacune porte son propre état dans la colonne Statut, à côté du Temps et du Coût qu'elle a demandés.
La ligne n'a pas encore été traitée — la cellule Statut affiche un tiret plutôt que de se répéter tout au long de la colonne.
Admis dans le traitement par lot, en attente de place dans le budget de débit de la clé.
Le libellé cède la place à une barre intégrée qui compte les étapes d'expertise terminées sur le total.
Tous les modèles ont répondu. Les colonnes Durée et Coût se remplissent, et les colonnes Résultat deviennent lisibles.
Aucun modèle n'a produit de résultat pour cette ligne. Une fois le traitement par lot arrêté, le bandeau propose de relancer uniquement les lignes en échec.
Écarté avant l'enrichissement — une non-correspondance de classification avérée, par exemple — la ligne n'a donc rien coûté.
Les puces Terminé / Échoué / Ignoré de la barre d'outils filtrent la grille sur ces lignes, et le sélecteur Entrée / Les deux / Résultat affiche ces mêmes lignes sous la forme de ce que vous avez envoyé, de ce qui est revenu, ou des deux côte à côte.
Vous pouvez annuler un traitement par lot en cours à tout moment. L'annulation est coopérative — les entités déjà en cours terminent leur appel LLM actuel, mais aucun nouvel appel ne démarre. Les résultats partiels des entités terminées sont conservés.
Le traitement par lot est conçu pour être résilient. Les échecs individuels n'interrompent pas le traitement par lot :
Une fois le traitement par lot terminé, exportez les résultats dans trois formats. Pour chaque entité, le résultat de fusion est privilégié s'il est disponible ; sinon, le meilleur résultat de modèle est utilisé.
Téléchargez les résultats complets sous forme de fichier JSON structuré contenant toutes les données d'entité, les sorties des modèles et les métadonnées de fusion.
Copiez les résultats JSON directement dans votre presse-papiers pour les coller dans d'autres outils ou scripts.
Un classeur à trois feuilles : Results (une ligne par entité avec les propriétés aplaties), Summary (métadonnées du traitement par lot, modèles, coûts) et Conflicts (détails des conflits par entité avec le raisonnement de résolution).
| Limite | Valeur |
|---|---|
| Nombre max d'entités par traitement par lot | Aucune limite fixe — dans la limite du quota d'utilisation de votre forfait |
| Taille max des données d'entité | 50 000 caractères |
| Longueur max du prompt | 100 000 caractères |
| Délai de récupération d'URL dépassé | 30 secondes |