Realtime kostenanalyses met tijdreeksgrafieken, uitsplitsingen per model, prestatiestatistieken en instelbare datumvoorinstellingen.
Overzicht
Het kostendashboard geeft je volledig inzicht in je LLM-uitgaven en -prestaties. Het bundelt gegevens uit alle verrijkingsrecords in je organisatie en presenteert deze via interactieve grafieken en samenvattingskaarten. Gebruik het om kostentrends te herkennen, de efficiëntie van modellen te vergelijken en je verrijkingspijplijn te optimaliseren.
Tabbladen
2
Datumvoorinstellingen
4
Grafiektypen
5
Organisatieoverstijgend
Beheer
Datumvoorinstellingen
Selecteer een tijdsbereik in de zijbalk. De URL wordt bijgewerkt om de geselecteerde preset weer te geven (bijv. /costs/30d), waardoor je weergaven als bladwijzer kunt opslaan:
Voorinstelling
Tijdsbereik
Grafiekgroepering
7d
Laatste 7 dagen
Dagelijks
30d
Laatste 30 dagen
Dagelijks
90d
Laatste 90 dagen
Wekelijks
all
Alle tijd
Maandelijks
Systeembeheerders krijgen in de zijbalk een organisatiekiezer met drie standen: hun eigen organisatie, alle organisaties samengevoegd, of één specifieke organisatie. Alle anderen — ook eigenaren — zien altijd de kosten van hun eigen organisatie; de backend bepaalt het bereik, dus het filter is niet vanaf de client te omzeilen. De keuze wordt per gebruiker bewaard in local storage.
Tabblad Kostenoverzicht
Het standaardtabblad biedt een uitgebreide uitsplitsing van de uitgaven:
Samenvattingskaarten
1Alles wat in de periode is uitgegeven
2Gemiddelde kosten van één aanroep
3Gemiddelde kosten van één ingevulde eigenschap
De twee gemiddelden maken runs vergelijkbaar: kosten per aanvraag beantwoorden “wat kost één verrijking”, kosten per eigenschap beantwoorden “wat kost één ingevuld veld” — het getal dat verandert als een schema groeit.
Grafieken en tabellen
Kosten in de tijd— Lijndiagram met bestedingstrends over de geselecteerde periode, gegroepeerd per dag/week/maand.
Kosten per model— Horizontale staafgrafiek van de top 10 modellen op totale kosten. Identificeer snel de duurste modellen.
Tokengebruik— Uitsplitsing van invoertokens, uitvoertokens en totaal verbruikte tokens.
Modelinzichten— Kaarten die het meest gebruikte model en het duurste model uitlichten.
Dagelijkse uitsplitsing— Tabel met datum, aantal aanvragen, totale kosten, gemiddelde kosten per aanvraag en tokentotalen.
Eén periode, vier manieren om dezelfde uitgaven te lezen: het totaal, het verloop in de tijd, welk model het draagt, en het detail per dag.
Tabblad Prestatieanalyse
Ga naar het tabblad Prestaties om de efficiëntie van models te analyseren en afwegingen tussen kosten en prestaties te vinden:
Samenvattingskaarten
Totaal records
156
Verrijkingsrecords in de periode
Gebruikte modellen
8
Verschillende modellen die resultaten hebben opgeleverd
Taalvarianten
3
Talen die worden gebruikt bij meertalige verrijking
Tokenbereiken
4
Aparte buckets voor invoertokengrootte
Grafieken en tabellen
Kosten versus duur— Spreidingsdiagram met bubbelgroottes evenredig aan het aantal aanvragen. Elke bubbel is een model — vind de beste balans tussen snelheid en kosten.
Prestaties per model— Tabel die het aantal aanvragen, de gemiddelde kosten, de gemiddelde duur en tokenstatistieken per model vergelijkt.
Kosten per aantal talen— Staafdiagram dat laat zien hoe de kosten schalen met het aantal geselecteerde talen voor meertalige enrichment.
Kosten per invoertokenbereik— Staafdiagram dat de kosten uitsplitst naar de grootte van de input-prompt (bijv. 0–1K, 1K–5K, 5K–10K tokens).
Prestaties per aantal schema-eigenschappen— Tabel die laat zien hoe enrichmentkosten en -duur samenhangen met de complexiteit van het schema (alleen enrichment-records).
De grafiek is een keuze, geen rapport: het model dat je zoekt ligt meestal het dichtst bij de linkeronderhoek en haalt nog net je kwaliteitsnorm.
Optimalisatietips
Modellen vergelijken
Gebruik de spreidingsgrafiek Kosten vs. Duur om modellen te vinden die goede kwaliteit leveren tegen lagere kosten. Kleinere, snellere modellen volstaan vaak voor eenvoudige schema's.
Trends bewaken
Bekijk wekelijks de grafiek Kosten in de tijd. Plotselinge pieken kunnen wijzen op verkeerd geconfigureerde batchtaken of onverwachte herhalingslussen.
Schema's op de juiste maat
De tabel Prestaties per aantal schema-eigenschappen laat zien hoe de kosten meeschalen met de schemagrootte. Verwijder overbodige eigenschappen om de kosten per verrijking te verlagen.
Caching-modellen gebruiken
Modellen met prompt caching (zoals Anthropic) verlagen de kosten voor herhaalde enrichments met hetzelfde schema. De kaarten voor tokengebruik tonen de besparing op gecachte tokens.