Análises de custos em tempo real com gráficos de séries temporais, discriminações por model, métricas de desempenho e predefinições de datas configuráveis.
O Painel de Custos dá-lhe visibilidade total sobre os seus gastos e desempenho com LLM. Agrega os dados de todos os registos de enriquecimento da sua organização e apresenta-os através de gráficos interativos e cartões de resumo. Use-o para identificar tendências de custos, comparar a eficiência dos modelos e otimizar o seu pipeline de enriquecimento.
Selecione um intervalo de tempo na barra lateral. O URL é atualizado para refletir a predefinição selecionada (por exemplo, /costs/30d), permitindo vistas que podem ser adicionadas aos favoritos:
| Predefinição | Intervalo de tempo | Agrupamento de gráficos |
|---|---|---|
7d | Últimos 7 dias | Diário |
30d | Últimos 30 dias | Diário |
90d | Últimos 90 dias | Semanal |
all | Desde sempre | Mensal |
Os administradores do sistema dispõem de um seletor de organização na barra lateral com três opções: a sua própria organização, todas as organizações agregadas ou uma organização específica. Todos os restantes — incluindo os proprietários — veem sempre os custos da sua própria organização; o backend resolve o âmbito, pelo que o filtro não pode ser contornado a partir do cliente. A escolha é guardada por utilizador no armazenamento local.
O separador predefinido fornece uma discriminação abrangente dos gastos:
Mude para o separador Desempenho para analisar a eficiência dos modelos e identificar compromissos entre custo e desempenho:
Utilize o gráfico de dispersão Custo vs Duração para encontrar models que oferecem boa qualidade a um custo mais baixo. Models mais pequenos e rápidos são muitas vezes suficientes para schemas simples.
Verifique o gráfico de Custo ao Longo do Tempo semanalmente. Picos súbitos podem indicar trabalhos em lote mal configurados ou ciclos de repetição inesperados.
A tabela Desempenho por Número de Propriedades do Esquema mostra como o custo escala com o tamanho do esquema. Remova propriedades desnecessárias para reduzir o custo por enriquecimento.
Os modelos com cache de prompts (como a Anthropic) reduzem custos em enriquecimentos repetidos com o mesmo esquema. Os cartões de utilização de tokens mostram as poupanças de tokens em cache.