← Provider Studio

Uso de tokens y costos de IA

Consumo real de modelos por organización, usuario, aplicación y funcionalidad.

Filtros

Resumen

— Tokens totales
Entrada—
Salida—
Costo estimado—
Solicitudes—
Usuarios activos—
Tokens / solicitud—
Latencia media—
Tasa de error—

Ritmo de gasto y economía unitaria

Costo por hora—
Proyección a 24 h—a este ritmo
Proyección a 30 d—a este ritmo
Costo por solicitud—
Costo por usuario—
Aciertos de caché—
Ahorro por caché—
Tokens de razonamiento—

Tokens en el tiempo

Entrada Salida

Costo en el tiempo

Costo estimado (USD)

Por aplicación

Por funcionalidad

Modelos con mayor costo

Usuarios con mayor consumo

Por proveedor

Por organización

Por tipo de actor

Distingue el consumo de personas del de procesos internos y del que llegó sin atribuir.

Distribución de errores

Solo llamadas fallidas, ordenadas por frecuencia. Un error barato que pasa a todas horas cuesta más que uno caro y raro.

Latencia por modelo

ModeloProveedor / appSolicitudes Mediana (p50)p95Media Errores

El p95 es el que importa: la media de una decena de llamadas rápidas y una colgada parece razonable, y el médico que esperó no lo diría.

Detalle de eventos

FechaUsuarioOrganización AppFuncionalidadProveedor ModeloEntradaSalida TotalCostoEstadoLatencia