Benchmarks
Banco de pruebas Determinatus
Ejecute una comparativa A/B en vivo entre la rutina estándar del sector y el kernel Determinatus. Las métricas se miden sobre la misma configuración de contexto y hardware.
Modo demostración: la interfaz reproduce la telemetría de referencia registrada. Al conectar el endpoint privado de Determinatus, cada ejecución medirá pasadas reales sobre GPU.
Latencia inter-token por paso
Cada punto es una pasada de decodificación medida en milisegundos.
Latencia inter-token
—
Throughput
—
Colapso de Softmax
—
Softmax
Factor de mejora
—
32k · T4
Resumen de la ejecución
| Métrica | Referencia | Determinatus | Factor |
|---|---|---|---|
| Latencia inter-token | — | — | — |
| Throughput | — | — | — |
| Colapso de Softmax | — | — | — |
Verificación formal en Lean 4
Árbol de pruebas que garantiza la ausencia de colapso numérico en la normalización Softmax.
- 01 · Definición del kernel BVI sobre registros de GPUVerificado
- 02 · Acotación del exponente máximo en SoftmaxVerificado
- 03 · Ausencia de desbordamiento en precisión reducidaVerificado
- 04 · Estabilidad numérica bajo contexto extendidoVerificado
- 05 · Equivalencia funcional con la referenciaVerificado
Conectar su endpoint privado
La lógica del kernel permanece en tu infraestructura. Esta interfaz envía la configuración elegida a tu API privada y muestra la telemetría devuelta, sin exponer código fuente.
POST https://api.determinatus.internal/v1/benchmark
{
"context_tokens": 32768,
"gpu": "T4",
"steps": 24
}