Benchmarks

Banco de pruebas Determinatus

Ejecute una comparativa A/B en vivo entre la rutina estándar del sector y el kernel Determinatus. Las métricas se miden sobre la misma configuración de contexto y hardware.

Modo demostración: la interfaz reproduce la telemetría de referencia registrada. Al conectar el endpoint privado de Determinatus, cada ejecución medirá pasadas reales sobre GPU.

Latencia inter-token por paso

Cada punto es una pasada de decodificación medida en milisegundos.

vLLM / LayerScale (referencia) Determinatus (kernel BVI/SAM)

Latencia inter-token

—

Throughput

—

Colapso de Softmax

—

Softmax

Factor de mejora

—

32k · T4

Resumen de la ejecución

MétricaReferenciaDeterminatusFactor
Latencia inter-token———
Throughput———
Colapso de Softmax———

Verificación formal en Lean 4

Árbol de pruebas que garantiza la ausencia de colapso numérico en la normalización Softmax.

  • 01 · Definición del kernel BVI sobre registros de GPUVerificado
  • 02 · Acotación del exponente máximo en SoftmaxVerificado
  • 03 · Ausencia de desbordamiento en precisión reducidaVerificado
  • 04 · Estabilidad numérica bajo contexto extendidoVerificado
  • 05 · Equivalencia funcional con la referenciaVerificado

Conectar su endpoint privado

La lógica del kernel permanece en tu infraestructura. Esta interfaz envía la configuración elegida a tu API privada y muestra la telemetría devuelta, sin exponer código fuente.

POST https://api.determinatus.internal/v1/benchmark
{
  "context_tokens": 32768,
  "gpu": "T4",
  "steps": 24
}