Pay as you gain · riesgo cero
TokenomiCo se conecta entre tu app y la API que ya usas y comprime lo que se repite en cada llamada — historial, herramientas e instrucciones. En una sesión agéntica real de 20 turnos medimos 28% menos costo de input (y en un prompt único y corto somos honestos: no hay ahorro). Solo pagas el 40% de lo que ahorres: sin ahorro, factura cero. Sin mensualidad, sin contrato, sin cambiar una línea de código.
el modelo
No vendemos suscripciones, vendemos resultados. Medimos cada token que dejaste de gastar y repartimos la ganancia — la mayor parte queda contigo. Si un mes no hay ahorro, la factura es cero. No puedes salir perdiendo.
cómo funciona
Sin migración, sin reescribir nada, sin cambiar de modelo. Si ya tienes una app con IA, conectas hoy.
Apunta el SDK que ya usas al endpoint de TokenomiCo. Misma API, mismos modelos, mismo código. Tu clave del proveedor queda cifrada y bajo tu control.
Nuestra tecnología recorta tus prompts en tiempo real, preservando el sentido. Y si en alguna petición no hay ganancia, pasa intacta — nunca quedas peor.
Cada respuesta muestra cuánto ahorraste. A fin de mes, un comprobante detalla el ahorro — la factura es el 40% y el otro 60% se queda en tu caja.
benchmarks · medido, no estimado
Todos los números de compresión de abajo salieron del compilador ejecutándose de verdad (LuaJIT 2.1), deterministas y reproducibles. Y somos explícitos sobre qué es medición directa, qué es modelo calibrado y qué aún no medimos.
Compresión por dominio (medición directa)
| dominio | tokens | reducción |
|---|---|---|
| Operaciones / incidentes | 106 → 56 | −47,2% |
| Refactorización de código | 98 → 54 | −44,9% |
| Auditoría jurídica (LGPD) | 117 → 66 | −43,6% |
| Análisis de datos | 98 → 56 | −42,9% |
| Pipeline CI/CD | 104 → 62 | −40,4% |
| Recon de seguridad | 119 → 71 | −40,3% |
| TOTAL | 642 → 365 | −43,1% |
Rango estrecho (40–47%) = robustez: ningún dominio "afortunado" inflando el promedio.
Loop agéntico: ¿y si γ es peor?
El factor de compresión del historial (γ) es el parámetro con más incertidumbre — por eso publicamos el rango completo, no solo el mejor caso:
| γ (historial) | ahorro @10 pasos | @30 pasos |
|---|---|---|
| 0,10 · agresivo | 94,8% | 93,8% |
| 0,20 | 91,2% | 88,0% |
| 0,30 · base | 87,7% | 82,1% |
| 0,40 · conservador | 84,1% | 76,3% |
Incluso en el peor caso (γ=0,40), el ahorro en el loop queda por encima del 76%. @ $3/MTok, 30 pasos: $0,98 → $0,18.
haz las cuentas
Mueve los controles con tus números y el recibo muestra, al instante, cuánto volvería a tu caja cada mes.
En nuestras pruebas, los prompts en lenguaje natural se reducen hasta un 30–40%. Sé conservador si quieres — incluso en el peor caso (0%) no pagas nada.
comprobante de ahorro · simulación
— se cobra solo sobre ganancia real —
para desarrolladores
Drop-in de verdad: una URL y un header. Controlas la compresión por petición y ves el ahorro en cada respuesta.
curl https://tokenomico.com/v1/anthropic/proxy \ -H "authorization: Bearer tk_live_..." \ -H "x-toke-compress: on" # on|off por petición \ -H "content-type: application/json" \ -d '{"model":"claude-sonnet-5","max_tokens":300, "messages":[{"role":"user","content":"..."}]}' # la respuesta incluye: x-toke-compressed: true x-toke-tokens-saved-est: 1284
Las respuestas stream:true pasan byte a byte, con usage real capturado del SSE para el billing.
Proxy para endpoints de API de los proveedores. Nada de suscripciones ni apps de chat de terceros.
PoC mensual con peticiones, tokens originales vs. enviados y el ahorro en dólares.
sin letra pequeña
En tareas muy sensibles a la forma exacta del texto, puede. Por eso es
opcional por petición (header x-toke-compress): actívala en cargas
tolerantes (clasificación, RAG, contexto largo) y desactívala en extracción/JSON y en las críticas.
Los prompts cortos y el contenido estructurado pasan sin comprimir automáticamente. Y cuando no hay
ganancia real, se envía el texto original — nunca quedas peor que antes.
Factura cero. El modelo es el 40% del ahorro medido, no de tu uso.
El proxy procesa el texto en tránsito para comprimirlo (TLS de entrada y salida) y no almacena prompts ni respuestas — solo métricas de tokens. Un matiz, por transparencia: la reescritura comprimida de pasajes recurrentes (nunca el original) puede retenerse hasta 7 días para acelerar los turnos siguientes. Tu clave BYOK queda cifrada en reposo (AES-256-GCM).
Mensual: la factura cierra el día 15 y llega por e-mail con el comprobante (PoC) y el link de pago (Stripe). Tolerancia hasta el día 18; después el proxy se suspende (HTTP 402) hasta regularizar — pagas y vuelves al instante. Las cuentas nuevas tienen carencia: la primera factura llega solo en el ciclo del mes siguiente al registro. Tus datos y claves siguen siendo tuyos.
Anthropic, OpenAI, Gemini, Grok (xAI), Perplexity, DeepSeek, Mistral, Groq, Kimi (Moonshot), Together AI y OpenRouter — la misma clave TokenomiCo para todos.
empieza ahora — sin tarjeta
Crea tu cuenta gratis, conecta tu clave y mira tu primer comprobante de ahorro hoy mismo. El único escenario en el que pagas es aquel en el que ya ganaste más.