$ curl llmtap.dev --mismo-modelo --10x-menos
Eso pagas de menos por token en la serie gpt-5.6 contra el precio oficial de OpenAI. Los mismos modelos de frontera (GPT, Claude, Gemini) detrás de una API compatible, cobrando por token exacto. Sin suscripción, sin rate limits de plan.
$50 de uso gratis para empezar. Sin tarjeta.
$ curl https://llmtap.dev/api/v1/chat/completions \
-H "Authorization: Bearer sk-live-your-key" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-sol",
"messages": [{"role": "user", "content": "hello"}]
}'Crea tu cuenta gratis en 30 segundos. Sin tarjeta.
Genera una key con nombre desde el dashboard. Cópiala de inmediato: se muestra una sola vez.
Apunta cualquier cliente compatible con OpenAI a https://llmtap.dev/api/v1. Una línea y listo.
El mismo SDK, el mismo código y los mismos modelos, a una fracción del costo.
Registro con email. Recargas saldo con USDT o USDC (red BSC) y se acredita automáticamente cuando la red confirma. También existen códigos promocionales canjeables.
Desde el dashboard creas keys con nombre, las revocas cuando quieras y ves el consumo por request con tokens exactos.
La API es compatible con el formato de OpenAI: apunta base_url a llmtap, usa tu key y tu código sigue igual.
Cobro exacto por tokens reportados por el upstream. El oficial es el precio de lista del proveedor correspondiente; el ahorro se calcula sobre input.
| modelo | proveedor | input | output | oficial in/out | ahorro |
|---|---|---|---|---|---|
| gpt-5.6-sol | OpenAI | $0.50 | $3.00 | $5.00/$30.00 | −90% |
| gpt-5.6-terra | OpenAI | $0.25 | $1.50 | $2.50/$15.00 | −90% |
| gpt-5.5 | OpenAI | $0.50 | $3.00 | $5.00/$30.00 | −90% |
| gpt-5.4 | OpenAI | $0.25 | $1.50 | $2.50/$15.00 | −90% |
| codex-auto-review | OpenAI | $0.25 | $1.50 | $2.50/$15.00 | −90% |
| claude-opus-4.8 | Anthropic | $0.80 | $4.00 | $5.00/$25.00 | −84% |
| claude-sonnet-5 | Anthropic | $0.32 | $1.60 | $2.00/$10.00 | −84% |
| claude-haiku-4.5 | Anthropic | $0.08 | $0.32 | $0.50/$2.50 | −84% |
| claude-fable-5 | Anthropic | $8.00 | $40.00 | $10.00/$50.00 | −20% |
| gemini-3.1-pro | $0.53 | $3.20 | $2.00/$12.00 | −73% | |
| gemini-3.5-flash | $0.40 | $2.40 | $1.50/$9.00 | −73% |
Compara nuestro precio de reventa contra las tarifas oficiales según tu consumo mensual.
Calculado con una proporción de 10:1 entre input y output, el patrón típico de uso de Cursor o Claude Code.
Cualquier cliente compatible con OpenAI. Cambias la base URL una vez y dejas el resto igual.
base_url = "https://llmtap.dev/v1" api_key = "sk-..."
Si tu código ya habla con OpenAI, apuntarlo a llmtap es cambiar base_url y la key. Streaming, function calling y el formato de errores se comportan igual.
Y si el upstream falla, el cargo se devuelve solo. Solo pagas por respuestas completadas.
from openai import OpenAI
client = OpenAI(
api_key="sk-live-your-key",
base_url="https://llmtap.dev/api/v1",
)
res = client.chat.completions.create(
model="claude-sonnet-5",
messages=[{"role": "user", "content": "hello"}],
)
print(res.choices[0].message.content)Compramos capacidad al por mayor en pools de suscripciones y ruteamos tus requests a los servidores oficiales. Mismo modelo, costo compartido. Es el mismo mecanismo que usan los proxies de API en Asia desde hace años.
La request va al upstream oficial sin transformación. Puedes correr tus propios benchmarks contra la API oficial y comparar: mismos pesos, mismos resultados. Además cada request queda logueada con tokens exactos en tu dashboard.
No pagas. Bloqueamos un estimado antes de llamar y liquidamos contra el uso real que reporta el upstream. Si el stream se corta o el proveedor responde error, el bloqueo se devuelve completo a tu saldo de forma automática.
Con cripto: USDT o USDC en red BSC, procesado por NowPayments. El saldo se acredita solo cuando la transacción confirma on-chain. Sin tarjetas, sin suscripción mensual: pagas por token consumido.
No. Cambias base_url y la API key. Funciona con el SDK de OpenAI, con curl, y con cualquier cliente que hable el formato /v1/chat/completions.
Reales. Las requests van al upstream oficial sin modificar. Puedes correr un benchmark del mismo modelo contra la API oficial y comparar: mismos pesos, misma salida.
Compramos capacidad al por mayor en pools de suscripciones y te traspasamos el ahorro. Es el mismo mecanismo que usan los proxies de API desde hace años: sin margen de retail ni costo de licencias por asiento.
Sí. Ruteamos a través de pools de upstream redundantes: si un proveedor se degrada, las requests hacen failover al siguiente disponible. La latencia típica queda dentro de un 5% de la API oficial. No guardamos el contenido de las requests, solo metadata.
No guardamos ni logueamos las requests más allá de la metadata (modelo, tokens, timestamp) que se necesita para facturar. El contenido del prompt y la respuesta no se retiene. Sin entrenamiento, sin compartir con terceros.
En Cursor: Settings → Models → Add OpenAI-compatible provider → base URL https://llmtap.dev/api/v1 y tu key. En Claude Code: apunta ANTHROPIC_BASE_URL a https://llmtap.dev/api/v1 y usa tu key como token de API. Funciona con cualquier cliente compatible con OpenAI.
Por ahora es solo pago por uso: pagas por cada token exacto consumido, nada más. Las suscripciones con tope mensual están en el roadmap.
$ listo-para-pagar-menos