$ curl llmtap.dev --mismo-modelo --10x-menos

−90%

Eso pagas de menos por token en la serie gpt-5.6 contra el precio oficial de OpenAI. Los mismos modelos de frontera (GPT, Claude, Gemini) detrás de una API compatible, cobrando por token exacto. Sin suscripción, sin rate limits de plan.

$50 de uso gratis para empezar. Sin tarjeta.

terminal200 OK
$ curl https://llmtap.dev/api/v1/chat/completions \
    -H "Authorization: Bearer sk-live-your-key" \
    -H "Content-Type: application/json" \
    -d '{
      "model": "gpt-5.6-sol",
      "messages": [{"role": "user", "content": "hello"}]
    }'
gpt-5.6-sol $0.50/$3.00 gpt-5.6-terra $0.25/$1.50 gpt-5.5 $0.50/$3.00 gpt-5.4 $0.25/$1.50 codex-auto-review $0.25/$1.50 claude-opus-4.8 $0.80/$4.00 claude-sonnet-5 $0.32/$1.60 claude-haiku-4.5 $0.08/$0.32 claude-fable-5 $8.00/$40.00 gemini-3.1-pro $0.53/$3.20 gemini-3.5-flash $0.40/$2.40 USD por 1M tokens input/output

Empieza en 4 pasos

01

Regístrate

Crea tu cuenta gratis en 30 segundos. Sin tarjeta.

02

Crea tu API key

Genera una key con nombre desde el dashboard. Cópiala de inmediato: se muestra una sola vez.

03

Cambia la base URL

Apunta cualquier cliente compatible con OpenAI a https://llmtap.dev/api/v1. Una línea y listo.

04

Listo

El mismo SDK, el mismo código y los mismos modelos, a una fracción del costo.

Cómo funciona

01

Crea tu cuenta y recarga

Registro con email. Recargas saldo con USDT o USDC (red BSC) y se acredita automáticamente cuando la red confirma. También existen códigos promocionales canjeables.

02

Genera tu API key

Desde el dashboard creas keys con nombre, las revocas cuando quieras y ves el consumo por request con tokens exactos.

03

Cambia una línea y llama

La API es compatible con el formato de OpenAI: apunta base_url a llmtap, usa tu key y tu código sigue igual.

Precios por 1M tokens

Cobro exacto por tokens reportados por el upstream. El oficial es el precio de lista del proveedor correspondiente; el ahorro se calcula sobre input.

modeloproveedorinputoutputoficial in/outahorro
gpt-5.6-solOpenAI$0.50$3.00$5.00/$30.0090%
gpt-5.6-terraOpenAI$0.25$1.50$2.50/$15.0090%
gpt-5.5OpenAI$0.50$3.00$5.00/$30.0090%
gpt-5.4OpenAI$0.25$1.50$2.50/$15.0090%
codex-auto-reviewOpenAI$0.25$1.50$2.50/$15.0090%
claude-opus-4.8Anthropic$0.80$4.00$5.00/$25.0084%
claude-sonnet-5Anthropic$0.32$1.60$2.00/$10.0084%
claude-haiku-4.5Anthropic$0.08$0.32$0.50/$2.5084%
claude-fable-5Anthropic$8.00$40.00$10.00/$50.0020%
gemini-3.1-proGoogle$0.53$3.20$2.00/$12.0073%
gemini-3.5-flashGoogle$0.40$2.40$1.50/$9.0073%

¿Cuánto ahorras?

Compara nuestro precio de reventa contra las tarifas oficiales según tu consumo mensual.

$50$200$500$1,000$2,000
Con llmtap
$200/mes
A precio oficial
$2,000/mes
Ahorras
$1,800/mes(90%)

Calculado con una proporción de 10:1 entre input y output, el patrón típico de uso de Cursor o Claude Code.

Funciona con todo

Cualquier cliente compatible con OpenAI. Cambias la base URL una vez y dejas el resto igual.

CursorClaude CodeClineKilo CodeContinue.devOpenAI SDKAnthropic SDKLangChain
Config universal, pégala donde sea:
base_url = "https://llmtap.dev/v1"
api_key  = "sk-..."

Cambias una línea. Nada más.

Si tu código ya habla con OpenAI, apuntarlo a llmtap es cambiar base_url y la key. Streaming, function calling y el formato de errores se comportan igual.

Y si el upstream falla, el cargo se devuelve solo. Solo pagas por respuestas completadas.

main.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-live-your-key",
    base_url="https://llmtap.dev/api/v1",
)

res = client.chat.completions.create(
    model="claude-sonnet-5",
    messages=[{"role": "user", "content": "hello"}],
)
print(res.choices[0].message.content)

Preguntas honestas

¿Por qué es tan barato?

Compramos capacidad al por mayor en pools de suscripciones y ruteamos tus requests a los servidores oficiales. Mismo modelo, costo compartido. Es el mismo mecanismo que usan los proxies de API en Asia desde hace años.

¿Cómo sé que responde el modelo real y no uno más barato?

La request va al upstream oficial sin transformación. Puedes correr tus propios benchmarks contra la API oficial y comparar: mismos pesos, mismos resultados. Además cada request queda logueada con tokens exactos en tu dashboard.

¿Qué pasa si el proveedor falla a mitad de una request?

No pagas. Bloqueamos un estimado antes de llamar y liquidamos contra el uso real que reporta el upstream. Si el stream se corta o el proveedor responde error, el bloqueo se devuelve completo a tu saldo de forma automática.

¿Cómo pago?

Con cripto: USDT o USDC en red BSC, procesado por NowPayments. El saldo se acredita solo cuando la transacción confirma on-chain. Sin tarjetas, sin suscripción mensual: pagas por token consumido.

¿Tengo que reescribir mi código?

No. Cambias base_url y la API key. Funciona con el SDK de OpenAI, con curl, y con cualquier cliente que hable el formato /v1/chat/completions.

¿Son los modelos reales o imitaciones?

Reales. Las requests van al upstream oficial sin modificar. Puedes correr un benchmark del mismo modelo contra la API oficial y comparar: mismos pesos, misma salida.

¿Por qué es más barato que el precio oficial?

Compramos capacidad al por mayor en pools de suscripciones y te traspasamos el ahorro. Es el mismo mecanismo que usan los proxies de API desde hace años: sin margen de retail ni costo de licencias por asiento.

¿Puedo usarlo en producción?

Sí. Ruteamos a través de pools de upstream redundantes: si un proveedor se degrada, las requests hacen failover al siguiente disponible. La latencia típica queda dentro de un 5% de la API oficial. No guardamos el contenido de las requests, solo metadata.

¿Qué pasa con la privacidad del código?

No guardamos ni logueamos las requests más allá de la metadata (modelo, tokens, timestamp) que se necesita para facturar. El contenido del prompt y la respuesta no se retiene. Sin entrenamiento, sin compartir con terceros.

¿Cómo conecto Cursor o Claude Code?

En Cursor: Settings → Models → Add OpenAI-compatible provider → base URL https://llmtap.dev/api/v1 y tu key. En Claude Code: apunta ANTHROPIC_BASE_URL a https://llmtap.dev/api/v1 y usa tu key como token de API. Funciona con cualquier cliente compatible con OpenAI.

¿Tienen suscripciones?

Por ahora es solo pago por uso: pagas por cada token exacto consumido, nada más. Las suscripciones con tope mensual están en el roadmap.

$ listo-para-pagar-menos

Crea tu cuenta, genera una key y llama en los próximos 5 minutos.

crear cuenta