skip to content
$API
$APIcontract at launchbuy at launch

pre-launchnext split soonsplit every 10 mincredit rate 1.5xgateway holdapi.lol/v1

for developers

Three steps. Your code does not change: any OpenAI client works once it points at the gateway.

  1. get a key

    Made in the dashboard after one wallet signature. It is shown once; only a hash is stored, so a lost key is replaced rather than recovered.

    open the dashboard keys look like sk-api-…

    Keys are issued at launch, once the gateway is live.

  2. point your client at the gateway

    Two settings. Paste them wherever your tool asks for an OpenAI key.

    base urlhttps://holdapi.lol/v1
    api keysk-api-… the key from step 1yours

    Or pick your tool and copy the whole snippet.

    Cursor  ->  Settings  ->  Models  ->  OpenAI API Key
    
    Base URL   https://holdapi.lol/v1
    API Key    sk-api-...
    
    Turn on "Override OpenAI Base URL", then pick a model
    from the list on this site.
    openai compatible · cursor
  3. pick a model

    Use the id as the model name. Rates are published per million tokens, and the endpoint meters your real usage against them instead of rounding to a plan.

    models · read from /v1/models

    • openai/gpt-6-astraopenai
    • openai/gpt-6.1-solopenai
    • openai/gpt-6-solopenai
    • openai/gpt-6-lunaopenai
    • openai/gpt-5.6-solopenai
    • openai/gpt-5.6-terraopenai
    • openai/gpt-5.6-lunaopenai
    • openai/gpt-5.6-sol-proopenai
    • openai/gpt-5.6-terra-proopenai
    • openai/gpt-5.6-luna-proopenai
    • openai/gpt-5.5openai
    • openai/gpt-5.5-proopenai
    • openai/chat-latestopenai
    • openai/gpt-5.4openai
    • openai/gpt-5.4-proopenai
    • openai/gpt-5.1openai
    • openai/gpt-5.2openai
    • openai/gpt-5.4-miniopenai
    • openai/gpt-5-miniopenai
    • openai/gpt-5.4-nanoopenai
    • openai/gpt-5.2-proopenai
    • openai/gpt-5.3-codexopenai
    • openai/gpt-4.1openai
    • openai/gpt-4.1-miniopenai
    • openai/gpt-4.1-nanoopenai
    • openai/gpt-4oopenai
    • openai/gpt-4o-miniopenai
    • openai/o1openai
    • openai/o3openai
    • openai/o3-miniopenai
    • openai/o4-miniopenai
    • anthropic/claude-haiku-4.5anthropic
    • anthropic/claude-sonnet-5.5anthropic
    • anthropic/claude-sonnet-5anthropic
    • anthropic/claude-sonnet-4.6anthropic
    • anthropic/claude-sonnet-4.5anthropic
    • anthropic/claude-opus-4.5anthropic
    • anthropic/claude-opus-4.7anthropic
    • anthropic/claude-fable-5.1anthropic
    • anthropic/claude-fable-5anthropic
    • anthropic/claude-opus-4.8anthropic
    • anthropic/claude-opus-5anthropic
    • anthropic/claude-opus-5.5anthropic
    • google/gemini-3.1-progoogle
    • google/gemini-3-flash-previewgoogle
    • google/gemini-3.8-flashgoogle
    • google/gemini-3.6-flashgoogle
    • google/gemini-3.5-flashgoogle
    • google/gemini-2.5-progoogle
    • google/gemini-2.5-flashgoogle
    • google/gemini-3.5-flash-litegoogle
    • google/gemini-3.1-flash-litegoogle
    • google/gemini-2.5-flash-litegoogle
    • deepseek/deepseek-v4-flash-vision-expdeepseek
    • deepseek/deepseek-v4-prodeepseek
    • deepseek/deepseek-chatdeepseek
    • deepseek/deepseek-reasonerdeepseek
    • moonshot/kimi-k3moonshot
    • zai/glm-5.3zai
    • zai/glm-5.3-flashzai
    • zai/glm-5.2zai
    • zai/glm-5.1zai
    • zai/glm-5zai
    • zai/glm-5-turbozai
    • xai/grok-4.3xai
    • xai/grok-build-0.1xai
    • xai/grok-4.7xai
    • xai/grok-4.6xai
    • xai/grok-4.5xai
    • minimax/minimax-m2.7minimax
    • minimax/minimax-m3minimax
    • qwen/qwen3.8-maxqwen
    • qwen/qwen3.7-maxqwen
    • qwen/qwen3.7-plusqwen
    • qwen/qwen3.7-flashqwen
    • qwen/qwen3.8-flashqwen
    • tencent/hy4-previewtencent
    • xiaomi/mimo-v2.5xiaomi
    • xiaomi/mimo-v2.5-proxiaomi
    • nvidia/nemotron-3-nano-omni-30b-a3b-reasoningnvidia
    • nvidia/nemotron-3.5-lightningnvidia
    • nvidia/llama-3.2-11b-visionnvidia
    • nvidia/nemotron-3-ultra-550bnvidia
    • cohere/north-mini-codecohere
    • poolside/laguna-xs-2.1nvidia
    • poolside/laguna-s-2.1poolside
    • mistral/mistral-large-4mistral
    • nvidia/muse-glimmer-30bnvidia

    A call is charged what the model costs. Each call first holds the most it could cost, then settles to what it used and returns the difference. That is why a long answer can hold more than it spends. If a model is not in this list, the endpoint will not run it.