Selbstbedienung mit Prepaid-Guthaben ab 5 USD, abgerechnet nach Verbrauch. Die Ratengrenzen steigen mit den Gesamtausgaben.
Prepaid-Guthaben, Mindestkauf 5 USD, Guthaben derzeit ohne Verfallsdatum
Ratengrenzen nach Build Tier 1 bis 5, abhängig von den bisherigen Gesamtausgaben (5 bis 1.000 USD)
Serverless Inference über eine OpenAI-kompatible API für Text, Bild, Video, Audio, Transkription, Embeddings und Rerank
Qwen3.8 Flash: 0,09 USD Input und 0,28 USD Output je 1 Mio. Token
gpt-oss-120B: 0,15 USD Input und 0,60 USD Output je 1 Mio. Token
MiniMax M3: 0,30 USD Input, 0,06 USD Cached Input und 1,20 USD Output je 1 Mio. Token
DeepSeek V4 Pro 0813: 1,32 USD Input und 3,96 USD Output je 1 Mio. Token
Kimi K3: 3,00 USD Input und 15,00 USD Output je 1 Mio. Token
Bildgenerierung ab 0,0017 USD je Megapixel, Videogenerierung ab 0,115 USD je Video, Transkription ab 0,0015 USD je Audiominute
Dedicated Inference on demand: NVIDIA HGX H100 5,49 USD, HGX B200 8,99 USD je GPU-Stunde
GPU Clusters on demand: HGX H100 3,99 USD, H200 5,99 USD, B200 8,19 USD, B300 9,99 USD je GPU-Stunde
GPU Clusters preemptible ab 1,99 USD, reserviert für 7 bis 180 Tage ab 3,19 USD je GPU-Stunde (H100)
Fine-Tuning ab 0,34 USD je 1 Mio. Trainings-Token, Mindestbetrag je Job ab 4 USD
Code Sandbox: 0,0446 USD je vCPU und Stunde, 0,0149 USD je GiB RAM und Stunde
Managed Storage: 0,16 USD je GiB und Monat