Exascaler-Speicher
Ein paralleles Dateisystem für datenintensive Lasten wie Training oder große Dokumentensammlungen. Jeder Kunde erhält einen eigenen Bereich mit unabhängigen Quoten und Zugriffskontrollen.
eigener Bereich · mit Quoten
Leistungen
Drei Leistungsbereiche auf derselben NVIDIA-B200-Plattform in einem Tier-III-Rechenzentrum in Madrid: dedizierte GPUs, Inferenz offener Modelle und Beratung. Sie können mit jedem Bereich beginnen und zu einem anderen wechseln, ohne Anbieter oder Vertrag zu wechseln.
Volle GPUs, hardwareseitig isolierte Fraktionen oder ganze Knoten. On demand ohne Bindung zum Testen, oder reserviert mit garantierter Kapazität für die Produktion. Ihre Umgebung, Ihr Image, Ihr Zugang. Alle Konfigurationen finden Sie unter Preise.
ab1,50 €/h
Ideal für technische Teams, die eigene, isolierte GPUs in Spanien wollen, vom stundenweisen Pilot bis zur Produktion.
Preise ansehen →Ein Teil der GPU mit eigenem Speicher und eigener Rechenleistung, per MIG (Multi-Instance GPU) hardwareseitig isoliert, sodass kein anderer Kunde Ihre Ressourcen nutzt. 1/8 mit rund 23 GB für 1,50 €/h, 1/4 mit 45 GB für 3,00 €/h und 1/2 mit 90 GB für 6,00 €/h. Für Inferenz, OCR, Sprache und mittelgroße Modelle.
Eine bis vier vollständige physische B200 GPUs in unserem Cluster, im Passthrough-Modus zugewiesen: Ihre Umgebung greift direkt auf die Hardware zu, ohne Virtualisierungsschicht dazwischen. Jede GPU hat 180 GB HBM3e-Speicher mit 8 TB/s. Wir liefern ein Image mit den Bibliotheken Ihres Projekts. 8,00 €/h pro GPU.
Ein ganzer Server mit acht B200 nur für Sie, außerhalb des geteilten Clusters, fertig montiert und mit eigenem Zugang. Die GPUs kommunizieren über NVLink 5 mit je 1,8 TB/s, der Knoten ist per InfiniBand NDR mit 400 Gb/s angebunden. Für Training, Feinabstimmung und große Modelle, zu 64,00 €/h.
Ein sofort nutzbarer Container mit SSH, Python, PyTorch, Jupyter und Coding-Agenten. Sie zahlen nur die Stunden, in denen Sie ihn nutzen, denn er pausiert, sobald Sie aufhören zu arbeiten. So kann Ihr Team Modelle testen, Daten vorbereiten oder entwickeln, bevor es auf eine dedizierte GPU wechselt.
Nutzen Sie die besten offenen Modelle, ohne GPUs zu verwalten. Über eine API, die mit den SDKs von OpenAI und Anthropic kompatibel ist, oder über einen privaten Endpunkt nur für Ihre Organisation. Alles wird in Madrid verarbeitet, und nichts, was Sie senden, wird zum Training von Modellen verwendet.
ab0,06 €/M Tokens
Ideal, wenn Sie KI in Ihren Anwendungen und Prozessen nutzen wollen, ohne sich um die Infrastruktur zu kümmern.
GPU Flow →Modelle wie GLM 5.3, Qwen3.8, Gemma 4 26B, Nemotron 3.5 Lightning 30B oder ALIA 40B vom Barcelona Supercomputing Center, verfügbar über GPU Flow. Sie zahlen für verarbeitete Tokens, ab 0,06 € pro Million Eingabe-Tokens. Wenn Sie bereits die SDKs von OpenAI oder Anthropic nutzen, ändern Sie Adresse und Schlüssel im Code, fertig.
Das offene Modell Ihrer Wahl oder Ihr eigenes feinabgestimmtes Modell, bereitgestellt auf GPUs, die nur für Ihre Organisation reserviert sind. Keine mit anderen Kunden geteilten Warteschlangen, eigene Zugriffsregeln und eine Kapazität, die auf Ihr Volumen ausgelegt ist. Die richtige Wahl, wenn Vertraulichkeit oder eine dauerhafte Last es erfordern.
Audiotranskription mit Whisper large-v3, Texterkennung in gescannten Dokumenten mit Vision-Modellen wie Qwen3-VL 32B und Nemotron Nano 12B VL sowie Sprachsynthese. Für Protokolle, Besprechungsaufnahmen, Papierakten oder telefonischen Kundenservice, mit Datenverarbeitung in Spanien.
Wir haben unsere eigene Infrastruktur aufgebaut und betreiben sie selbst. Wir helfen Ihnen, über Ihre zu entscheiden, indem wir Ihre Last auf unserem Cluster messen, bevor Sie Budget binden, und begleiten Sie bei Design, Bereitstellung und Betrieb.
erstes Gespräch45 Min., kostenlos
Ideal, wenn Sie entscheiden müssen, welche KI-Infrastruktur Ihre Organisation braucht, und das auf Basis gemessener Daten tun wollen.
Termin anfragen →Wir übersetzen Ihren Anwendungsfall (Modelle, Kontextlänge, gleichzeitige Nutzer und erwartete Antwortzeit) in die passende Konfiguration. Wir schätzen nicht auf dem Papier, sondern messen, indem wir Ihre Last auf unserem B200-Cluster ausführen, damit die Entscheidung auf echten Daten beruht und nicht auf Datenblättern.
Das richtige Produkt für jede Phase, nach der Referenzarchitektur von NVIDIA: DGX Spark auf dem Schreibtisch für Piloten und Entwicklung, RTX-PRO-Workstations für Abteilungen und HGX B200 für die Produktion. Wir helfen Ihnen, jedes Teil mit dem benötigten Netzwerk, Speicher und der passenden Software zusammenzubringen.
Leistung pro Rack, direkte Flüssigkeitskühlung am Chip, schnelles InfiniBand-Netzwerk und paralleler Speicher. Wir bringen ein, was wir beim Aufbau und Betrieb von NVIDIA Blackwell in unserem eigenen Cluster gelernt haben, damit Ihr Rechenzentrum für die Dichte heutiger GPUs bereit ist.
Wenn Ihre Organisation eigene Infrastruktur hat, betreiben wir sie für Sie: Überwachung, Updates, Wartung und Support, mit NVIDIA Base Command Manager und unserem Team in Spanien. Das Eigentum an Hardware und Daten bleibt jederzeit bei Ihnen.
Zusatzleistungen
Wir nehmen sie je nach Fall ins Angebot auf. Fragen Sie uns zu jeder davon.
Ein paralleles Dateisystem für datenintensive Lasten wie Training oder große Dokumentensammlungen. Jeder Kunde erhält einen eigenen Bereich mit unabhängigen Quoten und Zugriffskontrollen.
eigener Bereich · mit Quoten
Ersatz-GPUs im selben Cluster. Da Ihre Daten auf dem Exascaler-Speicher liegen und nicht auf der GPU, startet die Umgebung auf einer anderen GPU neu, ohne dass etwas verschoben werden muss.
Standard < 24 h · 24/7 < 4 h
Eine verschlüsselte Punkt-zu-Punkt-Verbindung zwischen Ihrem Standort oder Rechenzentrum und unserem Cluster in Madrid, über einen Konnektivitätspartner, damit Ihr Datenverkehr nie über das öffentliche Internet läuft.
Post-Quanten-Kryptografie verfügbar
Was passt
Eine schnelle Orientierung. Wenn Ihr Fall in keine Zeile passt, sprechen Sie uns an, und wir finden die Lösung gemeinsam.
| Bedarf | Bereich | Modell | Ab |
|---|---|---|---|
| Diese Woche ein offenes Modell testen | B · Inferenz | API nach Tokens über GPU Flow | 0,06 €/M Tokens |
| Mit Coding-Agenten entwickeln und experimentieren | A · Dedizierte GPU | Entwicklungs-Sandbox | 0,15 €/aktive h |
| Ein mittelgroßes Modell, OCR oder Sprache produktiv betreiben | A · Dedizierte GPU | MIG-Fraktion 1/8 bis 1/2 | 1,50 €/h |
| Der ganzen Belegschaft KI mit sensiblen Daten geben | B · Inferenz | Privater dedizierter Endpunkt | Je nach Volumen |
| Ein Modell mit eigenen Daten feinabstimmen oder trainieren | A · Dedizierte GPU | Dedizierter Pod oder Knoten 8 × B200 | 8,00 €/h |
| Die KI-Infrastruktur Ihrer Organisation festlegen | C · Beratung | Dimensionierung | 45 Min., kostenlos |
On demand zahlen Sie stundenweise, ohne Bindung und je nach Verfügbarkeit; reserviert ist die Kapazität garantiert, mit einer Mindestlaufzeit von sechs Monaten. Eine volle B200 kostet 8,00 €/h on demand oder 5.840 € pro Monat reserviert (730 Stunden). Für längere Laufzeiten sprechen wir gern mit Ihnen.
Es ist ein hardwareseitig isolierter Teil einer B200 GPU mit eigenem Speicher und eigener Rechenleistung. MIG (Multi-Instance GPU) ist eine NVIDIA-Technologie, die die Fraktionen auf Chipebene trennt, sodass kein anderer Kunde Ihre Ressourcen sehen oder nutzen kann. Sie reicht von 1/8 (rund 23 GB) bis 1/2 (90 GB).
Ja. Sie können es auf einem dedizierten Pod mit Ihrem eigenen Image bereitstellen oder einen privaten Endpunkt anfragen, der es nur für Ihre Organisation ausliefert. Ihre Modelle und deren Gewichte bleiben Ihr Eigentum, und Sie können sie jederzeit mitnehmen.
Eine dedizierte Standardumgebung steht 72 Stunden nach Unterzeichnung bereit. Die API von GPU Flow ist Self-Service, Sie können sie also direkt nach der Registrierung nutzen.
Nein. Alle veröffentlichten Preise verstehen sich zuzüglich Mehrwertsteuer und stehen auf der Seite Preise. Zusatzleistungen (Speicher, Hochverfügbarkeit und dedizierte Konnektivität) nehmen wir je nach Fall ins Angebot auf.
Ja. Alle drei Bereiche laufen auf derselben Plattform, sodass Sie von der API auf eine dedizierte GPU oder von einer Fraktion auf einen Pod wechseln können, ohne den Anbieter zu wechseln. Ihre Daten, Modelle und Gewichte gehören jederzeit Ihnen.
Nächster Schritt
Schildern Sie uns Ihren Fall, und wir schlagen die passende Konfiguration vor.