Drive

Souveräne Managed Inference

Open-Source-Modelle per API nutzen. Behalten Sie die volle Souveränität über Ihre Daten.

  • Neueste Modelle
  • Eigene Rechenzentren
  • Keine Cloud-Act-Exposition
EU flag
Gehostet in der EU DSGVO-konform
DE flag
Made in Germany Erstklassige Infrastruktur
Datensouveränität Volle Transparenz

Unterstützte Modelle

Greifen Sie über eine einzige API auf die neuesten Open-Source-Modelle zu.

pipecat-ai logo

phonellm-alpha-1-nvfp4

By pipecat-ai

Text Generation
Inferact logo

GLM-5.3-NVFP4

By Inferact

Text Generation
Inferact logo

Qwen3.8-Flash-Next-NVFP4

By Inferact

Image-Text-to-Text
Alibaba-NLP logo

gte-multilingual-reranker-base

By Alibaba-NLP

Text Ranking
RedHatAI logo

GLM-5.3-Flash-NVFP4

By RedHatAI

Image-Text-to-Text
google logo

embeddinggemma-300m

By google

Sentence Similarity
Community logo

nemotron:latest

By Community

Text Generation
Community logo

glm:latest

By Community

Text Generation
Community logo

qwen:latest

By Community

Image-Text-to-Text

Das ist Drive

Souveräne Managed Inference mit den neuesten Open-Source-Modellen, transparenter Token-Abrechnung und OpenAI-kompatiblen APIs.

Souverän von Grund auf

Wir besitzen den gesamten Stack – vom Rack bis zur API. Eigene Rechenzentren in ganz Europa, keine gemietete Kapazität. Kein Drittanbieter-Risiko, keine Cloud-Act-Exposition.

Keine Hardware, kein Kopfzerbrechen

Wir verwalten GPUs, Orchestrierung und Updates. Sie rufen nur die API auf und liefern aus.

Token-basierte Abrechnung

Zahlen Sie nur, was Sie nutzen – transparente Token-Preise. Keine Leerlaufkapazität, keine Überraschungen.

OpenAI-kompatibel

Drop-in-kompatibel mit dem OpenAI SDK. Base-URL tauschen und bestehende Tooling beibehalten.

API

Integrieren Sie Drive in jeden Workflow

Unsere API ist auf intuitive Usability ausgelegt. Dank der vertrauten Integrationsmöglichkeit können Sie direkt loslegen.

Funktionen

Model Gateway

Online

Ein einziger OpenAI-kompatibler Endpunkt für jedes gehostete Modell. Streaming oder Batch, strukturierte JSON-Outputs, natives Function Calling.

Agentic Engine

Upcoming

Erstellen Sie Multi-Step-Agenten mit integriertem Tool-Routing, Memory und Guardrails. Retrieval, MCP und Fine-tuning integriert – keine zusätzliche Infrastruktur nötig.

Starte mit Polarise Drive

Early Access anfragen und Workload beschreiben — wir melden uns innerhalb eines Werktags.

Häufig gestellte Fragen

Antworten auf häufige Fragen zu Polarise Drive.

Wir befinden uns derzeit in einer kontrollierten Rollout-Phase. Um durchgängig stabile Latenzen und ausreichend Kapazität sicherzustellen, gewähren wir Zugang zunächst selektiv an ausgewählte Partner. Nach Anmeldung über das Formular prüfen wir Ihr Nutzungsprofil und schalten den Zugang schrittweise frei. Produktionsreife Workloads sind dabei das erklärte Ziel unseres Rollouts, nicht dessen Ausnahme.
Ja. Wir betreiben ausschließlich eigene Rechenzentren in Europa und verzichten vollständig auf angemietete oder ausgelagerte Kapazitäten Dritter. Ihre Daten verlassen die EU zu keinem Zeitpunkt, und es besteht keinerlei Abhängigkeit von externen Cloud-Anbietern.
Wir stellen eine kontinuierlich wachsende Auswahl an Open-Source-Modellen über eine einheitliche API bereit. Das Deployment eigener Fine-Tunes bzw. Custom-Checkpoints ist für eine spätere Ausbaustufe vorgesehen und derzeit in Entwicklung. Wir informieren interessierte Partner gerne, sobald erste Kapazitäten dafür zur Verfügung stehen.
Kapazität wird nicht manuell zugeteilt, sondern über automatisiertes Autoscaling auf unserer eigenen Infrastruktur bereitgestellt. Da wir den gesamten Stack – vom Rack bis zur API – selbst besitzen, können wir Kapazität unmittelbar skalieren, unabhängig von Verfügbarkeit oder Preisgestaltung eines Drittanbieters.
Diese Komponenten – RAG-Pipelines, MCP-Anbindung sowie Function-Calling- und Agenten-Support – befinden sich in aktiver Entwicklung und werden sukzessive für Partner freigeschaltet. Sofern dies für Ihren Anwendungsfall relevant ist, empfehlen wir eine entsprechende Angabe im Formularfeld „Expected Usage", um die Priorisierung zu unterstützen.