Alle Modelle, ein Endpoint

Open-Source-KI gehostet in Europa.

Ein OpenAI-kompatibler Endpoint für OpenAI, Anthropic, Kimi, GLM, Qwen und weitere Open-Source-Modelle. Nutze Frontier-Modelle und Open-Source-KI über dieselbe API.

  • OpenAI-kompatibel
  • EU-Routing bevorzugt
  • Agents als Modelle
Modelle
Alle Anbieter

Anbieter wechselst du über den Modellnamen – nicht über deinen Code.

Kimi, GLM, Qwen und mehr

State-of-the-Art-Open-Source-Modelle laufen in europäischen Rechenzentren. Proprietäre Modelle routen wir über die EU, wo der Anbieter es zulässt.

Vom SDK zur Antwort

Einrichtung in drei Schritten.

  1. 01

    API-Key erstellen

    Ein Key aus dem Dashboard gilt für jedes Modell und jeden Agent, den du auf zwrm betreibst.

  2. 02

    Client auf zwrm umstellen

    Dein OpenAI-SDK bleibt. Du änderst nur die Base-URL und wählst einen Modellnamen – oder überlässt die Wahl zwrm/auto.

  3. 03

    Routen, pinnen, delegieren

    Der Router wählt ein passendes EU-Modell, du pinnst bei Bedarf ein bestimmtes Modell – oder schickst den Prompt an einen deiner eigenen Agents.

Was du bekommst

Was der Endpoint bietet.

Ein Endpoint bedeutet: eine Rechnung, ein Satz Limits und ein Ort, an dem du siehst, was tatsächlich genutzt wird.

  • OpenAI-kompatible API

    Chat Completions, Streaming und Tool Calls laufen mit den SDKs und Frameworks, die dein Team schon nutzt.

  • EU zuerst, jedes Modell

    Open-Source-Modelle laufen in europäischen Rechenzentren. Proprietäre Modelle werden über die EU geroutet, wo der Anbieter das zulässt – und sind gekennzeichnet, wo nicht.

  • Automatisches Routing

    zwrm/auto schickt jeden Prompt an ein Modell, das dazu passt: die kurze Zusammenfassung an ein schnelles EU-Modell, das Refactoring an ein Code-Modell.

  • Pinnen, wenn es zählt

    Nenne ein Modell explizit, wenn ein bestimmter Anbieter oder eine bestimmte Fähigkeit nicht verhandelbar ist.

  • Agents als Modelle

    Sprich deine eigenen zwrm Agents an wie jedes andere Modell. Aus dem Prompt wird ein Run mit Tools, Memory und Workspace.

  • Verbrauch im Blick

    Nutzung pro Modell und pro Key im Dashboard – die Rechnung überrascht dich nie.

EU-Hosting und Self-Hosting

Gehostet in der EU. Oder bei dir.

Nutze den gemanagten Endpoint auf europäischer Infrastruktur oder betreibe das zwrm Model-Gateway im eigenen Rechenzentrum – angebunden nur an die Anbieter, die du freigibst.

Betriebsmodell besprechen
Von dir betrieben

Deine Infrastruktur

Betreibe das Gateway im eigenen Rechenzentrum oder in deiner Private Cloud und lege fest, welche Upstream-Anbieter es erreichen darf.

  • On-Premises oder Private Cloud
  • Deine Allow-List für Anbieter
  • Deine Sicherheits- und Compliance-Vorgaben
Fragen, beantwortet

Häufige Fragen zu Modellen.

Welche Modelle sind verfügbar?

Modelle von OpenAI und Anthropic sowie in Europa gehostete Open-Source-Modelle wie Kimi, GLM und Qwen. Das Dashboard listet jedes Modell mit Kontextfenster, Preis und Region.

Ist die API wirklich OpenAI-kompatibel?

Ja. Nutze das offizielle OpenAI-SDK oder ein Framework, das die Chat-Completions-API spricht. Base-URL auf zwrm ändern, zwrm API-Key eintragen, fertig.

Wo werden meine Prompts verarbeitet?

Open-Source-Modelle laufen auf europäischer Infrastruktur. Proprietäre Modelle routen wir über EU-Endpoints, wo der Anbieter sie bereitstellt. Modelle ohne EU-Hosting sind als solche gekennzeichnet, damit du sie ausschließen kannst.

Was macht zwrm/auto?

zwrm/auto wählt für jede Anfrage ein Modell, das zur Aufgabe passt, und bevorzugt dabei EU-gehostete Modelle. Brauchst du ein bestimmtes Modell, nennst du es explizit – dann hält sich der Router raus.

Wie funktionieren Agents als Modelle?

Jeder zwrm Agent ist unter seinem Namen wie ein Modell ansprechbar. Ein Prompt an ihn startet einen Run mit den Tools, dem Memory und dem Workspace des Agents – das Ergebnis kommt zurück wie eine normale Completion.

Kann ich meine eigenen Provider-Keys nutzen?

Ja. Verbinde dein bestehendes OpenAI- oder Anthropic-Konto. zwrm routet diese Modelle dann über dein Abo – und du behältst einen Endpoint für alles.

Ein API-Key, alle Modelle

Starte mit deinem API-Key.

Erstelle in wenigen Minuten einen API-Key oder sprich mit uns über Routing-Regeln, Datenstandort und Volumenpreise.