Souveräne Inferenz · Gehostet von DEEP · Luxemburg

Alle offenen Modelle. Ein souveräner Endpoint.

BreignHUB gibt Ihren Anwendungen eine einzige OpenAI-kompatible API zu den Open-Weight-Modellen, die DEEP in seinen Tier-IV-Rechenzentren in Luxemburg betreibt. Ihre Prompts bleiben im Land. Ihre Daten werden nie für Training verwendet.

7
Modelle online
100 %
Inferenz in Luxemburg
0
gespeicherte Prompts
chat_completions.sh
curl https://hub.breign.eu/api/v1/chat/completions \
  -H "Authorization: Bearer $BREIGNHUB_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mistral-large-3",
    "messages": [
      { "role": "user",
        "content": "Summarise this supplier contract." }
    ]
  }'
Ihr SDK. Eine Basis-URL.200 OK

OpenAI SDK

Chat, Modelle, Embeddings

/v1

Chat · Embeddings · Audio

Infrastruktur, Sicherheit und Compliance durch DEEP · POST Luxembourg

  • Tier-IV-Rechenzentren
  • ISO 27001
  • ISO 27701
  • CSSF-ready
  • DSGVO · AI Act

Ein Endpoint

Alles, was Ihr Produkt von einem Modell verlangt

Chat, Code, Dokumente, Retrieval und Sprache — ausgeliefert über dieselbe authentifizierte Basis-URL, abgerechnet auf derselben Rechnung, protokolliert im selben Audit-Log.

  • Chat und Reasoning

    Führende Open-Weight-Modelle mit erweitertem Reasoning, vom 7B-Assistenten bis zum Mixture-of-Experts jenseits von 400B.

  • Code und Agenten

    Coding-Modelle mit langem Kontext, nativem Tool Calling und strukturierter Ausgabe für Agent-Runtimes.

  • Vision und Dokumente

    OCR, Tabellenextraktion und Seitenverständnis für Verträge, Rechnungen und gescannte Archive.

  • Embeddings und Reranking

    Mehrsprachige Vektoren und Cross-Encoder für RAG-Pipelines, die im Perimeter bleiben müssen.

  • Sprache und Transkription

    Transkription von Meetings und Anrufen auf Französisch, Deutsch, Englisch und Luxemburgisch, mit Sprechertrennung.

  • Dedizierte Kapazität

    Reservieren Sie GPUs für ein Modell, das nur Ihnen gehört — feinabgestimmte Gewichte, fester Durchsatz, fester Preis.

Souveränität

Ihr Prompt wird in Luxemburg berechnet. Punkt.

Nicht „EU-Region“. Nicht „nach Möglichkeit in Europa verarbeitet“. Die GPUs stehen in den Tier-IV-Rechenzentren von DEEP auf luxemburgischem Boden, betrieben von einem Unternehmen im Eigentum des luxemburgischen Staates. Keine Anfrage verlässt das Gebäude.

  • Kein Training mit Ihren Daten

    Prompts und Antworten werden am Ende der Anfrage verworfen. Zero Retention ist die Voreinstellung, kein Enterprise-Aufpreis.

  • Ende-zu-Ende verschlüsselt

    TLS 1.3 im Transit, Schlüssel im HSM von DEEP verwaltet. Private Anbindung über POST-Telecom-Leitungen möglich.

  • Prüfbar by design

    Signierte, unveränderliche Zugriffsprotokolle, die Sie der CSSF oder einer Datenschutzbehörde ohne Aufarbeitungsprojekt übergeben können.

  • AI-Act-konform ausgerichtet

    Modellkarten, Provenienz und Versionierung für jeden Endpoint veröffentlicht — Ihre eigene Konformitätsakte schreibt sich fast von selbst.

Migration

Eine Basis-URL mehr für Ihren OpenAI-Client

BreignHUB bietet eine echte OpenAI-kompatible Oberfläche — Chat Completions mit Streaming, Modellliste, Embeddings — und übersetzt sie auf die Breign-Gateway Ihrer Organisation. Ihr SDK, Ihre LangChain-Kette oder Ihr Agent-Framework läuft weiter.

  • Streaming-Completions, Modellliste und Embeddings im OpenAI-Format
  • Felder, die die Gateway nicht erfüllen kann, werden mit benanntem Fehler abgelehnt, nie stillschweigend verworfen
  • Ein Schlüssel trägt Ihre Organisation; widerrufen Sie ihn im Dashboard, und er funktioniert nicht mehr
from openai import OpenAI

client = OpenAI(
    base_url="https://hub.breign.eu/api/v1",
    api_key=os.environ["BREIGNHUB_API_KEY"],
)

resp = client.chat.completions.create(
    model="mistral-large-3",
    messages=[
        {"role": "system", "content": "You are a compliance analyst."},
        {"role": "user", "content": "List the termination clauses."},
    ],
    stream=True,
)

Teil der BREIGN-Plattform

Die reinen Modelle hier. Governance, Agenten und menschliche Aufsicht nebenan.

BreignHUB ist die Inferenzschicht. Wenn Sie Prompt-Filterung, Freigabe-Workflows, RAG über Ihre eigenen Bestände oder beaufsichtigte Agenten brauchen, öffnet dasselbe Konto BREIGN — die souveräne agentische Plattform auf derselben Infrastruktur.

BREIGN Studio

Agenten bauen und beaufsichtigen

BreignMate

Der Assistent für den Arbeitsalltag Ihrer Teams

BREIGN entdecken

Preise

Pro Token, pro GPU-Stunde oder pro Jahr

In Euro abgerechnet von einer luxemburgischen Gesellschaft. Keine Egress-Gebühren, keine Mindestbindung im nutzungsbasierten Tarif.

  • Nutzungsbasiert

    Selbstbedienung. Karte hinterlegen, Schlüssel erhalten, in unter zwei Minuten Tokens streamen.

    Auf Anfrage

    pro 1 Mio. Tokens

    Konto erstellen
  • Business

    Am häufigsten gewählt

    Volumentarife, Kontingente pro Projekt, Rechnungsstellung und ein unterzeichneter Auftragsverarbeitungsvertrag mit DEEP.

    Auf Anfrage

    pro Monat

    Vertrieb kontaktieren
  • Dediziert

    Reservierte GPUs, Ihre feinabgestimmten Gewichte, garantierter Durchsatz und private Anbindung.

    Auf Anfrage

    pro GPU-Stunde

    Mit einem Architekten sprechen

Ihre erste souveräne Completion noch heute Nachmittag

Startguthaben bei der Registrierung. Kein Vertriebsgespräch nötig, um loszulegen.