Alle offenen Modelle.
Ein souveräner Endpoint.
BreignHUB gibt Ihren Anwendungen eine einzige OpenAI-kompatible API zu den Open-Weight-Modellen, die DEEP in seinen Tier-IV-Rechenzentren in Luxemburg betreibt. Ihre Prompts bleiben im Land. Ihre Daten werden nie für Training verwendet.
- 7
- Modelle online
- 100 %
- Inferenz in Luxemburg
- 0
- gespeicherte Prompts
curl https://hub.breign.eu/api/v1/chat/completions \ -H "Authorization: Bearer $BREIGNHUB_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "mistral-large-3", "messages": [ { "role": "user", "content": "Summarise this supplier contract." } ] }'
OpenAI SDK
Chat, Modelle, Embeddings
/v1
Chat · Embeddings · Audio
Infrastruktur, Sicherheit und Compliance durch DEEP · POST Luxembourg
- Tier-IV-Rechenzentren
- ISO 27001
- ISO 27701
- CSSF-ready
- DSGVO · AI Act
Ein Endpoint
Alles, was Ihr Produkt von einem Modell verlangt
Chat, Code, Dokumente, Retrieval und Sprache — ausgeliefert über dieselbe authentifizierte Basis-URL, abgerechnet auf derselben Rechnung, protokolliert im selben Audit-Log.
Chat und Reasoning
Führende Open-Weight-Modelle mit erweitertem Reasoning, vom 7B-Assistenten bis zum Mixture-of-Experts jenseits von 400B.
Code und Agenten
Coding-Modelle mit langem Kontext, nativem Tool Calling und strukturierter Ausgabe für Agent-Runtimes.
Vision und Dokumente
OCR, Tabellenextraktion und Seitenverständnis für Verträge, Rechnungen und gescannte Archive.
Embeddings und Reranking
Mehrsprachige Vektoren und Cross-Encoder für RAG-Pipelines, die im Perimeter bleiben müssen.
Sprache und Transkription
Transkription von Meetings und Anrufen auf Französisch, Deutsch, Englisch und Luxemburgisch, mit Sprechertrennung.
Dedizierte Kapazität
Reservieren Sie GPUs für ein Modell, das nur Ihnen gehört — feinabgestimmte Gewichte, fester Durchsatz, fester Preis.
Der Katalog
7 Modelle heute im Betrieb
Ausschließlich offene Gewichte — keine geschlossene API wird durchgereicht. Jedes Modell wird von DEEP bereitgestellt, gepatcht und überwacht: Sie können eine Version festschreiben und so lange behalten, wie Sie sie brauchen.
- DEEP Inférence (test)online
GPT-OSS-20B
83ea51b2-415e-481d-ad1a-df458ea9c6a7/GPT-OSS-20B
128k— - InTech Inférence (DGX)online
ministral-3:14b
068be9d9-08d6-470b-a651-585be199cb2e/ministral-3:14b
128k— - InTech Inférence (DGX)online
mistral-small:24b
068be9d9-08d6-470b-a651-585be199cb2e/mistral-small:24b
128k— - InTech Inférence (DGX)online
qwen2.5vl:7b
068be9d9-08d6-470b-a651-585be199cb2e/qwen2.5vl:7b
128k— - InTech Inférence (DGX) OpenAI Compatibleonline
qwen2.5vl:7b
c60ac544-e4f4-48c0-8031-2d4faec0583e/qwen2.5vl:7b
128k— - InTech Inférence (DGX)online
qwen3-vl:30b
068be9d9-08d6-470b-a651-585be199cb2e/qwen3-vl:30b
128k— - DEEP Inférence (test)online
Qwen3.6-35B-A3B
83ea51b2-415e-481d-ad1a-df458ea9c6a7/Qwen3.6-35B-A3B
128k—
Souveränität
Ihr Prompt wird in Luxemburg berechnet. Punkt.
Nicht „EU-Region“. Nicht „nach Möglichkeit in Europa verarbeitet“. Die GPUs stehen in den Tier-IV-Rechenzentren von DEEP auf luxemburgischem Boden, betrieben von einem Unternehmen im Eigentum des luxemburgischen Staates. Keine Anfrage verlässt das Gebäude.
Kein Training mit Ihren Daten
Prompts und Antworten werden am Ende der Anfrage verworfen. Zero Retention ist die Voreinstellung, kein Enterprise-Aufpreis.
Ende-zu-Ende verschlüsselt
TLS 1.3 im Transit, Schlüssel im HSM von DEEP verwaltet. Private Anbindung über POST-Telecom-Leitungen möglich.
Prüfbar by design
Signierte, unveränderliche Zugriffsprotokolle, die Sie der CSSF oder einer Datenschutzbehörde ohne Aufarbeitungsprojekt übergeben können.
AI-Act-konform ausgerichtet
Modellkarten, Provenienz und Versionierung für jeden Endpoint veröffentlicht — Ihre eigene Konformitätsakte schreibt sich fast von selbst.
Migration
Eine Basis-URL mehr für Ihren OpenAI-Client
BreignHUB bietet eine echte OpenAI-kompatible Oberfläche — Chat Completions mit Streaming, Modellliste, Embeddings — und übersetzt sie auf die Breign-Gateway Ihrer Organisation. Ihr SDK, Ihre LangChain-Kette oder Ihr Agent-Framework läuft weiter.
- Streaming-Completions, Modellliste und Embeddings im OpenAI-Format
- Felder, die die Gateway nicht erfüllen kann, werden mit benanntem Fehler abgelehnt, nie stillschweigend verworfen
- Ein Schlüssel trägt Ihre Organisation; widerrufen Sie ihn im Dashboard, und er funktioniert nicht mehr
from openai import OpenAI client = OpenAI( base_url="https://hub.breign.eu/api/v1", api_key=os.environ["BREIGNHUB_API_KEY"], ) resp = client.chat.completions.create( model="mistral-large-3", messages=[ {"role": "system", "content": "You are a compliance analyst."}, {"role": "user", "content": "List the termination clauses."}, ], stream=True, )
Teil der BREIGN-Plattform
Die reinen Modelle hier. Governance, Agenten und menschliche Aufsicht nebenan.
BreignHUB ist die Inferenzschicht. Wenn Sie Prompt-Filterung, Freigabe-Workflows, RAG über Ihre eigenen Bestände oder beaufsichtigte Agenten brauchen, öffnet dasselbe Konto BREIGN — die souveräne agentische Plattform auf derselben Infrastruktur.
BREIGN Studio
Agenten bauen und beaufsichtigen
BreignMate
Der Assistent für den Arbeitsalltag Ihrer Teams
Preise
Pro Token, pro GPU-Stunde oder pro Jahr
In Euro abgerechnet von einer luxemburgischen Gesellschaft. Keine Egress-Gebühren, keine Mindestbindung im nutzungsbasierten Tarif.
Nutzungsbasiert
Selbstbedienung. Karte hinterlegen, Schlüssel erhalten, in unter zwei Minuten Tokens streamen.
Auf Anfragepro 1 Mio. Tokens
Konto erstellenBusiness
Am häufigsten gewähltVolumentarife, Kontingente pro Projekt, Rechnungsstellung und ein unterzeichneter Auftragsverarbeitungsvertrag mit DEEP.
Auf Anfragepro Monat
Vertrieb kontaktierenDediziert
Reservierte GPUs, Ihre feinabgestimmten Gewichte, garantierter Durchsatz und private Anbindung.
Auf Anfragepro GPU-Stunde
Mit einem Architekten sprechen
Ihre erste souveräne Completion noch heute Nachmittag
Startguthaben bei der Registrierung. Kein Vertriebsgespräch nötig, um loszulegen.