Tous les modèles ouverts.
Un endpoint souverain.
BreignHUB donne à vos applications une API unique, compatible OpenAI, vers les modèles à poids ouverts que DEEP opère dans ses centres de données Tier IV au Luxembourg. Vos prompts restent dans le pays. Vos données ne servent jamais à l’entraînement.
- 7
- modèles en ligne
- 100 %
- d’inférence au Luxembourg
- 0
- prompt conservé
curl https://hub.breign.eu/api/v1/chat/completions \ -H "Authorization: Bearer $BREIGNHUB_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "mistral-large-3", "messages": [ { "role": "user", "content": "Summarise this supplier contract." } ] }'
SDK OpenAI
Chat, modèles, embeddings
/v1
Chat · Embeddings · Audio
Infrastructure, sécurité et conformité par DEEP · POST Luxembourg
- Centres de données Tier IV
- ISO 27001
- ISO 27701
- CSSF-ready
- RGPD · AI Act
Un seul endpoint
Tout ce que votre produit demande à un modèle
Chat, code, documents, recherche et voix — servis depuis la même URL de base authentifiée, facturés sur la même facture, tracés dans le même journal d’audit.
Chat et raisonnement
Modèles à poids ouverts de premier plan avec raisonnement étendu, de l’assistant 7B au mélange d’experts de plus de 400B.
Code et agents
Modèles de code à contexte long, avec appel d’outils natif et sortie structurée pour les runtimes d’agents.
Vision et documents
OCR, extraction de tableaux et compréhension de page pour contrats, factures et archives numérisées.
Embeddings et reranking
Vecteurs multilingues et cross-encodeurs pour des pipelines RAG qui doivent rester dans le périmètre.
Voix et transcription
Transcription de réunions et d’appels en français, allemand, anglais et luxembourgeois, avec séparation des locuteurs.
Capacité dédiée
Réservez des GPU pour un modèle qui n’appartient qu’à vous — poids affinés, débit garanti, prix fixe.
Le catalogue
7 modèles en production aujourd’hui
Uniquement des poids ouverts — aucune API fermée n’est relayée. Chaque modèle est déployé, mis à jour et supervisé par DEEP : vous pouvez figer une version et la garder aussi longtemps que nécessaire.
- DEEP Inférence (test)en ligne
GPT-OSS-20B
83ea51b2-415e-481d-ad1a-df458ea9c6a7/GPT-OSS-20B
128k— - InTech Inférence (DGX)en ligne
ministral-3:14b
068be9d9-08d6-470b-a651-585be199cb2e/ministral-3:14b
128k— - InTech Inférence (DGX)en ligne
mistral-small:24b
068be9d9-08d6-470b-a651-585be199cb2e/mistral-small:24b
128k— - InTech Inférence (DGX)en ligne
qwen2.5vl:7b
068be9d9-08d6-470b-a651-585be199cb2e/qwen2.5vl:7b
128k— - InTech Inférence (DGX) OpenAI Compatibleen ligne
qwen2.5vl:7b
c60ac544-e4f4-48c0-8031-2d4faec0583e/qwen2.5vl:7b
128k— - InTech Inférence (DGX)en ligne
qwen3-vl:30b
068be9d9-08d6-470b-a651-585be199cb2e/qwen3-vl:30b
128k— - DEEP Inférence (test)en ligne
Qwen3.6-35B-A3B
83ea51b2-415e-481d-ad1a-df458ea9c6a7/Qwen3.6-35B-A3B
128k—
Souveraineté
Votre prompt est calculé au Luxembourg. Point.
Pas « région UE ». Pas « traité en Europe dans la mesure du possible ». Les GPU sont dans les centres de données Tier IV de DEEP, sur le sol luxembourgeois, exploités par une société détenue par l’État luxembourgeois. Aucune requête ne quitte le bâtiment.
Aucun entraînement sur vos données
Prompts et réponses sont détruits à la fin de la requête. La rétention zéro est le comportement par défaut, pas une option entreprise.
Chiffré de bout en bout
TLS 1.3 en transit, clés gérées dans le HSM de DEEP. Connectivité privée disponible sur les liens POST Telecom.
Auditable par construction
Journaux d’accès signés et immuables, remettables à la CSSF ou à une autorité de protection des données sans projet d’investigation.
Aligné sur l’AI Act
Fiches modèle, provenance et versionnage publiés pour chaque endpoint : votre dossier de conformité s’écrit tout seul.
Migration
Une URL de base de plus pour votre client OpenAI
BreignHUB expose une véritable surface compatible OpenAI — complétions de chat en streaming, liste de modèles, embeddings — et la traduit vers la passerelle Breign de votre organisation. Votre SDK, votre chaîne LangChain ou votre framework d’agents continue de fonctionner.
- Complétions en streaming, liste de modèles et embeddings, au format OpenAI
- Les champs que la passerelle ne peut pas honorer sont refusés avec une erreur nommée, jamais ignorés en silence
- Une clé porte votre organisation ; révoquez-la depuis le tableau de bord et elle cesse de fonctionner
from openai import OpenAI client = OpenAI( base_url="https://hub.breign.eu/api/v1", api_key=os.environ["BREIGNHUB_API_KEY"], ) resp = client.chat.completions.create( model="mistral-large-3", messages=[ {"role": "system", "content": "You are a compliance analyst."}, {"role": "user", "content": "List the termination clauses."}, ], stream=True, )
Une brique de la plateforme BREIGN
Les modèles bruts ici. La gouvernance, les agents et la supervision humaine à côté.
BreignHUB est la couche d’inférence. Quand il vous faut du filtrage de prompts, des workflows de validation, du RAG sur vos propres référentiels ou des agents supervisés, le même compte ouvre BREIGN — la plateforme agentique souveraine bâtie sur la même infrastructure.
BREIGN Studio
Construire et superviser des agents
BreignMate
L’assistant que vos équipes utilisent au quotidien
Tarifs
Au token, à l’heure de GPU, ou à l’année
Facturé en euros par une entité luxembourgeoise. Pas de frais de sortie, aucun engagement minimum sur l’offre à l’usage.
À l’usage
En autonomie. Vous ajoutez une carte, vous récupérez une clé, vous streamez des tokens en moins de deux minutes.
Sur demandepar million de tokens
Créer un compteBusiness
Le plus choisiTarifs au volume, quotas par projet, facturation et contrat de sous-traitance signé avec DEEP.
Sur demandepar mois
Contacter l’équipe commercialeDédié
GPU réservés, vos poids affinés, débit garanti et connectivité privée.
Sur demandepar heure de GPU
Parler à un architecte
Votre première complétion souveraine, cet après-midi
Crédits offerts à l’inscription. Aucun rendez-vous commercial pour démarrer.