Inférence souveraine · Hébergée par DEEP · Luxembourg

Tous les modèles ouverts. Un endpoint souverain.

BreignHUB donne à vos applications une API unique, compatible OpenAI, vers les modèles à poids ouverts que DEEP opère dans ses centres de données Tier IV au Luxembourg. Vos prompts restent dans le pays. Vos données ne servent jamais à l’entraînement.

7
modèles en ligne
100 %
d’inférence au Luxembourg
0
prompt conservé
chat_completions.sh
curl https://hub.breign.eu/api/v1/chat/completions \
  -H "Authorization: Bearer $BREIGNHUB_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mistral-large-3",
    "messages": [
      { "role": "user",
        "content": "Summarise this supplier contract." }
    ]
  }'
Votre SDK. Une URL de base.200 OK

SDK OpenAI

Chat, modèles, embeddings

/v1

Chat · Embeddings · Audio

Infrastructure, sécurité et conformité par DEEP · POST Luxembourg

  • Centres de données Tier IV
  • ISO 27001
  • ISO 27701
  • CSSF-ready
  • RGPD · AI Act

Un seul endpoint

Tout ce que votre produit demande à un modèle

Chat, code, documents, recherche et voix — servis depuis la même URL de base authentifiée, facturés sur la même facture, tracés dans le même journal d’audit.

  • Chat et raisonnement

    Modèles à poids ouverts de premier plan avec raisonnement étendu, de l’assistant 7B au mélange d’experts de plus de 400B.

  • Code et agents

    Modèles de code à contexte long, avec appel d’outils natif et sortie structurée pour les runtimes d’agents.

  • Vision et documents

    OCR, extraction de tableaux et compréhension de page pour contrats, factures et archives numérisées.

  • Embeddings et reranking

    Vecteurs multilingues et cross-encodeurs pour des pipelines RAG qui doivent rester dans le périmètre.

  • Voix et transcription

    Transcription de réunions et d’appels en français, allemand, anglais et luxembourgeois, avec séparation des locuteurs.

  • Capacité dédiée

    Réservez des GPU pour un modèle qui n’appartient qu’à vous — poids affinés, débit garanti, prix fixe.

Souveraineté

Votre prompt est calculé au Luxembourg. Point.

Pas « région UE ». Pas « traité en Europe dans la mesure du possible ». Les GPU sont dans les centres de données Tier IV de DEEP, sur le sol luxembourgeois, exploités par une société détenue par l’État luxembourgeois. Aucune requête ne quitte le bâtiment.

  • Aucun entraînement sur vos données

    Prompts et réponses sont détruits à la fin de la requête. La rétention zéro est le comportement par défaut, pas une option entreprise.

  • Chiffré de bout en bout

    TLS 1.3 en transit, clés gérées dans le HSM de DEEP. Connectivité privée disponible sur les liens POST Telecom.

  • Auditable par construction

    Journaux d’accès signés et immuables, remettables à la CSSF ou à une autorité de protection des données sans projet d’investigation.

  • Aligné sur l’AI Act

    Fiches modèle, provenance et versionnage publiés pour chaque endpoint : votre dossier de conformité s’écrit tout seul.

Migration

Une URL de base de plus pour votre client OpenAI

BreignHUB expose une véritable surface compatible OpenAI — complétions de chat en streaming, liste de modèles, embeddings — et la traduit vers la passerelle Breign de votre organisation. Votre SDK, votre chaîne LangChain ou votre framework d’agents continue de fonctionner.

  • Complétions en streaming, liste de modèles et embeddings, au format OpenAI
  • Les champs que la passerelle ne peut pas honorer sont refusés avec une erreur nommée, jamais ignorés en silence
  • Une clé porte votre organisation ; révoquez-la depuis le tableau de bord et elle cesse de fonctionner
from openai import OpenAI

client = OpenAI(
    base_url="https://hub.breign.eu/api/v1",
    api_key=os.environ["BREIGNHUB_API_KEY"],
)

resp = client.chat.completions.create(
    model="mistral-large-3",
    messages=[
        {"role": "system", "content": "You are a compliance analyst."},
        {"role": "user", "content": "List the termination clauses."},
    ],
    stream=True,
)

Une brique de la plateforme BREIGN

Les modèles bruts ici. La gouvernance, les agents et la supervision humaine à côté.

BreignHUB est la couche d’inférence. Quand il vous faut du filtrage de prompts, des workflows de validation, du RAG sur vos propres référentiels ou des agents supervisés, le même compte ouvre BREIGN — la plateforme agentique souveraine bâtie sur la même infrastructure.

BREIGN Studio

Construire et superviser des agents

BreignMate

L’assistant que vos équipes utilisent au quotidien

Découvrir BREIGN

Tarifs

Au token, à l’heure de GPU, ou à l’année

Facturé en euros par une entité luxembourgeoise. Pas de frais de sortie, aucun engagement minimum sur l’offre à l’usage.

  • À l’usage

    En autonomie. Vous ajoutez une carte, vous récupérez une clé, vous streamez des tokens en moins de deux minutes.

    Sur demande

    par million de tokens

    Créer un compte
  • Business

    Le plus choisi

    Tarifs au volume, quotas par projet, facturation et contrat de sous-traitance signé avec DEEP.

    Sur demande

    par mois

    Contacter l’équipe commerciale
  • Dédié

    GPU réservés, vos poids affinés, débit garanti et connectivité privée.

    Sur demande

    par heure de GPU

    Parler à un architecte

Votre première complétion souveraine, cet après-midi

Crédits offerts à l’inscription. Aucun rendez-vous commercial pour démarrer.