Voir sur GitHub · 174
Passerelle LLM auto-hébergée

Un seul point d'entrée devant tous les fournisseurs de LLM.

IAGA Gateway est un point d'entrée unique, compatible OpenAI, placé devant les principaux fournisseurs de LLM. Il apporte ce que les fournisseurs seuls n'offrent pas : fiabilité, maîtrise des coûts, sécurité et sûreté, conformité. Il est auto-hébergé : vous l'exécutez sur votre propre infrastructure et vous y pointez votre URL de base, sans modifier le code de votre application.

Demander un accèsAuto-hébergé
Un produit distinct

IAGA Gateway n'est pas IAGA Sentinel. Sentinel est la couche de preuve de conformité au règlement IA, qui produit une preuve signée et vérifiable hors ligne de ce que font les agents autonomes. La passerelle, elle, gouverne et optimise le trafic LLM en production. Produit différent, finalité différente. Elle est auto-hébergée : vous l'exécutez sur votre propre infrastructure et vous y pointez votre application.

Source

Votre application

n'importe quel SDK OpenAI

Passerelle

IAGA Gateway

routage · cache · sûreté · politique · audit

Fournisseurs
  • OpenAI
  • Anthropic
  • Groq
  • Google Gemini
  • OpenRouter

Ce qu'elle fait

Quatre colonnes de valeur, au-dessus du fournisseur qui répond.

01

Fiabilité

Rester disponible quand un fournisseur ne l'est pas.

  • Routage intelligent entre fournisseurs, avec bascule en cascade automatique.
  • L'auto-réparation élimine les modèles retirés et corrige les cibles de routage obsolètes.
  • Un disjoncteur (seuil de trois échecs) et un suivi de santé sur cinq minutes isolent les fournisseurs défaillants.
  • Passage direct natif lorsqu'un modèle est servi sans intermédiaire, et classification des erreurs par cause : fini les 424 opaques.
02

Maîtrise des coûts

Ne payer que les jetons réellement nécessaires.

  • Cache exact indexé sur le contexte complet de la requête (outils, format, graine, multimodal) : une correspondance signifie une requête identique.
  • Cache sémantique sur les requêtes proches via des embeddings, automatiquement contourné pour les appels d'outils, de vision et JSON.
  • Budgets par espace de travail et budgets de jetons, alertes de coût et comptage d'usage.
  • Le contrôle des appels d'outils supprime les appels superflus et chiffre l'économie aux tarifs officiels 2026.
03

Sécurité et sûreté

Des garde-fous sur la requête comme sur la réponse.

  • Une chaîne de critique résiliente (OpenRouter, puis Groq, puis OpenAI) note chaque réponse, avec mode fail-closed optionnel.
  • Expurgation des données personnelles à l'entrée comme à la sortie (sur activation).
  • Garde anti-abus d'outils : signale les schémas d'exfiltration et d'exécution de code avant le départ de l'appel.
  • Enveloppe cryptographique par espace de travail (clé de données et clé maîtresse, avec rotation) pour les identifiants fournisseurs.
  • Défenses des comptes et de l'infrastructure : MFA TOTP (argon2id), vérification HIBP des fuites, garde SSRF sur les URL, protection CSRF, sécurité au niveau des lignes, listes d'IP autorisées, détection d'anomalies.
04

Gouvernance et conformité

Apportez vos clés, gardez la piste d'audit.

  • BYOK multiclé : vos propres clés fournisseurs, plusieurs par fournisseur et par espace de travail, avec rotation et expiration.
  • Politique par espace de travail, chaque requête et chaque verdict étant inscrits au journal d'audit.
  • Observabilité via OpenTelemetry, Sentry et les métriques, avec une télémétrie _iaga.* cohérente même sur les appels bloqués.
  • Modèles de pages légales et de conformité bilingues (EN/FR) à adapter à votre propre déploiement : Trust, Security, Subprocessors, Privacy, Terms.
  • Fondations SAML et SCIM pour le SSO d'entreprise.

Le parcours d'une requête

Chaque appel traverse le même pipeline ordonné, avant et après avoir atteint un fournisseur.

  1. 01Authentification, limitation de débit, permissions et idempotence sûre au rejeu.
  2. 02Validation des charges utiles avec Zod : streaming, appels d'outils, multimodal, schéma JSON.
  3. 03Politique d'espace de travail : plafonds de jetons en sortie, mode fail-closed, application des prompts.
  4. 04Contrôle des appels d'outils : filtre heuristique, vérificateur LLM et anti-abus, avant tout appel au fournisseur.
  5. 05Routage par score, capacité et santé, avec bascule en cascade et passage direct natif.
  6. 06Cache : exact d'abord, puis sémantique.
  7. 07Critique et sûreté sur la réponse, avec expurgation des données personnelles en sortie.
  8. 08Audit et télémétrie (_iaga.*) sur chaque requête.

Se connecter en une ligne

Elle parle l'API Chat Completions d'OpenAI. Pointez votre SDK existant vers l'URL de base de votre passerelle et gardez le reste de votre code.

votre application · remplacement direct
# pointez tout SDK OpenAI vers l’URL de base de votre passerelle
base_url = "https://your-gateway.example.com/api/v1/gateway"

# rien d’autre ne change
POST /api/v1/gateway/chat-completions
API
POST /api/v1/gateway/chat-completions, un point d'entrée compatible OpenAI en remplacement direct.
Tableau de bord
Une console monopage : clés d'API, fournisseurs et BYOK, routage, politique, prompts, budgets, facturation, traitement par lots, webhooks, requêtes et bac à sable.
SDK
Paquets Node et Python.

Fournisseurs

OpenAI · Anthropic · Groq · Google Gemini · OpenRouter

Stack

Next.js 14 (App Router) · TypeScript · Prisma + Postgres (Neon) · Upstash Redis · workers BullMQ · facturation Stripe · e-mails Resend · Sentry + OpenTelemetry.

v1.0.1Auto-hébergé

Auto-hébergée et compatible OpenAI. Chaque sous-système présenté sur cette page est implémenté et fonctionne dans notre propre déploiement.

Obtenir un accès.

Dites-nous où vous joindre et nous vous aiderons à faire tourner la passerelle auto-hébergée sur votre propre infrastructure. Aucun démarchage, désinscription à tout moment.

En vous abonnant, vous consentez à recevoir des nouvelles d'IAGA Sentinel par e-mail, acheminées via Resend. Aucune revente, désinscription à tout moment. Voir notre politique de confidentialité.

Vous préférez l'e-mail ? info@iaga.tech