Keera Gateway

Un point d'accès pour chaque modèle de l'entreprise

Entre vos équipes et tous les LLM se trouve une seule base URL : les modèles de Keera, vos propres fine-tunes et les fournisseurs externes là où la politique l'autorise. Politiques, budgets et audit au même endroit.

Essayer Keera Voir Keera Engine ➔

Keera franchit un portail lumineux

Comment ça marche

Tout ce qui appelle un modèle chez vous pointe vers la même adresse. La passerelle vérifie chaque requête, l'écrit au journal et la transmet.

Vos outils

  • Agent de code dans le terminal et dans l'IDE
  • Applications internes et copilotes
  • Notebooks et jobs CI

Keera Gateway

  1. Identité et équipe depuis votre IdP
  2. Vérifier politique, quota et budget
  3. Masquer secrets et données personnelles
  4. Router vers le modèle autorisé

Modèles

  • Modèles ouverts sur Keera Engine en Suisse
  • Vos fine-tunes et clusters sur site
  • Fournisseurs externes, ouverts par politique

Chaque requête dans le journal d'audit et dans votre SIEM

Compatible OpenAI et Anthropic : les SDK et agents existants basculent avec une seule variable d'environnement.

Quatre choses qu'elle contrôle

Un point d'accès qui vous appartient - et quatre décisions qu'il prend pour chaque requête.

Fin du shadow AI

Bloquez la sortie directe au proxy : chaque requête IA de l'entreprise devient visible.

Une politique par équipe

Quels modèles et quelles classes de données une équipe ou une clé API peut atteindre : écrit comme une politique versionnée, appliquée à chaque requête.

Des coûts attribuables

Dépenses par équipe, clé API et centre de coûts, avec des limites de budget fermes et une alerte avant la facture.

Audit et masquage

Secrets et données personnelles tombent en périphérie. Qui, quel modèle, combien de tokens et quelle décision partent, immuables, vers votre SIEM - le prompt lui-même, non.

Interface web ou CLI, le même contrôle

Vous administrez la passerelle depuis une interface web qui ne cache rien : politiques, budgets, équipes, modèles et chaque session sont à quelques clics. Si vous préférez taper ou automatiser, prenez la CLI keera - même portée, scriptable, prête pour votre pipeline. Les deux écrivent la même politique versionnée : ce que vous cliquez dans le navigateur, la CLI le lit - et inversement.

Et comme chaque requête passe par le même point d'accès, vous voyez enfin ce que votre entreprise fait vraiment avec les LLM. La carte en direct trace une ligne là où une requête quitte votre réseau et montre combien de tokens et de francs finissent dehors. Tokens, coûts et requêtes refusées par équipe, modèle et période sont dans le navigateur ou en CSV pour vos propres analyses.

La carte en direct de l'interface web de Keera Gateway
L'interface web de Keera Gateway. Les valeurs proviennent d'une instance de démonstration.

Fonctionnalités

La passerelle est plus qu'un proxy. Voici quelques-unes de ses fonctionnalités les plus puissantes - chacune dans l'interface web et dans la CLI.

Garde-fous

Modèles autorisés, limites de débit et budgets - par organisation, équipe et clé. Versionnés, vérifiés à chaque requête, refusés en cas de doute.

Filtres intelligents

Un petit modèle lit chaque requête et en retire secrets, noms de clients et données personnelles - ou l'arrête. On mesure d'abord en mode ombre, puis on applique.

Routeurs intelligents

Un petit modèle choisit qui répond : le modèle local rapide pour les petites retouches, le grand seulement quand la tâche l'exige.

Carte en direct

Clients, passerelle et modèles en image, avec une ligne en travers : au-dessus, ce qui reste sur votre réseau ; en dessous, ce qui en sort. Les requêtes la traversent en direct.

Bacs à sable d'agents

La passerelle offre aux agents des conteneurs isolés : comme environnement de développement ou pour un pipeline CI. À l'intérieur, ils n'atteignent que ce dont ils ont vraiment besoin.

SSO et rôles

Connexion via votre propre fournisseur d'identité, droits issus de vos groupes d'annuaire. Chaque modification passe dans le journal d'audit.

Questions fréquentes

Ce que les équipes nous demandent le plus souvent avant de mettre la passerelle en place.

Stockez-vous mes prompts ?

Non. Ni le prompt ni la réponse du modèle ne sont conservés : le contenu passe, puis il a disparu. Ce qui est enregistré, c'est la requête elle-même : qui, quand, quel modèle, combien de tokens, quelle décision. C'est de là que viennent les coûts par équipe et la traçabilité, et ce journal reste dans votre infrastructure.

Est-ce que cela nous rend plus sûrs ?

Oui, surtout grâce aux clés. Les clés d'API de tous les modèles sont réunies au même endroit, au lieu d'être dispersées dans des fichiers .env, des secrets de CI et des portables. Vous les accordez par équipe et vous les révoquez à un seul endroit. Vos applications ne voient jamais la vraie clé.

Est-ce que cela m'aide pour le règlement européen sur l'IA ?

Oui. Le règlement vous demande de montrer ce que votre entreprise fait avec l'IA. La passerelle journalise chaque requête avec l'identité, le modèle et la décision, et vous montre l'usage et les coûts par équipe. Les preuves sont là quand on vous les demande. Le travail de conformité, lui, reste le vôtre.

En quoi se distingue-t-elle des autres passerelles IA ?

D'autres savent router les requêtes, et en open source cela ne coûte rien. Trois choses ne viennent pas avec. Nous exploitons la passerelle dans des centres de données suisses, vous avez un support entreprise directement chez nous avec un interlocuteur en Suisse, et les modèles Keera se trouvent derrière elle dès le premier jour. Rien de tout cela n'exige un client particulier ni une bibliothèque maison : vos outils continuent de parler les API qu'ils parlent déjà, et vous changez une seule URL de base. C'est ce qui vous garde indépendants - de nous aussi. Vous pouvez lire le code source sur GitHub.

Est-ce que Claude Code fonctionne avec ?

Oui. La passerelle parle l'API OpenAI et l'API Anthropic. Claude Code, votre propre agent, une application interne ou un notebook pointent vers l'URL de base de la passerelle et continuent comme avant.

Est-ce que cela ajoute de la latence ?

Très peu. Le passage par la politique, le budget et le journal coûte des microsecondes - à côté d'une réponse de modèle qui prend des secondes, personne ne le remarque. Seuls les filtres intelligents et les routeurs intelligents ajoutent un petit appel de modèle, et c'est vous qui les activez.

Est-elle légère ?

Oui. Elle consomme très peu de mémoire et elle est rapide. Pas de runtime lourd, pas de batterie de services devant elle - vous la posez à côté de vos applications sans construire une plateforme pour elle.

Est-elle cloud native ?

Oui, le cloud et Kubernetes sont sa maison. Elle tourne en conteneur, passe à l'échelle horizontalement et prend sa configuration dans le cluster. Dans votre cloud, dans votre cluster ou dans votre propre centre de données, c'est le même logiciel.

Essayer Keera

Nous mettons une équipe sur la passerelle et vous montrons quels modèles elle utilise et ce que cela coûte. Après 30 jours, c'est vous qui décidez.

Intérêt pour
Nous utilisons vos données uniquement pour répondre à cette demande.