Filtrez ce qui entre et ce qui sort de vos LLMs
Règles par mots, expressions régulières ou longueur maximale, appliquées à l’entrée (avant l’appel provider) et à la sortie (y compris en streaming). Chaque règle bloque la requête ou la signale dans vos traces — configurable sans redéploiement.
- Atout
- Input & output
- Atout
- Word · regex · longueur
- Atout
- Block ou flag
{
"target": "output",
"kind": "regex",
"pattern": "\\b[A-Z0-9._%+-]+@[A-Z0-9.-]+\\.[A-Z]{2,}\\b",
"action": "block",
"description": "Aucune adresse email dans les réponses"
}Ce que ça change
Guardrails, en pratique.
Filtrage en entrée
Les prompts interdits sont rejetés avant l’appel provider : rien n’est envoyé, rien n’est facturé.
Filtrage en sortie, même en streaming
Les réponses sont évaluées au fil de l’eau — une fuite de donnée est stoppée avant d’atteindre le client.
Block ou flag
Bloquez net (400 au client) ou laissez passer en signalant : le flag apparaît en header et dans les traces.
Fail-open par design
Une règle mal formée est loggée et ignorée — vos guardrails ne casseront jamais le trafic légitime.
Comment ça marche
Une règle de guardrail, en clair
- 1Créez vos règlesMots interdits, regex (données personnelles, secrets…), longueur maximale — par organisation.
- 2Choisissez la sévéritéblock pour arrêter net, flag pour observer d’abord et durcir ensuite, règle par règle.
- 3Auditez dans les tracesChaque déclenchement est visible : quelle règle, quelle requête, quelle action. Ajustez en continu.
Déclarez la cible, le type et l’action. La règle s’applique à la requête suivante, sans redéploiement.
{
"target": "output",
"kind": "regex",
"pattern": "\\b[A-Z0-9._%+-]+@[A-Z0-9.-]+\\.[A-Z]{2,}\\b",
"action": "block",
"description": "Aucune adresse email dans les réponses"
}Explorez les autres fonctionnalités
Assistants & RAG
Uploadez vos documents dans un contexte, liez-le à un assistant : les réponses s’appuient sur vos données. Chaque assistant a son modèle, son prompt système, ses coûts tracés — et peut être exposé en widget de chat sur votre site.
Chatbots embarquables
Exposez n’importe quel assistant en widget de chat sur votre site ou celui de vos clients : une clé publique, une vérification d’origine, un rate limit par visiteur. Le trafic du widget est tracé et facturé comme le reste de votre usage.
A/B testing
Sonnet ou GPT-4o pour votre support ? Un nouveau prompt système fait-il mieux ? Répartissez le trafic entre deux variantes, mesurez coût, latence et feedback utilisateur, puis basculez la meilleure — sans déploiement.
Routing intelligent
Chaque clé API porte une stratégie — cheapest, fastest, balanced ou quality — une allowlist de modèles et un budget. Latenza sélectionne le meilleur candidat à chaque appel, sans changer une ligne dans votre code applicatif.