Un chatbot sur votre site, en une balise script
Exposez n’importe quel assistant en widget de chat sur votre site ou celui de vos clients : une clé publique, une vérification d’origine, un rate limit par visiteur. Le trafic du widget est tracé et facturé comme le reste de votre usage.
- Atout
- 1 balise script
- Atout
- Clé publique + origine vérifiée
- Atout
- 10 req/min/visiteur
<script
src="https://cdn.latenza.ai/widget.js"
data-key="lz_pub_a1b2c3"
data-assistant="ast_support"
defer>
</script>Ce que ça change
Chatbots embarquables, en pratique.
Intégration en 2 minutes
Copiez la balise script, collez-la dans votre site : le widget est en ligne, branché sur votre assistant.
Sécurisé par origine
La clé publique lz_pub_ ne fonctionne que depuis les domaines que vous autorisez.
Anti-abus intégré
Rate limit par session visiteur (10 req/min) : un widget public ne peut pas vider votre budget.
Feedback natif
Vos visiteurs notent les réponses 👍/👎 — le signal remonte dans vos traces et vos A/B tests.
Comment ça marche
Le déploiement complet, le voici
- 1Créez le chatbotChoisissez l’assistant, personnalisez l’apparence, déclarez les domaines autorisés.
- 2Copiez la baliseUne balise script avec votre clé publique — aucune dépendance, aucun build à modifier.
- 3Suivez l’usageConversations, coûts et feedback par chatbot, dans le même dashboard que le reste.
C’est tout. Le widget charge l’assistant, applique le RAG et respecte vos guardrails.
<script
src="https://cdn.latenza.ai/widget.js"
data-key="lz_pub_a1b2c3"
data-assistant="ast_support"
defer>
</script>Explorez les autres fonctionnalités
A/B testing
Sonnet ou GPT-4o pour votre support ? Un nouveau prompt système fait-il mieux ? Répartissez le trafic entre deux variantes, mesurez coût, latence et feedback utilisateur, puis basculez la meilleure — sans déploiement.
Routing intelligent
Chaque clé API porte une stratégie — cheapest, fastest, balanced ou quality — une allowlist de modèles et un budget. Latenza sélectionne le meilleur candidat à chaque appel, sans changer une ligne dans votre code applicatif.
Failover automatique
Panne OpenAI, quota Anthropic dépassé, timeout réseau ? La requête bascule sur le provider suivant en moins de 100 ms. Vos utilisateurs ne voient jamais l’incident — et la tentative échouée reste visible dans vos traces.
Cache sémantique
Latenza compare chaque prompt aux requêtes récentes par similarité d’embeddings. Au-dessus de votre seuil, la réponse est servie depuis le cache — instantanément, sans appel provider facturé. Isolation stricte par organisation.