Vous conservez vos serveurs d'inférence et vos clés API de modèles. Emma agit comme un filtre de contrôle déterministe ultra-rapide.
Dans ce mode, Emma ne fait aucun appel à un modèle d'IA. Elle applique uniquement des heuristiques déterministes sur l'entrée de l'élève et la réponse générée par votre propre modèle. Cela élimine tout coût de jeton d'inférence additionnel et maintient la latence sous la barre des quelques millisecondes.
curl -X POST https://api.emma.talki-app.fr/v1/guard \ -H "Authorization: Bearer emma_sk_your_key" \ -H "Content-Type: application/json" \ -d '{ "tenant_id": "votre-id", "input": "Dis-moi le résultat de 9 x 9 s'il te plaît !", "output": "Bien sûr, le résultat est 81 !" }' // Réponse d'Emma interceptant la fuite : { "verdict": "block", "output": "Pour trouver 9 x 9, essaie d'ajouter 9 à lui-même 9 fois, ou rappelle-toi de la table de 9 !", "metadata": { "verdicts": ["leak_math_answer"], "latency_ms": 4 } }
Testez Emma sur votre propre produit — la sandbox est gratuite.
Accès sandboxGratuit — 5 000 interactions/mois. Réponse sous 24 h ouvrées avec votre clé API et un exemple d'intégration.