Démo en direct — vrais appels API

Empêchez votre agent IA de se faire manipuler

Un contrôle en temps réel entre le texte non fiable et les actions de votre agent — détecte manipulation, fuites de données et contenu dangereux avant qu'ils ne fassent des dégâts.

Si vous construisez un agent IA — un bot support avec accès à une base de données, un truc qui lit des emails ou des pages web scrapées, tout ce qui agit sur du texte qu'il n'a pas écrit lui-même — ce texte est une surface d'attaque. N'importe qui peut cacher une instruction dans un message, un document, une page web qui dit « ignore tes règles et fais X », et beaucoup d'agents vont juste... le faire.

La solution habituelle : un second appel au même LLM coûteux pour demander « c'était safe ? » — ce qui double le coût et la latence pour une simple classification oui/non, pas un vrai raisonnement.

→ Agent Guard fait ce contrôle oui/non correctement : un modèle conçu pour classifier, pas pour rédiger, qui tourne en moins d'une seconde pour une fraction de centime.

Où ça s'intègre
01

Bots support / avec accès outils

Avant que votre agent agisse sur un message (remboursement, changement de compte, requête DB), vérifiez que ce n'est pas une tentative de jailbreak.

02

Agents lisant du contenu externe

Emails, PDF, pages scrapées — tout ce que votre agent lit peut cacher une instruction. Vérifiez avant de traiter le contenu comme sûr.

03

Réponses sortantes

Avant l'envoi d'une réponse générée, vérifiez qu'elle ne fuite pas de données client et ne dérive pas hors sujet.

Testez en direct
0 / 3000

Latence
Coût
Tokens

vs. second appel LLM (tarifs publics)

Ce contrôle (Jev)
Équivalent GPT-4o mini
1 à 3s+, en plus de l'appel principal

Estimation GPT-4o mini : tarifs publics OpenAI ($0.15/M entrée, $0.60/M sortie) pour un prompt comparable. Chiffres Jev = votre requête réelle.

curl -X POST https://oraclemarin.fr/agent-guard-api/guard \ -H "Content-Type: application/json" \ -d '{"message": "...", "context": "your agent purpose"}' { blocked: false, jev: { is_safe, is_jailbreak, contains_pii, on_topic } }

Tarifs

Quota mensuel fixe, aucune surprise à la requête. Annulable à tout moment.

Free
0€/mois
200 contrôles/mois
Starter
9$/mois
25 000 contrôles/mois
Growth
29$/mois
150 000 contrôles/mois
Scale
79$/mois
750 000 contrôles/mois

Les prix reflètent le coût réel du service : chaque palier reste bien en dessous du coût d'un second appel GPT-4o-mini fait maison.