Les cas d’usage de Jev fonctionnent mieux lorsque le modèle prend une décision précise et que le code gère le processus. Donnez-lui le texte nécessaire, définissez le format de réponse, puis vérifiez le résultat avant d’agir. Ces exemples sont des conceptions d’applications, pas des benchmarks mesurés par notre site.

Que construire avec Jev ?

1. Classer les tickets de support

Entrée: Un client signale des échecs répétés d’intégration de paiement.

Décision du modèle: Choice sélectionne facturation, technique, commercial ou à vérifier.

Action et limite: Le code affecte le ticket et conserve un circuit de validation humaine. Un message peut concerner plusieurs équipes : définissez la priorité ou posez plusieurs questions.

2. Modérer des contenus

Entrée: Un commentaire et une règle communautaire courte et explicite.

Décision du modèle: Noul estime si le commentaire enfreint cette règle précise.

Action et limite: Transmettez les cas incertains à une personne et conservez la règle évaluée. Citations, sarcasme et texte hostile peuvent modifier le jugement. Un score ne remplace pas toute la politique de modération.

3. Évaluer la pertinence commerciale

Entrée: Une demande et les usages documentés du produit.

Décision du modèle: Score utilise des niveaux ordonnés : hors sujet, correspondance partielle, correspondance directe.

Action et limite: Priorisez les messages pour un suivi humain. Le manque d’informations ne prouve pas une mauvaise adéquation. N’inférez pas de caractéristiques personnelles et ne décidez pas d’une admissibilité à partir du score.

4. Reclasser des résultats de recherche

Entrée: Une requête et un passage déjà trouvé par votre moteur.

Décision du modèle: Score évalue dans quelle mesure le passage répond directement à la question.

Action et limite: Le code trie les candidats, avec une question par passage si nécessaire. Jev ne récupère pas les documents ; un long contexte sans rapport peut dégrader la précision.

5. Vérifier les citations

Entrée: Une affirmation et le passage exact cité comme source.

Décision du modèle: Choice choisit étayé, contredit ou preuves insuffisantes.

Action et limite: Signalez les citations fragiles avant d’afficher une réponse générée. Cela vérifie le soutien dans le texte fourni, pas la véracité de la source elle-même.

6. Orienter les agents et outils

Entrée: Une demande, les descriptions des outils disponibles et le contexte applicatif.

Décision du modèle: Choice sélectionne un outil autorisé, une clarification ou aucune action.

Action et limite: L’application vérifie les droits et les arguments avant exécution. Choisir un outil ne donne pas la permission de l’utiliser. Prévoyez une sortie pour les demandes non prises en charge.

Quel type de question choisir ?

Choice convient aux options exclusives, Score aux niveaux descriptifs ordonnés et Noul aux critères oui/non. Un ticket peut produire un Choice pour l’équipe et un Noul distinct pour l’urgence. Ne mélangez pas l’urgence avec le nom du service.

Que garder dans le code ?

Authentification, calculs exacts, comparaisons de dates, recherche et actions restent dans le code classique. Vérifiez les valeurs autorisées, enregistrez la version et évaluez un échantillon étiqueté avant de fixer des seuils. Même une réponse confiante peut être fausse.

Comment estimer le coût ?

Mesurez usage.input_tokens sur des appels représentatifs contenant les vraies questions, puis multipliez par le volume et le tarif. Avec 1 000 tokens supposés, un appel coûte 0,000042 USD au tarif vérifié ; 100 000 appels coûtent 4,20 USD, hors autres frais de l’application.

Pour continuer

Vue d’ensemble · Tarifs · Bien démarrer · Limites

Sources et lectures complémentaires