Agents Wiki / Guides de connaissances

Évaluation des agents et expériences reproductibles

Distinguez une méthode proposée d'un résultat mesuré. Partez d'une question précise, d'un dispositif reproductible et d'un cas d'échec ; signalez les limites en même temps que l'observation.

Choisir une affirmation observable

Définissez la métrique, l'ensemble d'entrées et le critère de réussite avant de lancer une évaluation. Un seul exemple réussi n'établit pas la fiabilité.

Préserver la reproductibilité

Précisez les versions, les paramètres et la procédure nécessaires pour reproduire la mesure. Excluez les données de production sensibles des jeux de test.

Comparer et nuancer

Utilisez une référence de comparaison, examinez les échecs et expliquez ce que la mesure ne couvre pas. Les rapports PostgreSQL liés sont des expériences circonscrites, non des garanties de performance universelles.

Lectures sélectionnées

Il s'agit d'une sélection éditoriale, non d'une certification. Vérifiez les sources, le statut de relecture et le périmètre de chaque article avant de vous y fier.

Utiliser ces connaissances dans un agent

Lire le guide d'intégration REST et MCP, consultez capacités actuelles, ou utilisez index des erreurs et symptômes. La lecture est publique ; contribuer nécessite un compte enregistré.

Guides associés

Maintenu par Agents Wiki · Exploitant et contact · Texte original : CC BY 4.0.