Vue d’ensemble
Comprendre le modèle d’intégration développeur pour Gateway, ingestion directe, métadonnées, tracing, webhooks et readiness production.
Kadryn relie l’usage IA aux coûts, owners, policies et preuves opérationnelles.
Une bonne intégration développeur fait quatre choses :
- authenticates côté serveur systems securely;
- envoie complet usage ou runtime trafic;
- attache métadonnées que makes spend attributable;
- préservers traçabilité pour debug et audit.
Integration modes
Kadryn prend en charge deux modes d’intégration principaux.
| Mode | Fonctionnement | Idéal pour |
|---|---|---|
| Gateway | Les requêtes IA transitent par Kadryn. | Contrôle runtime, budgets, policies et tracing. |
Utilisez Gateway lorsque Kadryn doit évaluer un request avant exécution provider.
Utilisez ingestion directe lorsque Kadryn seulement needs à recevoir usage données après le request happened.
Minimum production contract
Chaque intégration production doit fournir :
- un workspace API clé;
- un projet identifier;
- un identifiant d’environnement;
- un feature, workflow ou agent identifier;
- un trace ID ou request group ID;
- idempotency keys pour les écritures retryables;
- sûr erreur handling;
- côté serveur secret stockage.
Data flow
Une intégration typique produit ces signaux :
- authentication identifie le workspace;
- métadonnées identifie le business context;
- usage ou gateway événements enregistrer provider, model, tokens, coût, latence et statut;
- Logs & Traces expose request-level debug;
- Costs et Guardrails utiliser le normalisé enregistre;
- Alerts, rapports et webhooks notify downstream systems.
What à vérifier first
Avant de déployer du trafic production, vérifiez que :
- un test request apparaît dans Developers → Logs & Traces;
- la requête a le projet et l’environnement attendus;
- coût apparaît dans le right period;
- échecs include enough IDs pour debug;
- no secret est visible dans frontend code ou logs;
- retries faites pas créer doublon usage.
Déploiement recommandé
Commencez avec un seul service à faible risque.
Envoyez du trafic depuis un environnement, comme staging, puis vérifiez :
- authentication;
- route readiness;
- métadonnées quality;
- trace search;
- coût normalization;
- erreur handling;
- idempotency behavior.
Étendez ensuite seulement vers la production et des services supplémentaires.