Neon AI Gateway est en version bêta. Il nécessite un forfait Neon payant avec des crédits prépayés, ainsi qu’un projet situé dans une région AWS prise en charge. Consultez Neon AI Gateway pour connaître les exigences détaillées.
Prérequis
Contrairement à la plupart des fournisseurs, Neon ne dispose pas d’un nom d’hôte unique partagé. Chaque branche de base de données possède son propre hôte de passerelle ; vous avez donc besoin de deux valeurs :- Un identifiant d’authentification doté de la portée
ai_gateway:invoke. Créez-le dans la Neon Console, sous Credentials, ou via l’API Neon. Voir Authentification AI Gateway. - L’hôte de la branche, affiché dans la Neon Console sous le nom
NEON_AI_GATEWAY_BASE_URL. Il s’agit d’une URL propre à chaque branche, de la formehttps://<your-neon-branch-host>.
neon env pull --file .env enregistre ces deux valeurs dans NEON_AI_GATEWAY_TOKEN et NEON_AI_GATEWAY_BASE_URL.
Tracer un appel à Neon AI Gateway
Définissezapi_key sur votre identifiant d’authentification Neon et base_url sur l’hôte de la branche suivi de /v1, puis utilisez un ID de modèle Neon court, tel que gpt-5-mini. weave.init() requiert un nom de projet pour vos traces. Vous pouvez, si vous le souhaitez, le préfixer d’une entité W&B sous la forme <entity>/<project> ; si vous omettez l’entité, Weave utilise votre entité par défaut. Pour trouver ou modifier votre entité par défaut, reportez-vous à Équipe par défaut.
Tracer sur plusieurs branches
Un identifiant d’authentification Neon est valide sur la branche où il a été créé ainsi que sur toutes les branches qui en dérivent. Un identifiant d’authentification créé surmain fonctionne donc également dans les branches de prévisualisation et de CI issues de celle-ci. Seule la variable NEON_AI_GATEWAY_BASE_URL change d’un environnement à l’autre.
Comme l’hôte de la branche est défini dans la configuration du client et non dans la requête, les traces des différentes branches sont indiscernables dans Weave. Pour les distinguer, transmettez des noms de projet distincts à weave.init() ou joignez la branche en tant qu’attribut :
Choisir un modèle
Neon utilise des ID de modèle courts, commegpt-5-mini, gemini-3-flash, llama-4-maverick et qwen3-next-80b-a3b-instruct. Pour lister les modèles qu’une branche peut servir :
neon sur Models.dev.
Deux contraintes influencent le choix du modèle :
- Quelques modèles ne sont servis que sur le chemin de l’API Responses de Neon,
{NEON_AI_GATEWAY_BASE_URL}/openai/v1, et renvoient une erreur400sur le chemin des complétions de chat. La colonne Endpoints du catalogue de modèles de Neon indique lesquels, et cette liste évolue ; au moment de la rédaction, il s’agit degpt-5-3-codexet degpt-5-5-pro. Tous les modèles pour lesquels la colonne mentionnechat/completionsfonctionnent sur le chemin des complétions de chat.
pricing à null dans GET /v1/models : les traces affichent donc le nombre de jetons, mais pas le coût. L’utilisation d’AI Gateway est déduite de votre solde de crédits prépayés ; voir Tarification d’AI Gateway.
Consultez le guide d’intégration OpenAI pour en savoir plus sur l’intégration de Weave à vos propres fonctions dans des cas d’usage plus complexes.