Configurer les fournisseurs d'IA personnalisés et les API Keys dans PandaNpc

Mis à jour

Les fournisseurs personnalisés permettent à PandaNpc d'utiliser un compte API, une passerelle privée ou un point de terminaison de modèle local que vous contrôlez. C'est ce qu'on appelle généralement BYOK : apportez votre propre clé. C'est utile lorsque vous avez besoin d'un modèle hors catalogue intégré, d'une facturation côté fournisseur, d'un proxy interne, d'Ollama, de LM Studio ou d'un service compatible OpenAI auto-hébergé.

Pour le chat direct pris en charge, PandaNpc envoie la requête à votre point de terminaison configuré plutôt que de substituer un modèle intégré. Votre fournisseur en amont continue de contrôler la tarification, la conservation des données, les limites de débit, la disponibilité des modèles et l'utilisation acceptable.

Prérequis et limites de sécurité

Avant d'ajouter un fournisseur, rassemblez :

  • L'API Key du fournisseur ou le jeton d'authentification local.
  • Son URL de base API, se terminant normalement par /v1 pour un service compatible OpenAI.
  • L'identifiant exact du modèle accepté par l'API.
  • La fenêtre de contexte documentée et la limite de sortie maximale, si vous prévoyez de remplacer les valeurs par défaut.

Utilisez une clé dédiée avec les autorisations minimales nécessaires et une limite de dépenses si le fournisseur le permet. Ne placez jamais la clé dans la documentation, les invites de discussion, les captures d'écran, la sortie de la console du navigateur ou un dépôt Git.

Dans un navigateur Web, les requêtes directes sont soumises au CORS. Le fournisseur doit autoriser les requêtes provenant de https://pandanpc.com. Une URL de base telle que http://localhost:11434/v1 fait référence à l'ordinateur exécutant le navigateur, et non automatiquement à la machine PandaPaw distante. L'application de bureau peut être plus adaptée aux points de terminaison locaux car elle n'est pas limitée par le CORS du navigateur de la même manière.

Étape 1 : Ouvrir la configuration des modèles

Connectez-vous à PandaNpc et ouvrez Configuration des modèles. Les fournisseurs et les modèles sont des enregistrements distincts : le fournisseur stocke les détails de connexion et d'authentification, tandis que chaque modèle stocke l'identifiant et les limites envoyés à cette connexion.

Si un fournisseur officiel apparaît déjà, configurez-le ou copiez-le plutôt que d'inventer un protocole différent. Pour une nouvelle passerelle compatible OpenAI, sélectionnez Ajouter un fournisseur.

Étape 2 : Ajouter le fournisseur

Remplissez le formulaire du fournisseur :

Champ Que saisir Exemple ou guide
Nom d'affichage Un libellé visible par vous Company AI Gateway
Identifiant du fournisseur Un identifiant interne stable company-openai
API Key Le secret utilisé comme jeton porteur Valeur fournie par le fournisseur
URL de base Racine API sans /chat/completions https://gateway.example.com/v1
Protocole Le format de l'API en amont Choisissez openai pour les complétions de chat compatibles OpenAI
Secret Second secret facultatif Laissez vide sauf si le fournisseur l'exige
Organisation Identifiant d'organisation facultatif Uniquement si le fournisseur l'exige
Projet Identifiant de projet facultatif Uniquement si le fournisseur l'exige
Prise en charge du tableau de contenu Indique si le contenu du message peut utiliser des tableaux structurés Laissez activé pour les fournisseurs qui acceptent le contenu de message multimodal moderne

PandaNpc supprime les barres obliques finales de l'URL de base et ajoute /chat/completions pour la requête directe de chat compatible OpenAI. Saisissez donc :

text
https://api.example.com/v1

et non :

text
https://api.example.com/v1/chat/completions

Enregistrez le fournisseur avant d'ajouter un modèle. Lors de la modification d'un fournisseur existant, un champ API Key ou Secret vide signifie « conserver la valeur configurée » ; il ne réexpose pas le secret stocké dans le formulaire.

Étape 3 : Ajouter un modèle

Choisissez Ajouter un modèle sous le fournisseur et remplissez ces champs :

Champ Signification Exemple
Nom d'affichage Libellé de sélection lisible par l'humain My Coding Model
Valeur du modèle Identifiant exact du modèle en amont model-name-from-provider
Type de modèle Mappage de capacité/catégorie PandaNpc Sélectionnez une valeur actuelle du formulaire
Fournisseur Enregistrement de fournisseur créé ci-dessus Company AI Gateway
Fenêtre de contexte Nombre total de jetons pris en charge Utilisez la limite entière documentée du fournisseur
Max Tokens Nombre maximal de jetons de sortie générés Utilisez une valeur positive ne dépassant pas la limite du fournisseur

Nom d'affichage peut être modifié sans affecter l'appel API. Valeur du modèle ne peut pas être devinée à partir d'un nom commercial ; copiez-la depuis la documentation API du fournisseur ou le point de terminaison de liste de modèles.

Laissez Fenêtre de contexte et Max Tokens vides en cas de doute. Une valeur par défaut prudente est plus sûre que de déclarer une fenêtre de contexte plus grande que ce que le serveur prend en charge. Ces champs sont particulièrement importants pour PandaCode car ils influencent la compaction et la budgétisation de la sortie.

Exemples courants de points de terminaison

Les modèles suivants illustrent la forme de l'URL ; la disponibilité et les identifiants de modèles dépendent de votre installation ou de votre compte fournisseur :

Type de service URL de base typique Notes
API cloud compatible OpenAI https://provider.example.com/v1 Doit prendre en charge les Chat Completions en streaming et l'authentification par jeton porteur
Ollama sur l'ordinateur de visualisation http://localhost:11434/v1 Démarrez le point de terminaison compatible OpenAI d'Ollama ; l'utilisation dans un navigateur peut nécessiter une configuration CORS
LM Studio sur l'ordinateur de visualisation http://localhost:1234/v1 Démarrez le serveur local et sélectionnez un identifiant de modèle chargé
Passerelle réseau privé https://ai.internal.example/v1 Le client PandaNpc doit pouvoir résoudre et atteindre l'hôte

Ne supposez pas que chaque service annonçant « compatible OpenAI » implémente le streaming, les appels d'outils, les images, les champs de raisonnement ou des réponses d'erreur identiques. Testez les fonctionnalités exactes dont votre flux de travail a besoin.

Vérifier le fournisseur et le modèle

Utilisez une invite non sensible et à faible coût avant de vous fier à la configuration :

  1. Sélectionnez le nouveau modèle dans une nouvelle conversation.
  2. Envoyez Reply with exactly: provider connected.
  3. Confirmez que la réponse est diffusée en streaming et que le tableau de bord du fournisseur enregistre la requête.
  4. Envoyez un court message de suivi pour vérifier l'historique de la conversation.
  5. Si vous avez besoin d'outils, d'images ou d'un contexte long, testez chaque capacité séparément.

Pour un point de terminaison local, vérifiez-le d'abord en dehors de PandaNpc. Une liste de modèles compatible OpenAI est souvent disponible avec :

bash
curl http://localhost:11434/v1/models

Utilisez la réponse uniquement pour confirmer l'accessibilité et l'identifiant du modèle. Ne placez pas une API Key de production directement dans l'historique du shell.

Utiliser des modèles personnalisés avec PandaCode

PandaCode peut fournir un flux de travail de codage de style Claude Code tout en utilisant un backend de modèle de votre choix, notamment DeepSeek, Qwen, une passerelle compatible OpenAI ou un service interne. Après avoir configuré le fournisseur et le modèle, sélectionnez ce modèle pour la connexion ou la tâche PandaCode concernée.

Le modèle doit prendre en charge le modèle d'interaction requis par le moteur de codage. Un fournisseur qui fonctionne pour le chat simple peut échouer sur les appels d'outils, les flux longue durée ou le contenu structuré. Voir Modèles d'IA pris en charge par PandaNpc pour la différence entre les modèles de chat et les moteurs de codage locaux, et Installation et commandes de PandaPaw pour la configuration du moteur distant.

Dépannage

Erreur d'authentification `401` ou `403`

Créez une nouvelle clé de fournisseur, confirmez qu'elle est active et saisissez-la à nouveau. Vérifiez si le service en amont exige une organisation, un projet ou une méthode d'authentification différente. Une clé masquée copiée depuis un écran de modification n'est pas le secret d'origine.

Point de terminaison ou modèle `404` introuvable

Supprimez /chat/completions de l'URL de base configurée car PandaNpc l'ajoute. Confirmez que /v1 est présent si nécessaire et que la valeur du modèle correspond exactement à l'identifiant du modèle en amont. Un fournisseur peut renvoyer le même 404 à la fois pour une URL incorrecte et pour un modèle indisponible.

Le navigateur signale une erreur réseau ou CORS

Ouvrez la console de développement du navigateur uniquement pour identifier l'origine bloquée ; n'y collez pas de secrets. Configurez le fournisseur pour autoriser https://pandanpc.com, utilisez son point de terminaison HTTPS ou utilisez l'application de bureau PandaNpc. Les règles de contenu mixte empêchent une page HTTPS d'appeler certains points de terminaison HTTP simples.

Impossible d'atteindre Ollama ou LM Studio local

Assurez-vous que le serveur est exécuté sur le même ordinateur que le client effectuant la requête et écoute sur l'interface et le port configurés. Si le serveur de modèles s'exécute sur un autre ordinateur, localhost est incorrect ; utilisez un nom d'hôte ou une IP privée accessible et sécurisez le service avant de l'exposer.

La réponse commence mais s'arrête ou ne contient rien

Confirmez que l'API prend en charge les Chat Completions en streaming et émet des événements data: standard. Réduisez Max Tokens, testez un message texte uniquement et désactivez les tableaux de contenu structurés uniquement si le fournisseur documente qu'il accepte exclusivement le contenu sous forme de chaîne.

Les sessions longues échouent près de la limite de contexte

Abaissez la fenêtre de contexte configurée à la limite réelle prise en charge par le fournisseur et réservez de l'espace pour la sortie, les instructions système et les résultats d'outils. Démarrez une nouvelle session après avoir modifié la configuration du modèle afin que les nouvelles limites soient appliquées de manière cohérente.

Pour les détails sur les quotas au niveau du compte et le flux de données, lisez Comptes, plans et coûts API PandaNpc et la Politique de confidentialité.