Les fournisseurs personnalisés permettent à PandaNpc d'utiliser un compte API, une passerelle privée ou un point de terminaison de modèle local que vous contrôlez. C'est ce qu'on appelle généralement BYOK : apportez votre propre clé. C'est utile lorsque vous avez besoin d'un modèle hors catalogue intégré, d'une facturation côté fournisseur, d'un proxy interne, d'Ollama, de LM Studio ou d'un service compatible OpenAI auto-hébergé.
Pour le chat direct pris en charge, PandaNpc envoie la requête à votre point de terminaison configuré plutôt que de substituer un modèle intégré. Votre fournisseur en amont continue de contrôler la tarification, la conservation des données, les limites de débit, la disponibilité des modèles et l'utilisation acceptable.
Prérequis et limites de sécurité
Avant d'ajouter un fournisseur, rassemblez :
- L'API Key du fournisseur ou le jeton d'authentification local.
- Son URL de base API, se terminant normalement par
/v1pour un service compatible OpenAI. - L'identifiant exact du modèle accepté par l'API.
- La fenêtre de contexte documentée et la limite de sortie maximale, si vous prévoyez de remplacer les valeurs par défaut.
Utilisez une clé dédiée avec les autorisations minimales nécessaires et une limite de dépenses si le fournisseur le permet. Ne placez jamais la clé dans la documentation, les invites de discussion, les captures d'écran, la sortie de la console du navigateur ou un dépôt Git.
Dans un navigateur Web, les requêtes directes sont soumises au CORS. Le fournisseur doit autoriser les requêtes provenant de https://pandanpc.com. Une URL de base telle que http://localhost:11434/v1 fait référence à l'ordinateur exécutant le navigateur, et non automatiquement à la machine PandaPaw distante. L'application de bureau peut être plus adaptée aux points de terminaison locaux car elle n'est pas limitée par le CORS du navigateur de la même manière.
Étape 1 : Ouvrir la configuration des modèles
Connectez-vous à PandaNpc et ouvrez Configuration des modèles. Les fournisseurs et les modèles sont des enregistrements distincts : le fournisseur stocke les détails de connexion et d'authentification, tandis que chaque modèle stocke l'identifiant et les limites envoyés à cette connexion.
Si un fournisseur officiel apparaît déjà, configurez-le ou copiez-le plutôt que d'inventer un protocole différent. Pour une nouvelle passerelle compatible OpenAI, sélectionnez Ajouter un fournisseur.
Étape 2 : Ajouter le fournisseur
Remplissez le formulaire du fournisseur :
| Champ | Que saisir | Exemple ou guide |
|---|---|---|
| Nom d'affichage | Un libellé visible par vous | Company AI Gateway |
| Identifiant du fournisseur | Un identifiant interne stable | company-openai |
| API Key | Le secret utilisé comme jeton porteur | Valeur fournie par le fournisseur |
| URL de base | Racine API sans /chat/completions |
https://gateway.example.com/v1 |
| Protocole | Le format de l'API en amont | Choisissez openai pour les complétions de chat compatibles OpenAI |
| Secret | Second secret facultatif | Laissez vide sauf si le fournisseur l'exige |
| Organisation | Identifiant d'organisation facultatif | Uniquement si le fournisseur l'exige |
| Projet | Identifiant de projet facultatif | Uniquement si le fournisseur l'exige |
| Prise en charge du tableau de contenu | Indique si le contenu du message peut utiliser des tableaux structurés | Laissez activé pour les fournisseurs qui acceptent le contenu de message multimodal moderne |
PandaNpc supprime les barres obliques finales de l'URL de base et ajoute /chat/completions pour la requête directe de chat compatible OpenAI. Saisissez donc :
https://api.example.com/v1et non :
https://api.example.com/v1/chat/completionsEnregistrez le fournisseur avant d'ajouter un modèle. Lors de la modification d'un fournisseur existant, un champ API Key ou Secret vide signifie « conserver la valeur configurée » ; il ne réexpose pas le secret stocké dans le formulaire.
Étape 3 : Ajouter un modèle
Choisissez Ajouter un modèle sous le fournisseur et remplissez ces champs :
| Champ | Signification | Exemple |
|---|---|---|
| Nom d'affichage | Libellé de sélection lisible par l'humain | My Coding Model |
| Valeur du modèle | Identifiant exact du modèle en amont | model-name-from-provider |
| Type de modèle | Mappage de capacité/catégorie PandaNpc | Sélectionnez une valeur actuelle du formulaire |
| Fournisseur | Enregistrement de fournisseur créé ci-dessus | Company AI Gateway |
| Fenêtre de contexte | Nombre total de jetons pris en charge | Utilisez la limite entière documentée du fournisseur |
| Max Tokens | Nombre maximal de jetons de sortie générés | Utilisez une valeur positive ne dépassant pas la limite du fournisseur |
Nom d'affichage peut être modifié sans affecter l'appel API. Valeur du modèle ne peut pas être devinée à partir d'un nom commercial ; copiez-la depuis la documentation API du fournisseur ou le point de terminaison de liste de modèles.
Laissez Fenêtre de contexte et Max Tokens vides en cas de doute. Une valeur par défaut prudente est plus sûre que de déclarer une fenêtre de contexte plus grande que ce que le serveur prend en charge. Ces champs sont particulièrement importants pour PandaCode car ils influencent la compaction et la budgétisation de la sortie.
Exemples courants de points de terminaison
Les modèles suivants illustrent la forme de l'URL ; la disponibilité et les identifiants de modèles dépendent de votre installation ou de votre compte fournisseur :
| Type de service | URL de base typique | Notes |
|---|---|---|
| API cloud compatible OpenAI | https://provider.example.com/v1 |
Doit prendre en charge les Chat Completions en streaming et l'authentification par jeton porteur |
| Ollama sur l'ordinateur de visualisation | http://localhost:11434/v1 |
Démarrez le point de terminaison compatible OpenAI d'Ollama ; l'utilisation dans un navigateur peut nécessiter une configuration CORS |
| LM Studio sur l'ordinateur de visualisation | http://localhost:1234/v1 |
Démarrez le serveur local et sélectionnez un identifiant de modèle chargé |
| Passerelle réseau privé | https://ai.internal.example/v1 |
Le client PandaNpc doit pouvoir résoudre et atteindre l'hôte |
Ne supposez pas que chaque service annonçant « compatible OpenAI » implémente le streaming, les appels d'outils, les images, les champs de raisonnement ou des réponses d'erreur identiques. Testez les fonctionnalités exactes dont votre flux de travail a besoin.
Vérifier le fournisseur et le modèle
Utilisez une invite non sensible et à faible coût avant de vous fier à la configuration :
- Sélectionnez le nouveau modèle dans une nouvelle conversation.
- Envoyez
Reply with exactly: provider connected. - Confirmez que la réponse est diffusée en streaming et que le tableau de bord du fournisseur enregistre la requête.
- Envoyez un court message de suivi pour vérifier l'historique de la conversation.
- Si vous avez besoin d'outils, d'images ou d'un contexte long, testez chaque capacité séparément.
Pour un point de terminaison local, vérifiez-le d'abord en dehors de PandaNpc. Une liste de modèles compatible OpenAI est souvent disponible avec :
curl http://localhost:11434/v1/modelsUtilisez la réponse uniquement pour confirmer l'accessibilité et l'identifiant du modèle. Ne placez pas une API Key de production directement dans l'historique du shell.
Utiliser des modèles personnalisés avec PandaCode
PandaCode peut fournir un flux de travail de codage de style Claude Code tout en utilisant un backend de modèle de votre choix, notamment DeepSeek, Qwen, une passerelle compatible OpenAI ou un service interne. Après avoir configuré le fournisseur et le modèle, sélectionnez ce modèle pour la connexion ou la tâche PandaCode concernée.
Le modèle doit prendre en charge le modèle d'interaction requis par le moteur de codage. Un fournisseur qui fonctionne pour le chat simple peut échouer sur les appels d'outils, les flux longue durée ou le contenu structuré. Voir Modèles d'IA pris en charge par PandaNpc pour la différence entre les modèles de chat et les moteurs de codage locaux, et Installation et commandes de PandaPaw pour la configuration du moteur distant.
Dépannage
Erreur d'authentification `401` ou `403`
Créez une nouvelle clé de fournisseur, confirmez qu'elle est active et saisissez-la à nouveau. Vérifiez si le service en amont exige une organisation, un projet ou une méthode d'authentification différente. Une clé masquée copiée depuis un écran de modification n'est pas le secret d'origine.
Point de terminaison ou modèle `404` introuvable
Supprimez /chat/completions de l'URL de base configurée car PandaNpc l'ajoute. Confirmez que /v1 est présent si nécessaire et que la valeur du modèle correspond exactement à l'identifiant du modèle en amont. Un fournisseur peut renvoyer le même 404 à la fois pour une URL incorrecte et pour un modèle indisponible.
Le navigateur signale une erreur réseau ou CORS
Ouvrez la console de développement du navigateur uniquement pour identifier l'origine bloquée ; n'y collez pas de secrets. Configurez le fournisseur pour autoriser https://pandanpc.com, utilisez son point de terminaison HTTPS ou utilisez l'application de bureau PandaNpc. Les règles de contenu mixte empêchent une page HTTPS d'appeler certains points de terminaison HTTP simples.
Impossible d'atteindre Ollama ou LM Studio local
Assurez-vous que le serveur est exécuté sur le même ordinateur que le client effectuant la requête et écoute sur l'interface et le port configurés. Si le serveur de modèles s'exécute sur un autre ordinateur, localhost est incorrect ; utilisez un nom d'hôte ou une IP privée accessible et sécurisez le service avant de l'exposer.
La réponse commence mais s'arrête ou ne contient rien
Confirmez que l'API prend en charge les Chat Completions en streaming et émet des événements data: standard. Réduisez Max Tokens, testez un message texte uniquement et désactivez les tableaux de contenu structurés uniquement si le fournisseur documente qu'il accepte exclusivement le contenu sous forme de chaîne.
Les sessions longues échouent près de la limite de contexte
Abaissez la fenêtre de contexte configurée à la limite réelle prise en charge par le fournisseur et réservez de l'espace pour la sortie, les instructions système et les résultats d'outils. Démarrez une nouvelle session après avoir modifié la configuration du modèle afin que les nouvelles limites soient appliquées de manière cohérente.
Pour les détails sur les quotas au niveau du compte et le flux de données, lisez Comptes, plans et coûts API PandaNpc et la Politique de confidentialité.