Konfigurer brugerdefinerede AI-udbydere og API Keys i PandaNpc

Opdateret

Brugerdefinerede udbydere lader PandaNpc bruge en API-konto, privat gateway eller lokalt model-endpoint, som du kontrollerer. Dette kaldes ofte BYOK: medbring din egen nøgle. Det er nyttigt, når du har brug for en model uden for det indbyggede katalog, udbyderfakturering, en intern proxy, Ollama, LM Studio eller en selvhostet OpenAI-kompatibel tjeneste.

For understøttet direkte chat sender PandaNpc anmodningen til dit konfigurerede endpoint i stedet for at erstatte en indbygget model. Din upstream-udbyder kontrollerer stadig priser, opbevaring, hastighedsbegrænsninger, modeltilgængelighed og acceptabel brug.

Forudsætninger og sikkerhedsgrænser

Før du tilføjer en udbyder, skal du indsamle:

  • Udbyderens API Key eller lokale godkendelsestoken.
  • Dens API Base URL, der normalt slutter med /v1 for en OpenAI-kompatibel tjeneste.
  • Den nøjagtige modelidentifikator, som API'et accepterer.
  • Det dokumenterede kontekstvindue og maksimale output-grænse, hvis du planlægger at tilsidesætte standarderne.

Brug en dedikeret nøgle med de nødvendige minimale tilladelser og et forbrugsloft, hvor udbyderen understøtter det. Placer aldrig nøglen i dokumentation, chatprompter, skærmbilleder, browserkonsole-output eller et Git-lager.

I en webbrowser er direkte anmodninger underlagt CORS. Udbyderen skal tillade anmodninger fra https://pandanpc.com. En Base URL som http://localhost:11434/v1 henviser til den computer, der kører browseren, ikke automatisk til den eksterne PandaPaw-maskine. Desktop-appen kan være mere velegnet til lokale endpoints, fordi den ikke er begrænset af browser-CORS på samme måde.

Trin 1: Åbn modelkonfiguration

Log ind på PandaNpc, og åbn Model Configuration. Udbytere og modeller er separate poster: udbyderen gemmer forbindelses- og godkendelsesoplysninger, mens hver model gemmer identifikatoren og begrænsningerne, der sendes til den pågældende forbindelse.

Hvis en officiel udbyder allerede vises, skal du konfigurere eller kopiere den i stedet for at opfinde en anden protokol. For en ny OpenAI-kompatibel gateway skal du vælge Add Provider.

Trin 2: Tilføj udbyderen

Udfyld udbyderformularen:

Felt Hvad skal du angive Eksempel eller vejledning
Display Name En etiket, du kan se Company AI Gateway
Provider ID En stabil intern identifikator company-openai
API Key Hemmeligheden, der bruges som bearer-token Værdi udstedt af udbyderen
Base URL API-roden uden /chat/completions https://gateway.example.com/v1
Protocol Det upstream API-format Vælg openai for OpenAI-kompatible chat-fuldførelser
Secret Valgfri anden hemmelighed Lad være tom, medmindre udbyderen kræver det
Organization Valgfri organisationsidentifikator Kun når udbyderen kræver det
Project Valgfri projektidentifikator Kun når udbyderen kræver det
Support content array Om meddelelsesindhold må bruge strukturerede arrays Hold aktiveret for udbydere, der accepterer moderne multimodale meddelelsesindhold

PandaNpc fjerner efterstillede skråstreger fra Base URL'en og tilføjer /chat/completions for den direkte OpenAI-kompatible chat-anmodning. Derfor skal du angive:

text
https://api.example.com/v1

ikke:

text
https://api.example.com/v1/chat/completions

Gem udbyderen, før du tilføjer en model. Når du redigerer en eksisterende udbyder, betyder et tomt API Key- eller Secret-felt, at den konfigurerede værdi beholdes; det viser ikke den gemte hemmelighed tilbage i formularen.

Trin 3: Tilføj en model

Vælg Add Model under udbyderen, og udfyld disse felter:

Felt Betydning Eksempel
Display Name Læsbar etiket til valg My Coding Model
Model Value Nøjagtig upstream-model-ID model-name-from-provider
Model Type PandaNpc-funktions-/kategorikortlægning Vælg en aktuel værdi fra formularen
Provider Udbyderspost oprettet ovenfor Company AI Gateway
Context Window Samlet understøttede tokens Brug udbyderens dokumenterede heltalsgrænse
Max Tokens Maksimale genererede output-tokens Brug en positiv værdi, der ikke er større end udbyderens grænse

Display Name kan ændres uden at påvirke API-kaldet. Model Value kan ikke gættes ud fra et markedsføringsnavn; kopiér det fra udbyderens API-dokumentation eller model-list endpoint.

Lad Context Window og Max Tokens være tomme, hvis du er usikker. En konservativ standard er sikrere end at erklære et kontekstvindue, der er større end serveren understøtter. Disse felter er især vigtige for PandaCode, fordi de påvirker komprimering og outputbudgettering.

Almindelige endpoint-eksempler

Følgende mønstre illustrerer URL-formen; tilgængelighed og model-ID'er afhænger af din installation eller udbyderkonto:

Servicetype Typisk Base URL Bemærkninger
OpenAI-kompatibel cloud-API https://provider.example.com/v1 Skal understøtte streamede Chat Completions og bearer-godkendelse
Ollama på visningscomputeren http://localhost:11434/v1 Start Ollamas OpenAI-kompatible endpoint; brug i browseren kan kræve CORS-konfiguration
LM Studio på visningscomputeren http://localhost:1234/v1 Start den lokale server, og vælg et indlæst model-ID
Privat netværksgateway https://ai.internal.example/v1 PandaNpc-klienten skal kunne opløse og nå værten

Antag ikke, at enhver tjeneste, der reklamerer med “OpenAI-kompatibel”, implementerer streaming, værktøjskald, billeder, ræsonneringsfelter eller identiske fejlsvar. Test de præcise funktioner, din arbejdsgang har brug for.

Verificer udbyderen og modellen

Brug et billigt og ikke-følsomt prompt, før du stoler på konfigurationen:

  1. Vælg den nye model i en ny samtale.
  2. Send Reply with exactly: provider connected.
  3. Bekræft, at svaret streamer, og at udbyderens dashboard registrerer anmodningen.
  4. Send en kort opfølgning for at bekræfte samtalehistorikken.
  5. Hvis du har brug for værktøjer, billeder eller lang kontekst, skal du teste hver funktion separat.

For et lokalt endpoint skal du først verificere det uden for PandaNpc. En OpenAI-kompatibel modeliste er ofte tilgængelig med:

bash
curl http://localhost:11434/v1/models

Brug kun svaret til at bekræfte tilgængelighed og model-ID. Læg ikke en produktions-API Key direkte i shell-historikken.

Brug brugerdefinerede modeller med PandaCode

PandaCode kan levere en Claude Code-lignende kodningsarbejdsgang, mens den bruger en model-backend, du vælger, herunder DeepSeek, Qwen, en OpenAI-kompatibel gateway eller en intern tjeneste. Når du har konfigureret udbyderen og modellen, skal du vælge den pågældende model for den relevante PandaCode-forbindelse eller -opgave.

Modellen skal understøtte det interaktionsmønster, som kodningsmotoren kræver. En udbyder, der fungerer til almindelig chat, kan stadig fejle på værktøjskald, langvarige streams eller struktureret indhold. Se AI-modeller understøttet af PandaNpc for forskellen mellem chatmodeller og lokale kodningsmotorer, og PandaPaw-installation og -kommandoer for opsætning af ekstern motor.

Fejlfinding

`401`- eller `403`-godkendelsesfejl

Opret en ny udbyder-API Key, bekræft at den er aktiv, og indtast den igen. Kontrollér, om upstream-tjenesten kræver en organisation, et projekt eller en anden godkendelsesmetode. En maskeret API Key kopieret fra en redigeringsskærm er ikke den oprindelige hemmelighed.

`404`-endpoint eller model ikke fundet

Fjern /chat/completions fra den konfigurerede Base URL, fordi PandaNpc tilføjer den. Bekræft, at /v1 er til stede, når det kræves, og at Model Value nøjagtigt matcher det upstream model-ID. En udbyder kan returnere den samme 404 for både en forkert URL og en utilgængelig model.

Browseren rapporterer en netværks- eller CORS-fejl

Åbn browserens udviklerkonsole kun for at identificere den blokerede oprindelse; indsæt ikke hemmeligheder der. Konfigurér udbyderen til at tillade https://pandanpc.com, brug dens HTTPS-endpoint, eller brug PandaNpc-desktopappen. Regler for blandet indhold blokerer en HTTPS-side i at kalde nogle almindelige HTTP-endpoints.

Lokal Ollama eller LM Studio kan ikke nås

Sørg for, at serveren kører på den samme computer som klienten, der foretager anmodningen, og at den lytter på den konfigurerede grænseflade og port. Hvis modelserveren kører på en anden computer, er localhost forkert; brug et tilgængeligt privat værtsnavn eller IP-adresse, og sikr tjenesten, før du eksponerer den.

Svaret starter, men stopper eller har intet indhold

Bekræft, at API'et understøtter streamede Chat Completions og udsender standard data:-hændelser. Reducer Max Tokens, test en tekstbesked, og deaktiver strukturerede indholds-arrays kun, hvis udbyderen dokumenterer, at den udelukkende accepterer strengindhold.

Lange sessioner fejler nær kontekstgrænsen

Sænk det konfigurerede Context Window til udbyderens reelle understøttede grænse, og reserver plads til output, systeminstruktioner og værktøjsresultater. Start en ny session efter at have ændret modelkonfigurationen, så de nye grænser anvendes konsekvent.

For kvoter på konto- og dataniveau og oplysninger om dataflow, læs PandaNpc-konti, planer og API-omkostninger og Privatlivspolitikken.