Konfigurer egendefinerte AI-leverandører og API-nøkler i PandaNpc

Oppdatert

Egendefinerte leverandører lar PandaNpc bruke en API-konto, privat gateway eller lokalt modellendepunkt som du kontrollerer. Dette kalles ofte BYOK: ta med din egen nøkkel. Det er nyttig når du trenger en modell utenfor den innebygde katalogen, leverandør-side fakturering, en intern proxy, Ollama, LM Studio, eller en selv-hostet OpenAI-kompatibel tjeneste.

For støttet direkte chat sender PandaNpc forespørselen til ditt konfigurerte endepunkt i stedet for å erstatte med en innebygd modell. Din oppstrømsleverandør kontrollerer fortsatt pris, oppbevaring, ratebegrensninger, modelltilgjengelighet og akseptabel bruk.

Forutsetninger og sikkerhetsgrenser

Før du legger til en leverandør, samle inn:

  • Leverandørens API-nøkkel eller lokale autentiseringstoken.
  • Dens API Base URL, vanligvis slutter på /v1 for en OpenAI-kompatibel tjeneste.
  • Den eksakte modellidentifikatoren som API-en godtar.
  • Det dokumenterte kontekstvinduet og maksimal utgangsgrense, hvis du planlegger å overstyre standardinnstillingene.

Bruk en dedikert nøkkel med minimum nødvendige tillatelser og en forbruksgrense der leverandøren støtter det. Plasser aldri nøkkelen i dokumentasjon, chatteprompter, skjermbilder, nettleserkonsollutdata eller et Git-repository.

I en nettleser er direkte forespørsler underlagt CORS. Leverandøren må tillate forespørsler fra https://pandanpc.com. En Base URL som http://localhost:11434/v1 refererer til datamaskinen som kjører nettleseren, ikke automatisk til den eksterne PandaPaw-maskinen. Desktop-appen kan være mer egnet for lokale endepunkter fordi den ikke er begrenset av nettleser-CORS på samme måte.

Trinn 1: Åpne modellkonfigurasjon

Logg inn på PandaNpc og åpne Modellkonfigurasjon. Leverandører og modeller er separate poster: leverandøren lagrer tilkoblings- og autentiseringsdetaljer, mens hver modell lagrer identifikatoren og grensene som sendes til den tilkoblingen.

Hvis en offisiell leverandør allerede vises, konfigurer eller kopier den i stedet for å finne opp en annen protokoll. For en ny OpenAI-kompatibel gateway, velg Legg til leverandør.

Trinn 2: Legg til leverandøren

Fyll ut leverandørskjemaet:

Felt Hva du skal fylle inn Eksempel eller veiledning
Visningsnavn En etikett som er synlig for deg Company AI Gateway
Leverandør-ID En stabil intern identifikator company-openai
API-nøkkel Hemmeligheten som brukes som bærertoken Verdi utstedt av leverandøren
Base URL API-roten uten /chat/completions https://gateway.example.com/v1
Protokoll Oppstrøms API-format Velg openai for OpenAI-kompatible chatfullføringer
Hemmelighet Valgfri andre hemmelighet La stå tom med mindre leverandøren krever det
Organisasjon Valgfri organisasjonsidentifikator Kun når leverandøren krever det
Prosjekt Valgfri prosjektidentifikator Kun når leverandøren krever det
Støtte innholdsarray Om meldingsinnhold kan bruke strukturerte matriser Hold aktivert for leverandører som aksepterer moderne multimodalt meldingsinnhold

PandaNpc fjerner etterfølgende skråstreker fra Base URL og legger til /chat/completions for den direkte OpenAI-kompatible chatforespørselen. Derfor skriver du inn:

text
https://api.example.com/v1

ikke:

text
https://api.example.com/v1/chat/completions

Lagre leverandøren før du legger til en modell. Når du redigerer en eksisterende leverandør, betyr et tomt API-nøkkel- eller hemmelighetsfelt «behold den konfigurerte verdien»; det viser ikke den lagrede hemmeligheten tilbake i skjemaet.

Trinn 3: Legg til en modell

Velg Legg til modell under leverandøren og fyll ut disse feltene:

Felt Betydning Eksempel
Visningsnavn Lesbar velgeretikett for mennesker My Coding Model
Modellverdi Eksakt oppstrøms modell-ID model-name-from-provider
Modelltype PandaNpc-kapasitets-/kategorikartlegging Velg en gjeldende verdi fra skjemaet
Leverandør Leverandørposten opprettet ovenfor Company AI Gateway
Kontekstvindu Totalt antall støttede tokens Bruk leverandørens dokumenterte heltallsgrense
Maks tokens Maksimalt antall genererte utdata-tokens Bruk en positiv verdi som ikke er større enn leverandørens grense

Visningsnavn kan endres uten å påvirke API-kallet. Modellverdi kan ikke gjettes ut fra et markedsføringsnavn; kopier den fra leverandørens API-dokumentasjon eller modellliste-endepunkt.

La Kontekstvindu og Maks tokens stå tomme når du er usikker. En konservativ standard er tryggere enn å erklære et kontekstvindu større enn serveren støtter. Disse feltene er spesielt viktige for PandaCode fordi de påvirker komprimering og utdatabudsjettering.

Vanlige endepunkteksempler

Følgende mønstre illustrerer URL-form; tilgjengelighet og modell-ID-er avhenger av installasjonen eller leverandørkontoen din:

Tjenestetype Typisk Base URL Merknader
OpenAI-kompatibel sky-API https://provider.example.com/v1 Må støtte strømmede chatfullføringer og bærertoken-autentisering
Ollama på visningsdatamaskinen http://localhost:11434/v1 Start Ollamas OpenAI-kompatible endepunkt; nettleserbruk kan kreve CORS-konfigurasjon
LM Studio på visningsdatamaskinen http://localhost:1234/v1 Start den lokale serveren og velg en lastet modell-ID
Privat nettverksgateway https://ai.internal.example/v1 PandaNpc-klienten må kunne oppløse og nå verten

Ikke anta at hver tjeneste som reklamerer med «OpenAI-kompatibel» implementerer strømming, verktøykall, bilder, resonneringsfelt eller identiske feilresponser. Test de nøyaktige funksjonene arbeidsflyten din trenger.

Bekreft leverandøren og modellen

Bruk en rimelig, ikke-sensitiv prompt før du stoler på konfigurasjonen:

  1. Velg den nye modellen i en ny samtale.
  2. Send Reply with exactly: provider connected.
  3. Bekreft at responsen strømmes og at leverandørens dashbord registrerer forespørselen.
  4. Send en kort oppfølging for å verifisere samtalehistorikken.
  5. Hvis du trenger verktøy, bilder eller lang kontekst, test hver funksjon separat.

For et lokalt endepunkt, verifiser det først utenfor PandaNpc. En OpenAI-kompatibel modelliste er ofte tilgjengelig med:

bash
curl http://localhost:11434/v1/models

Bruk responsen kun for å bekrefte tilgjengelighet og modell-ID-en. Ikke legg en produksjons-API-nøkkel direkte i skallhistorikken.

Bruk egendefinerte modeller med PandaCode

PandaCode kan gi en Claude Code-stil kodingsarbeidsflyt mens du bruker en modellbackend du velger, inkludert DeepSeek, Qwen, en OpenAI-kompatibel gateway eller en intern tjeneste. Etter å ha konfigurert leverandøren og modellen, velg den modellen for den aktuelle PandaCode-tilkoblingen eller -oppgaven.

Modellen må støtte interaksjonsmønsteret som kreves av kodemotoren. En leverandør som fungerer for vanlig chat kan fortsatt mislykkes på verktøykall, langvarige strømmer eller strukturert innhold. Se AI-modeller støttet av PandaNpc for forskjellen mellom chatmodeller og lokale kodemotorer, og PandaPaw-installasjon og -kommandoer for oppsett av ekstern motor.

Feilsøking

`401` eller `403` autentiseringsfeil

Opprett en ny leverandørnøkkel, bekreft at den er aktiv, og skriv den inn på nytt. Sjekk om oppstrømstjenesten krever en organisasjon, et prosjekt eller en annen autentiseringsmetode. En maskert nøkkel kopiert fra en redigeringsskjerm er ikke den opprinnelige hemmeligheten.

`404` endepunkt eller modell ikke funnet

Fjern /chat/completions fra den konfigurerte Base URL-en fordi PandaNpc legger den til. Bekreft at /v1 er til stede når det kreves, og at Modellverdi samsvarer nøyaktig med oppstrøms modell-ID. En leverandør kan returnere samme 404 for både en feil URL og en utilgjengelig modell.

Nettleseren rapporterer en nettverks- eller CORS-feil

Åpne nettleserens utviklerkonsoll kun for å identifisere den blokkerte opprinnelsen; lim ikke inn hemmeligheter der. Konfigurer leverandøren til å tillate https://pandanpc.com, bruk HTTPS-endepunktet, eller bruk PandaNpc-skrivebordsappen. Regler for blandet innhold blokkerer en HTTPS-side fra å kalle enkelte ren HTTP-endepunkter.

Lokal Ollama eller LM Studio kan ikke nås

Sørg for at serveren kjører på samme datamaskin som klienten som sender forespørselen, og at den lytter på det konfigurerte grensesnittet og porten. Hvis modellserveren kjører på en annen datamaskin, er localhost feil; bruk et tilgjengelig privat vertsnavn eller IP-adresse, og sikre tjenesten før du eksponerer den.

Responsen starter, men stopper eller har ikke innhold

Bekreft at API-en støtter strømmede chatfullføringer og sender standard data:-hendelser. Reduser Maks tokens, test en tekstmelding, og deaktiver strukturerte innholdsarrays bare hvis leverandøren dokumenterer at den kun aksepterer strenginnhold.

Lange økter mislykkes nær kontekstgrensen

Senk det konfigurerte Kontekstvinduet til leverandørens faktiske støttede grense, og reserver plass til utdata, systeminstruksjoner og verktøyresultater. Start en ny økt etter å ha endret modellkonfigurasjonen slik at de nye grensene brukes konsekvent.

For kontonivåkvote og dataflytdetaljer, les PandaNpc-kontoer, -planer og API-kostnader og Personvernerklæringen.