Egendefinerte leverandører lar PandaNpc bruke en API-konto, privat gateway eller lokalt modellendepunkt som du kontrollerer. Dette kalles ofte BYOK: ta med din egen nøkkel. Det er nyttig når du trenger en modell utenfor den innebygde katalogen, leverandør-side fakturering, en intern proxy, Ollama, LM Studio, eller en selv-hostet OpenAI-kompatibel tjeneste.
For støttet direkte chat sender PandaNpc forespørselen til ditt konfigurerte endepunkt i stedet for å erstatte med en innebygd modell. Din oppstrømsleverandør kontrollerer fortsatt pris, oppbevaring, ratebegrensninger, modelltilgjengelighet og akseptabel bruk.
Forutsetninger og sikkerhetsgrenser
Før du legger til en leverandør, samle inn:
- Leverandørens API-nøkkel eller lokale autentiseringstoken.
- Dens API Base URL, vanligvis slutter på
/v1for en OpenAI-kompatibel tjeneste. - Den eksakte modellidentifikatoren som API-en godtar.
- Det dokumenterte kontekstvinduet og maksimal utgangsgrense, hvis du planlegger å overstyre standardinnstillingene.
Bruk en dedikert nøkkel med minimum nødvendige tillatelser og en forbruksgrense der leverandøren støtter det. Plasser aldri nøkkelen i dokumentasjon, chatteprompter, skjermbilder, nettleserkonsollutdata eller et Git-repository.
I en nettleser er direkte forespørsler underlagt CORS. Leverandøren må tillate forespørsler fra https://pandanpc.com. En Base URL som http://localhost:11434/v1 refererer til datamaskinen som kjører nettleseren, ikke automatisk til den eksterne PandaPaw-maskinen. Desktop-appen kan være mer egnet for lokale endepunkter fordi den ikke er begrenset av nettleser-CORS på samme måte.
Trinn 1: Åpne modellkonfigurasjon
Logg inn på PandaNpc og åpne Modellkonfigurasjon. Leverandører og modeller er separate poster: leverandøren lagrer tilkoblings- og autentiseringsdetaljer, mens hver modell lagrer identifikatoren og grensene som sendes til den tilkoblingen.
Hvis en offisiell leverandør allerede vises, konfigurer eller kopier den i stedet for å finne opp en annen protokoll. For en ny OpenAI-kompatibel gateway, velg Legg til leverandør.
Trinn 2: Legg til leverandøren
Fyll ut leverandørskjemaet:
| Felt | Hva du skal fylle inn | Eksempel eller veiledning |
|---|---|---|
| Visningsnavn | En etikett som er synlig for deg | Company AI Gateway |
| Leverandør-ID | En stabil intern identifikator | company-openai |
| API-nøkkel | Hemmeligheten som brukes som bærertoken | Verdi utstedt av leverandøren |
| Base URL | API-roten uten /chat/completions |
https://gateway.example.com/v1 |
| Protokoll | Oppstrøms API-format | Velg openai for OpenAI-kompatible chatfullføringer |
| Hemmelighet | Valgfri andre hemmelighet | La stå tom med mindre leverandøren krever det |
| Organisasjon | Valgfri organisasjonsidentifikator | Kun når leverandøren krever det |
| Prosjekt | Valgfri prosjektidentifikator | Kun når leverandøren krever det |
| Støtte innholdsarray | Om meldingsinnhold kan bruke strukturerte matriser | Hold aktivert for leverandører som aksepterer moderne multimodalt meldingsinnhold |
PandaNpc fjerner etterfølgende skråstreker fra Base URL og legger til /chat/completions for den direkte OpenAI-kompatible chatforespørselen. Derfor skriver du inn:
https://api.example.com/v1ikke:
https://api.example.com/v1/chat/completionsLagre leverandøren før du legger til en modell. Når du redigerer en eksisterende leverandør, betyr et tomt API-nøkkel- eller hemmelighetsfelt «behold den konfigurerte verdien»; det viser ikke den lagrede hemmeligheten tilbake i skjemaet.
Trinn 3: Legg til en modell
Velg Legg til modell under leverandøren og fyll ut disse feltene:
| Felt | Betydning | Eksempel |
|---|---|---|
| Visningsnavn | Lesbar velgeretikett for mennesker | My Coding Model |
| Modellverdi | Eksakt oppstrøms modell-ID | model-name-from-provider |
| Modelltype | PandaNpc-kapasitets-/kategorikartlegging | Velg en gjeldende verdi fra skjemaet |
| Leverandør | Leverandørposten opprettet ovenfor | Company AI Gateway |
| Kontekstvindu | Totalt antall støttede tokens | Bruk leverandørens dokumenterte heltallsgrense |
| Maks tokens | Maksimalt antall genererte utdata-tokens | Bruk en positiv verdi som ikke er større enn leverandørens grense |
Visningsnavn kan endres uten å påvirke API-kallet. Modellverdi kan ikke gjettes ut fra et markedsføringsnavn; kopier den fra leverandørens API-dokumentasjon eller modellliste-endepunkt.
La Kontekstvindu og Maks tokens stå tomme når du er usikker. En konservativ standard er tryggere enn å erklære et kontekstvindu større enn serveren støtter. Disse feltene er spesielt viktige for PandaCode fordi de påvirker komprimering og utdatabudsjettering.
Vanlige endepunkteksempler
Følgende mønstre illustrerer URL-form; tilgjengelighet og modell-ID-er avhenger av installasjonen eller leverandørkontoen din:
| Tjenestetype | Typisk Base URL | Merknader |
|---|---|---|
| OpenAI-kompatibel sky-API | https://provider.example.com/v1 |
Må støtte strømmede chatfullføringer og bærertoken-autentisering |
| Ollama på visningsdatamaskinen | http://localhost:11434/v1 |
Start Ollamas OpenAI-kompatible endepunkt; nettleserbruk kan kreve CORS-konfigurasjon |
| LM Studio på visningsdatamaskinen | http://localhost:1234/v1 |
Start den lokale serveren og velg en lastet modell-ID |
| Privat nettverksgateway | https://ai.internal.example/v1 |
PandaNpc-klienten må kunne oppløse og nå verten |
Ikke anta at hver tjeneste som reklamerer med «OpenAI-kompatibel» implementerer strømming, verktøykall, bilder, resonneringsfelt eller identiske feilresponser. Test de nøyaktige funksjonene arbeidsflyten din trenger.
Bekreft leverandøren og modellen
Bruk en rimelig, ikke-sensitiv prompt før du stoler på konfigurasjonen:
- Velg den nye modellen i en ny samtale.
- Send
Reply with exactly: provider connected. - Bekreft at responsen strømmes og at leverandørens dashbord registrerer forespørselen.
- Send en kort oppfølging for å verifisere samtalehistorikken.
- Hvis du trenger verktøy, bilder eller lang kontekst, test hver funksjon separat.
For et lokalt endepunkt, verifiser det først utenfor PandaNpc. En OpenAI-kompatibel modelliste er ofte tilgjengelig med:
curl http://localhost:11434/v1/modelsBruk responsen kun for å bekrefte tilgjengelighet og modell-ID-en. Ikke legg en produksjons-API-nøkkel direkte i skallhistorikken.
Bruk egendefinerte modeller med PandaCode
PandaCode kan gi en Claude Code-stil kodingsarbeidsflyt mens du bruker en modellbackend du velger, inkludert DeepSeek, Qwen, en OpenAI-kompatibel gateway eller en intern tjeneste. Etter å ha konfigurert leverandøren og modellen, velg den modellen for den aktuelle PandaCode-tilkoblingen eller -oppgaven.
Modellen må støtte interaksjonsmønsteret som kreves av kodemotoren. En leverandør som fungerer for vanlig chat kan fortsatt mislykkes på verktøykall, langvarige strømmer eller strukturert innhold. Se AI-modeller støttet av PandaNpc for forskjellen mellom chatmodeller og lokale kodemotorer, og PandaPaw-installasjon og -kommandoer for oppsett av ekstern motor.
Feilsøking
`401` eller `403` autentiseringsfeil
Opprett en ny leverandørnøkkel, bekreft at den er aktiv, og skriv den inn på nytt. Sjekk om oppstrømstjenesten krever en organisasjon, et prosjekt eller en annen autentiseringsmetode. En maskert nøkkel kopiert fra en redigeringsskjerm er ikke den opprinnelige hemmeligheten.
`404` endepunkt eller modell ikke funnet
Fjern /chat/completions fra den konfigurerte Base URL-en fordi PandaNpc legger den til. Bekreft at /v1 er til stede når det kreves, og at Modellverdi samsvarer nøyaktig med oppstrøms modell-ID. En leverandør kan returnere samme 404 for både en feil URL og en utilgjengelig modell.
Nettleseren rapporterer en nettverks- eller CORS-feil
Åpne nettleserens utviklerkonsoll kun for å identifisere den blokkerte opprinnelsen; lim ikke inn hemmeligheter der. Konfigurer leverandøren til å tillate https://pandanpc.com, bruk HTTPS-endepunktet, eller bruk PandaNpc-skrivebordsappen. Regler for blandet innhold blokkerer en HTTPS-side fra å kalle enkelte ren HTTP-endepunkter.
Lokal Ollama eller LM Studio kan ikke nås
Sørg for at serveren kjører på samme datamaskin som klienten som sender forespørselen, og at den lytter på det konfigurerte grensesnittet og porten. Hvis modellserveren kjører på en annen datamaskin, er localhost feil; bruk et tilgjengelig privat vertsnavn eller IP-adresse, og sikre tjenesten før du eksponerer den.
Responsen starter, men stopper eller har ikke innhold
Bekreft at API-en støtter strømmede chatfullføringer og sender standard data:-hendelser. Reduser Maks tokens, test en tekstmelding, og deaktiver strukturerte innholdsarrays bare hvis leverandøren dokumenterer at den kun aksepterer strenginnhold.
Lange økter mislykkes nær kontekstgrensen
Senk det konfigurerte Kontekstvinduet til leverandørens faktiske støttede grense, og reserver plass til utdata, systeminstruksjoner og verktøyresultater. Start en ny økt etter å ha endret modellkonfigurasjonen slik at de nye grensene brukes konsekvent.
For kontonivåkvote og dataflytdetaljer, les PandaNpc-kontoer, -planer og API-kostnader og Personvernerklæringen.