Met aangepaste providers kan PandaNpc gebruikmaken van een API-account, privé-gateway of lokaal model-eindpunt dat u beheert. Dit wordt vaak BYOK genoemd: breng uw eigen sleutel. Het is handig wanneer u een model nodig hebt buiten de ingebouwde catalogus, facturering aan providerzijde, een interne proxy, Ollama, LM Studio of een zelfgehoste OpenAI-compatibele service.
Voor ondersteunde directe chat verzendt PandaNpc het verzoek naar uw geconfigureerde eindpunt in plaats van een ingebouwd model te vervangen. Uw upstream-provider blijft de prijzen, retentie, snelheidslimieten, modelbeschikbaarheid en acceptabel gebruik bepalen.
Vereisten en beveiligingsgrenzen
Voordat u een provider toevoegt, verzamelt u:
- De API-sleutel van de provider of een lokaal authenticatietoken.
- De API-basis-URL, die normaal eindigt op
/v1voor een OpenAI-compatibele service. - De exacte modelidentificatie die door de API wordt geaccepteerd.
- Het gedocumenteerde contextvenster en de maximale uitvoerlimiet, als u van plan bent de standaardwaarden te overschrijven.
Gebruik een speciale sleutel met de minimaal noodzakelijke rechten en een uitgavenlimiet waar de provider dit ondersteunt. Plaats de sleutel nooit in documentatie, chatprompts, screenshots, browserconsole-uitvoer of een Git-repository.
In een webbrowser zijn directe verzoeken onderworpen aan CORS. De provider moet verzoeken van https://pandanpc.com toestaan. Een basis-URL zoals http://localhost:11434/v1 verwijst naar de computer waarop de browser draait, niet automatisch naar de externe PandaPaw-machine. De desktop-app kan geschikter zijn voor lokale eindpunten omdat deze niet op dezelfde manier wordt beperkt door browser-CORS.
Stap 1: Open Modelconfiguratie
Meld u aan bij PandaNpc en open Modelconfiguratie. Providers en modellen zijn afzonderlijke records: de provider slaat verbindings- en authenticatiegegevens op, terwijl elk model de identificatie en limieten opslaat die naar die verbinding worden verzonden.
Als er al een officiële provider verschijnt, configureer of kopieer deze dan in plaats van een ander protocol te bedenken. Selecteer voor een nieuwe OpenAI-compatibele gateway Provider toevoegen.
Stap 2: Voeg de provider toe
Vul het providerformulier in:
| Veld | Wat in te vullen | Voorbeeld of richtlijn |
|---|---|---|
| Weergavenaam | Een label dat u kunt zien | Company AI Gateway |
| Provider-ID | Een stabiele interne identificatie | company-openai |
| API Key | Het geheim dat als bearer-token wordt gebruikt | Door provider verstrekte waarde |
| Basis-URL | API-root zonder /chat/completions |
https://gateway.example.com/v1 |
| Protocol | Het upstream-API-formaat | Kies openai voor OpenAI-compatibele chatcompletions |
| Geheim | Optioneel tweede geheim | Leeg laten tenzij de provider dit vereist |
| Organisatie | Optionele organisatie-identificatie | Alleen wanneer de provider dit vereist |
| Project | Optionele projectidentificatie | Alleen wanneer de provider dit vereist |
| Ondersteuning inhoudarray | Of berichtinhoud gestructureerde arrays mag gebruiken | Ingeschakeld houden voor providers die moderne multimodale berichtinhoud accepteren |
PandaNpc verwijdert schuine strepen aan het einde van de Basis-URL en voegt /chat/completions toe voor het directe OpenAI-compatibele chatverzoek. Voer daarom in:
https://api.example.com/v1niet:
https://api.example.com/v1/chat/completionsSla de provider op voordat u een model toevoegt. Bij het bewerken van een bestaande provider betekent een leeg veld voor API Key of Geheim: "behoud de geconfigureerde waarde"; het toont het opgeslagen geheim niet terug in het formulier.
Stap 3: Voeg een model toe
Kies Model toevoegen onder de provider en vul deze velden in:
| Veld | Betekenis | Voorbeeld |
|---|---|---|
| Weergavenaam | Leesbaar selectielabel | My Coding Model |
| Modelwaarde | Exacte upstream-model-ID | model-name-from-provider |
| Modeltype | PandaNpc-capaciteits-/categoriekoppeling | Selecteer een huidige waarde uit het formulier |
| Provider | Hierboven aangemaakt providerrecord | Company AI Gateway |
| Contextvenster | Totaal ondersteunde tokens | Gebruik de gedocumenteerde gehele limiet van de provider |
| Max. tokens | Maximum gegenereerde uitvoertokens | Gebruik een positieve waarde niet groter dan de providerlimiet |
Weergavenaam kan worden gewijzigd zonder de API-aanroep te beïnvloeden. Modelwaarde kan niet worden geraden uit een marketingnaam; kopieer het uit de API-documentatie of het model-lijsteindpunt van de provider.
Laat Contextvenster en Max. tokens leeg als u twijfelt. Een conservatieve standaardwaarde is veiliger dan een contextvenster te verklaren dat groter is dan de server ondersteunt. Deze velden zijn vooral belangrijk voor PandaCode omdat ze invloed hebben op compactie en uitvoerbudgettering.
Veelvoorkomende eindpuntvoorbeelden
De volgende patronen illustreren de URL-vorm; beschikbaarheid en model-ID's zijn afhankelijk van uw installatie of provideraccount:
| Servicetype | Typische basis-URL | Opmerkingen |
|---|---|---|
| OpenAI-compatibele cloud-API | https://provider.example.com/v1 |
Moet gestreamde Chat Completions en bearer-authenticatie ondersteunen |
| Ollama op de weergavecomputer | http://localhost:11434/v1 |
Start het OpenAI-compatibele eindpunt van Ollama; browsergebruik kan CORS-configuratie vereisen |
| LM Studio op de weergavecomputer | http://localhost:1234/v1 |
Start de lokale server en selecteer een geladen model-ID |
| Gateway voor privénetwerk | https://ai.internal.example/v1 |
De PandaNpc-client moet de host kunnen omzetten en bereiken |
Ga er niet vanuit dat elke service die "OpenAI-compatibel" adverteert, streaming, toolaanroepen, afbeeldingen, redeneervelden of identieke foutreacties implementeert. Test de exacte functies die uw werkstroom nodig heeft.
Controleer de provider en het model
Gebruik een goedkope, niet-gevoelige prompt voordat u op de configuratie vertrouwt:
- Selecteer het nieuwe model in een nieuw gesprek.
- Stuur
Reply with exactly: provider connected. - Bevestig dat de reactie streamt en dat het providerdashboard het verzoek registreert.
- Stuur een korte vervolgvraag om de gespreksgeschiedenis te verifiëren.
- Als u tools, afbeeldingen of lange context nodig hebt, test dan elke capaciteit afzonderlijk.
Controleer een lokaal eindpunt eerst buiten PandaNpc. Een OpenAI-compatibele modellenlijst is vaak beschikbaar met:
curl http://localhost:11434/v1/modelsGebruik de reactie alleen om de bereikbaarheid en de model-ID te bevestigen. Plaats geen productie-API-sleutel rechtstreeks in de shellgeschiedenis.
Gebruik aangepaste modellen met PandaCode
PandaCode kan een Claude Code-stijl coderingswerkstroom bieden terwijl u een modelbackend naar keuze gebruikt, waaronder DeepSeek, Qwen, een OpenAI-compatibele gateway of een interne service. Selecteer na het configureren van de provider en het model dat model voor de relevante PandaCode-verbinding of -taak.
Het model moet het interactiepatroon ondersteunen dat de coderingsengine vereist. Een provider die werkt voor gewone chat kan nog steeds falen bij toolaanroepen, langlopende streams of gestructureerde inhoud. Zie AI-modellen ondersteund door PandaNpc voor het verschil tussen chatmodellen en lokale coderingsengines, en PandaPaw-installatie en -opdrachten voor de installatie van externe engines.
Probleemoplossing
`401`- of `403`-authenticatiefout
Maak een nieuwe providersleutel aan, bevestig dat deze actief is, en voer deze opnieuw in. Controleer of de upstreamservice een organisatie, project of andere authenticatiemethode vereist. Een gemaskeerde sleutel die van een bewerkingsscherm is gekopieerd, is niet het oorspronkelijke geheim.
`404`-eindpunt of model niet gevonden
Verwijder /chat/completions uit de geconfigureerde Basis-URL omdat PandaNpc dit toevoegt. Bevestig dat /v1 aanwezig is wanneer vereist en dat de modelwaarde exact overeenkomt met het upstream-model-ID. Een provider kan dezelfde 404 retourneren voor zowel een verkeerde URL als een niet-beschikbaar model.
Browser meldt een netwerk- of CORS-fout
Open de ontwikkelaarsconsole van de browser alleen om de geblokkeerde oorsprong te identificeren; plak daar geen geheimen. Configureer de provider om https://pandanpc.com toe te staan, gebruik het HTTPS-eindpunt of gebruik de PandaNpc-desktop-app. Regels voor gemengde inhoud blokkeren een HTTPS-pagina om sommige pure HTTP-eindpunten aan te roepen.
Lokaal Ollama of LM Studio kan niet worden bereikt
Zorg ervoor dat de server draait op dezelfde computer als de client die het verzoek doet en luistert op de geconfigureerde interface en poort. Als de modelserver op een andere computer draait, is localhost onjuist; gebruik een bereikbare privéhostnaam of IP en beveilig de service voordat u deze blootstelt.
Reactie start maar stopt of heeft geen inhoud
Bevestig dat de API gestreamde Chat Completions ondersteunt en standaard data:-gebeurtenissen uitzendt. Verlaag Max. tokens, test een tekstbericht en schakel gestructureerde inhoudarrays alleen uit als de provider documenteert dat deze uitsluitend tekenreeksinhoud accepteert.
Lange sessies mislukken nabij de contextlimiet
Verlaag het geconfigureerde Contextvenster naar de echte ondersteunde limiet van de provider en reserveer ruimte voor uitvoer, systeeminstructies en toolresultaten. Start een nieuwe sessie na het wijzigen van de modelconfiguratie zodat de nieuwe limieten consistent worden toegepast.
Lees voor details over quota en gegevensstromen op accountniveau PandaNpc-accounts, -abonnementen en API-kosten en het Privacybeleid.