Configureer aangepaste AI-providers en API-sleutels in PandaNpc

Bijgewerkt

Met aangepaste providers kan PandaNpc gebruikmaken van een API-account, privé-gateway of lokaal model-eindpunt dat u beheert. Dit wordt vaak BYOK genoemd: breng uw eigen sleutel. Het is handig wanneer u een model nodig hebt buiten de ingebouwde catalogus, facturering aan providerzijde, een interne proxy, Ollama, LM Studio of een zelfgehoste OpenAI-compatibele service.

Voor ondersteunde directe chat verzendt PandaNpc het verzoek naar uw geconfigureerde eindpunt in plaats van een ingebouwd model te vervangen. Uw upstream-provider blijft de prijzen, retentie, snelheidslimieten, modelbeschikbaarheid en acceptabel gebruik bepalen.

Vereisten en beveiligingsgrenzen

Voordat u een provider toevoegt, verzamelt u:

  • De API-sleutel van de provider of een lokaal authenticatietoken.
  • De API-basis-URL, die normaal eindigt op /v1 voor een OpenAI-compatibele service.
  • De exacte modelidentificatie die door de API wordt geaccepteerd.
  • Het gedocumenteerde contextvenster en de maximale uitvoerlimiet, als u van plan bent de standaardwaarden te overschrijven.

Gebruik een speciale sleutel met de minimaal noodzakelijke rechten en een uitgavenlimiet waar de provider dit ondersteunt. Plaats de sleutel nooit in documentatie, chatprompts, screenshots, browserconsole-uitvoer of een Git-repository.

In een webbrowser zijn directe verzoeken onderworpen aan CORS. De provider moet verzoeken van https://pandanpc.com toestaan. Een basis-URL zoals http://localhost:11434/v1 verwijst naar de computer waarop de browser draait, niet automatisch naar de externe PandaPaw-machine. De desktop-app kan geschikter zijn voor lokale eindpunten omdat deze niet op dezelfde manier wordt beperkt door browser-CORS.

Stap 1: Open Modelconfiguratie

Meld u aan bij PandaNpc en open Modelconfiguratie. Providers en modellen zijn afzonderlijke records: de provider slaat verbindings- en authenticatiegegevens op, terwijl elk model de identificatie en limieten opslaat die naar die verbinding worden verzonden.

Als er al een officiële provider verschijnt, configureer of kopieer deze dan in plaats van een ander protocol te bedenken. Selecteer voor een nieuwe OpenAI-compatibele gateway Provider toevoegen.

Stap 2: Voeg de provider toe

Vul het providerformulier in:

Veld Wat in te vullen Voorbeeld of richtlijn
Weergavenaam Een label dat u kunt zien Company AI Gateway
Provider-ID Een stabiele interne identificatie company-openai
API Key Het geheim dat als bearer-token wordt gebruikt Door provider verstrekte waarde
Basis-URL API-root zonder /chat/completions https://gateway.example.com/v1
Protocol Het upstream-API-formaat Kies openai voor OpenAI-compatibele chatcompletions
Geheim Optioneel tweede geheim Leeg laten tenzij de provider dit vereist
Organisatie Optionele organisatie-identificatie Alleen wanneer de provider dit vereist
Project Optionele projectidentificatie Alleen wanneer de provider dit vereist
Ondersteuning inhoudarray Of berichtinhoud gestructureerde arrays mag gebruiken Ingeschakeld houden voor providers die moderne multimodale berichtinhoud accepteren

PandaNpc verwijdert schuine strepen aan het einde van de Basis-URL en voegt /chat/completions toe voor het directe OpenAI-compatibele chatverzoek. Voer daarom in:

text
https://api.example.com/v1

niet:

text
https://api.example.com/v1/chat/completions

Sla de provider op voordat u een model toevoegt. Bij het bewerken van een bestaande provider betekent een leeg veld voor API Key of Geheim: "behoud de geconfigureerde waarde"; het toont het opgeslagen geheim niet terug in het formulier.

Stap 3: Voeg een model toe

Kies Model toevoegen onder de provider en vul deze velden in:

Veld Betekenis Voorbeeld
Weergavenaam Leesbaar selectielabel My Coding Model
Modelwaarde Exacte upstream-model-ID model-name-from-provider
Modeltype PandaNpc-capaciteits-/categoriekoppeling Selecteer een huidige waarde uit het formulier
Provider Hierboven aangemaakt providerrecord Company AI Gateway
Contextvenster Totaal ondersteunde tokens Gebruik de gedocumenteerde gehele limiet van de provider
Max. tokens Maximum gegenereerde uitvoertokens Gebruik een positieve waarde niet groter dan de providerlimiet

Weergavenaam kan worden gewijzigd zonder de API-aanroep te beïnvloeden. Modelwaarde kan niet worden geraden uit een marketingnaam; kopieer het uit de API-documentatie of het model-lijsteindpunt van de provider.

Laat Contextvenster en Max. tokens leeg als u twijfelt. Een conservatieve standaardwaarde is veiliger dan een contextvenster te verklaren dat groter is dan de server ondersteunt. Deze velden zijn vooral belangrijk voor PandaCode omdat ze invloed hebben op compactie en uitvoerbudgettering.

Veelvoorkomende eindpuntvoorbeelden

De volgende patronen illustreren de URL-vorm; beschikbaarheid en model-ID's zijn afhankelijk van uw installatie of provideraccount:

Servicetype Typische basis-URL Opmerkingen
OpenAI-compatibele cloud-API https://provider.example.com/v1 Moet gestreamde Chat Completions en bearer-authenticatie ondersteunen
Ollama op de weergavecomputer http://localhost:11434/v1 Start het OpenAI-compatibele eindpunt van Ollama; browsergebruik kan CORS-configuratie vereisen
LM Studio op de weergavecomputer http://localhost:1234/v1 Start de lokale server en selecteer een geladen model-ID
Gateway voor privénetwerk https://ai.internal.example/v1 De PandaNpc-client moet de host kunnen omzetten en bereiken

Ga er niet vanuit dat elke service die "OpenAI-compatibel" adverteert, streaming, toolaanroepen, afbeeldingen, redeneervelden of identieke foutreacties implementeert. Test de exacte functies die uw werkstroom nodig heeft.

Controleer de provider en het model

Gebruik een goedkope, niet-gevoelige prompt voordat u op de configuratie vertrouwt:

  1. Selecteer het nieuwe model in een nieuw gesprek.
  2. Stuur Reply with exactly: provider connected.
  3. Bevestig dat de reactie streamt en dat het providerdashboard het verzoek registreert.
  4. Stuur een korte vervolgvraag om de gespreksgeschiedenis te verifiëren.
  5. Als u tools, afbeeldingen of lange context nodig hebt, test dan elke capaciteit afzonderlijk.

Controleer een lokaal eindpunt eerst buiten PandaNpc. Een OpenAI-compatibele modellenlijst is vaak beschikbaar met:

bash
curl http://localhost:11434/v1/models

Gebruik de reactie alleen om de bereikbaarheid en de model-ID te bevestigen. Plaats geen productie-API-sleutel rechtstreeks in de shellgeschiedenis.

Gebruik aangepaste modellen met PandaCode

PandaCode kan een Claude Code-stijl coderingswerkstroom bieden terwijl u een modelbackend naar keuze gebruikt, waaronder DeepSeek, Qwen, een OpenAI-compatibele gateway of een interne service. Selecteer na het configureren van de provider en het model dat model voor de relevante PandaCode-verbinding of -taak.

Het model moet het interactiepatroon ondersteunen dat de coderingsengine vereist. Een provider die werkt voor gewone chat kan nog steeds falen bij toolaanroepen, langlopende streams of gestructureerde inhoud. Zie AI-modellen ondersteund door PandaNpc voor het verschil tussen chatmodellen en lokale coderingsengines, en PandaPaw-installatie en -opdrachten voor de installatie van externe engines.

Probleemoplossing

`401`- of `403`-authenticatiefout

Maak een nieuwe providersleutel aan, bevestig dat deze actief is, en voer deze opnieuw in. Controleer of de upstreamservice een organisatie, project of andere authenticatiemethode vereist. Een gemaskeerde sleutel die van een bewerkingsscherm is gekopieerd, is niet het oorspronkelijke geheim.

`404`-eindpunt of model niet gevonden

Verwijder /chat/completions uit de geconfigureerde Basis-URL omdat PandaNpc dit toevoegt. Bevestig dat /v1 aanwezig is wanneer vereist en dat de modelwaarde exact overeenkomt met het upstream-model-ID. Een provider kan dezelfde 404 retourneren voor zowel een verkeerde URL als een niet-beschikbaar model.

Browser meldt een netwerk- of CORS-fout

Open de ontwikkelaarsconsole van de browser alleen om de geblokkeerde oorsprong te identificeren; plak daar geen geheimen. Configureer de provider om https://pandanpc.com toe te staan, gebruik het HTTPS-eindpunt of gebruik de PandaNpc-desktop-app. Regels voor gemengde inhoud blokkeren een HTTPS-pagina om sommige pure HTTP-eindpunten aan te roepen.

Lokaal Ollama of LM Studio kan niet worden bereikt

Zorg ervoor dat de server draait op dezelfde computer als de client die het verzoek doet en luistert op de geconfigureerde interface en poort. Als de modelserver op een andere computer draait, is localhost onjuist; gebruik een bereikbare privéhostnaam of IP en beveilig de service voordat u deze blootstelt.

Reactie start maar stopt of heeft geen inhoud

Bevestig dat de API gestreamde Chat Completions ondersteunt en standaard data:-gebeurtenissen uitzendt. Verlaag Max. tokens, test een tekstbericht en schakel gestructureerde inhoudarrays alleen uit als de provider documenteert dat deze uitsluitend tekenreeksinhoud accepteert.

Lange sessies mislukken nabij de contextlimiet

Verlaag het geconfigureerde Contextvenster naar de echte ondersteunde limiet van de provider en reserveer ruimte voor uitvoer, systeeminstructies en toolresultaten. Start een nieuwe sessie na het wijzigen van de modelconfiguratie zodat de nieuwe limieten consistent worden toegepast.

Lees voor details over quota en gegevensstromen op accountniveau PandaNpc-accounts, -abonnementen en API-kosten en het Privacybeleid.