Konfigurace vlastních AI poskytovatelů a API Keys v PandaNpc

Aktualizováno

Vlastní poskytovatelé umožňují PandaNpc používat API účet, soukromou bránu nebo lokální endpoint modelu, který ovládáte. Tomu se běžně říká BYOK: přineste si vlastní klíč. Je to užitečné, když potřebujete model mimo vestavěný katalog, fakturaci na straně poskytovatele, interní proxy, Ollama, LM Studio nebo službu kompatibilní s OpenAI hostovanou na vlastní infrastruktuře.

Pro podporovaný přímý chat odešle PandaNpc požadavek na vámi nakonfigurovaný endpoint, místo aby dosadil vestavěný model. Váš nadřazený poskytovatel (upstream provider) stále řídí ceny, uchovávání dat, omezení rychlosti (rate limits), dostupnost modelů a přijatelné použití.

Předpoklady a bezpečnostní hranice

Před přidáním poskytovatele si připravte:

  • API Key poskytovatele nebo lokální autentizační token.
  • Základní URL API, obvykle končící na /v1 pro službu kompatibilní s OpenAI.
  • Přesný identifikátor modelu, který API přijímá.
  • Zdokumentované kontextové okno a maximální limit výstupu, pokud plánujete přepsat výchozí hodnoty.

Použijte vyhrazený klíč s minimálními potřebnými oprávněními a limitem výdajů, pokud to poskytovatel umožňuje. Nikdy neumisťujte klíč do dokumentace, promptů v chatu, snímků obrazovky, výstupu konzole prohlížeče nebo do repozitáře Git.

Ve webovém prohlížeči podléhají přímé požadavky CORS. Poskytovatel musí povolit požadavky z https://pandanpc.com. Základní URL jako http://localhost:11434/v1 odkazuje na počítač, na kterém běží prohlížeč, ne automaticky na vzdálený počítač s PandaPaw. Desktopová aplikace může být pro lokální endpointy vhodnější, protože není omezena CORS prohlížeče stejným způsobem.

Krok 1: Otevřete konfiguraci modelů

Přihlaste se do PandaNpc a otevřete Konfiguraci modelů. Poskytovatelé a modely jsou samostatné záznamy: poskytovatel ukládá údaje o připojení a ověřování, zatímco každý model ukládá identifikátor a limity odesílané do tohoto připojení.

Pokud se zde již zobrazuje oficiální poskytovatel, nakonfigurujte nebo zkopírujte ho, místo abyste vymýšleli jiný protokol. Pro novou bránu kompatibilní s OpenAI vyberte Přidat poskytovatele.

Krok 2: Přidejte poskytovatele

Vyplňte formulář poskytovatele:

Pole Co zadat Příklad nebo pokyn
Zobrazovaný název Popisek viditelný pro vás Company AI Gateway
ID poskytovatele Stabilní interní identifikátor company-openai
API Key Tajný klíč používaný jako bearer token Hodnota vydaná poskytovatelem
Základní URL Kořen API bez /chat/completions https://gateway.example.com/v1
Protokol Formát nadřazeného API Vyberte openai pro chat completions kompatibilní s OpenAI
Tajný klíč Volitelné druhé tajemství Nechte prázdné, pokud to poskytovatel nevyžaduje
Organizace Volitelný identifikátor organizace Pouze pokud to poskytovatel vyžaduje
Projekt Volitelný identifikátor projektu Pouze pokud to poskytovatel vyžaduje
Podpora pole obsahu Zda může obsah zpráv používat strukturovaná pole Ponechte povoleno pro poskytovatele, kteří přijímají moderní multimodální obsah zpráv

PandaNpc odstraňuje koncová lomítka ze základní URL a přidává /chat/completions pro přímý požadavek chatu kompatibilního s OpenAI. Proto zadejte:

text
https://api.example.com/v1

ne:

text
https://api.example.com/v1/chat/completions

Uložte poskytovatele před přidáním modelu. Při úpravě stávajícího poskytovatele znamená prázdné pole API Key nebo Tajný klíč „ponechat nakonfigurovanou hodnotu“; nezpřístupňuje uložené tajemství zpět ve formuláři.

Krok 3: Přidejte model

Zvolte Přidat model u poskytovatele a vyplňte tato pole:

Pole Význam Příklad
Zobrazovaný název Lidsky čitelný popisek pro výběr My Coding Model
Hodnota modelu Přesné ID modelu nadřazeného API model-name-from-provider
Typ modelu Mapování schopností/kategorií v PandaNpc Vyberte aktuální hodnotu z formuláře
Poskytovatel Záznam poskytovatele vytvořený výše Company AI Gateway
Kontextové okno Celkový počet podporovaných tokenů Použijte zdokumentovaný celočíselný limit poskytovatele
Max tokenů Maximální počet vygenerovaných výstupních tokenů Použijte kladnou hodnotu nepřesahující limit poskytovatele

Display Name (Zobrazovaný název) lze změnit bez ovlivnění volání API. Model Value (Hodnota modelu) nelze odvodit z marketingového názvu; zkopírujte ji z dokumentace API poskytovatele nebo z endpointu se seznamem modelů.

Pole Kontextové okno a Max tokenů nechte prázdná, pokud si nejste jisti. Konzervativní výchozí hodnota je bezpečnější než deklarovat kontextové okno větší, než server podporuje. Tato pole jsou důležitá zejména pro PandaCode, protože ovlivňují kompaktnost a rozpočtování výstupu.

Běžné příklady endpointů

Následující vzory ilustrují tvar URL; dostupnost a ID modelů závisí na vaší instalaci nebo účtu poskytovatele:

Typ služby Typická základní URL Poznámky
Cloudové API kompatibilní s OpenAI https://provider.example.com/v1 Musí podporovat streamované Chat Completions a bearer autentizaci
Ollama na prohlížecím počítači http://localhost:11434/v1 Spusťte endpoint Ollama kompatibilní s OpenAI; použití v prohlížeči může vyžadovat konfiguraci CORS
LM Studio na prohlížecím počítači http://localhost:1234/v1 Spusťte místní server a vyberte ID načteného modelu
Brána soukromé sítě https://ai.internal.example/v1 Klient PandaNpc musí být schopen rozlišit a dosáhnout hostitele

Nepředpokládejte, že každá služba inzerující „kompatibilní s OpenAI“ implementuje streamování, volání nástrojů, obrázky, pole pro uvažování nebo identické chybové odpovědi. Otestujte přesně ty funkce, které váš pracovní postup potřebuje.

Ověřte poskytovatele a model

Použijte levný a necitlivý prompt, než začnete konfiguraci používat:

  1. Vyberte nový model v nové konverzaci.
  2. Pošlete Reply with exactly: provider connected.
  3. Ověřte, že odpověď streamuje a že dashboard poskytovatele zaznamenává požadavek.
  4. Pošlete krátkou navazující zprávu pro ověření historie konverzace.
  5. Pokud potřebujete nástroje, obrázky nebo dlouhý kontext, otestujte každou schopnost zvlášť.

Pro lokální endpoint jej nejprve ověřte mimo PandaNpc. Seznam modelů kompatibilní s OpenAI je často dostupný pomocí:

bash
curl http://localhost:11434/v1/models

Použijte odpověď pouze k potvrzení dosažitelnosti a ID modelu. Nevkládejte produkční API key přímo do historie shellu.

Použití vlastních modelů s PandaCode

PandaCode může poskytovat pracovní postup kódování ve stylu Claude Code, přičemž používá backend modelu dle vaší volby, včetně DeepSeek, Qwen, brány kompatibilní s OpenAI nebo interní služby. Po konfiguraci poskytovatele a modelu vyberte tento model pro příslušné připojení nebo úlohu v PandaCode.

Model musí podporovat vzor interakce vyžadovaný kódovacím enginem. Poskytovatel, který funguje pro běžný chat, může selhat u volání nástrojů, dlouhých streamů nebo strukturovaného obsahu. Podívejte se na AI modely podporované PandaNpc, kde najdete rozdíl mezi chatovými modely a lokálními kódovacími enginy, a na Instalace a příkazy PandaPaw pro nastavení vzdáleného enginu.

Řešení problémů

Chyba autentizace `401` nebo `403`

Vytvořte nový klíč poskytovatele, ověřte, že je aktivní, a zadejte jej znovu. Zkontrolujte, zda nadřazená služba vyžaduje organizaci, projekt nebo jinou metodu autentizace. Maskovaný klíč zkopírovaný z obrazovky úprav není původní tajemství.

`404` endpoint nebo model nebyl nalezen

Odstraňte /chat/completions z nakonfigurované základní URL, protože ji PandaNpc přidává. Ověřte, že /v1 je přítomno, pokud je vyžadováno, a že Model Value přesně odpovídá ID modelu nadřazeného API. Poskytovatel může vrátit stejnou 404 jak pro chybnou URL, tak pro nedostupný model.

Prohlížeč hlásí chybu sítě nebo CORS

Otevřete konzoli pro vývojáře v prohlížeči pouze pro identifikaci blokovaného původu; nevkládejte tam tajemství. Nakonfigurujte poskytovatele tak, aby povoloval https://pandanpc.com, použijte jeho HTTPS endpoint, nebo použijte desktopovou aplikaci PandaNpc. Pravidla smíšeného obsahu blokují volání některých obyčejných HTTP endpointů z HTTPS stránky.

Lokální Ollama nebo LM Studio není dosažitelné

Ujistěte se, že server běží na stejném počítači jako klient, který požadavek odesílá, a že naslouchá na nakonfigurovaném rozhraní a portu. Pokud modelový server běží na jiném počítači, localhost je nesprávné; použijte dosažitelný soukromý hostname nebo IP a zabezpečte službu před jejím vystavením.

Odpověď začne, ale zastaví se nebo nemá obsah

Ověřte, že API podporuje streamované Chat Completions a vysílá standardní události data:. Snižte Max tokenů, otestujte zprávu pouze s textem a vypněte pole strukturovaného obsahu pouze v případě, že poskytovatel dokumentuje, že přijímá výhradně řetězcový obsah.

Dlouhé relace selhávají blízko limitu kontextu

Snižte nakonfigurované Kontextové okno na skutečný podporovaný limit poskytovatele a vyhraďte prostor pro výstup, systémové instrukce a výsledky nástrojů. Po změně konfigurace modelu začněte novou relaci, aby se nové limity použily konzistentně.

Podrobnosti o kvótách na úrovni účtu a toku dat najdete v části PandaNpc účty, plány a náklady na API a v Zásadách ochrany osobních údajů.