Niestandardowi dostawcy pozwalają PandaNpc korzystać z konta API, prywatnej bramy lub lokalnego punktu końcowego modelu, który kontrolujesz. Jest to powszechnie nazywane BYOK: przynieść własny klucz. Jest to przydatne, gdy potrzebujesz modelu spoza wbudowanego katalogu, rozliczeń po stronie dostawcy, wewnętrznego proxy, Ollama, LM Studio lub samodzielnie hostowanej usługi zgodnej z OpenAI.
W przypadku obsługiwanego czatu bezpośredniego PandaNpc wysyła żądanie do skonfigurowanego punktu końcowego, zamiast podstawiać wbudowany model. Twój zewnętrzny dostawca nadal kontroluje ceny, retencję, limity szybkości, dostępność modeli i dozwolone zastosowania.
Wymagania wstępne i granice bezpieczeństwa
Przed dodaniem dostawcy zbierz:
- Klucz API dostawcy lub lokalny token uwierzytelniający.
- API Base URL, zwykle kończący się na
/v1dla usługi zgodnej z OpenAI. - Dokładny identyfikator modelu akceptowany przez API.
- Udokumentowane okno kontekstu i maksymalny limit wyjściowy, jeśli planujesz zastąpić wartości domyślne.
Użyj dedykowanego klucza z minimalnymi niezbędnymi uprawnieniami i limitem wydatków, jeśli dostawca go obsługuje. Nigdy nie umieszczaj klucza w dokumentacji, promptach czatu, zrzutach ekranu, wyjściu konsoli przeglądarki ani w repozytorium Git.
W przeglądarce internetowej bezpośrednie żądania podlegają CORS. Dostawca musi zezwolić na żądania z https://pandanpc.com. Base URL, taki jak http://localhost:11434/v1, odnosi się do komputera uruchamiającego przeglądarkę, a nie automatycznie do zdalnej maszyny PandaPaw. Aplikacja desktopowa może być bardziej odpowiednia dla lokalnych punktów końcowych, ponieważ nie jest ograniczona przez CORS w przeglądarce w ten sam sposób.
Krok 1: Otwórz konfigurację modeli
Zaloguj się do PandaNpc i otwórz Model Configuration. Dostawcy i modele to osobne rekordy: dostawca przechowuje szczegóły połączenia i uwierzytelniania, a każdy model przechowuje identyfikator i limity wysyłane do tego połączenia.
Jeśli oficjalny dostawca już się pojawia, skonfiguruj go lub skopiuj, zamiast wymyślać inny protokół. W przypadku nowej bramy zgodnej z OpenAI wybierz Add Provider.
Krok 2: Dodaj dostawcę
Wypełnij formularz dostawcy:
| Pole | Co wpisać | Przykład lub wskazówka |
|---|---|---|
| Nazwa wyświetlana | Etykieta widoczna dla Ciebie | Company AI Gateway |
| ID dostawcy | Stabilny wewnętrzny identyfikator | company-openai |
| API Key | Sekret używany jako token okaziciela | Wartość wydana przez dostawcę |
| Base URL | Punkt główny API bez /chat/completions |
https://gateway.example.com/v1 |
| Protokół | Format zewnętrznego API | Wybierz openai dla kompletacji czatu zgodnych z OpenAI |
| Sekret | Opcjonalny drugi sekret | Pozostaw puste, chyba że dostawca tego wymaga |
| Organizacja | Opcjonalny identyfikator organizacji | Tylko gdy wymaga tego dostawca |
| Projekt | Opcjonalny identyfikator projektu | Tylko gdy wymaga tego dostawca |
| Obsługa tablicy treści | Czy treść wiadomości może używać ustrukturyzowanych tablic | Zachowaj włączone dla dostawców akceptujących nowoczesną multimodalną treść wiadomości |
PandaNpc usuwa końcowe ukośniki z Base URL i dodaje /chat/completions dla bezpośredniego żądania czatu zgodnego z OpenAI. Dlatego wpisz:
https://api.example.com/v1nie:
https://api.example.com/v1/chat/completionsZapisz dostawcę przed dodaniem modelu. Podczas edytowania istniejącego dostawcy puste pole API Key lub Sekret oznacza „zachowaj skonfigurowaną wartość”; nie ujawnia przechowywanego sekretu z powrotem w formularzu.
Krok 3: Dodaj model
Wybierz Add Model przy dostawcy i wypełnij te pola:
| Pole | Znaczenie | Przykład |
|---|---|---|
| Nazwa wyświetlana | Czytelna etykieta wyboru | My Coding Model |
| Wartość modelu | Dokładny identyfikator modelu u dostawcy | model-name-from-provider |
| Typ modelu | Mapowanie możliwości/kategorii PandaNpc | Wybierz bieżącą wartość z formularza |
| Dostawca | Rekord dostawcy utworzony powyżej | Company AI Gateway |
| Okno kontekstu | Całkowita obsługiwana liczba tokenów | Użyj udokumentowanego limitu całkowitego dostawcy |
| Maks. tokeny | Maksymalna liczba wygenerowanych tokenów wyjściowych | Użyj dodatniej wartości nie większej niż limit dostawcy |
Nazwa wyświetlana może być zmieniana bez wpływu na wywołanie API. Wartość modelu nie może być zgadywana na podstawie nazwy marketingowej; skopiuj ją z dokumentacji API dostawcy lub punktu końcowego listy modeli.
Pozostaw Okno kontekstu i Maks. tokeny puste, gdy nie jesteś pewien. Konserwatywna wartość domyślna jest bezpieczniejsza niż deklarowanie okna kontekstu większego niż serwer obsługuje. Te pola są szczególnie ważne dla PandaCode, ponieważ wpływają na kompaktowanie i budżetowanie wyjścia.
Typowe przykłady punktów końcowych
Poniższe wzorce ilustrują kształt adresu URL; dostępność i identyfikatory modeli zależą od Twojej instalacji lub konta dostawcy:
| Typ usługi | Typowy Base URL | Uwagi |
|---|---|---|
| Chmurowy API zgodny z OpenAI | https://provider.example.com/v1 |
Musi obsługiwać strumieniowe Chat Completions i uwierzytelnianie okaziciela |
| Ollama na komputerze przeglądającym | http://localhost:11434/v1 |
Uruchom punkt końcowy Ollama zgodny z OpenAI; użycie w przeglądarce może wymagać konfiguracji CORS |
| LM Studio na komputerze przeglądającym | http://localhost:1234/v1 |
Uruchom lokalny serwer i wybierz załadowany identyfikator modelu |
| Brama sieci prywatnej | https://ai.internal.example/v1 |
Klient PandaNpc musi być w stanie rozwiązać i osiągnąć hosta |
Nie zakładaj, że każda usługa reklamująca „zgodność z OpenAI” implementuje strumieniowanie, wywołania narzędzi, obrazy, pola rozumowania lub identyczne odpowiedzi błędów. Przetestuj dokładnie funkcje, których potrzebuje Twój przepływ pracy.
Weryfikacja dostawcy i modelu
Użyj taniego, niewrażliwego promptu, zanim zaczniesz polegać na konfiguracji:
- Wybierz nowy model w świeżej rozmowie.
- Wyślij
Odpowiedz dokładnie: dostawca połączony. - Potwierdź, że odpowiedź jest strumieniowana, a panel dostawcy rejestruje żądanie.
- Wyślij krótką odpowiedź, aby zweryfikować historię rozmowy.
- Jeśli potrzebujesz narzędzi, obrazów lub długiego kontekstu, przetestuj każdą funkcję osobno.
W przypadku lokalnego punktu końcowego najpierw zweryfikuj go poza PandaNpc. Lista modeli zgodna z OpenAI jest często dostępna za pomocą:
curl http://localhost:11434/v1/modelsUżyj odpowiedzi tylko do potwierdzenia osiągalności i identyfikatora modelu. Nie umieszczaj produkcyjnego klucza API bezpośrednio w historii powłoki.
Używanie niestandardowych modeli z PandaCode
PandaCode może zapewnić przepływ pracy w stylu Claude Code, korzystając z wybranego backendu modelu, w tym DeepSeek, Qwen, bramy zgodnej z OpenAI lub usługi wewnętrznej. Po skonfigurowaniu dostawcy i modelu wybierz ten model dla odpowiedniego połączenia lub zadania PandaCode.
Model musi obsługiwać wzorzec interakcji wymagany przez silnik kodowania. Dostawca, który działa w zwykłym czacie, może nadal zawieść przy wywołaniach narzędzi, długotrwałych strumieniach lub ustrukturyzowanej treści. Zobacz Modele AI obsługiwane przez PandaNpc, aby poznać różnicę między modelami czatu a lokalnymi silnikami kodowania, oraz Instalacja i polecenia PandaPaw, aby uzyskać konfigurację zdalnego silnika.
Rozwiązywanie problemów
Błąd uwierzytelniania `401` lub `403`
Utwórz nowy klucz dostawcy, potwierdź, że jest aktywny, i wprowadź go ponownie. Sprawdź, czy usługa zewnętrzna wymaga organizacji, projektu lub innej metody uwierzytelniania. Zmaskowany klucz skopiowany z ekranu edycji nie jest oryginalnym sekretem.
Błąd `404` punkt końcowy lub model nie znaleziony
Usuń /chat/completions ze skonfigurowanego Base URL, ponieważ PandaNpc go dodaje. Potwierdź, że /v1 jest obecne, gdy jest wymagane, i że Wartość modelu dokładnie odpowiada identyfikatorowi modelu u dostawcy. Dostawca może zwrócić ten sam 404 zarówno dla błędnego adresu URL, jak i niedostępnego modelu.
Przeglądarka zgłasza błąd sieci lub CORS
Otwórz konsolę deweloperską przeglądarki tylko w celu zidentyfikowania zablokowanego pochodzenia; nie wklejaj tam sekretów. Skonfiguruj dostawcę tak, aby zezwalał na https://pandanpc.com, użyj jego punktu końcowego HTTPS lub użyj aplikacji desktopowej PandaNpc. Reguły mieszanej treści blokują stronie HTTPS wywołanie niektórych zwykłych punktów końcowych HTTP.
Lokalne Ollama lub LM Studio nieosiągalne
Upewnij się, że serwer działa na tym samym komputerze co klient wysyłający żądanie i nasłuchuje na skonfigurowanym interfejsie i porcie. Jeśli serwer modelu działa na innym komputerze, localhost jest błędny; użyj osiągalnej prywatnej nazwy hosta lub adresu IP i zabezpiecz usługę przed jej wystawieniem.
Odpowiedź zaczyna się, ale zatrzymuje się lub nie ma treści
Potwierdź, że API obsługuje strumieniowane Chat Completions i emituje standardowe zdarzenia data:. Zmniejsz Maks. tokeny, przetestuj wiadomość tylko tekstową i wyłącz ustrukturyzowane tablice treści tylko wtedy, gdy dostawca dokumentuje, że akceptuje wyłącznie treść string.
Długie sesje nieudane w pobliżu limitu kontekstu
Zmniejsz skonfigurowane Okno kontekstu do rzeczywistego obsługiwanego limitu dostawcy i zarezerwuj miejsce na wyjście, instrukcje systemowe i wyniki narzędzi. Rozpocznij nową sesję po zmianie konfiguracji modelu, aby nowe limity były stosowane spójnie.
Aby uzyskać szczegóły dotyczące limitów na poziomie konta i przepływu danych, przeczytaj Konta, plany i koszty API PandaNpc oraz Politykę prywatności.