Konfigurasi Penyedia AI Kustom dan API Keys di PandaNpc

Diperbarui

Penyedia kustom memungkinkan PandaNpc menggunakan akun API, gateway pribadi, atau endpoint model lokal yang Anda kontrol. Ini biasanya disebut BYOK: bawa kunci Anda sendiri. Ini berguna ketika Anda membutuhkan model di luar katalog bawaan, penagihan sisi penyedia, proxy internal, Ollama, LM Studio, atau layanan yang kompatibel dengan OpenAI yang di-hosting sendiri.

Untuk obrolan langsung yang didukung, PandaNpc mengirim permintaan ke endpoint yang Anda konfigurasikan, bukan mengganti dengan model bawaan. Penyedia hulu Anda tetap mengontrol harga, retensi, batas kecepatan, ketersediaan model, dan penggunaan yang dapat diterima.

Prasyarat dan batasan keamanan

Sebelum menambahkan penyedia, kumpulkan:

  • API Key penyedia atau token autentikasi lokal.
  • URL Basis API-nya, biasanya diakhiri dengan /v1 untuk layanan yang kompatibel dengan OpenAI.
  • Identifikasi model yang tepat yang diterima oleh API.
  • Jendela konteks dan batas output maksimum yang didokumentasikan, jika Anda berencana mengganti default.

Gunakan API Key khusus dengan izin minimum yang diperlukan dan batas pengeluaran jika penyedia mendukungnya. Jangan pernah menempatkan kunci di dokumentasi, perintah obrolan, tangkapan layar, keluaran konsol browser, atau repositori Git.

Di browser web, permintaan langsung tunduk pada CORS. Penyedia harus mengizinkan permintaan dari https://pandanpc.com. URL Basis seperti http://localhost:11434/v1 merujuk ke komputer yang menjalankan browser, bukan secara otomatis ke mesin PandaPaw jarak jauh. Aplikasi desktop bisa lebih cocok untuk endpoint lokal karena tidak dibatasi oleh CORS browser dengan cara yang sama.

Langkah 1: Buka Konfigurasi Model

Masuk ke PandaNpc dan buka Konfigurasi Model. Penyedia dan model adalah catatan terpisah: penyedia menyimpan detail koneksi dan autentikasi, sementara setiap model menyimpan pengidentifikasi dan batas yang dikirim ke koneksi tersebut.

Jika penyedia resmi sudah muncul, konfigurasikan atau salin alih-alih membuat protokol yang berbeda. Untuk gateway baru yang kompatibel dengan OpenAI, pilih Tambah Penyedia.

Langkah 2: Tambahkan penyedia

Lengkapi formulir penyedia:

Kolom Yang perlu diisi Contoh atau panduan
Nama Tampilan Label yang terlihat oleh Anda Company AI Gateway
ID Penyedia Pengidentifikasi internal yang stabil company-openai
API Key Rahasia yang digunakan sebagai token pembawa Nilai yang diterbitkan penyedia
URL Basis Root API tanpa /chat/completions https://gateway.example.com/v1
Protokol Format API hulu Pilih openai untuk chat completions yang kompatibel dengan OpenAI
Secret Rahasia kedua opsional Biarkan kosong kecuali penyedia memerlukannya
Organisasi Pengidentifikasi organisasi opsional Hanya saat diperlukan oleh penyedia
Proyek Pengidentifikasi proyek opsional Hanya saat diperlukan oleh penyedia
Dukungan array konten Apakah konten pesan dapat menggunakan array terstruktur Biarkan aktif untuk penyedia yang menerima konten pesan multimodal modern

PandaNpc menghapus garis miring di akhir URL Basis dan menambahkan /chat/completions untuk permintaan obrolan langsung yang kompatibel dengan OpenAI. Oleh karena itu, masukkan:

text
https://api.example.com/v1

bukan:

text
https://api.example.com/v1/chat/completions

Simpan penyedia sebelum menambahkan model. Saat mengedit penyedia yang ada, kolom API Key atau Secret yang kosong berarti “pertahankan nilai yang dikonfigurasi”; ini tidak menampilkan rahasia yang tersimpan kembali ke formulir.

Langkah 3: Tambahkan model

Pilih Tambah Model di bawah penyedia dan lengkapi kolom-kolom ini:

Kolom Arti Contoh
Nama Tampilan Label pemilih yang dapat dibaca manusia My Coding Model
Nilai Model ID model hulu yang tepat model-name-from-provider
Tipe Model Pemetaan kemampuan/kategori PandaNpc Pilih nilai saat ini dari formulir
Penyedia Catatan penyedia yang dibuat di atas Company AI Gateway
Jendela Konteks Total token yang didukung Gunakan batas integer yang didokumentasikan penyedia
Token Maksimum Token keluaran maksimum yang dihasilkan Gunakan nilai positif tidak lebih besar dari batas penyedia

Display Name dapat diubah tanpa memengaruhi panggilan API. Model Value tidak dapat ditebak dari nama pemasaran; salin dari dokumentasi API penyedia atau endpoint daftar model.

Biarkan Jendela Konteks dan Token Maksimum kosong jika Anda tidak yakin. Default yang konservatif lebih aman daripada menyatakan jendela konteks yang lebih besar dari yang didukung server. Kolom-kolom ini sangat penting untuk PandaCode karena memengaruhi kompaksi dan penganggaran keluaran.

Contoh endpoint umum

Pola berikut mengilustrasikan bentuk URL; ketersediaan dan ID model bergantung pada instalasi atau akun penyedia Anda:

Jenis layanan URL Basis umum Catatan
API cloud yang kompatibel dengan OpenAI https://provider.example.com/v1 Harus mendukung Chat Completions streaming dan autentikasi bearer
Ollama di komputer yang menampilkan http://localhost:11434/v1 Mulai endpoint Ollama yang kompatibel dengan OpenAI; penggunaan browser mungkin memerlukan konfigurasi CORS
LM Studio di komputer yang menampilkan http://localhost:1234/v1 Mulai server lokal dan pilih ID model yang dimuat
Gateway jaringan pribadi https://ai.internal.example/v1 Klien PandaNpc harus dapat menyelesaikan dan menjangkau host

Jangan berasumsi bahwa setiap layanan yang mengiklankan “OpenAI compatible” mengimplementasikan streaming, panggilan alat, gambar, bidang penalaran, atau respons kesalahan yang identik. Uji fitur yang tepat yang dibutuhkan alur kerja Anda.

Verifikasi penyedia dan model

Gunakan prompt berbiaya rendah dan tidak sensitif sebelum mengandalkan konfigurasi:

  1. Pilih model baru dalam percakapan baru.
  2. Kirim Reply with exactly: provider connected.
  3. Konfirmasi bahwa respons mengalir (streaming) dan dasbor penyedia mencatat permintaan.
  4. Kirim tindak lanjut singkat untuk memverifikasi riwayat percakapan.
  5. Jika Anda memerlukan alat, gambar, atau konteks panjang, uji setiap kemampuan secara terpisah.

Untuk endpoint lokal, verifikasi terlebih dahulu di luar PandaNpc. Daftar model yang kompatibel dengan OpenAI sering tersedia dengan:

bash
curl http://localhost:11434/v1/models

Gunakan respons hanya untuk mengonfirmasi keterjangkauan dan ID model. Jangan menaruh API Key produksi langsung ke riwayat shell.

Gunakan model kustom dengan PandaCode

PandaCode dapat menyediakan alur kerja pengkodean ala Claude Code sambil menggunakan backend model yang Anda pilih, termasuk DeepSeek, Qwen, gateway yang kompatibel dengan OpenAI, atau layanan internal. Setelah mengonfigurasi penyedia dan model, pilih model tersebut untuk koneksi atau tugas PandaCode yang relevan.

Model harus mendukung pola interaksi yang diperlukan oleh mesin pengkodean. Penyedia yang berfungsi untuk obrolan biasa mungkin masih gagal pada panggilan alat, aliran yang berjalan lama, atau konten terstruktur. Lihat model AI yang didukung oleh PandaNpc untuk perbedaan antara model obrolan dan mesin pengkodean lokal, dan instalasi dan perintah PandaPaw untuk pengaturan mesin jarak jauh.

Pemecahan Masalah

`401` atau `403` kesalahan autentikasi

Buat API Key penyedia baru, konfirmasi aktif, dan masukkan kembali. Periksa apakah layanan hulu memerlukan organisasi, proyek, atau metode autentikasi yang berbeda. Kunci yang disamarkan yang disalin dari layar pengeditan bukanlah rahasia asli.

`404` endpoint atau model tidak ditemukan

Hapus /chat/completions dari URL Basis yang dikonfigurasi karena PandaNpc menambahkannya. Konfirmasi bahwa /v1 ada saat diperlukan dan bahwa Nilai Model persis cocok dengan ID model hulu. Penyedia dapat mengembalikan 404 yang sama untuk URL yang salah dan model yang tidak tersedia.

Browser melaporkan kesalahan jaringan atau CORS

Buka konsol pengembang browser hanya untuk mengidentifikasi asal yang diblokir; jangan tempel rahasia di sana. Konfigurasikan penyedia untuk mengizinkan https://pandanpc.com, gunakan endpoint HTTPS-nya, atau gunakan aplikasi desktop PandaNpc. Aturan konten campuran memblokir halaman HTTPS untuk memanggil beberapa endpoint HTTP biasa.

Ollama lokal atau LM Studio tidak dapat dijangkau

Pastikan server berjalan di komputer yang sama dengan klien yang membuat permintaan dan mendengarkan pada antarmuka serta port yang dikonfigurasi. Jika server model berjalan di komputer lain, localhost salah; gunakan nama host atau IP privat yang dapat dijangkau dan amankan layanan sebelum mengeksposnya.

Respons dimulai tetapi berhenti atau tidak memiliki konten

Konfirmasi bahwa API mendukung Chat Completions streaming dan memancarkan peristiwa data: standar. Kurangi Token Maksimum, uji pesan hanya teks, dan nonaktifkan array konten terstruktur hanya jika penyedia mendokumentasikan bahwa ia menerima konten string secara eksklusif.

Sesi panjang gagal mendekati batas konteks

Turunkan Jendela Konteks yang dikonfigurasi ke batas dukungan nyata penyedia dan sisakan ruang untuk keluaran, instruksi sistem, dan hasil alat. Mulai sesi baru setelah mengubah konfigurasi model agar batas baru diterapkan secara konsisten.

Untuk detail kuota tingkat akun dan alur data, baca Akun, paket, dan biaya API PandaNpc dan Kebijakan Privasi.