Integrasi LiteLLM

Gunakan LiteLLM dengan model AI Tiongkok melalui ChinaAPI.

Tambahkan ChinaAPI sebagai backend OpenAI-compatible di proxy LiteLLM atau Python SDK , lalu arahkan aplikasi ke model Tiongkok dengan harga resmi menggunakan satu kunci.

Prasyarat

Sebelum mengedit konfigurasi.

LiteLLM terpasang

Gunakan server proxy LiteLLM atau SDK Python.

Titik akhir ChinaAPI

Base URL adalah https://api.chinaapi.ai/v1. API keys dibuat di bawah Dashboard -> Console -> Tokens.

Pengaturan proxy

Menggunakan openai /<model> entri dalam config.yaml.

model_list:
  - model_name: deepseek-fast
    litellm_params:
      model: openai/deepseek-v4-flash
      api_base: https://api.chinaapi.ai/v1
      api_key: os.environ/CHINAAPI_API_KEY

  - model_name: kimi-code
    litellm_params:
      model: openai/kimi-k2.7-code
      api_base: https://api.chinaapi.ai/v1
      api_key: os.environ/CHINAAPI_API_KEY

  - model_name: qwen-max
    litellm_params:
      model: openai/qwen3.7-max
      api_base: https://api.chinaapi.ai/v1
      api_key: os.environ/CHINAAPI_API_KEY
export CHINAAPI_API_KEY="sk-..."
litellm --config config.yaml --port 4000

SDK Python

Hubungi ChinaAPI langsung dari LiteLLM.

import os
from litellm import completion

response = completion(
    model="openai/deepseek-v4-flash",
    api_base="https://api.chinaapi.ai/v1",
    api_key=os.environ["CHINAAPI_API_KEY"],
    messages=[{"role": "user", "content": "Say LiteLLM is connected to ChinaAPI."}],
    stream=True,
)

for chunk in response:
    print(chunk, end="")

Model yang direkomendasikan

Rute LiteLLM yang bagus.

Untuk detail model terkini dan bukti tingkat suku bunga, silakan tinjau. DeepSeek-V4 Dan Kimi K2.7 sebelum menetapkan rute produksi.

deepseek-v4-flash

Rute cadangan cepat untuk obrolan, bantuan pengkodean, dan perulangan agen.

kimi-k2.7-code

Rute pengkodean yang baik untuk tugas tingkat repositori dan sesi yang lebih panjang.

qwen3.7-max

Rute yang mengutamakan penalaran ketika kualitas lebih penting daripada latensi.

glm-5.2

Rute konteks panjang untuk dokumen dan basis kode yang lebih besar.

MiniMax-M3

Pengkodean multimodal dan model konteks panjang untuk perutean alternatif.

Penyelesaian Masalah

Masalah umum LiteLLM.

Model berpikir seperti qwen3.7-max Dapat menghasilkan token penalaran sebelum output akhir. Gunakan streaming di klien di belakang LiteLLM atau tingkatkan batas waktu upstream/klien.

Model tidak ditemukan: periksa model ID yang tepat pada harga langsunglalu perbarui litellm_params .model. Pertahankan openai / Awalan untuk perutean OpenAI-compatible .

401 : mengonfirmasi CHINAAPI_API_KEY menyelesaikan menjadi sebuah sk-... kunci dan LiteLLM meneruskannya sebagai penyedia API key .

Harga dan pendaftaran

Gunakan penetapan harga token yang disinkronkan dengan gateway di belakang gateway LiteLLM Anda.

Tarif mungkin mengikuti daftar harga resmi penyedia di Tiongkok jika dikonfigurasi. Daftar untuk mendapatkan kredit gratis $2 , lalu periksa harga langsung sebelum mengarahkan lalu lintas produksi.