Integrasi Gambar, Audio, Video, dan Pengambilan

Kemampuan ini menggunakan Base URL dan kunci bearer yang sama dengan chat, tetapi masing-masing memiliki endpoint dan payload sendiri. ID model di bawah ini adalah contoh yang berfungsi; periksa Konsol → Model untuk katalog model terbaru sebelum diterapkan ke produksi.

Pembuatan Gambar

POST /v1/images/generations

Kirim prompt dalam format JSON. Baca aset yang dihasilkan dari data[0].url, atau dari data[0].b64_json saat model yang dipilih mengembalikan base64.

Parameter utama: prompt dan model wajib diisi. Gunakan size untuk resolusi, n untuk jumlah gambar, dan response_format untuk url atau b64_json. quality dan style bersifat khusus model; nilai umum meliputi standard, hd, atau auto.

curl · image
curl https://api.chinaapi.ai/v1/images/generations \
  -H "Authorization: Bearer $CHINAAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao-seedream-4-5-251128",
    "prompt": "A cinematic skyline at blue hour",
    "size": "1024x1024",
    "response_format": "url",
    "n": 1
  }'

Pembuatan Gambar Gemini

POST /v1/chat/completions

Model gambar Gemini menggunakan bentuk permintaan OpenAI Chat Completions. Baca gambar Markdown yang dihasilkan dari choices[0].message.content; payload gambarnya adalah URL data:image/....

Parameter utama: kirim ID model katalog yang sudah masuk akun di model dan prompt gambar di messages. Jangan kirim model ini ke /v1/images/generations.

curl · Gemini image chat
curl https://api.chinaapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $CHINAAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "<GEMINI_IMAGE_MODEL>",
    "messages": [
      {
        "role": "user",
        "content": "Generate a cinematic skyline at blue hour"
      }
    ],
    "stream": false
  }'

Ucapan ke Teks

POST /v1/audio/transcriptions

Unggah audio sebagai multipart form data; jangan atur header Content-Type secara manual. Teks yang dikenali dikembalikan dalam field text.

Parameter utama: kirim model dan file sebagai field multipart. Gunakan response_format berupa json, text, atau verbose_json saat didukung oleh model yang dipilih.

curl · transcription
curl https://api.chinaapi.ai/v1/audio/transcriptions \
  -H "Authorization: Bearer $CHINAAPI_KEY" \
  -F "model=qwen3-asr-flash" \
  -F "file=@speech.wav" \
  -F "response_format=json"

Teks ke Ucapan

POST /v1/audio/speech

Isi respons berupa audio biner, jadi simpan ke file. alloy memilih suara default model; sebuah model juga dapat mempublikasikan ID suara khusus penyedia.

Parameter utama: gunakan input, model, dan voice. Pilih output dengan response_format seperti mp3 atau wav; speed dan instructions tersedia saat didukung oleh model yang dipilih.

curl · speech
curl https://api.chinaapi.ai/v1/audio/speech \
  -H "Authorization: Bearer $CHINAAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mimo-v2.5-tts",
    "input": "Hello from ChinaAPI.",
    "voice": "alloy",
    "response_format": "mp3"
  }' \
  --output speech.mp3

Pembuatan Video

POST /v1/video/generations

Pembuatan video bersifat asinkron. Kirim sekali, simpan task_id yang dikembalikan, lalu polling GET /v1/video/generations/{task_id} hingga tugas berhasil atau gagal. Membuat tugas dapat menggunakan kuota.

Parameter utama: prompt dan model memulai tugas. Gunakan duration, width, height, fps, dan n jika didukung. Resolusi adalah kontrol kejernihan yang umum. Masukkan kontrol khusus penyedia seperti quality, quality_level, negative_prompt, atau pengaturan kamera ke metadata hanya jika tercantum untuk model tersebut.

curl · video
curl https://api.chinaapi.ai/v1/video/generations \
  -H "Authorization: Bearer $CHINAAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "happyhorse-1.1-t2v",
    "prompt": "A paper boat crossing a moonlit lake",
    "duration": 5,
    "width": 1280,
    "height": 720
  }'

curl https://api.chinaapi.ai/v1/video/generations/$TASK_ID \
  -H "Authorization: Bearer $CHINAAPI_KEY"