Integrasi Gambar, Audio, Video, dan Pengambilan
Tidak ada yang cocok. Coba nama protokol, kemampuan, atau path endpoint.
Kemampuan ini menggunakan Base URL dan kunci bearer yang sama dengan chat, tetapi masing-masing memiliki endpoint dan payload sendiri. ID model di bawah ini adalah contoh yang berfungsi; periksa Konsol → Model untuk katalog model terbaru sebelum diterapkan ke produksi.
Pembuatan Gambar
POST /v1/images/generations
Kirim prompt dalam format JSON. Baca aset yang dihasilkan dari data[0].url, atau dari data[0].b64_json saat model yang dipilih mengembalikan base64.
Parameter utama: prompt dan model wajib diisi. Gunakan size untuk resolusi, n untuk jumlah gambar, dan response_format untuk url atau b64_json. quality dan style bersifat khusus model; nilai umum meliputi standard, hd, atau auto.
curl https://api.chinaapi.ai/v1/images/generations \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedream-4-5-251128",
"prompt": "A cinematic skyline at blue hour",
"size": "1024x1024",
"response_format": "url",
"n": 1
}'
Pembuatan Gambar Gemini
POST /v1/chat/completions
Model gambar Gemini menggunakan bentuk permintaan OpenAI Chat Completions. Baca gambar Markdown yang dihasilkan dari choices[0].message.content; payload gambarnya adalah URL data:image/....
Parameter utama: kirim ID model katalog yang sudah masuk akun di model dan prompt gambar di messages. Jangan kirim model ini ke /v1/images/generations.
curl https://api.chinaapi.ai/v1/chat/completions \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "<GEMINI_IMAGE_MODEL>",
"messages": [
{
"role": "user",
"content": "Generate a cinematic skyline at blue hour"
}
],
"stream": false
}'
Ucapan ke Teks
POST /v1/audio/transcriptions
Unggah audio sebagai multipart form data; jangan atur header Content-Type secara manual. Teks yang dikenali dikembalikan dalam field text.
Parameter utama: kirim model dan file sebagai field multipart. Gunakan response_format berupa json, text, atau verbose_json saat didukung oleh model yang dipilih.
curl https://api.chinaapi.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-F "model=qwen3-asr-flash" \
-F "file=@speech.wav" \
-F "response_format=json"
Teks ke Ucapan
POST /v1/audio/speech
Isi respons berupa audio biner, jadi simpan ke file. alloy memilih suara default model; sebuah model juga dapat mempublikasikan ID suara khusus penyedia.
Parameter utama: gunakan input, model, dan voice. Pilih output dengan response_format seperti mp3 atau wav; speed dan instructions tersedia saat didukung oleh model yang dipilih.
curl https://api.chinaapi.ai/v1/audio/speech \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.5-tts",
"input": "Hello from ChinaAPI.",
"voice": "alloy",
"response_format": "mp3"
}' \
--output speech.mp3
Pembuatan Video
POST /v1/video/generations
Pembuatan video bersifat asinkron. Kirim sekali, simpan task_id yang dikembalikan, lalu polling GET /v1/video/generations/{task_id} hingga tugas berhasil atau gagal. Membuat tugas dapat menggunakan kuota.
Parameter utama: prompt dan model memulai tugas. Gunakan duration, width, height, fps, dan n jika didukung. Resolusi adalah kontrol kejernihan yang umum. Masukkan kontrol khusus penyedia seperti quality, quality_level, negative_prompt, atau pengaturan kamera ke metadata hanya jika tercantum untuk model tersebut.
curl https://api.chinaapi.ai/v1/video/generations \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "happyhorse-1.1-t2v",
"prompt": "A paper boat crossing a moonlit lake",
"duration": 5,
"width": 1280,
"height": 720
}'
curl https://api.chinaapi.ai/v1/video/generations/$TASK_ID \
-H "Authorization: Bearer $CHINAAPI_KEY"