Intégration image, audio, vidéo et recherche
Aucun résultat. Essayez un protocole, une capacité ou un chemin d'endpoint.
Ces fonctions utilisent la même Base URL et la même clé bearer que le chat, mais chacune possède son propre endpoint et son propre payload. Les ID de modèles ci-dessous sont des exemples fonctionnels ; vérifiez Console → Modèles pour obtenir le catalogue à jour avant la mise en production.
Génération d’images
POST /v1/images/generations
Envoyez un prompt JSON. Récupérez le résultat dans data[0].url, ou dans data[0].b64_json lorsque le modèle sélectionné renvoie du base64.
Paramètres clés : prompt et model sont requis. Utilisez size pour la résolution, n pour le nombre d’images et response_format pour url ou b64_json. quality et style dépendent du modèle ; les valeurs courantes incluent standard, hd ou auto.
curl https://api.chinaapi.ai/v1/images/generations \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedream-4-5-251128",
"prompt": "A cinematic skyline at blue hour",
"size": "1024x1024",
"response_format": "url",
"n": 1
}'
Génération d’images Gemini
POST /v1/chat/completions
Les modèles d’image Gemini utilisent le format OpenAI Chat Completions. L’image Markdown générée se trouve dans choices[0].message.content et utilise une URL data:image/....
Paramètres clés : utilisez dans model l’ID visible dans le catalogue après connexion et placez le prompt d’image dans messages. N’envoyez pas ce modèle à /v1/images/generations.
curl https://api.chinaapi.ai/v1/chat/completions \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "<GEMINI_IMAGE_MODEL>",
"messages": [
{
"role": "user",
"content": "Generate a cinematic skyline at blue hour"
}
],
"stream": false
}'
Transcription audio
POST /v1/audio/transcriptions
Envoyez le fichier audio en multipart form data ; ne définissez pas manuellement l’en-tête Content-Type. Le texte reconnu est renvoyé dans le champ text.
Paramètres clés : envoyez model et file sous forme de champs multipart. Utilisez response_format avec json, text ou verbose_json lorsque le modèle sélectionné le prend en charge.
curl https://api.chinaapi.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-F "model=qwen3-asr-flash" \
-F "file=@speech.wav" \
-F "response_format=json"
Synthèse vocale
POST /v1/audio/speech
Le corps de la réponse contient des données audio binaires : enregistrez-le dans un fichier. alloy sélectionne la voix par défaut du modèle ; certains modèles publient aussi des ID de voix propres au fournisseur.
Paramètres clés : utilisez input, model et voice. Choisissez une sortie avec response_format, par exemple mp3 ou wav ; speed et instructions sont disponibles lorsque le modèle sélectionné les prend en charge.
curl https://api.chinaapi.ai/v1/audio/speech \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.5-tts",
"input": "Hello from ChinaAPI.",
"voice": "alloy",
"response_format": "mp3"
}' \
--output speech.mp3
Génération vidéo
POST /v1/video/generations
La génération vidéo est asynchrone. Envoyez la requête une seule fois, conservez le task_id renvoyé, puis interrogez GET /v1/video/generations/{task_id} jusqu’à la réussite ou l’échec. La création d’une tâche peut consommer du quota.
Paramètres clés : prompt et model démarrent la tâche. Utilisez duration, width, height, fps et n lorsqu’ils sont pris en charge. La résolution est le réglage habituel de la netteté. Ajoutez les contrôles propres au fournisseur, tels que quality, quality_level, negative_prompt ou les réglages de caméra, dans metadata uniquement lorsqu’ils sont publiés pour ce modèle.
curl https://api.chinaapi.ai/v1/video/generations \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "happyhorse-1.1-t2v",
"prompt": "A paper boat crossing a moonlit lake",
"duration": 5,
"width": 1280,
"height": 720
}'
curl https://api.chinaapi.ai/v1/video/generations/$TASK_ID \
-H "Authorization: Bearer $CHINAAPI_KEY"