Интеграция изображений, аудио, видео и поиска
Ничего не найдено. Попробуйте указать протокол, возможность или путь эндпоинта.
Эти возможности используют тот же Base URL и тот же bearer-ключ, что и чат, но у каждой свой эндпоинт и своя структура запроса. Идентификаторы моделей ниже — рабочие примеры; перед выпуском в продакшен сверьтесь с актуальным каталогом в разделе Консоль → Модели.
Генерация изображений
POST /v1/images/generations
Отправьте промпт в JSON. Читайте созданный файл из data[0].url или из data[0].b64_json, если выбранная модель возвращает base64.
Ключевые параметры: prompt и model обязательны. size задаёт разрешение, n — количество изображений, response_format — url или b64_json. quality и style зависят от модели; распространённые значения — standard, hd или auto.
curl https://api.chinaapi.ai/v1/images/generations \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedream-4-5-251128",
"prompt": "A cinematic skyline at blue hour",
"size": "1024x1024",
"response_format": "url",
"n": 1
}'
Генерация изображений Gemini
POST /v1/chat/completions
Модели изображений Gemini используют форму запроса OpenAI Chat Completions. Читайте созданное изображение в формате Markdown из choices[0].message.content; полезная нагрузка изображения — это URL вида data:image/....
Ключевые параметры: передайте идентификатор модели из каталога в model, а промпт изображения — в messages. Не отправляйте эту модель на /v1/images/generations.
curl https://api.chinaapi.ai/v1/chat/completions \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "<GEMINI_IMAGE_MODEL>",
"messages": [
{
"role": "user",
"content": "Generate a cinematic skyline at blue hour"
}
],
"stream": false
}'
Речь в текст
POST /v1/audio/transcriptions
Загружайте аудио как multipart form data; не задавайте заголовок Content-Type вручную. Распознанный текст возвращается в поле text.
Ключевые параметры: передайте model и file как поля multipart. Используйте response_format со значением json, text или verbose_json, если выбранная модель это поддерживает.
curl https://api.chinaapi.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-F "model=qwen3-asr-flash" \
-F "file=@speech.wav" \
-F "response_format=json"
Текст в речь
POST /v1/audio/speech
Тело ответа — двоичное аудио, поэтому записывайте его в файл. alloy выбирает голос модели по умолчанию; модель может публиковать и собственные идентификаторы голосов.
Ключевые параметры: используйте input, model и voice. Формат вывода задаётся через response_format — например, mp3 или wav; speed и instructions доступны, если выбранная модель их поддерживает.
curl https://api.chinaapi.ai/v1/audio/speech \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.5-tts",
"input": "Hello from ChinaAPI.",
"voice": "alloy",
"response_format": "mp3"
}' \
--output speech.mp3
Генерация видео
POST /v1/video/generations
Генерация видео асинхронная. Отправьте запрос один раз, сохраните возвращённый task_id, затем опрашивайте GET /v1/video/generations/{task_id}, пока задача не завершится успешно или с ошибкой. Создание задачи может списывать квоту.
Ключевые параметры: задачу запускают prompt и model. Там, где это поддерживается, используйте duration, width, height, fps и n. Разрешение — общий способ управления чёткостью. Параметры, специфичные для поставщика, такие как quality, quality_level, negative_prompt или настройки камеры, помещайте в metadata только тогда, когда они указаны для этой модели.
curl https://api.chinaapi.ai/v1/video/generations \
-H "Authorization: Bearer $CHINAAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "happyhorse-1.1-t2v",
"prompt": "A paper boat crossing a moonlit lake",
"duration": 5,
"width": 1280,
"height": 720
}'
curl https://api.chinaapi.ai/v1/video/generations/$TASK_ID \
-H "Authorization: Bearer $CHINAAPI_KEY"