MeduxMedux

Generate > Create Audio

Create Audio

Generate speech audio from text using a reusable voice asset.

POST/api/app/v1/generate/audio

Examples

curl -X POST https://api.medux.io/api/app/v1/generate/audio \
  -H 'Authorization: Bearer $MEDUX_API_KEY' \
  -H 'Content-Type: application/json' \
  -d '{"links":["https://example.com/reference"],"model":"MODEL","model_id":"MODEL_ID","text":"Hello from Medux","title":"Demo title","voice_asset_id":"VOICE_ASSET_ID"}'

Media Samples

Approved examples for understanding request inputs, response shape, and official example output.

Official text-to-speech audio

This example uses speech-standard.

Sample request

Generate speech audio from text with an official public voice.

voice_asset_idofficial_voice_demo_001textWelcome to Medux. This audio was generated from text.model_idspeech-standardmodel_idspeech-standard

Sample response

Official example output for preview only. It is not a user Media Result.

output_urlOfficial example audio output

Example output

Auth Requirements

Authentication is required via Authorization header.

Preconditions

Requires a voice_asset_id.

Requires voice_asset_id from your Media Assets or official public assets, plus non-empty text.

Also accepts optional links and model.

Request

Body

application/json
Authorizationstringrequired

Bearer token or API key.

Location: HEADER

linksarray<string>optional

Optional reference links submitted from the Playground form.

Location: BODY

modelstringoptional

Generation model label or version selected in the Playground form.

Location: BODY

model_idstringoptional

Stable public Medux model identifier.

Location: BODY

textstringoptional

No description provided.

Location: BODY

titlestringoptional

No description provided.

Location: BODY

voice_asset_idstringrequired

Reusable voice asset used for text-to-speech generation.

Location: BODY

Response

Response

application/json
codeint32optional

Application response code.

CodeMeaning
0OK
12Invalid input
1401Insufficient credits
1402Asset category does not match this operation
1403Voice asset is required
1404Provider returned an error
1405Provider request timed out
13Authentication is required
16Rate limit exceeded
99Server error

Available options: 0 12 1410 1409 1401 1402 1403 1407 1408 1404 1405 13 16 99

Location: RESPONSE

data.assetobjectoptional

No description provided.

Location: RESPONSE

data.paid_plan_requiredobjectoptional

No description provided.

Location: RESPONSE

data.taskobjectoptional

No description provided.

Location: RESPONSE

messagestringoptional

No description provided.

Available options: ok invalid input invalid model paid plan required insufficient credits asset category mismatch voice asset required asset locked asset expired provider error provider timeout unauthenticated rate limit server error

Location: RESPONSE

MCP Tool

This endpoint is also available through the Medux-hosted remote MCP service.

Speech / Text-to-Speech Audio

Create speech audio from text and an optional reusable voice asset.

Invocation Example

Generate speech audio from this text using voice_asset_id {voice_asset_id} and model_id speech-standard.

medux_speech_create_audioResult: audio
voice_asset_id{voice_asset_id}text{text}model_idspeech-standard