Type
Speech recognition (ASR)
Start free — $2 credit
Alibaba / Qwen API model
Qwen3-ASR-Flash — multilingual file transcription with language hints, inverse text normalization, emotion recognition, and OpenAI-compatible audio input.
Specs
Transparent USD pricing. No mainland-China account or phone required. The displayed media rate may include a service margin covering provider input/output billing, payment processing, chargeback exposure, and operations. Any margin is included in the displayed rate and is not added separately.
Speech recognition (ASR)
Audio input, text output
Audio, Speech-to-Text, Multilingual, Emotion Recognition, ITN
$0.11 per audio hour
/v1/audio/transcriptions
Qwen3-ASR-Flash — multilingual file transcription with language hints, inverse text normalization, emotion recognition, and OpenAI-compatible audio input.
Pricing
$0.11 per audio hour. Paid in USD. The displayed media rate may include a service margin covering provider input/output billing, payment processing, chargeback exposure, and operations. Any margin is included in the displayed rate and is not added separately. View live pricing
Quickstart
curl -X POST https://api.chinaapi-ru.com/v1/audio/transcriptions \
-H "Authorization: Bearer sk-..." \
-F "model=qwen3-asr-flash" \
-F "file=@meeting.wav" \
-F "response_format=json"
Internal links
Use qwen3-asr-flash through ChinaAPI with an API key and the OpenAI-compatible endpoint shown above.
qwen3-asr-flash is $0.11 per audio hour, paid in USD. The live pricing page is authoritative. The displayed media rate may include a service margin covering provider input/output billing, payment processing, chargeback exposure, and operations. Any margin is included in the displayed rate and is not added separately.
No. ChinaAPI provides access without a mainland-China account or phone number and includes a $2 free trial. Check live pricing for the displayed USD rate.