Skip to main content
POST
Enroll voice for identification

Authorizations

x-api-key
string
header
required

Body

multipart/form-data

Upload a clean voice sample (>= 10 seconds) to generate a voice embedding.

audio_file
file
required

Clean voice sample (>= 10 seconds)

user_id
string

Optional user identifier for tracking

Response

Voice embedding generated successfully

embedding
number<float>[]

Voice embedding vector (256-dimensional)

Example:
processing_time
number<float>

Time taken to process the audio and generate the embedding in seconds

Example:

13.586525440216064

model_version
string

Model version used to generate the embedding

Example:

"titanet-large"

deepfake_checked
boolean

Whether deepfake detection was performed during enrollment

Example:

true