REM · STT
Speech-to-text
Base URL https://api.lucidweights.ai/v1/stt/. Transcribe raw audio samples, uploaded files, or live PCM streams under /v1/stt/*.
Endpoints
| Method | Path | Purpose |
|---|---|---|
| POST | /v1/stt/load_model | Pre-load / warm a backend |
| POST | /v1/stt/transcribe | Transcribe base64 raw audio (PCM / µ-law) |
| POST | /v1/stt/file-transcribe | Transcribe an uploaded audio file |
| WS | /v1/stt/stream | Real-time streaming transcription |
Backends
ultrafastnormal
ultra is the default and recommended backend: fastest, auto-detects language, and model_name does not apply. fast and normal are multilingual and size-selectable.
Model names (fast / normal)
tinybasesmallmediumlarge-v2large-v3largelarge-v3-turboturbo
Languages query param
| Value | Behaviour |
|---|---|
| omitted | Full auto-detect |
| one code: en | Language forced; lowest latency |
| several: en,es,hi | fast/normal pick best match; ultra ignores multi-language hints |