🎙️ Sesión de Voz en Tiempo Real
desconectado⏱️ Métricas del Último Turno
TTFA Total (p95)
-- ms
Meta: ≤ 500 ms
Endpointing
-- ms
VAD / Semántico
LLM TTFT
-- ms
GPT-5.4-mini
TTS TTFB
-- ms
Cartesia Sonic-3
💬 Transcripción en Vivo
Deepgram Nova-3 + LiveKit TranscriptsPulsa "Hablar con el agente" para iniciar la conversación.
⚡ Banco de Pruebas de Latencia (USA East)
Medición de latencia end-to-end desde la VPS de producción (Ashburn, VA) hacia LiveKit Cloud US East B.
Modelos Evaluados en la Cadena:
| Etapa | Proveedor / Modelo | Ubicación | Presupuesto | Estado |
|---|---|---|---|---|
| STT (Escucha) | Deepgram Nova-3 | US East | 100–150 ms | Óptimo |
| LLM (Razonamiento) | OpenAI GPT-5.4-mini | US East | 150–300 ms | Óptimo |
| TTS (Habla) | Cartesia Sonic-3 | US East | 90–200 ms | Óptimo |
| VAD / Endpointing | Inference TurnDetector + Silero | In-Process | 150–300 ms | Bajo análisis |
⚙️ Configuración del Agente y Tenant
Editor del prompt del sistema y parámetros de voz de demo.yaml.
🛠️ Catálogo de Herramientas (Tools)
Verificación de conectividad con el SaaS vertical de salones (demo-saas).
GET
listServices
Server Tool · PrefetchLista los servicios disponibles del salón (corte, tinte, manicure...). Se precarga al abrir la llamada.
GET
getAvailability
Server ToolConsulta disponibilidad horaria de un servicio específico para una fecha.
RPC
highlightService
Client ToolResalta visualmente un servicio en la pantalla del usuario vía WebRTC RPC.