Configuración de Deepgram para transcripción de audio
¿Alguna vez has intentado procesar notas de voz y te has encontrado con transcripciones que no tienen sentido? Manejar audio de forma manual consume mucho tiempo y suele fallar cuando los archivos son pesados o el formato no es el ideal.
Si buscas una solución que funcione sin complicaciones, Deepgram es la mejor opción. En OpenClaw, lo usamos para procesar audio entrante y notas de voz mediante tools.media.audio. Cuando lo activas, el sistema sube el archivo a Deepgram e inyecta el texto directamente en el flujo de respuesta usando el bloque {{Transcript}}.
Requisitos previos
Sección titulada «Requisitos previos»- Una API key de Deepgram.
- OpenClaw instalado y funcionando.
Inicio rápido
Sección titulada «Inicio rápido»Configurar Deepgram te tomará menos de 5 minutos. Sigue estos pasos:
- Define tu API key en las variables de entorno:
DEEPGRAM_API_KEY=dg_...- Activa el provider en tu archivo de configuración:
{ tools: { media: { audio: { enabled: true, models: [{ provider: "deepgram", model: "nova-3" }], }, }, },}Opciones de configuración
Sección titulada «Opciones de configuración»Puedes ajustar cómo Deepgram procesa el audio. Te recomiendo usar nova-3 por su velocidad. Si necesitas especificar un idioma, puedes hacerlo así:
{ tools: { media: { audio: { enabled: true, models: [{ provider: "deepgram", model: "nova-3", language: "es" }], }, }, },}Para un control más preciso, como la detección automática de idioma o el formateo inteligente, usa providerOptions:
{ tools: { media: { audio: { enabled: true, providerOptions: { deepgram: { detect_language: true, punctuate: true, smart_format: true, }, }, models: [{ provider: "deepgram", model: "nova-3" }], }, }, },}Solución de problemas
Sección titulada «Solución de problemas»Si encuentras problemas al procesar audio, revisa estos puntos basados en el comportamiento del sistema:
- Errores de autenticación: OpenClaw sigue un orden estándar para los providers. Asegúrate de que
DEEPGRAM_API_KEYesté bien escrita en tu entorno. - Uso de proxies: Si no puedes conectar directamente con la API, usa
tools.media.audio.baseUrlytools.media.audio.headerspara redirigir las peticiones. - Límites de archivos: El sistema aplica reglas de audio generales. Verifica que tus archivos no superen los límites de tamaño o los tiempos de espera (timeouts).
- Transcripciones vacías: Recuerda que este proceso no es streaming; utiliza el endpoint de transcripción pre-grabada.
Próximos pasos
Sección titulada «Próximos pasos»OpenClaw Expert
Sigues atascado?
Si esta pagina no resolvio tu caso, pregunta a OpenClaw Expert para pasos concretos.