Ir al contenido

Configuración de Deepgram para transcripción de audio

¿Alguna vez has intentado procesar notas de voz y te has encontrado con transcripciones que no tienen sentido? Manejar audio de forma manual consume mucho tiempo y suele fallar cuando los archivos son pesados o el formato no es el ideal.

Si buscas una solución que funcione sin complicaciones, Deepgram es la mejor opción. En OpenClaw, lo usamos para procesar audio entrante y notas de voz mediante tools.media.audio. Cuando lo activas, el sistema sube el archivo a Deepgram e inyecta el texto directamente en el flujo de respuesta usando el bloque {{Transcript}}.

  • Una API key de Deepgram.
  • OpenClaw instalado y funcionando.

Configurar Deepgram te tomará menos de 5 minutos. Sigue estos pasos:

  1. Define tu API key en las variables de entorno:
Ventana de terminal
DEEPGRAM_API_KEY=dg_...
  1. Activa el provider en tu archivo de configuración:
{
tools: {
media: {
audio: {
enabled: true,
models: [{ provider: "deepgram", model: "nova-3" }],
},
},
},
}

Puedes ajustar cómo Deepgram procesa el audio. Te recomiendo usar nova-3 por su velocidad. Si necesitas especificar un idioma, puedes hacerlo así:

{
tools: {
media: {
audio: {
enabled: true,
models: [{ provider: "deepgram", model: "nova-3", language: "es" }],
},
},
},
}

Para un control más preciso, como la detección automática de idioma o el formateo inteligente, usa providerOptions:

{
tools: {
media: {
audio: {
enabled: true,
providerOptions: {
deepgram: {
detect_language: true,
punctuate: true,
smart_format: true,
},
},
models: [{ provider: "deepgram", model: "nova-3" }],
},
},
},
}

Si encuentras problemas al procesar audio, revisa estos puntos basados en el comportamiento del sistema:

  • Errores de autenticación: OpenClaw sigue un orden estándar para los providers. Asegúrate de que DEEPGRAM_API_KEY esté bien escrita en tu entorno.
  • Uso de proxies: Si no puedes conectar directamente con la API, usa tools.media.audio.baseUrl y tools.media.audio.headers para redirigir las peticiones.
  • Límites de archivos: El sistema aplica reglas de audio generales. Verifica que tus archivos no superen los límites de tamaño o los tiempos de espera (timeouts).
  • Transcripciones vacías: Recuerda que este proceso no es streaming; utiliza el endpoint de transcripción pre-grabada.

AI Setup Assistant

OpenClaw

OpenClaw Expert

Sigues atascado?

Si esta pagina no resolvio tu caso, pregunta a OpenClaw Expert para pasos concretos.