Análisis acústico

Hay cosas que se miden. No se le piden adivinadas a un modelo.

Cuánto esperó el cliente en espera, cuánto de la llamada fue silencio, qué tan rápido habló el agente, qué tan forzada estaba su voz al final del turno: son propiedades de la onda, y las medimos. El trabajo corre en un servicio que operamos nosotros, construido sobre Praat y librosa, en infraestructura propia. Sin un segundo proveedor de IA y sin nadie más guardando tu audio.

Qué obtienes

Medido, no estimado

Talk ratio, velocidad de habla, muletillas, silencios y tiempo en espera salen de la señal y de la transcripción, de forma determinista. Un supervisor puede recontarlos a mano y obtener el mismo número, que es lo que importa cuando ese número está por decírsele a una persona.

Qué está haciendo la voz

Tono, jitter, shimmer, relación armónicos-ruido, planitud espectral y energía. Las medidas que usaría un fonetista, calculadas con Praat y librosa en vez de inferidas de un resumen de texto de la llamada.

En infraestructura que operamos

El servicio acústico es nuestro y está en nuestra propia red. Tus grabaciones no se mandan a un segundo proveedor de IA para esto, porque medir una onda no necesita ninguno.

Sabe qué no es voz

El tono de llamada al inicio de una grabación y la música de espera en el medio se detectan y se excluyen, para que «silencio» signifique el cliente esperando y no los dos segundos de timbre antes de que alguien contestara.

Cómo funciona

1

El archivo original, una vez

La medición corre sobre el audio que subiste, antes de comprimirlo para guardarlo: el trabajo de un códec es tirar justamente el contenido tipo ruido del que están hechas estas medidas.

2

Se mide la onda

Nuestro servicio calcula las cifras acústicas y la línea de tiempo de esperas y silencios, y devuelve números.

3

Queda al lado de la nota

En la llamada, en el dashboard y en el plan de coaching — con los promedios de la propia empresa al lado, para que una llamada se lea contra cómo suena normalmente ese equipo.

Lo que suelen preguntar sobre esto

Porque un modelo de lenguaje lee una transcripción, y una transcripción ya tiró el audio. Pregúntale cuánto duró una espera y te da un número plausible, no una medición. Estas cifras terminan en conversaciones de coaching y a veces en apelaciones, así que tienen que ser reproducibles — y la única forma es medir la onda.

El análisis acústico ocurre en nuestra propia infraestructura y la grabación no se manda a un tercero para eso. La transcripción es el único paso que usa la plataforma de IA empresarial de Google, bajo términos que excluyen tus datos del entrenamiento de modelos. Preferimos trazar esa línea con claridad antes de que supongas de más o de menos.

La llamada se abre igual y las métricas sacadas de la transcripción siguen ahí; el panel acústico simplemente no aparece hasta que vuelva. Una herramienta de calidad que se niega a mostrar una llamada porque un servicio lateral está reiniciando es peor que una que muestra un poco menos.

Incluido en
Smart AIElite AI
Ver en qué plan viene

Pruébalo con tus propias llamadas

Mándanos un puñado de grabaciones y tu scorecard actual. Las evaluamos, te mostramos el resultado junto al de tu equipo y te decimos con honestidad qué ganarías y qué no.

Sin demo automática. Una conversación real, normalmente en un día hábil.