Audio a texto
Un modelo de voz candidato separaría habla y silencio, transcribiría cada turno y conservaría hablante, tiempo y palabras. Este modelo propio todavía no está entrenado.
Vocero propone un flujo para pasar de audio a transcripción y de la transcripción a un acta que una persona pueda verificar. Cada decisión, tarea o respuesta debe conservar su vínculo con lo dicho.
En desarrollo para uso interno. El modelo propio aún no está entrenado.
La arquitectura separa el reconocimiento de voz del análisis de la reunión para que cada etapa pueda evaluarse por separado.
Un modelo de voz candidato separaría habla y silencio, transcribiría cada turno y conservaría hablante, tiempo y palabras. Este modelo propio todavía no está entrenado.
Un modelo de lenguaje candidato extraería entidades, acuerdos, tareas, responsables y asuntos pendientes desde la transcripción. Esta etapa también forma parte del plan.
La salida prevista organiza los hallazgos en un acta legible y conserva referencias a las líneas de la transcripción para facilitar la revisión.
El acta es una ayuda para la persona responsable de la reunión, no una decisión automática.
Cada punto debe señalar la línea o líneas que lo sustentan. Si la reunión no contiene una respuesta, el sistema debe indicarlo en vez de inventarla.
Una persona confirma nombres, cifras, decisiones, responsables y fechas antes de guardar o enviar el acta.
Los nombres, cifras o decisiones ausentes de la transcripción cuentan como invenciones y deben registrarse en la evaluación.
La presentación interactiva usa reuniones ficticias con una salida correcta conocida para explicar el formato.
Un guion sintético de atención al cliente muestra un cargo duplicado, la apertura de un caso, una nota de crédito y una confirmación por correo.
Las respuestas guionadas citan las líneas pertinentes y señalan cuando falta un dato, como el número de caso.
Los tiempos, ondas, entidades y respuestas están programados. El ejemplo no es una prueba del reconocimiento de voz ni del modelo propio.
La aplicación se usa internamente con un motor de dictado que no es el modelo propio de Vocero. El programa aún debe crear datos, entrenar candidatos y medir resultados.
El sitio y sus demostraciones sintéticas funcionan, y CareCompile usa internamente una aplicación de reuniones y dictado.
No hay un modelo propio entrenado, cifras de precisión ni una evaluación sellada completada.
Vocero investiga dictado para el español de El Salvador y Centroamérica. Pruebe las reglas de comandos implementadas y conozca el plan de voz regional.
Conocer el alcanceCareCompile busca una contraparte institucional en El Salvador para explorar datos de voz y texto con consentimiento, propósito limitado y evaluación independiente.
Conocer el alcanceRevise la arquitectura propuesta de Vocero, su plan de entrenamiento y Vocero-Bench para medir voz, dictado y actas por país. Aún no hay resultados.
Conocer el alcanceBuscamos una institución dispuesta a conversar sobre reuniones, voces y textos regionales. Explicamos el propósito, el consentimiento y la gobernanza antes de grabar o recibir datos.