Vocerode CareCompile
Programa de voz de CareCompile

Arquitectura y evaluación antes de afirmar resultados

Vocero separa voz, reglas de dictado y análisis de reuniones para poder probar cada pieza. La arquitectura, el entrenamiento y el banco de pruebas son un plan técnico; el sitio identifica aparte lo que ya está construido.

En desarrollo para uso interno. El modelo propio aún no está entrenado.

01 / VOCERO

Una cascada de componentes

El diseño evita atribuir al modelo de lenguaje tareas que corresponden al reconocimiento de voz o a reglas explícitas.

Oído

Un modelo abierto de voz candidato convertiría audio en texto, con hablantes y tiempos, y produciría etiquetas para los comandos de dictado.

Reglas

Una capa sin IA aplica puntuación, formato y correcciones. Esta capa sí está construida y su versión de demostración corre en el navegador.

Cerebro

Un modelo base abierto candidato convertiría la transcripción en decisiones, tareas, entidades y respuestas con referencias.

Revisión

La salida final requiere revisión humana antes de guardarse o enviarse.

02 / VOCERO

Entrenamiento por etapas

Cada etapa propuesta tiene una puerta de evidencia. Ninguna etapa de entrenamiento del modelo propio se ha ejecutado.

Primero, línea base

El plan compara candidatos abiertos en un conjunto sellado por país antes de elegir modelos o iniciar ajustes.

Después, ajuste regional

El oído se ajustaría con audio regional y español general. El cerebro se ajustaría con actas, tareas y respuestas con cita.

Preentrenamiento solo si hace falta

El texto regional se usaría para preentrenamiento continuo únicamente si la línea base revela un vacío de vocabulario que un glosario no resuelve.

Servicio controlado

El objetivo es cuantizar y servir en equipos de CareCompile, detrás de un interruptor apagado por defecto y con aprobación explícita para activarlo.

03 / VOCERO

Vocero-Bench Centroamérica

El banco está diseñado para evaluar por país y separar desarrollo de prueba. No se ha grabado audio, sellado el conjunto ni calificado modelos.

Voz y dictado

Las métricas previstas incluyen error de palabras, error de caracteres, puntuación, comandos en orden y activaciones falsas.

Actas y respuestas

Dos revisores nativos por país calificarían completitud, exactitud, utilidad y registro, y se publicarían los desacuerdos.

Contenido inventado

Cualquier nombre, cifra o decisión ausente de la transcripción se cuenta como invención; el informe no afirmaría cero sin la evidencia estadística correspondiente.

04 / VOCERO

Controles para una comparación verificable

El método propuesto busca impedir que el entrenamiento vea o reproduzca la prueba.

Separación por hablante y reunión

El diseño asigna 80% a prueba sellada y 20% a desarrollo público, sin compartir hablantes ni reuniones entre ambas partes.

Custodio independiente

Quien guarda el audio de prueba no entrena modelos; el equipo de entrenamiento recibiría solo resultados agregados por país.

Huella y contaminación

El plan publica la huella SHA-256 del manifiesto y verifica hashes, identidad de hablantes y coincidencias de trece palabras antes de cada corrida.

Publicación responsable

Cuando existan resultados, deben incluir versión del banco, fecha, sistemas comparados y método. Hoy no hay cifras que publicar.

Explore el programa

Conozca también

EL SALVADOR / CARECOMPILE

Designe una contraparte institucional en El Salvador

Buscamos una institución dispuesta a conversar sobre reuniones, voces y textos regionales. Explicamos el propósito, el consentimiento y la gobernanza antes de grabar o recibir datos.