Oído
Un modelo abierto de voz candidato convertiría audio en texto, con hablantes y tiempos, y produciría etiquetas para los comandos de dictado.
Vocero separa voz, reglas de dictado y análisis de reuniones para poder probar cada pieza. La arquitectura, el entrenamiento y el banco de pruebas son un plan técnico; el sitio identifica aparte lo que ya está construido.
En desarrollo para uso interno. El modelo propio aún no está entrenado.
El diseño evita atribuir al modelo de lenguaje tareas que corresponden al reconocimiento de voz o a reglas explícitas.
Un modelo abierto de voz candidato convertiría audio en texto, con hablantes y tiempos, y produciría etiquetas para los comandos de dictado.
Una capa sin IA aplica puntuación, formato y correcciones. Esta capa sí está construida y su versión de demostración corre en el navegador.
Un modelo base abierto candidato convertiría la transcripción en decisiones, tareas, entidades y respuestas con referencias.
La salida final requiere revisión humana antes de guardarse o enviarse.
Cada etapa propuesta tiene una puerta de evidencia. Ninguna etapa de entrenamiento del modelo propio se ha ejecutado.
El plan compara candidatos abiertos en un conjunto sellado por país antes de elegir modelos o iniciar ajustes.
El oído se ajustaría con audio regional y español general. El cerebro se ajustaría con actas, tareas y respuestas con cita.
El texto regional se usaría para preentrenamiento continuo únicamente si la línea base revela un vacío de vocabulario que un glosario no resuelve.
El objetivo es cuantizar y servir en equipos de CareCompile, detrás de un interruptor apagado por defecto y con aprobación explícita para activarlo.
El banco está diseñado para evaluar por país y separar desarrollo de prueba. No se ha grabado audio, sellado el conjunto ni calificado modelos.
Las métricas previstas incluyen error de palabras, error de caracteres, puntuación, comandos en orden y activaciones falsas.
Dos revisores nativos por país calificarían completitud, exactitud, utilidad y registro, y se publicarían los desacuerdos.
Cualquier nombre, cifra o decisión ausente de la transcripción se cuenta como invención; el informe no afirmaría cero sin la evidencia estadística correspondiente.
El método propuesto busca impedir que el entrenamiento vea o reproduzca la prueba.
El diseño asigna 80% a prueba sellada y 20% a desarrollo público, sin compartir hablantes ni reuniones entre ambas partes.
Quien guarda el audio de prueba no entrena modelos; el equipo de entrenamiento recibiría solo resultados agregados por país.
El plan publica la huella SHA-256 del manifiesto y verifica hashes, identidad de hablantes y coincidencias de trece palabras antes de cada corrida.
Cuando existan resultados, deben incluir versión del banco, fecha, sistemas comparados y método. Hoy no hay cifras que publicar.
Conozca el diseño de Vocero para transcribir reuniones y producir actas con decisiones, tareas y citas de origen. En desarrollo; la demostración es sintética.
Conocer el alcanceVocero investiga dictado para el español de El Salvador y Centroamérica. Pruebe las reglas de comandos implementadas y conozca el plan de voz regional.
Conocer el alcanceCareCompile busca una contraparte institucional en El Salvador para explorar datos de voz y texto con consentimiento, propósito limitado y evaluación independiente.
Conocer el alcanceBuscamos una institución dispuesta a conversar sobre reuniones, voces y textos regionales. Explicamos el propósito, el consentimiento y la gobernanza antes de grabar o recibir datos.