Cómo dictar una nota SOAP por voz, paso a paso

Siete pasos, del micrófono al expediente. El reconocimiento de voz ocurre dentro de tu navegador: a nosotros nos llega el texto, nunca el audio.

bryan Daniel Camacho 5 min de lectura

Cuentas la consulta en voz alta mientras el paciente todavía está frente a ti. El navegador convierte tu voz en texto, la inteligencia artificial lo separa en los campos de la nota SOAP y tú apruebas campo por campo antes de guardar. El reconocimiento de voz ocurre dentro de tu navegador, así que el audio no se sube a ningún servidor nuestro: lo que viaja es el texto ya escrito.

Si buscabas un asistente de voz médico, esto es lo que hace y lo que no

Conviene decirlo de entrada, porque la diferencia cambia cómo se usa.

Lo que hace: el micrófono convierte lo que dices en texto, dentro de tu propio navegador. Ese texto cae en el mismo cuadro donde podrías escribirlo o pegarlo a mano. Después, la IA toma ese texto y lo ordena en los campos de la nota.

Lo que no hace: no escucha la consulta ni participa en ella. No entiende órdenes habladas, no responde, no decide nada. No hay un asistente escuchando: hay un dictado que llena un cuadro de texto, y una IA que después trabaja sobre ese texto.

Son dos piezas separadas y puedes usar una sin la otra. Si prefieres escribir, escribes; la IA hace lo mismo con el texto tecleado.

Cómo dictar una nota, paso a paso

  1. Abre el expediente del paciente y busca el bloque "Asistente de transcripción".
  2. Presiona el botón de micrófono, "Dictar por voz". La primera vez el navegador te va a pedir permiso: acéptalo.
  3. Cuenta la consulta como se la contarías a un colega. No hace falta dictar por campos ni decir "síntomas" o "plan" en voz alta.
  4. Vas a ver el texto aparecer mientras hablas. Presiona otra vez el micrófono para detener.
  5. Corrige a mano lo que el reconocimiento haya entendido mal.
  6. Presiona "Estructurar con IA". Vuelve un borrador separado en campos.
  7. Marca los campos que quieras conservar y presiona "Aplicar campos seleccionados". Los que no marques no entran al expediente.

Antes de empezar

El dictado está configurado en español. Funciona mejor con el micrófono cerca y en una sola pasada: es más fácil corregir un texto seguido que dictar en fragmentos.

Qué campos devuelve la IA

El borrador vuelve separado en siete campos:

Esos siete campos cubren la estructura de una nota SOAP: lo subjetivo son el motivo, los síntomas y los negativos relevantes; lo objetivo son los signos vitales y el examen físico; la evaluación son los diagnósticos con su código; y el plan es el plan.

Por qué los negativos relevantes van en un campo aparte

Porque ya falló una vez y esa falla enseñó algo. Un doctor dictó "no hay irradiación a las piernas ni pérdida de fuerza" y el modelo metió esas dos frases dentro de los síntomas. El expediente terminaba afirmando lo contrario de lo dictado.

Desde entonces esos negativos salen a su propio campo y hay un filtro que los reclasifica aunque el modelo se equivoque. Es también la razón por la que la revisión del médico no es un trámite: es la que decide.

Por qué el audio no sale de tu navegador

El reconocimiento de voz que usamos es el que ya trae el navegador. La voz se convierte en texto en tu dispositivo y a nosotros nos llega el texto, nunca el sonido. No grabamos la consulta y no existe un servidor nuestro que reciba audio.

La alternativa habría sido transcribir en nuestros servidores, que es lo que hacen muchas herramientas. Se descartó a propósito: habría significado subir audio con voz del paciente a un endpoint nuevo.

Hay un segundo filtro antes de que el texto salga hacia el modelo de lenguaje: se le borran los identificadores directos del paciente, o sea nombre, teléfono, correo y documento. Lo que el modelo estructura es un relato clínico que ya no dice de quién es.

En qué navegadores funciona

Funciona en Chrome, Edge y Safari, que traen el reconocimiento de voz incorporado. Firefox no lo soporta de forma nativa, así que ahí el micrófono no aparece y el cuadro de texto sigue disponible para escribir o pegar el relato.

Es la contrapartida de no subir tu audio a ningún lado: dependemos de lo que el navegador ofrece.

Lo que el dictado no hace

Preguntas frecuentes

¿Necesito instalar algo? No. El micrófono del navegador alcanza.

¿Puedo escribir en vez de dictar? Sí, y es el mismo cuadro. El dictado solo llena ese campo por voz.

¿Qué pasa si el reconocimiento entiende mal una palabra? La corriges en el texto antes de pedir la estructuración. Conviene leer el relato completo antes de continuar, sobre todo en dosis y cifras.

¿La IA ve el nombre de mi paciente? No. Los identificadores directos se borran antes de que el texto salga.

¿Sirve si hablo rápido o con acento? El reconocimiento es el del navegador y está configurado en español. Como cualquier dictado, mejora hablando cerca del micrófono y en frases completas.