Historias clínicas electrónicas (HCE) y LLM locales
Hace un año hice un prototipo de una HCE minimalista para un cliente. El usuario solo escribe la evolución en una sección de texto libre y guarda. Por detrás, un LLM local se ocupa de:
- Extraer información relevante de la evolución (por ejemplo, signos vitales).
- Crear un resumen actualizado del paciente.
Todo corre en el mismo dispositivo, sobre Ollama. El modelo principal es qwen2.5:7b (7.6B, cuantizado a 4 bits, contexto de 32k) para resúmenes y extracción.
En el equipo de prueba, un Ryzen 5 5500U, solo CPU.
La generación ronda 1,5 tokens/s y hay una penalidad de carga en frío de ~35s.
Pros:
- Privacidad: la información del paciente nunca se envía a un servidor en otro país. Todo sucede en el dispositivo.
- No hay que formatear ni ordenar la información: el LLM clasifica las secciones y les da nuevo formato.
- Al abrir la HCE, enseguida vemos el resumen actualizado y los datos extraídos.
Contras:
- La velocidad de procesamiento depende del hardware donde corre la HCE.
- Los modelos locales son menos capaces que los "frontier models" de la nube.
- Sobreexigencia y calentamiento del dispositivo.