LLM

Modelos disponibles

El sistema soporta múltiples modelos de lenguaje para procesar los informes cardiológicos. Se evaluaron 11 modelos en los benchmarks del TFM: modelos cloud (Gemini, Groq) con rendimiento óptimo y modelos locales vía Ollama que garantizan privacidad total sin enviar datos al exterior, aunque requieren hardware adecuado para tiempos de respuesta aceptables.

Rendimiento

Gemini 3.1 Flash Lite es el motor principal empleado en el TFM: 100 % de éxito en el corpus de 27 informes cardiológicos, con latencia media de 14,8 s y contexto de 1 M tokens.

Coste cero

Los modelos Llama en Groq y Phi-4 Mini vía Ollama funcionan sin coste por token, permitiendo comparar calidad sin gasto económico en el TFM.

Privacidad

Los modelos locales (Ollama) garantizan que ningún dato clínico sale del equipo, alineándose con RGPD y la normativa sanitaria.