La rápida evolución de los modelos de lenguaje de gran escala (LLM, por sus siglas en inglés) ha comenzado a abrir nuevos interrogantes en el campo de la salud mental. Por su capacidad para procesar, sintetizar y generar lenguaje natural, estas tecnologías plantean posibilidades concretas tanto en la asistencia diagnóstica como en el apoyo formativo y psicoeducativo.
Para dimensionar el estado actual de la evidencia, un equipo de investigadores liderado por Mahmud Omar y colaboradores publicó en Frontiers in Psychiatry una revisión sistemática (Applications of large language models in psychiatry: a systematic review). El trabajo recopiló estudios centrados en el uso de herramientas como ChatGPT y GPT-4 en contextos psiquiátricos, evaluando su precisión, sus beneficios potenciales y las precauciones clínicas necesarias para su implementación.
Razonamiento clínico y soporte en la evaluación
Los estudios revisados señalan que los modelos avanzados muestran un desempeño notable en tareas de formulación y análisis de casos. En diversos escenarios clínicos estructurados, los LLM lograron proponer diagnósticos diferenciales coherentes con guías clínicas internacionales, sugerir estrategias de abordaje para cuadros depresivos y colaborar en la elaboración de hipótesis iniciales.
Asimismo, se destaca su capacidad para analizar grandes volúmenes de texto (como narrativas de pacientes o interacciones en entornos digitales), identificando patrones sintomáticos de forma rápida. Esta función no reemplaza el criterio del profesional, pero puede operar como un soporte complementario en etapas de cribado o en la organización inicial de la información diagnóstica.
Psicoeducación y accesibilidad de la información
En el terreno psicoeducativo, los modelos de lenguaje han demostrado utilidad para traducir conceptos clínicos complejos a un lenguaje accesible, facilitando materiales de orientación para consultantes y familiares. En regiones con menor acceso a recursos de salud mental, estas herramientas representan una vía potencial para reducir barreras de información inicial y fomentar hábitos de autocuidado basados en evidencia.
Límites actuales: complejidad diagnóstica y evaluación del riesgo
Pese a los avances, la revisión de Omar y colaboradores subraya limitaciones críticas que exigen prudencia y supervisión humana permanente:
- Casos con alta comorbilidad: Si bien los modelos responden con solidez ante viñetas clínicas típicas, su precisión disminuye cuando se enfrentan a presentaciones clínicas atípicas, variables contextuales sutiles o cuadros complejos con múltiples diagnósticos superpuestos.
- Evaluación del riesgo y situaciones de crisis: La literatura advierte que los modelos pueden subestimar niveles de riesgo suicida o no captar la urgencia implícita en ciertas expresiones del consultante. La detección de señales de alarma y la contención en crisis requieren una lectura relacional, afectiva e intuitiva que la tecnología aún no puede garantizar.
- Privacidad y sesgos éticos: El resguardo de los datos confidenciales y la prevención de sesgos en el entrenamiento de los algoritmos siguen siendo desafíos abiertos antes de pensar en una integración directa en la atención al paciente.
Integración responsable en la práctica profesional
La evidencia disponible sugiere que los modelos de lenguaje no están diseñados para asumir un rol terapéutico autónomo ni para suplantar el juicio clínico. Su valor reside en su capacidad para operar como asistentes de apoyo (optimizando tiempos de análisis, facilitando recursos pedagógicos y colaborando en el razonamiento diagnóstico), siempre dentro de un marco ético riguroso y bajo la conducción del profesional de la salud mental.