ClinicalGPT-R1 : une nouvelle LLM pour le diagnostic surpasse GPT-4o sur les tâches cliniques chinoises
Les chercheurs ont présenté un modèle de langage médical universel, entraîné sur 20 000 dossiers cliniques réels. Dans le benchmark MedBench-Hard, il a obtenu des résultats supérieurs à GPT-4o en chinois et comparables à GPT-4 dans les scénarios anglophones.








