Новость9521 июл.
Исследование сравнивает эффективность пяти LLM (включая GPT-4.1, Gemini-2.5-Flash и o3) с показателями врачей при решении открытых клинических задач. Результаты показали, что языковые модели превосходят клиницистов по точности, безопасности и структурированности ответов в условиях ограниченных ресурсов.