Новость9528 июл.
Исследование оценивает эффективность четырех LLM (GPT-4o, OpenAI o3, Gemini-2.5pro и DeepSeek-R1) в анализе причин смерти на основе 118 реальных случаев. Результаты показали, что DeepSeek-R1 превосходит конкурентов по качеству логических выводов, однако все модели склонны к галлюцинациям и требуют обязательного контроля со стороны экспертов.