General-purpose large language models outperform specialized clinical AI
General-purpose large language models GPT-5.2, Gemini 3.1 Pro, and Claude Opus 4.6 outperformed specialized clinical AI tools OpenEvidence and UpToDate Expert AI on medical knowledge tests, expert alignment, and real cli…