Biomedical Large Languages Models Seem not to be Superior to Generalist Models on Unseen Medical Data

Open in new window