paper-with-me

Multiple Choice Question Answering (MCQA) 벤치마크

Multiple Choice Question Answering (MCQA) on MedMCQA

22개 결과 · ⬇ CSV · JSON

Test Set (Acc-%)

0.33 0.4283 0.5265 0.6247 0.723 2022-03 2026-09 PubmedBERT(Gu et al., 2022) — 0.41 (2022-03-27) SciBERT (Beltagy et al., 2019) — 0.39 (2022-03-27) BioBERT (Lee et al.,2020) — 0.37 (2022-03-27) BERT (Devlin et al., 2019)-Base — 0.33 (2022-03-27) Codex 5-shot CoT — 0.627 (2022-07-17) VOD (BioLinkBERT) — 0.629 (2022-09-23) Med-PaLM 2 (ER) — 0.723 (2023-05-16) Med-PaLM 2 (CoT+SC) — 0.715 (2023-05-16) Med-PaLM 2 (5-shot) — 0.713 (2023-05-16) BioMedGPT-10B — 0.514 (2023-08-18) PubmedBERT(Gu et al., 2022) — 0.41 (2022-03-27) Codex 5-shot CoT — 0.627 (2022-07-17) VOD (BioLinkBERT) — 0.629 (2022-09-23) Med-PaLM 2 (ER) — 0.723 (2023-05-16)
RankModel Test Set (Acc-%)Dev Set (Acc-%) PaperCodeYear
21 OPT (few-shot, k=5) 0.296 Galactica: A Large Language Model for Science paperswithcode/galai 2022
22 PaLM (8B, Few-shot) 0.267 Large Language Models Encode Clinical Knowledge dmis-lab/olaph 2022
← 이전 21–22 / 22 페이지당 10 20 50 100