<?xml version='1.0' encoding='utf-8'?>
<?xml-stylesheet type="text/xsl" href="/v2/static/oai2.xsl"?>
<OAI-PMH xmlns="http://www.openarchives.org/OAI/2.0/" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation="http://www.openarchives.org/OAI/2.0/ http://www.openarchives.org/OAI/2.0/OAI-PMH.xsd">
  <responseDate>2026-10-10T16:15:40Z</responseDate>
  <request identifier="oai:figshare.com:article/33938661" metadataPrefix="oai_dc" verb="GetRecord">https://api.figshare.com/v2/oai</request>
  <GetRecord>
    <record>
      <header>
        <identifier>oai:figshare.com:article/33938661</identifier>
        <datestamp>2026-09-18T17:42:31Z</datestamp>
        <setSpec>category_7</setSpec>
        <setSpec>category_45</setSpec>
        <setSpec>category_734</setSpec>
        <setSpec>category_106</setSpec>
        <setSpec>portal_5</setSpec>
        <setSpec>item_type_3</setSpec>
        <setSpec>month_year_09_2026</setSpec>
      </header>
      <metadata>
        <oai_dc:dc xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance"  xmlns:oai_dc="http://www.openarchives.org/OAI/2.0/oai_dc/" xmlns:dc="http://purl.org/dc/elements/1.1/" xsi:schemaLocation="http://www.openarchives.org/OAI/2.0/oai_dc/ http://www.openarchives.org/OAI/2.0/oai_dc.xsd">
          <dc:title>&lt;p&gt;Accuracy (%) on medical licensing examination questions. N = 655 questions, no supporting context provided. 95% confidence interval is 4.1 percentage points.&lt;/p&gt;</dc:title>
          <dc:creator>Kiran Bhattacharyya (24534373)</dc:creator>
          <dc:creator>Sreeram Kamabattula (24534370)</dc:creator>
          <dc:subject>Medicine</dc:subject>
          <dc:subject>Sociology</dc:subject>
          <dc:subject>Biological Sciences not elsewhere classified</dc:subject>
          <dc:subject>Science Policy</dc:subject>
          <dc:subject>recommend generalizable configurations</dc:subject>
          <dc:subject>new prompting method</dc:subject>
          <dc:subject>inference — offers</dc:subject>
          <dc:subject>continuous reflection ”</dc:subject>
          <dc:subject>call “ prompt</dc:subject>
          <dc:subject>7 percentage points</dc:subject>
          <dc:subject>larger model ’</dc:subject>
          <dc:subject>smaller model ’</dc:subject>
          <dc:subject>test baseline prompts</dc:subject>
          <dc:subject>practicing clinicians available</dc:subject>
          <dc:subject>meet accuracy requirements</dc:subject>
          <dc:subject>div &gt;&lt; p</dc:subject>
          <dc:subject>increased reasoning budgets</dc:subject>
          <dc:subject>offs across prompting</dc:subject>
          <dc:subject>time scaling &lt;/</dc:subject>
          <dc:subject>time scaling</dc:subject>
          <dc:subject>model scales</dc:subject>
          <dc:subject>p &lt;/</dc:subject>
          <dc:subject>generation budgets</dc:subject>
          <dc:subject>favor smaller</dc:subject>
          <dc:subject>medical reasoning</dc:subject>
          <dc:subject>technical skill</dc:subject>
          <dc:subject>statistically supported</dc:subject>
          <dc:subject>specific effects</dc:subject>
          <dc:subject>specific accuracy</dc:subject>
          <dc:subject>premise models</dc:subject>
          <dc:subject>overlapping 95</dc:subject>
          <dc:subject>increasing accuracy</dc:subject>
          <dc:subject>improve domain</dc:subject>
          <dc:subject>general framework</dc:subject>
          <dc:subject>free alternative</dc:subject>
          <dc:subject>example use</dc:subject>
          <dc:subject>engineering llm</dc:subject>
          <dc:subject>empirical results</dc:subject>
          <dc:subject>efficiency objectives</dc:subject>
          <dc:subject>direct answer</dc:subject>
          <dc:subject>confidence interval</dc:subject>
          <dc:subject>clinical settings</dc:subject>
          <dc:subject>cases relevant</dc:subject>
          <dc:subject>based systems</dc:subject>
          <dc:subject>balance cost</dc:subject>
          <dc:subject>augmented generation</dc:subject>
          <dc:subject>assess accuracy</dc:subject>
          <dc:subject>also identify</dc:subject>
          <dc:subject>allowing us</dc:subject>
          <dc:subject>achieve accuracy</dc:subject>
          <dc:subject>accessibility concerns</dc:subject>
          <dc:subject>3 27b</dc:subject>
          <dc:description>&lt;p&gt;Accuracy (%) on medical licensing examination questions. N = 655 questions, no supporting context provided. 95% confidence interval is 4.1 percentage points.&lt;/p&gt;</dc:description>
          <dc:date>2026-09-18T18:00:05Z</dc:date>
          <dc:type>Dataset</dc:type>
          <dc:type>Dataset</dc:type>
          <dc:identifier>10.1371/journal.pdig.0001182.t007</dc:identifier>
          <dc:relation>https://figshare.com/articles/dataset/_p_Accuracy_on_medical_licensing_examination_questions_N_655_questions_no_supporting_context_provided_95_confidence_interval_is_4_1_percentage_points_p_/33938661</dc:relation>
          <dc:rights>CC BY 4.0</dc:rights>
        </oai_dc:dc>
      </metadata>
    </record>
  </GetRecord>
</OAI-PMH>
