<?xml version='1.0' encoding='utf-8'?>
<?xml-stylesheet type="text/xsl" href="/v2/static/oai2.xsl"?>
<OAI-PMH xmlns="http://www.openarchives.org/OAI/2.0/" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation="http://www.openarchives.org/OAI/2.0/ http://www.openarchives.org/OAI/2.0/OAI-PMH.xsd">
  <responseDate>2026-10-11T12:37:38Z</responseDate>
  <request identifier="oai:figshare.com:article/33814144" metadataPrefix="oai_dc" verb="GetRecord">https://api.figshare.com/v2/oai</request>
  <GetRecord>
    <record>
      <header>
        <identifier>oai:figshare.com:article/33814144</identifier>
        <datestamp>2026-09-15T17:55:55Z</datestamp>
        <setSpec>category_734</setSpec>
        <setSpec>category_931</setSpec>
        <setSpec>category_106</setSpec>
        <setSpec>portal_5</setSpec>
        <setSpec>item_type_3</setSpec>
        <setSpec>month_year_09_2026</setSpec>
      </header>
      <metadata>
        <oai_dc:dc xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance"  xmlns:oai_dc="http://www.openarchives.org/OAI/2.0/oai_dc/" xmlns:dc="http://purl.org/dc/elements/1.1/" xsi:schemaLocation="http://www.openarchives.org/OAI/2.0/oai_dc/ http://www.openarchives.org/OAI/2.0/oai_dc.xsd">
          <dc:title>&lt;p&gt;Zero-shot accuracy of four evaluated large language models across seven regulatory functional subdomains.&lt;/p&gt;</dc:title>
          <dc:creator>Xuejing Fu (24950107)</dc:creator>
          <dc:creator>Zhen Chen (129176)</dc:creator>
          <dc:creator>Wentao Lu (7905074)</dc:creator>
          <dc:subject>Biological Sciences not elsewhere classified</dc:subject>
          <dc:subject>Information Systems not elsewhere classified</dc:subject>
          <dc:subject>Science Policy</dc:subject>
          <dc:subject>stratified independent review</dc:subject>
          <dc:subject>stable dataset release</dc:subject>
          <dc:subject>jurisdictional pharmaceutical regulation</dc:subject>
          <dc:subject>jurisdiction question answering</dc:subject>
          <dc:subject>42 – 8</dc:subject>
          <dc:subject>autonomous regulatory interpretation</dc:subject>
          <dc:subject>support workflows rather</dc:subject>
          <dc:subject>observed residual material</dc:subject>
          <dc:subject>overall accuracy ranged</dc:subject>
          <dc:subject>two regulatory experts</dc:subject>
          <dc:subject>systematically evaluated using</dc:subject>
          <dc:subject>div &gt;&lt; p</dc:subject>
          <dc:subject>29 %– 5</dc:subject>
          <dc:subject>regulatory applications</dc:subject>
          <dc:subject>two highest</dc:subject>
          <dc:subject>material errors</dc:subject>
          <dc:subject>findings support</dc:subject>
          <dc:subject>monolingual accuracy</dc:subject>
          <dc:subject>wilson 95</dc:subject>
          <dc:subject>supervised decision</dc:subject>
          <dc:subject>subsequently classified</dc:subject>
          <dc:subject>standardized zero</dc:subject>
          <dc:subject>shot protocol</dc:subject>
          <dc:subject>semantic screen</dc:subject>
          <dc:subject>scoring models</dc:subject>
          <dc:subject>results indicate</dc:subject>
          <dc:subject>reproducible resource</dc:subject>
          <dc:subject>negative population</dc:subject>
          <dc:subject>multiple comparisons</dc:subject>
          <dc:subject>max —</dc:subject>
          <dc:subject>increasingly explored</dc:subject>
          <dc:subject>including 10</dc:subject>
          <dc:subject>evaluation resources</dc:subject>
          <dc:subject>error proportion</dc:subject>
          <dc:subject>drug administration</dc:subject>
          <dc:subject>differ significantly</dc:subject>
          <dc:subject>consistently lower</dc:subject>
          <dc:subject>confidence interval</dc:subject>
          <dc:subject>bilingual multiple</dc:subject>
          <dc:subject>absolute differences</dc:subject>
          <dc:subject>62 %).</dc:subject>
          <dc:subject>444 items</dc:subject>
          <dc:subject>432 items</dc:subject>
          <dc:subject>43 %.</dc:subject>
          <dc:subject>122 classified</dc:subject>
          <dc:description>&lt;p&gt;Zero-shot accuracy of four evaluated large language models across seven regulatory functional subdomains.&lt;/p&gt;</dc:description>
          <dc:date>2026-09-15T17:55:41Z</dc:date>
          <dc:type>Dataset</dc:type>
          <dc:type>Dataset</dc:type>
          <dc:identifier>10.1371/journal.pone.0343858.t007</dc:identifier>
          <dc:relation>https://figshare.com/articles/dataset/_p_Zero-shot_accuracy_of_four_evaluated_large_language_models_across_seven_regulatory_functional_subdomains_p_/33814144</dc:relation>
          <dc:rights>CC BY 4.0</dc:rights>
        </oai_dc:dc>
      </metadata>
    </record>
  </GetRecord>
</OAI-PMH>
