<?xml version='1.0' encoding='utf-8'?>
<?xml-stylesheet type="text/xsl" href="/v2/static/oai2.xsl"?>
<OAI-PMH xmlns="http://www.openarchives.org/OAI/2.0/" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation="http://www.openarchives.org/OAI/2.0/ http://www.openarchives.org/OAI/2.0/OAI-PMH.xsd">
  <responseDate>2026-10-11T01:16:33Z</responseDate>
  <request identifier="oai:figshare.com:article/33974701" metadataPrefix="oai_dc" verb="GetRecord">https://api.figshare.com/v2/oai</request>
  <GetRecord>
    <record>
      <header>
        <identifier>oai:figshare.com:article/33974701</identifier>
        <datestamp>2026-09-23T17:21:47Z</datestamp>
        <setSpec>category_7</setSpec>
        <setSpec>category_19</setSpec>
        <setSpec>category_21</setSpec>
        <setSpec>category_64</setSpec>
        <setSpec>category_106</setSpec>
        <setSpec>category_132</setSpec>
        <setSpec>portal_5</setSpec>
        <setSpec>item_type_3</setSpec>
        <setSpec>month_year_09_2026</setSpec>
      </header>
      <metadata>
        <oai_dc:dc xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance"  xmlns:oai_dc="http://www.openarchives.org/OAI/2.0/oai_dc/" xmlns:dc="http://purl.org/dc/elements/1.1/" xsi:schemaLocation="http://www.openarchives.org/OAI/2.0/oai_dc/ http://www.openarchives.org/OAI/2.0/oai_dc.xsd">
          <dc:title>&lt;p&gt;Summary statistics by funder.&lt;/p&gt;</dc:title>
          <dc:creator>Jan-Ole Hesselberg (21453807)</dc:creator>
          <dc:creator>Pål Ulleberg (522303)</dc:creator>
          <dc:creator>Øystein Sørensen (4767861)</dc:creator>
          <dc:creator>Knut Inge Fostervold (11509353)</dc:creator>
          <dc:creator>Sigrid Hegna Ingvaldsen (15359171)</dc:creator>
          <dc:creator>Ida Svege (11509356)</dc:creator>
          <dc:subject>Medicine</dc:subject>
          <dc:subject>Pharmacology</dc:subject>
          <dc:subject>Biotechnology</dc:subject>
          <dc:subject>Cancer</dc:subject>
          <dc:subject>Science Policy</dc:subject>
          <dc:subject>Infectious Diseases</dc:subject>
          <dc:subject>general panel membership</dc:subject>
          <dc:subject>average iccs ranged</dc:subject>
          <dc:subject>human judgment rather</dc:subject>
          <dc:subject>structured review formats</dc:subject>
          <dc:subject>stable reviewer tendencies</dc:subject>
          <dc:subject>reviewer age composition</dc:subject>
          <dc:subject>moderate across funders</dc:subject>
          <dc:subject>substantially improve reliability</dc:subject>
          <dc:subject>systematic reviewer characteristics</dc:subject>
          <dc:subject>including reviewer similarity</dc:subject>
          <dc:subject>depth review procedures</dc:subject>
          <dc:subject>matter expertise rather</dc:subject>
          <dc:subject>examines factors associated</dc:subject>
          <dc:subject>slightly lower disagreement</dc:subject>
          <dc:subject>reviewer similarity</dc:subject>
          <dc:subject>review depth</dc:subject>
          <dc:subject>specific rather</dc:subject>
          <dc:subject>review roles</dc:subject>
          <dc:subject>multiple factors</dc:subject>
          <dc:subject>four funders</dc:subject>
          <dc:subject>reliability persist</dc:subject>
          <dc:subject>rater reliability</dc:subject>
          <dc:subject>lower disagreement</dc:subject>
          <dc:subject>application characteristics</dc:subject>
          <dc:subject>yet concerns</dc:subject>
          <dc:subject>variability arose</dc:subject>
          <dc:subject>temporal trends</dc:subject>
          <dc:subject>specific ambiguity</dc:subject>
          <dc:subject>reviewers selected</dc:subject>
          <dc:subject>reviewers disagree</dc:subject>
          <dc:subject>residual level</dc:subject>
          <dc:subject>research area</dc:subject>
          <dc:subject>registered report</dc:subject>
          <dc:subject>rater agreement</dc:subject>
          <dc:subject>program features</dc:subject>
          <dc:subject>primarily due</dc:subject>
          <dc:subject>leveraging data</dc:subject>
          <dc:subject>level ambiguity</dc:subject>
          <dc:subject>inherent variability</dc:subject>
          <dc:subject>greater responsibility</dc:subject>
          <dc:subject>grant evaluations</dc:subject>
          <dc:subject>expert reviews</dc:subject>
          <dc:subject>clearer criteria</dc:subject>
          <dc:subject>assessments conducted</dc:subject>
          <dc:subject>also associated</dc:subject>
          <dc:subject>absolute magnitude</dc:subject>
          <dc:subject>1 percent</dc:subject>
          <dc:description>&lt;div&gt;&lt;p&gt;Grant peer review processes are pivotal in allocating substantial research funding, yet concerns about their reliability persist, primarily due to low inter-rater agreement. This study is a registered report that examines factors associated with agreement among peer reviewers in grant evaluations, leveraging data from 134,991 reviews across four Norwegian research funders. Using a cross-classified linear regression model, we explored the relationship between inter-rater agreement and multiple factors, including reviewer similarity, experience, expertise, research area, application characteristics, review depth, and temporal trends. Our analyses revealed several statistically significant associations, but most effects were small in absolute magnitude. Reviewer similarity in gender was associated with lower disagreement. The use of in-depth review procedures, referring to review roles with greater responsibility for evaluating the application, was also associated with slightly lower disagreement. In contrast, expert reviews, defined as assessments conducted by reviewers selected for subject-matter expertise rather than general panel membership, and certain research areas showed modestly higher disagreement. Application amount, reviewer age composition, and temporal trends exhibited limited influence. Only a small share of disagreement stemmed from stable reviewer tendencies (3.1 percent), whereas most variability arose at the application level (24.1 percent) and the residual level (55.2 percent), indicating that disagreement is largely application-specific rather than reviewer-driven. Inter-rater reliability was moderate across funders: average ICCs ranged from 0.50 to 0.65. Our findings only partly support previous research and indicate that disagreement is driven primarily by application-specific ambiguity and inherent variability in human judgment rather than systematic reviewer characteristics or program features. Consequently, interventions targeting reviewer behaviour alone are unlikely to substantially improve reliability; gains are more likely to come from clearer criteria, more structured review formats, and reducing application-level ambiguity, though such measures are expected to yield only incremental improvements.&lt;/p&gt;&lt;/div&gt;</dc:description>
          <dc:date>2026-09-23T17:21:34Z</dc:date>
          <dc:type>Dataset</dc:type>
          <dc:type>Dataset</dc:type>
          <dc:identifier>10.1371/journal.pone.0356108.t003</dc:identifier>
          <dc:relation>https://figshare.com/articles/dataset/_p_Summary_statistics_by_funder_p_/33974701</dc:relation>
          <dc:rights>CC BY 4.0</dc:rights>
        </oai_dc:dc>
      </metadata>
    </record>
  </GetRecord>
</OAI-PMH>
