<?xml version='1.0' encoding='utf-8'?>
<?xml-stylesheet type="text/xsl" href="/v2/static/oai2.xsl"?>
<OAI-PMH xmlns="http://www.openarchives.org/OAI/2.0/" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation="http://www.openarchives.org/OAI/2.0/ http://www.openarchives.org/OAI/2.0/OAI-PMH.xsd">
  <responseDate>2026-10-10T13:01:54Z</responseDate>
  <request identifier="oai:figshare.com:article/33970177" metadataPrefix="oai_dc" verb="GetRecord">https://api.figshare.com/v2/oai</request>
  <GetRecord>
    <record>
      <header>
        <identifier>oai:figshare.com:article/33970177</identifier>
        <datestamp>2026-09-23T04:16:35Z</datestamp>
        <setSpec>category_28864</setSpec>
        <setSpec>item_type_3</setSpec>
        <setSpec>month_year_09_2026</setSpec>
      </header>
      <metadata>
        <oai_dc:dc xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance"  xmlns:oai_dc="http://www.openarchives.org/OAI/2.0/oai_dc/" xmlns:dc="http://purl.org/dc/elements/1.1/" xsi:schemaLocation="http://www.openarchives.org/OAI/2.0/oai_dc/ http://www.openarchives.org/OAI/2.0/oai_dc.xsd">
          <dc:title>AIM Auditability and Rule-Level RL Fusion: Full Training Traces and Checkpoints</dc:title>
          <dc:creator>hung Liu (25093672)</dc:creator>
          <dc:subject>Artificial intelligence not elsewhere classified</dc:subject>
          <dc:subject>Reinforcement Learning Learning</dc:subject>
          <dc:subject>Auditability (AI)</dc:subject>
          <dc:subject>Provenance Challenge</dc:subject>
          <dc:subject>Rule Induction</dc:subject>
          <dc:subject>policy composition</dc:subject>
          <dc:description>&lt;h3 dir="ltr"&gt;Track 2 — archived dataset (&lt;code&gt;runs/&lt;/code&gt;)&lt;/h3&gt;&lt;table&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Directory&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Size&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Role&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;code&gt;runs/shared_multienv_gpi/&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;3.1 GB&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;b&gt;Primary.&lt;/b&gt; The 8-seed, 2-environment experiment behind every headline number&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;code&gt;runs/grammar_confidence_070/&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;584 MB&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Confidence-threshold rule-bank sweep&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;code&gt;runs/grammar_audit_pilot/&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;340 MB&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Pilot audit run&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;code&gt;runs/repeatability_full/&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;164 MB&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Deterministic-repeatability verification&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;code&gt;runs/private_target_replicates/&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;153 MB&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Multi-replicate private-target-game runs&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;code&gt;runs/grammar_merge_070_final/&lt;/code&gt;, &lt;code&gt;_070/&lt;/code&gt;, &lt;code&gt;_070_v2/&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;364 MB&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Seed-grammar merge at confidence 0.70 (final, base, superseded variant retained for audit trail)&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;code&gt;runs/grammar_merge_090_final/&lt;/code&gt;, &lt;code&gt;_090/&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;165 MB&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Seed-grammar merge at confidence 0.90&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;code&gt;runs/private_target_extended/&lt;/code&gt;, &lt;code&gt;_batch8/&lt;/code&gt;, &lt;code&gt;private_target/&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;44 MB&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Private-target-game variants&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;code&gt;runs/grammar_intersections/&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;36 KB&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Pairwise rule intersections&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;code&gt;runs/seed-0_20260922T013053Z/&lt;/code&gt;, &lt;code&gt;_012930Z/&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;15 MB&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;Single-seed AIM baseline runs cited in &lt;code&gt;paper/AIM_Auditability_Research_Log.md&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;tr&gt;&lt;td&gt;&lt;p dir="ltr"&gt;loose files&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;~1.6 MB&lt;/p&gt;&lt;/td&gt;&lt;td&gt;&lt;p dir="ltr"&gt;&lt;code&gt;replication_summary.json&lt;/code&gt;, &lt;code&gt;replication_summary_interim.json&lt;/code&gt;, &lt;code&gt;grammar_mdl_seed11_070.json&lt;/code&gt;, &lt;code&gt;objective_diagnostic.json&lt;/code&gt;, &lt;code&gt;seed-0_full_baseline_console.log&lt;/code&gt;&lt;/p&gt;&lt;/td&gt;&lt;/tr&gt;&lt;/table&gt;&lt;p dir="ltr"&gt;Total: 584 files, 4.7 GB uncompressed.&lt;/p&gt;&lt;p dir="ltr"&gt;Per-directory role notes: &lt;code&gt;shared_multienv_gpi/&lt;/code&gt; holds per-step trajectory traces, training-update ledgers, actor and training checkpoints, shared calibration, induced rule banks, and FQE critic checkpoints. The legacy directories hold the single-seed AIM baseline, the grammar-merge and calibration sweeps, the private-target-game runs, and the repeatability verification.&lt;/p&gt;&lt;p dir="ltr"&gt;&lt;b&gt;Ten files exceed GitHub's 100 MB per-file limit&lt;/b&gt; (largest 391.5 MB); this is the reason for the two-track split. The largest offenders are &lt;code&gt;trajectory.jsonl&lt;/code&gt; traces and &lt;code&gt;lossless_trace_grammar.json&lt;/code&gt;, which compress by roughly 6.4x.&lt;/p&gt;</dc:description>
          <dc:date>2026-09-23T04:16:35Z</dc:date>
          <dc:type>Dataset</dc:type>
          <dc:type>Dataset</dc:type>
          <dc:identifier>10.6084/m9.figshare.33970177.v1</dc:identifier>
          <dc:relation>https://figshare.com/articles/dataset/AIM_Auditability_and_Rule-Level_RL_Fusion_Full_Training_Traces_and_Checkpoints/33970177</dc:relation>
          <dc:rights>CC BY 4.0</dc:rights>
        </oai_dc:dc>
      </metadata>
    </record>
  </GetRecord>
</OAI-PMH>
