{"as_of":"2026-08-08T09:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:20e036e9f18ba4534485848f35202f2413facd8944b6ab1bfd3aad06229423b4","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:17:13.821920Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03537/citation-record","integrity":"/paper/2509.03537/integrity","json":"/paper/2509.03537/citation-record.json","paper":"/paper/2509.03537"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T04:13:14.044604Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T15:17:13.732880Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.732880Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:5b9f14f8f6fe7f25776ec513cb45f0bc082b61e0d4d525ccfbc625b656adf1c8","observation_id":"5a7a71da-eeb0-4562-b917-d3a509c04373","resolution":{"observed_at":"2026-08-05T15:17:13.732880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17161","last_updated":"2025-05-26T17:16:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-28T18:59:44Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17161","snapshot_observed_at":"2026-08-05T15:17:13.738630Z","title":"Le, Sergey Levine, and Yi Ma","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.738630Z"},"links":{"cited_paper":"/paper/2501.17161","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:6782d18d9b3fc871939c57ab23277db11434f55f939b01b464f4192025de8db1","observation_id":"a8e3db9b-6914-4760-826b-fecc9e6486ec","resolution":{"observed_at":"2026-08-05T15:17:13.738630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T15:17:13.743935Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.743935Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:2885e277fa9e3c0dce683182dc95f29ecd06eb8905c3745ef32ff71d0c10784b","observation_id":"b73d0ffa-457b-4b1d-85c5-b595229fe28f","resolution":{"observed_at":"2026-08-05T15:17:13.743935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01391","last_updated":"2024-02-05T13:28:23Z","snapshot_observed_at":"2026-07-06T17:24:16.787573Z","submitted_at":"2024-02-02T13:14:31Z","title":"StepCoder: Improve Code Generation with Reinforcement Learning from Compiler Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01391","snapshot_observed_at":"2026-08-05T15:17:13.749999Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.749999Z"},"links":{"cited_paper":"/paper/2402.01391","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:350387ee894206ec4644b55c095c95ee68d3c3eac5f276a88dc37059d1907e0b","observation_id":"bbe70dc4-8e78-4d4e-88a8-b072a15b3a7e","resolution":{"observed_at":"2026-08-05T15:17:13.749999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06807","last_updated":"2025-02-18T22:21:40Z","snapshot_observed_at":"2026-08-05T15:21:07.825807Z","submitted_at":"2025-02-03T23:00:15Z","title":"Competitive Programming with Large Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06807","snapshot_observed_at":"2026-08-05T15:17:13.755616Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.755616Z"},"links":{"cited_paper":"/paper/2502.06807","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:80075a6bb3356e2f8f5d3a929d04eb7b518ae4b4c58b06cea2dd41cc64cba744","observation_id":"b8753fe9-fef7-4f22-9d23-1e4dc5afc420","resolution":{"observed_at":"2026-08-05T15:17:13.755616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:17:14.117799Z","title":null,"venue":null,"work_id":"b35b9d0a-76a8-45d9-85ca-9979c238b7ae","year":2022},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.761076Z"},"links":{"citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:19f516fb154e02ea092d91d37af4c756fac0e9fbedb0625ff30f3b2dcf0595ec","observation_id":"397166e6-a4a4-44d1-8f37-0ffa783c02d6","resolution":{"observed_at":"2026-08-05T15:17:14.122287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.14502","last_updated":"2023-04-12T16:35:27Z","snapshot_observed_at":"2026-07-06T13:36:37.251739Z","submitted_at":"2022-07-29T06:43:28Z","title":"Language Models Can Teach Themselves to Program Better","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.14502","snapshot_observed_at":"2026-08-05T15:17:13.766596Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.766596Z"},"links":{"cited_paper":"/paper/2207.14502","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:652deff31f6adce96753e13e784629e041f838643b2baae58a95f6740536b92f","observation_id":"16e4a717-7845-47c8-b931-7bb989f39dba","resolution":{"observed_at":"2026-08-05T15:17:13.766596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-05T15:17:13.771367Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.771367Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:8d39239775d4a1d1b897700d43d64c6d68b30085d390db614a4455ed53be165e","observation_id":"f12c963a-9083-4579-8128-fc2233fb8adc","resolution":{"observed_at":"2026-08-05T15:17:13.771367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-05T15:17:13.776157Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.776157Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:90c089a7b2629088e458248f315062a52b0d6701942d2c0aa10f19010b2f1c2b","observation_id":"5e56cf67-6e4d-4b7c-92ac-30340b4a9d38","resolution":{"observed_at":"2026-08-05T15:17:13.776157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-05T15:17:13.781115Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.781115Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:8a2ae6cdd68e2e00e01a16bd73e3c325bb364e6009e4a844aa722038ce16fad4","observation_id":"944c58a2-a88b-4d2a-9dbe-d3b2c24a94d1","resolution":{"observed_at":"2026-08-05T15:17:13.781115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01257","last_updated":"2025-01-03T16:36:12Z","snapshot_observed_at":"2026-07-31T19:08:41.925451Z","submitted_at":"2025-01-02T13:49:00Z","title":"CodeElo: Benchmarking Competition-level Code Generation of LLMs with Human-comparable Elo Ratings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01257","snapshot_observed_at":"2026-08-05T15:17:13.786271Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.786271Z"},"links":{"cited_paper":"/paper/2501.01257","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:e98cba196186268a0cd0fbadd7f65307987dc8f7a9e67fda0584b95bba4d5014","observation_id":"bf84de14-32ec-4fa4-bdbf-4020e10daa64","resolution":{"observed_at":"2026-08-05T15:17:13.786271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T15:17:13.791467Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.791467Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:c05f7b891e5fb093778d92cccae788cd874a8e49a64bd81749eb50835f0ea785","observation_id":"c5759bce-d896-4232-b2df-88f3d6ad35f4","resolution":{"observed_at":"2026-08-05T15:17:13.791467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T15:17:13.797081Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.797081Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:337ec9dcbc9ea8ab16309fd9bd5aa5362946bc264c544f60b529e5e4abcfe84f","observation_id":"4cf570fe-e19a-413a-98c7-b137748981b8","resolution":{"observed_at":"2026-08-05T15:17:13.797081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13816","last_updated":"2023-07-19T19:55:31Z","snapshot_observed_at":"2026-08-06T04:20:20.002125Z","submitted_at":"2023-01-31T18:02:26Z","title":"Execution-based Code Generation using Deep Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13816","snapshot_observed_at":"2026-08-05T15:17:13.801965Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.801965Z"},"links":{"cited_paper":"/paper/2301.13816","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:47ccf43f3e8a0361a2572337e6f4126ecdf4747dc9d9c87b59d5d54b3841a6ee","observation_id":"826bf715-dc69-4193-92a9-815a966ded12","resolution":{"observed_at":"2026-08-05T15:17:13.801965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:17:14.103256Z","title":"Sutton and Andrew G","venue":null,"work_id":"17861a47-9167-4310-b1be-4aa4fa5d5d7c","year":2018},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.807366Z"},"links":{"citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:c2d30ff1e1ffb58a52b29314bb458c647cb0ae23eea47b9081c6c8eb257a30c8","observation_id":"44eb70b4-099c-4dfc-a3ce-bf381b2e2cd2","resolution":{"observed_at":"2026-08-05T15:17:14.107674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10400","last_updated":"2025-02-24T08:57:10Z","snapshot_observed_at":"2026-08-07T21:53:28.691375Z","submitted_at":"2024-12-05T16:10:42Z","title":"Reinforcement Learning Enhanced LLMs: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10400","snapshot_observed_at":"2026-08-05T15:17:13.811953Z","title":"abcdefg”, then valid words are “faced","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.811953Z"},"links":{"cited_paper":"/paper/2412.10400","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:424eda0bcc930cd40e54dc07dfc335c693f5371db6bb73764c42e20a32c53ae0","observation_id":"4337c025-72a6-4375-9146-b13ac84b2cc5","resolution":{"observed_at":"2026-08-05T15:17:13.811953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:17:14.088603Z","title":"the word is a subset of the puzzle’s characters)","venue":null,"work_id":"15d7b766-b7c2-48ea-bd84-ea6ed32579b6","year":null},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.817245Z"},"links":{"citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:2a1fc71112384cabd4cc724a530831123ecbe5b9e04d74e3e3784b677d09b4f5","observation_id":"e33c6417-4a03-41ba-be60-dfa7156370dc","resolution":{"observed_at":"2026-08-05T15:17:14.093333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:17:14.071359Z","title":"includes the first character of the puzzle and contains all the characters from the puzzle","venue":null,"work_id":"55f177be-1f9d-40b6-b508-221e1d2a9873","year":null},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.821920Z"},"links":{"citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:a578fcc6141f42e231b93c8d6c437bb6c76f128d4e93c6bb932a1db83f4d6d3b","observation_id":"3ece2b84-8724-4fa4-a6b2-6345d1d91dd0","resolution":{"observed_at":"2026-08-05T15:17:14.077781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:54:42.419580Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2509.03537."}