{"as_of":"2026-08-08T23:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a6f2863638e6dbac9973107a481a53585d4565f0775bdd117afc22dae34d0f36","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:50:25.927351Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-06T20:50:25.927351Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01663","last_updated":"2025-07-02T12:45:34Z","snapshot_observed_at":"2026-08-06T20:43:52.277899Z","submitted_at":"2025-07-02T12:45:34Z","title":"AsyncFlow: An Asynchronous Streaming RL Framework for Efficient LLM Post-Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:25.927351Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2507.01663"},"observation_digest":"sha256:b947dc5d749b2ff252c7ab6a45856a619a199174f247ff8b87de88c4127308ea","observation_id":"bf7613ef-81f8-41ae-b7c2-09a9db61ff12","resolution":{"observed_at":"2026-08-06T20:50:25.927351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-06T17:51:17.701818Z","title":"Nemo-aligner: Scal- able toolkit for efficient model alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09850","last_updated":"2025-07-16T17:16:18Z","snapshot_observed_at":"2026-08-07T21:24:42.345046Z","submitted_at":"2025-07-14T01:14:50Z","title":"The Challenge of Teaching Reasoning to LLMs Without RL or Distillation","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T17:51:17.701818Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2507.09850"},"observation_digest":"sha256:093f7bdf0f027e4640ab5c81910318ba3ca0d77c42d317f79420c2ca0402f8ce","observation_id":"d6f2d8f8-f5b9-4855-9ecc-2958f85c6327","resolution":{"observed_at":"2026-08-06T17:51:17.701818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-06T16:19:43.466905Z","title":"Nemo-aligner: Scalable toolkit for efficient model align- ment.arXiv preprint arXiv:2405.01481,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13833","last_updated":"2026-05-30T14:24:59Z","snapshot_observed_at":"2026-08-06T16:13:04.437168Z","submitted_at":"2025-07-18T11:41:49Z","title":"DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T16:19:43.466905Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2507.13833"},"observation_digest":"sha256:014808c8376d9ec5cc88d5b332bb1248a39175a984577fadc4e815629446aa81","observation_id":"2bf3ee51-b65c-4289-b049-862bb2e7007c","resolution":{"observed_at":"2026-08-06T16:19:43.466905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":"2405.01481","doi":"10.48550/arxiv.2405.01481","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nemo-aligner: Scalable toolkit for efficient model alignment","venue":"arXiv (Cornell University)","work_id":"1e8ee77a-1a57-4dff-ab72-33f7dd80c556","year":2024},"citing_paper":{"arxiv_id":"2510.19225","last_updated":"2026-04-08T03:04:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-22T04:19:37Z","title":"RLBoost: Harvesting Preemptible Resources for Cost-Efficient Reinforcement Learning on LLMs","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T05:29:46.136115Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2510.19225"},"observation_digest":"sha256:f55551346cb12b0df807d9db2b210c6bf1d69fbeddd0bc62337474d106dce50b","observation_id":"ebe49702-74e0-46e6-9b87-78bf1d386461","resolution":{"observed_at":"2026-05-18T05:30:55.184777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":"2405.01481","doi":"10.48550/arxiv.2405.01481","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nemo-aligner: Scalable toolkit for efficient model alignment","venue":"arXiv (Cornell University)","work_id":"1e8ee77a-1a57-4dff-ab72-33f7dd80c556","year":2024},"citing_paper":{"arxiv_id":"2511.14617","last_updated":"2026-04-03T12:47:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-18T16:12:21Z","title":"Seer: Online Context Learning for Fast Synchronous LLM Reinforcement Learning","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-17T20:38:30.169363Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2511.14617"},"observation_digest":"sha256:9519eb5ad75786e82ee3bc06ed5a141ecd4f132bc9c19d8610214a39c1d947f3","observation_id":"13db1838-6460-4c15-b620-8e6e87b94088","resolution":{"observed_at":"2026-05-17T20:40:14.517448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":"2405.01481","doi":"10.48550/arxiv.2405.01481","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nemo-aligner: Scalable toolkit for efficient model alignment","venue":"arXiv (Cornell University)","work_id":"1e8ee77a-1a57-4dff-ab72-33f7dd80c556","year":2024},"citing_paper":{"arxiv_id":"2512.12476","last_updated":"2026-04-11T14:05:07Z","snapshot_observed_at":"2026-07-06T22:38:59.725645Z","submitted_at":"2025-12-13T22:20:51Z","title":"HetRL: Efficient Reinforcement Learning for LLMs in Heterogeneous Environments","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-16T22:21:26.271796Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2512.12476"},"observation_digest":"sha256:8d9ed3a03bcac5768c6b34b9515cda9e409ef0cc08a0e49369f5288a648f6ee3","observation_id":"3de10776-5083-4f30-8968-e8431037f067","resolution":{"observed_at":"2026-05-16T22:23:36.671858Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":"2405.01481","doi":"10.48550/arxiv.2405.01481","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nemo-aligner: Scalable toolkit for efficient model alignment","venue":"arXiv (Cornell University)","work_id":"1e8ee77a-1a57-4dff-ab72-33f7dd80c556","year":2024},"citing_paper":{"arxiv_id":"2605.13907","last_updated":"2026-05-13T03:36:57Z","snapshot_observed_at":"2026-07-06T23:25:25.361350Z","submitted_at":"2026-05-13T03:36:57Z","title":"AIS: Adaptive Importance Sampling for Quantized RL","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T03:13:14.384567Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2605.13907"},"observation_digest":"sha256:5a1db924deb5bb05c00033e8627a0f06c86c86d74117daea6b6800e8156212fb","observation_id":"9c070b65-f6a5-4037-ac1c-133cb04b100f","resolution":{"observed_at":"2026-05-15T03:14:52.702508Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":"2405.01481","doi":"10.48550/arxiv.2405.01481","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nemo-aligner: Scalable toolkit for efficient model alignment","venue":"arXiv (Cornell University)","work_id":"1e8ee77a-1a57-4dff-ab72-33f7dd80c556","year":2024},"citing_paper":{"arxiv_id":"2605.15565","last_updated":"2026-05-15T03:13:35Z","snapshot_observed_at":"2026-08-03T02:43:16.115285Z","submitted_at":"2026-05-15T03:13:35Z","title":"AstraFlow: Dataflow-Oriented Reinforcement Learning for Agentic LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T20:10:32.300423Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2605.15565"},"observation_digest":"sha256:e3eeec4b1d3130e5bff468aea936a7401f28574e3fd5264581501a6982b5b6ad","observation_id":"f275f9a5-465a-4df6-90d9-fb8f31b817b3","resolution":{"observed_at":"2026-05-20T20:13:43.733269Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":"2405.01481","doi":"10.48550/arxiv.2405.01481","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nemo-aligner: Scalable toolkit for efficient model alignment","venue":"arXiv (Cornell University)","work_id":"1e8ee77a-1a57-4dff-ab72-33f7dd80c556","year":2024},"citing_paper":{"arxiv_id":"2605.20863","last_updated":"2026-05-20T07:55:06Z","snapshot_observed_at":"2026-07-06T23:31:23.407780Z","submitted_at":"2026-05-20T07:55:06Z","title":"PlexRL: Cluster-Level Orchestration of Serviceized LLM Execution for RLVR","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-21T02:24:48.872065Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2605.20863"},"observation_digest":"sha256:e24b904f38bd973e12d20d4037592c87f83d3c48ac3ed6248bf544524822c9fc","observation_id":"ce777bb2-6fb7-4c66-90ea-1ba83f659937","resolution":{"observed_at":"2026-05-21T02:29:25.309065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":"2405.01481","doi":"10.48550/arxiv.2405.01481","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nemo-aligner: Scalable toolkit for efficient model alignment","venue":"arXiv (Cornell University)","work_id":"1e8ee77a-1a57-4dff-ab72-33f7dd80c556","year":2024},"citing_paper":{"arxiv_id":"2606.09711","last_updated":"2026-06-08T16:32:54Z","snapshot_observed_at":"2026-07-06T23:49:03.237958Z","submitted_at":"2026-06-08T16:32:54Z","title":"Proxy Reward Internalization and Mechanistic Exploitation: A Learned Precursor to Reward Hacking and Its Generalization","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-06-27T16:26:34.918099Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2606.09711"},"observation_digest":"sha256:7d607ebf8fdd5d21e197acce8b17415ee07150a877c960ae8d556ed9a781c0eb","observation_id":"11cdd8c7-22d3-413d-acc1-725e40234434","resolution":{"observed_at":"2026-07-03T01:37:30.462636Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T08:50:14.063035+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01481","snapshot_observed_at":"2026-07-13T04:42:35.589143Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09207","last_updated":"2026-08-05T13:11:42Z","snapshot_observed_at":"2026-08-08T23:13:02.648188Z","submitted_at":"2026-07-10T08:51:14Z","title":"Bidirectional Resource Scheduling for Disaggregated and Asynchronous RL Post-Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T04:42:35.589143Z"},"links":{"cited_paper":"/paper/2405.01481","citing_paper":"/paper/2607.09207"},"observation_digest":"sha256:407a101a3a91f14b7fad8361dab5b65c00f9fd90232ff9c0e1a378ba082a8c7f","observation_id":"773edd7a-2c84-450c-9864-ff06209b4a50","resolution":{"observed_at":"2026-07-13T04:42:35.589143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2405.01481/citation-record","integrity":"/paper/2405.01481/integrity","json":"/paper/2405.01481/citation-record.json","paper":"/paper/2405.01481"},"outbound":[],"paper":{"arxiv_id":"2405.01481","last_updated":"2024-09-03T05:47:42Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T02:02:52.136893Z","submitted_at":"2024-05-02T17:13:40Z","title":"NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2405.01481."}