{"as_of":"2026-08-10T07:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:128ea1f1e052e730c09f8f4413e8ec2cf03fb09d0ae11de3682387a1293267c1","coverage":[{"denominator":5,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T11:08:09.510213Z","state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T12:27:08.805309Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T07:56:47.922960Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2601.07376","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.07376","snapshot_observed_at":"2026-07-07T03:18:52.285192Z","title":"OpenTinker Authors","venue":null,"work_id":"1c1f8911-c3eb-4497-beda-6e7d3a78393d","year":2026},"citing_paper":{"arxiv_id":"2605.01214","last_updated":"2026-05-02T03:06:02Z","snapshot_observed_at":"2026-08-04T03:54:47.150761Z","submitted_at":"2026-05-02T03:06:02Z","title":"Agentic AI Systems Should Be Designed as Marginal Token Allocators","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-09T15:11:41.570592Z"},"links":{"cited_paper":"/paper/2601.07376","citing_paper":"/paper/2605.01214"},"observation_digest":"sha256:c46efcbfadd4c2de6edd4c6101533e9074bbe025e37490e445d41ac0fb29a1ef","observation_id":"952ab6ce-a753-4394-acb0-ca502f3766bc","resolution":{"observed_at":"2026-07-07T03:18:52.285192Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2601.07376","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.07376","snapshot_observed_at":"2026-07-07T03:18:52.285192Z","title":"OpenTinker Authors","venue":null,"work_id":"1c1f8911-c3eb-4497-beda-6e7d3a78393d","year":2026},"citing_paper":{"arxiv_id":"2605.13779","last_updated":"2026-05-26T16:10:31Z","snapshot_observed_at":"2026-07-06T23:25:21.032938Z","submitted_at":"2026-05-13T16:59:08Z","title":"MinT: Managed Infrastructure for Training and Serving Millions of LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-14T19:25:12.407148Z"},"links":{"cited_paper":"/paper/2601.07376","citing_paper":"/paper/2605.13779"},"observation_digest":"sha256:603b799b103a30aef8f9885227f0b9b20623b9bd9ea9cac38959c1998f822b5b","observation_id":"a5b811a2-f57d-41b7-8258-3bd9938189e2","resolution":{"observed_at":"2026-07-07T03:18:52.285192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2601.07376","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.07376","snapshot_observed_at":"2026-07-07T03:18:52.285192Z","title":"OpenTinker Authors","venue":null,"work_id":"1c1f8911-c3eb-4497-beda-6e7d3a78393d","year":2026},"citing_paper":{"arxiv_id":"2605.13779","last_updated":"2026-05-26T16:10:31Z","snapshot_observed_at":"2026-07-06T23:25:21.032938Z","submitted_at":"2026-05-13T16:59:08Z","title":"MinT: Managed Infrastructure for Training and Serving Millions of LLMs","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T21:47:00.295144Z"},"links":{"cited_paper":"/paper/2601.07376","citing_paper":"/paper/2605.13779"},"observation_digest":"sha256:1cbe138c9329d97b2d2a3bbd702544330b1a9a6fc997f23fa321caa3885763f6","observation_id":"899154d4-fdd6-40d0-890c-1af55d0dc941","resolution":{"observed_at":"2026-07-07T03:18:52.285192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2601.07376","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2601.07376","snapshot_observed_at":"2026-07-07T03:18:52.285192Z","title":"OpenTinker Authors","venue":null,"work_id":"1c1f8911-c3eb-4497-beda-6e7d3a78393d","year":2026},"citing_paper":{"arxiv_id":"2606.04484","last_updated":"2026-07-21T12:35:46Z","snapshot_observed_at":"2026-08-02T12:27:06.509399Z","submitted_at":"2026-06-03T06:02:52Z","title":"AgentJet: A Distributed Swarm Training Framework for Agentic Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T06:26:35.100859Z"},"links":{"cited_paper":"/paper/2601.07376","citing_paper":"/paper/2606.04484"},"observation_digest":"sha256:b9317bb968f2af94e1c44be35cc2f1770aa3692e87985a8dae08b02a32e82904","observation_id":"34186f12-8aa4-4978-9cdd-21d18e70a184","resolution":{"observed_at":"2026-07-07T03:18:52.285192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.07376","snapshot_observed_at":"2026-08-02T12:27:08.805309Z","title":"OpenTinker: Separating concerns in agentic reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04484","last_updated":"2026-07-21T12:35:46Z","snapshot_observed_at":"2026-08-02T12:27:06.509399Z","submitted_at":"2026-06-03T06:02:52Z","title":"AgentJet: A Distributed Swarm Training Framework for Agentic Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T12:27:08.805309Z"},"links":{"cited_paper":"/paper/2601.07376","citing_paper":"/paper/2606.04484"},"observation_digest":"sha256:c4272ace8865896e08c5b8d480af386caa9b1df23d6499bca63a6c83fcadb808","observation_id":"f1932882-5d1f-4461-8d10-0ce09ed13d4d","resolution":{"observed_at":"2026-08-02T12:27:08.805309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.07376","snapshot_observed_at":"2026-08-01T21:32:08.591340Z","title":"Opentinker: Separating concerns in agentic reinforcement learning, 2026.https: //arxiv.org/abs/2601.07376","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16074","last_updated":"2026-07-17T15:58:20Z","snapshot_observed_at":"2026-08-07T07:08:37.667683Z","submitted_at":"2026-07-17T15:58:20Z","title":"JoyNexus: Service-Oriented Multi-Tenant Post-Training for VLA Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T21:32:08.591340Z"},"links":{"cited_paper":"/paper/2601.07376","citing_paper":"/paper/2607.16074"},"observation_digest":"sha256:2419c433fdd0a9ec4d3ab8bb8c3f15ca43fb55ff422ac7a3417e2c6dcf182aeb","observation_id":"91d2c092-7bfc-4e20-a5a3-0b80ad0888f9","resolution":{"observed_at":"2026-08-01T21:32:08.591340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2601.07376/citation-record","integrity":"/paper/2601.07376/integrity","json":"/paper/2601.07376/citation-record.json","paper":"/paper/2601.07376"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24298","last_updated":"2026-03-02T03:07:29Z","snapshot_observed_at":"2026-08-02T16:10:09.199211Z","submitted_at":"2025-05-30T07:18:25Z","title":"AReaL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24298","snapshot_observed_at":"2026-08-03T11:08:09.185820Z","title":"Areal: A large-scale asynchronous reinforcement learning system for language reasoning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T11:08:09.185820Z"},"links":{"cited_paper":"/paper/2505.24298","citing_paper":"/paper/2601.07376"},"observation_digest":"sha256:cd12060fe8cfeed91daebba95eba65ae81917de66f5094066eda13595f909838","observation_id":"70d7ed3e-a225-46ab-9638-255e8247c743","resolution":{"observed_at":"2026-08-03T11:08:09.185820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11143","last_updated":"2025-10-09T12:22:46Z","snapshot_observed_at":"2026-07-31T12:28:37.704994Z","submitted_at":"2024-05-20T01:04:40Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11143","snapshot_observed_at":"2026-08-03T11:08:09.266985Z","title":"Openrlhf: An easy-to-use, scalable and high-performance rlhf framework, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T11:08:09.266985Z"},"links":{"cited_paper":"/paper/2405.11143","citing_paper":"/paper/2601.07376"},"observation_digest":"sha256:5626ae92b51e43b2cfa713e5b22265010e067bf7aefe73adc51746e226715f3a","observation_id":"842e9f74-e1b6-4333-ae05-237dacb7c4f8","resolution":{"observed_at":"2026-08-03T11:08:09.266985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:08:09.350328Z","title":"Tinker, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T11:08:09.350328Z"},"links":{"citing_paper":"/paper/2601.07376"},"observation_digest":"sha256:defdf6e07addc9b899d5906f34aeeb07bd2bc715226fcca0a5151fdc6148bd39","observation_id":"163af5e1-8833-4886-9f02-b695ce74d492","resolution":{"observed_at":"2026-08-03T11:08:09.350328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03680","last_updated":"2025-08-05T17:50:13Z","snapshot_observed_at":"2026-08-06T04:17:53.374156Z","submitted_at":"2025-08-05T17:50:13Z","title":"Agent Lightning: Train ANY AI Agents with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.03680","snapshot_observed_at":"2026-08-03T11:08:09.429860Z","title":"Qiu, and Yuqing Yang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T11:08:09.429860Z"},"links":{"cited_paper":"/paper/2508.03680","citing_paper":"/paper/2601.07376"},"observation_digest":"sha256:9bbbab78818ef4707d02c46997375f80762abf3c994ad490bc8df7c509f5a003","observation_id":"fa5821be-347f-433a-8119-8b008824ceb0","resolution":{"observed_at":"2026-08-03T11:08:09.429860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T11:08:09.510213Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T11:08:09.510213Z"},"links":{"citing_paper":"/paper/2601.07376"},"observation_digest":"sha256:97d2596c24691eaeea1b5c8a39e5907691c7f0faab829a840c7be73bc920bc93","observation_id":"ec43eaac-95a9-4c57-aeb9-07ecefb38d4d","resolution":{"observed_at":"2026-08-03T11:08:09.510213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.07376","last_updated":"2026-07-06T09:21:40Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-05T07:22:32.174869Z","submitted_at":"2026-01-12T09:57:46Z","title":"OpenTinker: Separating Concerns in Agentic Reinforcement Learning"},"reference_resolution":{"displayed":5,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":5},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 5 of 5 outbound references and 6 inbound Pith citation observations for arXiv:2601.07376."}