{"as_of":"2026-08-08T02:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7dcd3f9396d60eb90aa69c6b3839ff39edd363d9a85524cb39f9d2fd5f888c99","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:27:54.037626Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T23:39:05.062745Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-07T15:27:54.037626Z","title":"Transformers as decision makers: Provable in-context reinforcement learning via supervised pretraining","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15143","last_updated":"2025-05-21T06:00:41Z","snapshot_observed_at":"2026-08-08T00:48:55.411761Z","submitted_at":"2025-05-21T06:00:41Z","title":"Filtering Learning Histories Enhances In-Context Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:27:54.037626Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2505.15143"},"observation_digest":"sha256:ebc3d5a836c7ecf3e0f95e4fa8fbbe9d6921563bce8c1b0e4611ace1c9d96a80","observation_id":"541f0503-2ac9-4743-a858-254dd076fde4","resolution":{"observed_at":"2026-08-07T15:27:54.037626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-07T11:40:56.046409Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01919","last_updated":"2025-06-02T17:39:31Z","snapshot_observed_at":"2026-08-07T22:04:35.171751Z","submitted_at":"2025-06-02T17:39:31Z","title":"Transformers as Multi-task Learners: Decoupling Features in Hidden Markov Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:40:56.046409Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2506.01919"},"observation_digest":"sha256:9504c37d611ad3579c90f501af753e62daa2e58ea3868d990def22b1f80b7e93","observation_id":"50c28daa-a967-4087-85c5-2fc111ff7716","resolution":{"observed_at":"2026-08-07T11:40:56.046409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-07T10:35:36.202620Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05295","last_updated":"2025-06-12T16:25:06Z","snapshot_observed_at":"2026-08-07T10:19:20.091786Z","submitted_at":"2025-06-05T17:48:19Z","title":"Sample Complexity and Representation Ability of Test-time Scaling Paradigms","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:36.202620Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2506.05295"},"observation_digest":"sha256:bf2f022611f41224a0b81ad46bd666f3652c0846ae124f0364fbfc1c1056b6e5","observation_id":"c84e3eb6-9af2-4682-a82d-4f7318704b19","resolution":{"observed_at":"2026-08-07T10:35:36.202620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-06T15:30:40.997628Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15759","last_updated":"2025-07-21T16:15:18Z","snapshot_observed_at":"2026-08-07T12:39:48.882990Z","submitted_at":"2025-07-21T16:15:18Z","title":"Interaction as Intelligence: Deep Research With Human-AI Partnership","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T15:30:40.997628Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2507.15759"},"observation_digest":"sha256:c15c4576eeae73d708296317359f7915b1da771b517d084015f332f9673f1443","observation_id":"627131a0-eb13-4e91-838c-1ba57d615dbd","resolution":{"observed_at":"2026-08-06T15:30:40.997628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-04T09:58:08.178667Z","title":"Transformers as decision makers: Provable in-context reinforcement learning via supervised pretraining","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12624","last_updated":"2026-05-31T20:05:16Z","snapshot_observed_at":"2026-08-06T02:38:52.181285Z","submitted_at":"2025-10-14T15:23:32Z","title":"Learning-To-Measure: In-Context Active Feature Acquisition","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T09:58:08.178667Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2510.12624"},"observation_digest":"sha256:03b072db5b8bf3b77311e284bdaf0b5d1e12252e00b2cd93de238ab1e94ce260","observation_id":"8c60488e-d1e0-4a74-9e90-5374a3e4abe7","resolution":{"observed_at":"2026-08-04T09:58:08.178667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":"2310.08566","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-07-03T23:39:05.062745Z","title":"org/abs/2310.08566","venue":null,"work_id":"e935c7e1-06b2-4630-8b3b-ef426afd370f","year":2023},"citing_paper":{"arxiv_id":"2605.07959","last_updated":"2026-05-08T16:22:08Z","snapshot_observed_at":"2026-07-06T23:20:15.696237Z","submitted_at":"2026-05-08T16:22:08Z","title":"Convergent Stochastic Training of Attention and Understanding LoRA","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-11T02:48:35.907351Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2605.07959"},"observation_digest":"sha256:a1c31c086694699da6c920e5735f81afb3b808c4d708b8a5aaac91648206657f","observation_id":"ebf6068c-72f4-48a4-85fb-f1e9f78abac9","resolution":{"observed_at":"2026-05-11T03:05:55.072521Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":"2310.08566","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-07-03T23:39:05.062745Z","title":"org/abs/2310.08566","venue":null,"work_id":"e935c7e1-06b2-4630-8b3b-ef426afd370f","year":2023},"citing_paper":{"arxiv_id":"2605.09727","last_updated":"2026-05-10T19:52:29Z","snapshot_observed_at":"2026-07-31T17:23:23.893636Z","submitted_at":"2026-05-10T19:52:29Z","title":"One for All: A Non-Linear Transformer can Enable Cross-Domain Generalization for In-Context Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T03:46:21.786972Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2605.09727"},"observation_digest":"sha256:fa5ab951ee341fa9b07ecdba8912badc34205f8aadc09794043ab00de8668863","observation_id":"0a4ae872-dfc1-4ca1-8eec-3aa057f95ca3","resolution":{"observed_at":"2026-05-12T06:56:31.956466Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":"2310.08566","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-07-03T23:39:05.062745Z","title":"org/abs/2310.08566","venue":null,"work_id":"e935c7e1-06b2-4630-8b3b-ef426afd370f","year":2023},"citing_paper":{"arxiv_id":"2605.25210","last_updated":"2026-05-24T18:19:40Z","snapshot_observed_at":"2026-07-31T17:51:56.004972Z","submitted_at":"2026-05-24T18:19:40Z","title":"Multi-Objective Learning for Diffusion Models: A Statistical Theory under Semi-Supervised Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T12:09:27.409746Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2605.25210"},"observation_digest":"sha256:311c21d1de3138e2135d0fa76dd238403dd8e33b9fcfd962a271610f2ad73cca","observation_id":"a545a2ba-50f9-4a1c-a6b9-1a5908caabdd","resolution":{"observed_at":"2026-06-30T12:34:39.412832Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":"2310.08566","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-07-03T23:39:05.062745Z","title":"org/abs/2310.08566","venue":null,"work_id":"e935c7e1-06b2-4630-8b3b-ef426afd370f","year":2023},"citing_paper":{"arxiv_id":"2606.18812","last_updated":"2026-06-18T16:24:52Z","snapshot_observed_at":"2026-08-02T11:57:05.307680Z","submitted_at":"2026-06-17T08:27:27Z","title":"Reinforcement Learning Foundation Models Should Already Be A Thing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T21:50:00.974590Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2606.18812"},"observation_digest":"sha256:945f1ed51854a4e77cd377f85f62c9ffe6ff86cfd4aa9bb42d4b2b87ab29b61b","observation_id":"cb66579a-6707-412b-a64f-bb9f26450594","resolution":{"observed_at":"2026-07-03T23:39:05.065765Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":"2310.08566","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-07-03T23:39:05.062745Z","title":"org/abs/2310.08566","venue":null,"work_id":"e935c7e1-06b2-4630-8b3b-ef426afd370f","year":2023},"citing_paper":{"arxiv_id":"2606.31184","last_updated":"2026-06-30T06:13:38Z","snapshot_observed_at":"2026-08-03T09:10:10.737689Z","submitted_at":"2026-06-30T06:13:38Z","title":"Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-01T06:44:18.631601Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2606.31184"},"observation_digest":"sha256:f2972907490a9a6270d62870d6fd75ec490f690088511a2bce7993df8c2a9f69","observation_id":"04ef0b51-afca-40b5-b359-5390aa85266e","resolution":{"observed_at":"2026-07-01T06:45:29.285229Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2310.08566/citation-record","integrity":"/paper/2310.08566/integrity","json":"/paper/2310.08566/citation-record.json","paper":"/paper/2310.08566"},"outbound":[],"paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2310.08566."}