{"as_of":"2026-08-06T03:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:034085ae0c5ffd7325115a63d147fc7f4cd4f6dd6bb0d3ca28304c4f0d0873af","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T21:50:00.974590Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.14892","last_updated":"2023-06-26T17:58:50Z","snapshot_observed_at":"2026-07-06T15:46:55.111790Z","submitted_at":"2023-06-26T17:58:50Z","title":"Supervised Pretraining Can Learn In-Context Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2306.14892","doi":"10.48550/arxiv.2306.14892","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.14892","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Xie, Annie and Pacchiano, Aldo and Chandak, Yash and Finn, Chelsea and Nachum, Ofir and Brunskill, Emma , year =","venue":"arXiv (Cornell University)","work_id":"18ce988a-68a6-4f82-8c8a-26038347746d","year":null},"citing_paper":{"arxiv_id":"2309.16797","last_updated":"2023-09-28T19:01:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T19:01:07Z","title":"Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution","version":1},"reference_index":194,"source":"arxiv_source","source_observed_at":"2026-05-16T08:12:30.984870Z"},"links":{"cited_paper":"/paper/2306.14892","citing_paper":"/paper/2309.16797"},"observation_digest":"sha256:c6cfc9960391bf8b3f2fd365b926bb891f1109eaffce460845b72de89ed73be8","observation_id":"f4e02161-42d8-43f8-9165-6ef40fa7e2bd","resolution":{"observed_at":"2026-05-16T08:12:35.080068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14892","last_updated":"2023-06-26T17:58:50Z","snapshot_observed_at":"2026-07-06T15:46:55.111790Z","submitted_at":"2023-06-26T17:58:50Z","title":"Supervised Pretraining Can Learn In-Context Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2306.14892","doi":"10.48550/arxiv.2306.14892","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.14892","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Xie, Annie and Pacchiano, Aldo and Chandak, Yash and Finn, Chelsea and Nachum, Ofir and Brunskill, Emma , year =","venue":"arXiv (Cornell University)","work_id":"18ce988a-68a6-4f82-8c8a-26038347746d","year":null},"citing_paper":{"arxiv_id":"2605.09727","last_updated":"2026-05-10T19:52:29Z","snapshot_observed_at":"2026-07-31T17:23:23.893636Z","submitted_at":"2026-05-10T19:52:29Z","title":"One for All: A Non-Linear Transformer can Enable Cross-Domain Generalization for In-Context Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T03:46:21.786972Z"},"links":{"cited_paper":"/paper/2306.14892","citing_paper":"/paper/2605.09727"},"observation_digest":"sha256:99c49334b8387aaab254fc27c63790e7340be3d86f2ac1197aad7bb7f38868a9","observation_id":"51a9fedf-71d2-4fba-a256-aea2cab9baa1","resolution":{"observed_at":"2026-05-12T06:56:31.935629Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14892","last_updated":"2023-06-26T17:58:50Z","snapshot_observed_at":"2026-07-06T15:46:55.111790Z","submitted_at":"2023-06-26T17:58:50Z","title":"Supervised Pretraining Can Learn In-Context Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2306.14892","doi":"10.48550/arxiv.2306.14892","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.14892","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Xie, Annie and Pacchiano, Aldo and Chandak, Yash and Finn, Chelsea and Nachum, Ofir and Brunskill, Emma , year =","venue":"arXiv (Cornell University)","work_id":"18ce988a-68a6-4f82-8c8a-26038347746d","year":null},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-13T04:55:55.013900Z"},"links":{"cited_paper":"/paper/2306.14892","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:4db6f815145907c82ecc9a6fe5d3e2c64aaef3dea67cf5c012fc9df8db54ec7c","observation_id":"0d394af4-8626-4273-aa97-f8663abe2f41","resolution":{"observed_at":"2026-05-13T04:57:17.371685Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14892","last_updated":"2023-06-26T17:58:50Z","snapshot_observed_at":"2026-07-06T15:46:55.111790Z","submitted_at":"2023-06-26T17:58:50Z","title":"Supervised Pretraining Can Learn In-Context Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2306.14892","doi":"10.48550/arxiv.2306.14892","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.14892","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Xie, Annie and Pacchiano, Aldo and Chandak, Yash and Finn, Chelsea and Nachum, Ofir and Brunskill, Emma , year =","venue":"arXiv (Cornell University)","work_id":"18ce988a-68a6-4f82-8c8a-26038347746d","year":null},"citing_paper":{"arxiv_id":"2605.12288","last_updated":"2026-06-10T07:32:21Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:44:33Z","title":"TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-15T05:41:10.714594Z"},"links":{"cited_paper":"/paper/2306.14892","citing_paper":"/paper/2605.12288"},"observation_digest":"sha256:a8c736a179878150ef81ab7649ee3ff6757e05e69b13f76a50af112ce9f08db5","observation_id":"c55a68a0-d79c-4972-838b-c8e9b2fef293","resolution":{"observed_at":"2026-05-15T05:45:06.497953Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14892","last_updated":"2023-06-26T17:58:50Z","snapshot_observed_at":"2026-07-06T15:46:55.111790Z","submitted_at":"2023-06-26T17:58:50Z","title":"Supervised Pretraining Can Learn In-Context Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2306.14892","doi":"10.48550/arxiv.2306.14892","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.14892","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Xie, Annie and Pacchiano, Aldo and Chandak, Yash and Finn, Chelsea and Nachum, Ofir and Brunskill, Emma , year =","venue":"arXiv (Cornell University)","work_id":"18ce988a-68a6-4f82-8c8a-26038347746d","year":null},"citing_paper":{"arxiv_id":"2606.18812","last_updated":"2026-06-18T16:24:52Z","snapshot_observed_at":"2026-08-02T11:57:05.307680Z","submitted_at":"2026-06-17T08:27:27Z","title":"Reinforcement Learning Foundation Models Should Already Be A Thing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T21:50:00.974590Z"},"links":{"cited_paper":"/paper/2306.14892","citing_paper":"/paper/2606.18812"},"observation_digest":"sha256:d3c4747a572b52f520a8af5337869effcdec018c9964ce511f3bff5edfbde395","observation_id":"3a18d0c7-fd70-4d9a-9dd7-2e0936c7274d","resolution":{"observed_at":"2026-07-03T23:39:05.055344Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14892","last_updated":"2023-06-26T17:58:50Z","snapshot_observed_at":"2026-07-06T15:46:55.111790Z","submitted_at":"2023-06-26T17:58:50Z","title":"Supervised Pretraining Can Learn In-Context Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2306.14892","doi":"10.48550/arxiv.2306.14892","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.14892","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Xie, Annie and Pacchiano, Aldo and Chandak, Yash and Finn, Chelsea and Nachum, Ofir and Brunskill, Emma , year =","venue":"arXiv (Cornell University)","work_id":"18ce988a-68a6-4f82-8c8a-26038347746d","year":null},"citing_paper":{"arxiv_id":"2606.24962","last_updated":"2026-06-23T09:13:08Z","snapshot_observed_at":"2026-08-04T02:44:08.654755Z","submitted_at":"2026-06-23T09:13:08Z","title":"Towards Scalable Multi-Task Reinforcement Learning with Large Decision Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T00:38:48.912290Z"},"links":{"cited_paper":"/paper/2306.14892","citing_paper":"/paper/2606.24962"},"observation_digest":"sha256:660a931d66d1974a30cda64071b5ee4ac72c8bc3e76e040cb7b33837a54bab14","observation_id":"e7d950d4-a278-414c-ae1e-03b695a73b5c","resolution":{"observed_at":"2026-07-04T16:29:57.124700Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2306.14892/citation-record","integrity":"/paper/2306.14892/integrity","json":"/paper/2306.14892/citation-record.json","paper":"/paper/2306.14892"},"outbound":[],"paper":{"arxiv_id":"2306.14892","last_updated":"2023-06-26T17:58:50Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T15:46:55.111790Z","submitted_at":"2023-06-26T17:58:50Z","title":"Supervised Pretraining Can Learn In-Context Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2306.14892."}