{"as_of":"2026-08-09T12:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3c064d73fb11485784c57ed8474fdf3ea90fbe88a595e3ceda6bc49271d91f1c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:03:28.595829Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T06:59:38.343947Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1903.03698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-07-04T06:59:38.343947Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":"9912f351-bd16-4037-9627-98a975a611ff","year":1903},"citing_paper":{"arxiv_id":"2502.12272","last_updated":"2026-04-30T11:57:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-17T19:16:37Z","title":"Learning to Reason at the Frontier of Learnability","version":6},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-23T02:41:21.571824Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2502.12272"},"observation_digest":"sha256:2295cac5210f6dea9d65cc9c051ee440b665d6ab5169568f2bca8df588e1229a","observation_id":"1f05f239-4449-48a3-b8f2-60e199228dce","resolution":{"observed_at":"2026-05-23T02:42:26.146328Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-08-07T11:03:28.595829Z","title":"Skew-fit: State-covering self-supervised reinforcement learning","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2506.04287","last_updated":"2025-06-20T03:16:30Z","snapshot_observed_at":"2026-08-07T22:33:30.380387Z","submitted_at":"2025-06-04T10:04:21Z","title":"Automated Skill Discovery for Language Agents through Exploration and Iterative Feedback","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:03:28.595829Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2506.04287"},"observation_digest":"sha256:046e3f2a7544cfb2c8f5fb1963868d4c533b673c0150fe37d4b41b52bddbdefb","observation_id":"017bcc25-aebd-4488-a748-ab051c631b87","resolution":{"observed_at":"2026-08-07T11:03:28.595829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1903.03698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-07-04T06:59:38.343947Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":"9912f351-bd16-4037-9627-98a975a611ff","year":1903},"citing_paper":{"arxiv_id":"2506.21039","last_updated":"2026-05-20T06:53:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-26T06:35:42Z","title":"Strict Subgoal Execution: Reliable Long-Horizon Planning in Hierarchical Reinforcement Learning","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T00:53:46.002945Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2506.21039"},"observation_digest":"sha256:a91f0e58b4f6e52058a100d713244e0287dccd57cf09cf2b3478c1de1f2c20cd","observation_id":"c6dee320-569f-47f3-bc62-1e567b91fe3b","resolution":{"observed_at":"2026-05-22T00:54:31.211533Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-08-05T10:40:49.651497Z","title":"H., Dalal, M., Lin, S., Nair, A., Bahl, S., and Levine, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.03863","last_updated":"2025-09-04T03:44:44Z","snapshot_observed_at":"2026-08-05T10:40:44.290489Z","submitted_at":"2025-09-04T03:44:44Z","title":"Expedition & Expansion: Leveraging Semantic Representations for Goal-Directed Exploration in Continuous Cellular Automata","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T10:40:49.651497Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2509.03863"},"observation_digest":"sha256:395ded67910a47f2d895820d6826c59052852753fed336419e897fa6749a75fd","observation_id":"639fedf0-4c81-41fe-a29d-b835cdc805f0","resolution":{"observed_at":"2026-08-05T10:40:49.651497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1903.03698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-07-04T06:59:38.343947Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":"9912f351-bd16-4037-9627-98a975a611ff","year":1903},"citing_paper":{"arxiv_id":"2604.25496","last_updated":"2026-06-24T16:12:26Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:56:54Z","title":"Improving Zero-Shot Offline RL via Behavioral Task Sampling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-07T16:27:15.347522Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2604.25496"},"observation_digest":"sha256:9fe60055a280b1dba29743912d45d5b230e83746b527b6802523f6465ab0c42c","observation_id":"2e9cf429-8e9e-4b43-a86d-194bb7e1b6d0","resolution":{"observed_at":"2026-05-11T23:41:18.672711Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1903.03698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-07-04T06:59:38.343947Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":"9912f351-bd16-4037-9627-98a975a611ff","year":1903},"citing_paper":{"arxiv_id":"2605.01242","last_updated":"2026-05-02T04:46:54Z","snapshot_observed_at":"2026-07-06T23:14:29.125042Z","submitted_at":"2026-05-02T04:46:54Z","title":"Breaking the Computational Barrier: Provably Efficient Actor-Critic for Low-Rank MDPs","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-09T15:12:54.575483Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2605.01242"},"observation_digest":"sha256:b77249914add6345622bbf30301b65187f05a66d921c40adae5e4cb026e2ed22","observation_id":"075a2598-7790-4088-af7b-9a03bae07a5d","resolution":{"observed_at":"2026-05-11T16:46:05.336561Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1903.03698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-07-04T06:59:38.343947Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":"9912f351-bd16-4037-9627-98a975a611ff","year":1903},"citing_paper":{"arxiv_id":"2605.01862","last_updated":"2026-05-08T03:23:44Z","snapshot_observed_at":"2026-07-06T23:15:01.968194Z","submitted_at":"2026-05-03T13:11:28Z","title":"QHyer: Q-conditioned Hybrid Attention-mamba Transformer for Offline Goal-conditioned RL","version":2},"reference_index":147,"source":"arxiv_source","source_observed_at":"2026-05-11T01:17:48.643521Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2605.01862"},"observation_digest":"sha256:2e7df3add5203a6775bca8c8b35f969109a7c864d5532c4df0ce8fde6a587e63","observation_id":"6e6dc1f7-d09c-40aa-b705-444c3e1892bc","resolution":{"observed_at":"2026-05-11T04:30:58.692267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1903.03698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-07-04T06:59:38.343947Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":"9912f351-bd16-4037-9627-98a975a611ff","year":1903},"citing_paper":{"arxiv_id":"2605.06145","last_updated":"2026-05-07T12:40:49Z","snapshot_observed_at":"2026-08-03T04:29:49.815774Z","submitted_at":"2026-05-07T12:40:49Z","title":"Unifying Goal-Conditioned RL and Unsupervised Skill Learning via Control-Maximization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T13:52:43.033237Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2605.06145"},"observation_digest":"sha256:4fbb87fce1063559e5942efe808e105d04addbe5bc4a930f272202656c250f12","observation_id":"f2e07870-d7eb-4aab-afd7-91423fe3e8b7","resolution":{"observed_at":"2026-05-11T18:46:10.732263Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1903.03698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-07-04T06:59:38.343947Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":"9912f351-bd16-4037-9627-98a975a611ff","year":1903},"citing_paper":{"arxiv_id":"2605.14350","last_updated":"2026-05-14T04:22:24Z","snapshot_observed_at":"2026-07-06T23:25:49.545418Z","submitted_at":"2026-05-14T04:22:24Z","title":"Distributionally Robust Multi-Task Reinforcement Learning via Adaptive Task Sampling","version":1},"reference_index":275,"source":"arxiv_source","source_observed_at":"2026-05-15T03:05:36.871497Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2605.14350"},"observation_digest":"sha256:6b9663b6323bdb36158568fc0fc8aca0f77c257292a8d2a4a689b013405acd1e","observation_id":"eea2001c-898b-4c15-81b7-327ad86964d2","resolution":{"observed_at":"2026-05-15T03:08:59.509737Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1903.03698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-07-04T06:59:38.343947Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":"9912f351-bd16-4037-9627-98a975a611ff","year":1903},"citing_paper":{"arxiv_id":"2605.23551","last_updated":"2026-05-22T12:17:09Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:17:09Z","title":"Goal-Conditioned Agents that Learn Everything All at Once","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-25T04:59:48.867927Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2605.23551"},"observation_digest":"sha256:4b2822a86a9c3be1cdc7ab1f8cef0ff6bb61681311c1851f6638118dff0b365d","observation_id":"b9f52f1f-f1da-4758-a06c-ae5928b5502b","resolution":{"observed_at":"2026-05-25T05:00:21.678792Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1903.03698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-07-04T06:59:38.343947Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":"9912f351-bd16-4037-9627-98a975a611ff","year":1903},"citing_paper":{"arxiv_id":"2606.09476","last_updated":"2026-06-08T13:35:22Z","snapshot_observed_at":"2026-08-01T13:38:00.934917Z","submitted_at":"2026-06-08T13:35:22Z","title":"Goal Sets, Not Goal States: Queryable Robot Goals through Goal-Set Hindsight Relabeling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T16:07:28.361043Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2606.09476"},"observation_digest":"sha256:cb12451628e3c6227d7134f3b19697d949b0a6cd263c42724c14b58b6d85eccc","observation_id":"dfbde33f-fb4c-49d0-acd5-f523771f393e","resolution":{"observed_at":"2026-07-03T02:07:34.164785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"1903.03698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-07-04T06:59:38.343947Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":"9912f351-bd16-4037-9627-98a975a611ff","year":1903},"citing_paper":{"arxiv_id":"2606.21788","last_updated":"2026-06-19T22:38:51Z","snapshot_observed_at":"2026-07-06T23:56:45.447705Z","submitted_at":"2026-06-19T22:38:51Z","title":"Rotation-Aware Point-Cloud Embeddings for Vision-Based In-Hand Reorientation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T13:54:05.409504Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2606.21788"},"observation_digest":"sha256:ec13e431618a6ef0eec3b1ecbda1c86c761fc8f7be07a61b88dbebb6711b1af8","observation_id":"59b6ff6c-371b-4593-844c-e50fa85ba480","resolution":{"observed_at":"2026-07-04T06:59:38.345512Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.03698","snapshot_observed_at":"2026-08-01T08:32:00.219755Z","title":"arXiv preprint arXiv:1903.03698 , year=","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2607.21120","last_updated":"2026-07-23T09:55:45Z","snapshot_observed_at":"2026-08-05T03:29:01.517081Z","submitted_at":"2026-07-23T09:55:45Z","title":"Relative Value Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-01T08:32:00.219755Z"},"links":{"cited_paper":"/paper/1903.03698","citing_paper":"/paper/2607.21120"},"observation_digest":"sha256:3c7f0b2456d209c3c750ddc4a2e1d2a83b3041c67d97f3410c70840de95eeaf9","observation_id":"872d3749-4388-436a-9ef2-e6857443b901","resolution":{"observed_at":"2026-08-01T08:32:00.219755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1903.03698/citation-record","integrity":"/paper/1903.03698/integrity","json":"/paper/1903.03698/citation-record.json","paper":"/paper/1903.03698"},"outbound":[],"paper":{"arxiv_id":"1903.03698","last_updated":"2020-08-04T04:07:27Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T07:38:07.496179Z","submitted_at":"2019-03-08T23:32:17Z","title":"Skew-Fit: State-Covering Self-Supervised Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:1903.03698."}