{"as_of":"2026-08-18T10:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b48f73c694056ae3e62a142eaa09bc4ba84e4091faf395d11ce5238a404b12b8","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T01:44:37.492572Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T00:41:12.545963Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.05888","snapshot_observed_at":"2026-08-02T00:41:12.545963Z","title":"Retry policy gradients in continuous action spaces.arXiv preprint arXiv:2606.05888, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14962","last_updated":"2026-07-16T13:14:21Z","snapshot_observed_at":"2026-08-14T02:06:21.782867Z","submitted_at":"2026-07-16T13:14:21Z","title":"Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:12.545963Z"},"links":{"cited_paper":"/paper/2606.05888","citing_paper":"/paper/2607.14962"},"observation_digest":"sha256:1eab5dd3b1f4e4fc5dcfe37386027e1fab453c49b1e2f15f2df71649e2dcc2be","observation_id":"98fbfd37-543b-4703-916f-ca483b3488e8","resolution":{"observed_at":"2026-08-02T00:41:12.545963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.05888/citation-record","integrity":"/paper/2606.05888/integrity","json":"/paper/2606.05888/citation-record.json","paper":"/paper/2606.05888"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.10751","last_updated":"2025-08-14T15:34:47Z","snapshot_observed_at":"2026-08-13T06:01:10.639866Z","submitted_at":"2025-08-14T15:34:47Z","title":"Pass@k Training for Adaptively Balancing Exploration and Exploitation of Large Reasoning Models","version":1},"cited_work":{"arxiv_id":"2508.10751","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.10751","snapshot_observed_at":"2026-07-04T21:00:08.457909Z","title":"Pass@ k training for adaptively balancing exploration and exploitation of large reasoning models","venue":null,"work_id":"e7962a8e-fc74-4d96-9a1b-3c7897f6c60d","year":2025},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"cited_paper":"/paper/2508.10751","citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:0429b1d5c9b376c401644d5a1d33dae035c7e8f193ccb7daa41ca52d6a761ec6","observation_id":"19363c93-9a7d-400c-9e42-7115da93686e","resolution":{"observed_at":"2026-07-02T12:56:57.024097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07207","last_updated":"2019-10-18T09:17:44Z","snapshot_observed_at":"2026-08-14T00:35:36.804755Z","submitted_at":"2019-10-16T08:11:08Z","title":"Soft Actor-Critic for Discrete Action Settings","version":2},"cited_work":{"arxiv_id":"1910.07207","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.07207","snapshot_observed_at":"2026-07-04T19:40:05.986446Z","title":"arXiv:1910.07207 [cs, stat] , author =","venue":null,"work_id":"684554b0-ea6b-4199-b360-8e61b4bd9971","year":1910},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"cited_paper":"/paper/1910.07207","citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:a7eed055bd4b6ca25f266710d91a1b60f618335be372360ebce92121fa22ca02","observation_id":"4ce9cad1-9684-465b-a774-bee3b9e4f106","resolution":{"observed_at":"2026-07-02T12:56:57.023856Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:44:37.492572Z","title":"Formal Theory of Creativity, Fun, and Intrinsic Motivation (1990–2010).IEEE Transactions on Autonomous Mental Development, 2(3):230–247,","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:e0482b7cd6b6bdadcb120e503092b74f1a3d5a2550b8496f58a04ecfd93d1356","observation_id":"79e9363a-b13f-405e-8daa-6d80fd84adbf","resolution":{"observed_at":"2026-06-28T01:44:37.492572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:cae8c39afa9d43c3b644fe5f44b72a1024fbb4c2223256f8a6a46de47cb3ca4f","observation_id":"84630d76-08e1-4318-a6c9-567e436357e1","resolution":{"observed_at":"2026-07-02T12:56:57.021274Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.20854","last_updated":"2026-05-30T15:59:38Z","snapshot_observed_at":"2026-07-06T23:31:23.407780Z","submitted_at":"2026-05-20T07:44:43Z","title":"Finite-Time Regret Analysis of Retry-Aware Bandits","version":2},"cited_work":{"arxiv_id":"2605.20854","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.20854","snapshot_observed_at":"2026-07-02T12:56:57.025050Z","title":"Finite-Time Regret Analysis of Retry-Aware Bandits","venue":"cs.LG","work_id":"d0f1a8b7-1dc3-44c8-833d-ca152ecc0865","year":2026},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"cited_paper":"/paper/2605.20854","citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:2f81f5af121c990fd88409a738bb6fd4988600556607431f25935ceafc7db118","observation_id":"c57fcdf4-207c-4831-89dd-8ba69012d046","resolution":{"observed_at":"2026-07-02T12:56:57.026584Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:44:37.492572Z","title":"We include the code in the supplementary material","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:f719556cf5191dff376a86f8c616b8d602e0ad016a343a2af3888bb7231ce078","observation_id":"51fabc0b-fc4e-4553-9a4b-4ec75f2d21a6","resolution":{"observed_at":"2026-06-28T01:44:37.492572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:44:37.492572Z","title":null,"venue":null,"work_id":null,"year":2080},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:1a85b88fa9074b6bfbb15e726226835048862736bb9f1dc9661b9c4fac651aa4","observation_id":"e32aa80c-fdb8-4386-890c-08b762c4d3e9","resolution":{"observed_at":"2026-06-28T01:44:37.492572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:44:37.492572Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:7ce7254b08ee54722dc039379a1c7b5a03fc65e7d593f7c2a51462fe28fee1fb","observation_id":"4c4bf057-044b-443a-8e96-d388c9dafaa1","resolution":{"observed_at":"2026-06-28T01:44:37.492572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:44:37.492572Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:0eec8fc56e2dc209998956fe74e144a882c948083e11d07ee422372ac795eaa3","observation_id":"3c66705e-b816-4883-8c1e-141309130430","resolution":{"observed_at":"2026-06-28T01:44:37.492572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:44:37.492572Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:4d5028fca1a5f8c2ed1ae463e11a3bc04a23d708d90c0d65fd476363f78e8f6a","observation_id":"8f4d7fd7-1c3a-4697-9a36-cfffca2b93b1","resolution":{"observed_at":"2026-06-28T01:44:37.492572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:44:37.492572Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:3c21ecdb8ef9cc8c2a9114b3e666e2797f74b09a2c449181aea11b09c102c298","observation_id":"1340e0ee-731f-4367-9d16-932ee51e3069","resolution":{"observed_at":"2026-06-28T01:44:37.492572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:44:37.492572Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T01:44:37.492572Z"},"links":{"citing_paper":"/paper/2606.05888"},"observation_digest":"sha256:6f8c1dd41af02d75642b75b38d9e8abf3c2f51a83661c83781d5ba64e1f26344","observation_id":"a25c0331-12a3-4eb4-8d5b-8c315a10d5e5","resolution":{"observed_at":"2026-06-28T01:44:37.492572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.05888","last_updated":"2026-06-04T08:57:45Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T12:01:33.602409Z","submitted_at":"2026-06-04T08:57:45Z","title":"Retry Policy Gradients in Continuous Action Spaces"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":8,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 1 inbound Pith citation observation for arXiv:2606.05888."}