{"as_of":"2026-08-08T17:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1361e3d53a6aaaf8ae05fb7b704a04bf3de6e64e7caf181e1f92ca958253e5ed","coverage":[{"denominator":159,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:38:08.555316Z","state":"measured"},{"denominator":103,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":103,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:07:43.000377Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T04:01:01.522619Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"cited_work":{"arxiv_id":"2507.12483","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12483","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"95ff2acb-c3ab-43f9-8b2e-84ae8b691ea9","year":2025},"citing_paper":{"arxiv_id":"2605.22526","last_updated":"2026-05-21T14:18:29Z","snapshot_observed_at":"2026-07-06T23:32:49.530788Z","submitted_at":"2026-05-21T14:18:29Z","title":"\"Refactoring Runaway\": Understanding and Mitigating Tangled Refactorings in Coding Agents for Issue Resolution","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T03:58:08.767022Z"},"links":{"cited_paper":"/paper/2507.12483","citing_paper":"/paper/2605.22526"},"observation_digest":"sha256:5492204aa5eb29b5c05551acffa1b877ac44767bde5eb10f63f7b046cf03dccb","observation_id":"5bf9edd6-af47-4414-8257-205ae034b3ad","resolution":{"observed_at":"2026-05-22T04:01:01.525207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12483","snapshot_observed_at":"2026-08-01T12:07:43.000377Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19682","last_updated":"2026-07-22T02:31:10Z","snapshot_observed_at":"2026-08-07T08:31:51.827949Z","submitted_at":"2026-07-22T02:31:10Z","title":"Context Matters: Improving the Practical Reliability of LLM-Based Unit Test Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T12:07:43.000377Z"},"links":{"cited_paper":"/paper/2507.12483","citing_paper":"/paper/2607.19682"},"observation_digest":"sha256:c4c06802e3b480f839b7a9fc29c883be179fd85e8322d06576b02ccb6b9fb51e","observation_id":"386d3403-272e-4e31-821e-872cf6e56678","resolution":{"observed_at":"2026-08-01T12:07:43.000377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12483","snapshot_observed_at":"2026-07-31T11:28:31.995734Z","title":"A survey of reinforce- ment learning for software engineering,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24577","last_updated":"2026-07-27T15:46:57Z","snapshot_observed_at":"2026-07-31T11:28:30.949504Z","submitted_at":"2026-07-27T15:46:57Z","title":"Evaluating Fuzz Testing for Reinforcement Learning Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-31T11:28:31.995734Z"},"links":{"cited_paper":"/paper/2507.12483","citing_paper":"/paper/2607.24577"},"observation_digest":"sha256:b6f89264dcca76193e09d7234974c9da0352c8fadbabf363af76419259e6276b","observation_id":"bc87c4b4-ffb7-4cd1-9e90-c05fe99ed2b6","resolution":{"observed_at":"2026-07-31T11:28:31.995734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12483/citation-record","integrity":"/paper/2507.12483/integrity","json":"/paper/2507.12483/citation-record.json","paper":"/paper/2507.12483"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:07.994374Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:07.994374Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:0b2950cd55e66181fd6f0e3f1f4aec3fea8b103741093772befca069383c45af","observation_id":"f1e5a34b-c8b5-4d29-a790-411f32e6a9ca","resolution":{"observed_at":"2026-08-06T17:38:07.994374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.000528Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.000528Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:78cb66555c5a48f7d88908c85b98a16c42d81503efde930f7849b8530b7af99f","observation_id":"aad762bb-1134-4cf4-a918-8d0093cf8ec4","resolution":{"observed_at":"2026-08-06T17:38:08.000528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.006078Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.006078Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:6243de23e729ee0d69861fdf0ae4e5563d90752f71c68f37a2a294c981ab7943","observation_id":"b03622b7-39e7-492b-adc9-8e1b6d4c8ef3","resolution":{"observed_at":"2026-08-06T17:38:08.006078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-06T17:38:08.011943Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.011943Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:e16941ee2b151298489b274c67f7b3dfb235d4062d422dfff036ca8238ec4a65","observation_id":"7203cc63-84e6-4e0f-ac27-f640d870e168","resolution":{"observed_at":"2026-08-06T17:38:08.011943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.019421Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.019421Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:73abfe989d6f8527a1622048800670216e870b775d4f1b6635f597fbe3fbbaa3","observation_id":"f3f34d9c-63f4-4085-8c5b-213ea4647ab9","resolution":{"observed_at":"2026-08-06T17:38:08.019421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.026871Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.026871Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:0c63043f092a3c9e75abc10e0b769888e4172a74482d699611dbb3491ab17318","observation_id":"53d57ed6-a080-4d90-85ce-b056aadeeb13","resolution":{"observed_at":"2026-08-06T17:38:08.026871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.033451Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.033451Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:ed23bc087efce3dd3f7f563ab6f28c9b19563779a6e7f86b7a6c07db585ea858","observation_id":"c66d3d8a-586d-4280-b843-3941a9daa3a8","resolution":{"observed_at":"2026-08-06T17:38:08.033451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.038711Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.038711Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a8436bcff5e83491416322be08c7e6958e59cb1f529c5aea36d1d0a5b7200328","observation_id":"556b9b5d-9066-4eff-a5d1-0a2d8ba688cf","resolution":{"observed_at":"2026-08-06T17:38:08.038711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.044662Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.044662Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:75defc15e91597193304ac84849913787497132336814d2c580c08be073e7ba3","observation_id":"d11f0b6c-9aca-475b-8d96-640fc6a5dbad","resolution":{"observed_at":"2026-08-06T17:38:08.044662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.049594Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.049594Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:6f95c8e3cd0d28cd790ddfd3d2006cd5d640bc7cbdae65ac7f869d8cd089e53a","observation_id":"56e56cbb-034b-4cb6-a78c-dc67573bea82","resolution":{"observed_at":"2026-08-06T17:38:08.049594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.057336Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.057336Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:6ff59b24847b69ae91a3efc8fbc857ac3d171c3864fea22a3b67b1d80a962962","observation_id":"bf4bf8dd-7bc5-4991-8b6a-f5ee1b79f814","resolution":{"observed_at":"2026-08-06T17:38:08.057336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.062421Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.062421Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:008e60e4465f881004bfa2df6270f7144dcf8d1c3984bc7684035f1d760b2d88","observation_id":"9afabaad-6b13-41aa-9632-a9917901f3c5","resolution":{"observed_at":"2026-08-06T17:38:08.062421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.067825Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.067825Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:27ca8148f72e53078568fc5aeb3b018a71a7c44f50de7cc06d67037ebef9c8ed","observation_id":"2b883686-33ec-4add-9af9-9d4d1465244a","resolution":{"observed_at":"2026-08-06T17:38:08.067825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.073851Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.073851Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:ea9972ce5a5fd3d851e4c8d868147370c87d6f6a0c4cf2f81233241b09546107","observation_id":"04c644a9-132e-4db8-a447-5b959db7b1d0","resolution":{"observed_at":"2026-08-06T17:38:08.073851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.079606Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.079606Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:db856c8b5e76f667c0120b4ac2080fc5b9afff3ab9eba8861e9e4b456af0744e","observation_id":"0f5540d2-90a6-4fbf-8da8-c8272ad70c00","resolution":{"observed_at":"2026-08-06T17:38:08.079606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.086678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.086678Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:69852f7ab7496dae65fc07751554df2d92cd24338e094fd78ecaf52c21ddb799","observation_id":"55f309b8-b4cc-4276-80a8-581df99d1fe2","resolution":{"observed_at":"2026-08-06T17:38:08.086678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.094151Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.094151Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:c9d7897e07e0380a76655c6ceffa1cdd97f565f1ead8038b72bbb73bfe12d984","observation_id":"e5d8e1a3-5a9c-44ae-a1c6-d91f34fce385","resolution":{"observed_at":"2026-08-06T17:38:08.094151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.101749Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.101749Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:b4b418c02bad349e316afe3e3e46acc4a4d7bc59a2b989cb9dc4d473ccc8f3b5","observation_id":"72e8f88b-e148-4fdb-adc8-e3e30c132856","resolution":{"observed_at":"2026-08-06T17:38:08.101749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.107717Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.107717Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:3884f0f0ffe2811829a5389265be24f185c36917a34c792563da24c7b67e8168","observation_id":"f58dae0f-f492-42b3-a1b3-aa2fedb044b9","resolution":{"observed_at":"2026-08-06T17:38:08.107717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.113343Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.113343Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:f68d1b8a07290e4cd86e8caae99154a00eb1b95b69b8df75a005a1d07e16b96b","observation_id":"d747ca88-6b1f-4445-89fe-7c4c74177687","resolution":{"observed_at":"2026-08-06T17:38:08.113343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.119245Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.119245Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a5de1f79dd9ef4ddbb5c97241058d10c3a0015892850ede04710ca2cad4bb5d5","observation_id":"d2424ad8-a2c6-4454-9261-d3a27f1b6986","resolution":{"observed_at":"2026-08-06T17:38:08.119245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.126252Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.126252Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:fbcd600a4899bf6ba0385929fc779e3c45002dcb897e84b9b1899144691ceabb","observation_id":"a3743819-3905-438b-995a-f5f534e444e5","resolution":{"observed_at":"2026-08-06T17:38:08.126252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.131455Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.131455Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:f38aa14ab047d5c953235b76168755406ad76ef98ac6247d714c41cd6f339ad6","observation_id":"9f9a8441-4a31-4bf3-b7ae-2a3f5d042df5","resolution":{"observed_at":"2026-08-06T17:38:08.131455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.136645Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.136645Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:50d2138d8482821f3fcc21a8803d09cb37ea1259602565a6ddc172e0daf58b29","observation_id":"fb2e12f3-99da-43c8-870b-98c9323b636e","resolution":{"observed_at":"2026-08-06T17:38:08.136645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.142228Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.142228Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:b3a6443dfb444c53c12b6e0d2443cc3378d2c98dfdb345d63c3617c68c0aa197","observation_id":"57be6f25-5500-45da-89dd-280b34ff4efc","resolution":{"observed_at":"2026-08-06T17:38:08.142228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.147544Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.147544Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:96ddb521df8ea88f83e1f421551ba3a0a93f0d908e44708cb5d5ef6e4f7d71ee","observation_id":"09ae3d32-daa8-4931-80c0-18ebfbf2649a","resolution":{"observed_at":"2026-08-06T17:38:08.147544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.152860Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.152860Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:580a5ad48dc33582e6591be23e614228ffc3f14eccc0edcbb9bed6ca062bd555","observation_id":"b7e2c72d-35dd-4614-8696-27cf8de8e48d","resolution":{"observed_at":"2026-08-06T17:38:08.152860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.158238Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.158238Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:95dbb3bf9377e8d65ed15d5ef86aad40ff9b8e27cdb61a028ba61a380daceea7","observation_id":"c62e3c84-e8e0-424e-9b90-b301508b7a79","resolution":{"observed_at":"2026-08-06T17:38:08.158238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.163085Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.163085Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:668ae3d3df576d9db51a85fd5336f92eea170fbcde3333f25a9fc6c4d681aadf","observation_id":"db5a624e-e7e4-44f3-9aea-d5019e81c16a","resolution":{"observed_at":"2026-08-06T17:38:08.163085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.167813Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.167813Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:9b0565151e354bf9a2dcbf4bb52e71085975fd29f7095b3e89b13ff4b9388afe","observation_id":"19fee21d-bc29-415f-aa72-caf4046e7747","resolution":{"observed_at":"2026-08-06T17:38:08.167813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.172553Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.172553Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:bbd02316c36391d9ce2ef1e67de13a8570c42d450748cfde81d8e9692b1f97ff","observation_id":"7ea90db8-befc-4538-b4ad-07288911add2","resolution":{"observed_at":"2026-08-06T17:38:08.172553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.177577Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.177577Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:7926bb2c0a47f36f494a97342d035789b890fa743ed504ce5539104a448c9b37","observation_id":"62c0a4c4-fcca-4e18-acff-0fa8fb4c2b30","resolution":{"observed_at":"2026-08-06T17:38:08.177577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.183691Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.183691Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:8acb66e7030121e8a24daea2458e245f2db762e1fded38e04aa77d812417b552","observation_id":"9514b3d4-1098-4ef9-964c-36e8cf7b1855","resolution":{"observed_at":"2026-08-06T17:38:08.183691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.190478Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.190478Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:14375325becbaf9b328b66b6fd404711a24d80783e082a0252b88ad07049eefa","observation_id":"503d5ced-4632-4498-aeb1-9ad8fcb551b6","resolution":{"observed_at":"2026-08-06T17:38:08.190478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.196354Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.196354Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:37b525cfcf3d054e1b72b035fdcbadb1cf84eaac8dbdfde7ebb52cc28775e2d2","observation_id":"762dfb1a-ba32-497e-be3d-ac6bc7bb5d36","resolution":{"observed_at":"2026-08-06T17:38:08.196354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.201720Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.201720Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:91910d917caf49c1071505640c13d2b29d645aa2c3922ee0aa227eb5099de4b7","observation_id":"d3baf35a-b967-4925-b19f-dc8350740c2b","resolution":{"observed_at":"2026-08-06T17:38:08.201720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.206661Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.206661Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:83d3e994b81ae19992f920f148d1ef2195f93649cdbbbcaedc0d63984d49f3f6","observation_id":"38d5d02e-24e2-41f8-b083-68e89ef4e5b0","resolution":{"observed_at":"2026-08-06T17:38:08.206661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.211324Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.211324Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:9fee916fab2b3def19f8c77b9ec0fdf63d96d352ab28ee6fadfb0c28d430b820","observation_id":"3660da95-3410-421f-a7e6-d3b41b956e09","resolution":{"observed_at":"2026-08-06T17:38:08.211324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.217458Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.217458Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:3974760003724aef8034f38fa0547c4bc940b9a2822b0ea73f5ae4ad527d023f","observation_id":"fdb7cc2c-d03d-4de3-b2bf-8e65970d8770","resolution":{"observed_at":"2026-08-06T17:38:08.217458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.222379Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.222379Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:dc465a5ec23cd46ad625fcea19608c2d7bfd0adc0bf7afb85a80e40b8eeea86d","observation_id":"c913bca1-916c-4681-9be9-368068f9ee3f","resolution":{"observed_at":"2026-08-06T17:38:08.222379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.227379Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.227379Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:4ebcd826c89aab271693199ea1f1523c82a4a7f2c8dda64f83110ee9e79e797e","observation_id":"1e7df1b7-fc3b-4646-a7ef-f7107a8b9f49","resolution":{"observed_at":"2026-08-06T17:38:08.227379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.232280Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.232280Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:9c7a1ccec5224da9fa35fa565834422ec3b508cce64d2672ac2419dbae27cfec","observation_id":"192d3d26-d475-4b1a-92d0-61dd3922b12f","resolution":{"observed_at":"2026-08-06T17:38:08.232280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.237242Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.237242Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:9331a70f43fe54da0fa0860016abb11ec3e56fe6c8d53ae03165e00b630eef34","observation_id":"e086b494-b302-4b42-866e-a56b75008fba","resolution":{"observed_at":"2026-08-06T17:38:08.237242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.242011Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.242011Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:fe4d5b51da3ebf8d817344bbe8b1bced1a99c069c9420599b2880d37f36ba843","observation_id":"ea75b22e-df36-41dc-988d-66633edf3908","resolution":{"observed_at":"2026-08-06T17:38:08.242011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.246700Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.246700Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:17e5793f845908e9ce4cc33af35961e6ff74acc0a1cfd1ea94f28a8e7259b16b","observation_id":"ae0488c5-56cb-4a14-9a79-b4dd2e31d518","resolution":{"observed_at":"2026-08-06T17:38:08.246700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T17:38:08.251979Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.251979Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:8512db5e73bfb48d2b9e3e4e0c210232181c98033043e453f38e52e12cf44296","observation_id":"fc85c82c-3145-4980-b3d5-618c8ed87ef4","resolution":{"observed_at":"2026-08-06T17:38:08.251979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.257408Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.257408Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:610ca0599e1726165207be0a23ac35215a3c6c21df4c51415f30fc2748eacf13","observation_id":"35e939d7-1be1-41ec-b738-bb28583c154e","resolution":{"observed_at":"2026-08-06T17:38:08.257408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.262023Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.262023Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:f743493d14020039b6a3222cf2bdef0dcbc5c9e1b377bcd5ca52f2d46b2399e3","observation_id":"402e5fc6-42c8-41c4-9f5d-c7c4db971536","resolution":{"observed_at":"2026-08-06T17:38:08.262023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.268944Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.268944Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:81d6d9e39703e297832c741a618d1107ab0013de0f297af94543651e193f34f6","observation_id":"78e81e4c-6d70-49e7-b7a5-725045650b90","resolution":{"observed_at":"2026-08-06T17:38:08.268944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.274948Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.274948Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:c225428e1b79412b3d9907048a0c27671ad78beedb7555e06af6280113adcc51","observation_id":"520a0bbd-d346-4eec-a15c-b4a0944d541d","resolution":{"observed_at":"2026-08-06T17:38:08.274948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.280653Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.280653Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:7bb869d423951dc409b0615efe482b24dba3d90fc7c4a63b82c216f5bc15982c","observation_id":"2f59c34c-635d-4d4f-a143-55c23a6aff81","resolution":{"observed_at":"2026-08-06T17:38:08.280653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.288062Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.288062Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:f02b2028b999d90c0d00669b435d9b465db3256c831f1ca3fb30cdbb7093391b","observation_id":"d2f4ec0b-0900-4bd6-bd79-4fc0c9b0ceda","resolution":{"observed_at":"2026-08-06T17:38:08.288062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.294598Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.294598Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:3d9d8bd1b5baaf060b65797669ff210fb908131ea2f13c73c380def3d9a543c7","observation_id":"acba14fc-9d83-4ede-9d6a-aed0f3cafe8b","resolution":{"observed_at":"2026-08-06T17:38:08.294598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.300543Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.300543Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5769bd6c778db22205255ada64cd22d962370f5cb4c10c62a9635a755622fea8","observation_id":"fb001746-5f25-4ec9-b362-8c3c5d4d243a","resolution":{"observed_at":"2026-08-06T17:38:08.300543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.305405Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.305405Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:445db147854952f3bdcbfb93bc6f8ce9c4214b04c190ec044c80c03154451671","observation_id":"e6dd20a9-3365-4268-80da-a6fdc06e26ce","resolution":{"observed_at":"2026-08-06T17:38:08.305405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.310417Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.310417Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:ccc523f2ef4ec8e21e2c0d36b1478afccea530cbc2d4050268e654091c46910a","observation_id":"fe02c121-d8e3-4097-bfa7-ffaec80cf6e9","resolution":{"observed_at":"2026-08-06T17:38:08.310417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.315246Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.315246Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:f786200b9d6565895295685a9848916bd1f7fb51b056872b5c5195e16c10de88","observation_id":"c9294b1a-6dd8-4901-b59d-7ec698ac0829","resolution":{"observed_at":"2026-08-06T17:38:08.315246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.320635Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.320635Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:10671e81f003df53b79dfd4e93aaad62864b178bd532854e93a4b42a87f54219","observation_id":"a336ea3f-df88-4003-bc5a-dd90caa7b791","resolution":{"observed_at":"2026-08-06T17:38:08.320635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.325998Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.325998Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:24ba6259c156539871ff00fcbc840cb43b0ae9b063f1d68c92aa478e4dd79fc3","observation_id":"b7656314-db60-4b18-b14c-d22b1e2f31d5","resolution":{"observed_at":"2026-08-06T17:38:08.325998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07098","last_updated":"2025-01-22T04:42:10Z","snapshot_observed_at":"2026-08-05T10:13:11.978649Z","submitted_at":"2024-11-11T16:20:27Z","title":"A Multi-Agent Approach for REST API Testing with Semantic Graphs and LLM-Driven Inputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07098","snapshot_observed_at":"2026-08-06T17:38:08.330851Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.330851Z"},"links":{"cited_paper":"/paper/2411.07098","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:3f0bfc83f5514b8563eb66ad9e55c926daa60ebc0b0ace207746b0daf50b06c7","observation_id":"699c0644-c4d9-408c-83fd-25478ca38926","resolution":{"observed_at":"2026-08-06T17:38:08.330851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.337643Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.337643Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5ba7bb38af09eff9eb6527b5cc9f12b53558a0cc7a2ffae7d6cb925b1011111c","observation_id":"4b4fdc91-a376-419c-a3f7-88cbce78bdc8","resolution":{"observed_at":"2026-08-06T17:38:08.337643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.342544Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.342544Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:b24457770fd634ce216463d79b4ead08937a8de9378a094f66da8959234d79d0","observation_id":"b27bc9d6-8aec-4c46-9246-17745790e9cf","resolution":{"observed_at":"2026-08-06T17:38:08.342544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.348023Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.348023Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a319cd319773c9930ddc893860692c37a8f2a34b7d51e50893b6215644dbf4bd","observation_id":"3500ef3d-0cf3-46f6-870b-2726897ff38f","resolution":{"observed_at":"2026-08-06T17:38:08.348023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-06T15:42:21.967989Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-06T17:38:08.353720Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.353720Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:c9b9eba00d2f901c02e5deddd97be091de7d3f851b5c5a0b113812f9d99c7a89","observation_id":"9a214699-9469-44d6-8f27-34f2804150de","resolution":{"observed_at":"2026-08-06T17:38:08.353720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.360236Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.360236Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a3e5eed2f5d2e26bd744dd19e4baf351d479ae19cdaa7108dd4dde126bb29bbf","observation_id":"8202110d-2ea6-46cd-a8d5-ea6db0332704","resolution":{"observed_at":"2026-08-06T17:38:08.360236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.365845Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.365845Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:eef3c8db9b8d8b957e227382be5c4023fb48bab9bf243c3f7cac6c4609b3518e","observation_id":"9ee3845b-3c89-4611-82f3-b2d66aa5ee4f","resolution":{"observed_at":"2026-08-06T17:38:08.365845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.370887Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.370887Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:e2cbdc6b9110658b7a1640ed338f0aa8211ad8bbb5e9e6badcaf7d409fedbfa7","observation_id":"f4630717-59a8-432e-8f34-11dda3c5d5ae","resolution":{"observed_at":"2026-08-06T17:38:08.370887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.377769Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.377769Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:ff791199fb6063abb0a1ea4150a76d7036077f6f9d3a2424a59b5a1f6434a2d9","observation_id":"a535a2eb-1bdd-46c9-bc22-7f64c3786592","resolution":{"observed_at":"2026-08-06T17:38:08.377769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.383947Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.383947Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:342fa3dc2294b2b74b06de48bf303b6dbaf7dcf33e0bcbb3bd248e1c605e5879","observation_id":"a79d0646-dcae-4d73-8ff9-13aa27d99031","resolution":{"observed_at":"2026-08-06T17:38:08.383947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.389616Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.389616Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:646f5cec4e27d2d4d49891b0c580efb11f216e421cb016e9690c4088435e900d","observation_id":"f44ca3fd-0cb1-4783-8445-dec8c8eddfd7","resolution":{"observed_at":"2026-08-06T17:38:08.389616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-06T17:38:08.395660Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.395660Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:cd3e9cb577ea27810188e28fbc0601a368a66428b0c90a3f188edca563d1e568","observation_id":"73b6398c-8e73-4fea-891a-c3bec51a828a","resolution":{"observed_at":"2026-08-06T17:38:08.395660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.402247Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.402247Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:1f31e6870e2930bf26de799bc8f11ca94b9be3fc272359dc77e9f4a6c6ae1d3b","observation_id":"e5c0c05e-1d8b-4368-9c80-1b3096d3baf8","resolution":{"observed_at":"2026-08-06T17:38:08.402247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.406949Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.406949Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:2205b17a36fd9c89d0abea90fec341868cb7ae5ef410e2368856629d5e26d37e","observation_id":"f99cc920-0e03-4440-8976-020b63c124ed","resolution":{"observed_at":"2026-08-06T17:38:08.406949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.412353Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.412353Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:1dda3ead918c707f1114326ee006be52c0f5fafa5a7db35eee498103ad578aa9","observation_id":"6145d91e-e18a-4cdd-9c78-b9c030482aef","resolution":{"observed_at":"2026-08-06T17:38:08.412353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.418499Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.418499Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:baca3b891b73ff26220e2ec167faf8e6cbe1dc60241295512ed91207ff46c228","observation_id":"8107ba2e-281d-4629-9a2e-b3edc646fe66","resolution":{"observed_at":"2026-08-06T17:38:08.418499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.426271Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.426271Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a4c983e6e054b26b9391279eedede5fe15bd1bec2146b9a871feda9d14d71827","observation_id":"7750164f-ae3c-4661-8422-ac9783907e2c","resolution":{"observed_at":"2026-08-06T17:38:08.426271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.431409Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.431409Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:9a7727afbb410a198b5679c260c0422d40427bacae5650bfa7eb8e6d4310f68f","observation_id":"6eac124a-a423-4a1e-b196-1a7b58fa2b2e","resolution":{"observed_at":"2026-08-06T17:38:08.431409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.436800Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.436800Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:a63e8508e709adc7276dff72de7732bdd4a5d64d68838e0f887492e40a114e9d","observation_id":"7e56b2dc-4185-4c96-b0d3-cfa067dea3ce","resolution":{"observed_at":"2026-08-06T17:38:08.436800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.441321Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.441321Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:b7de5b733bde993aab923140f9a8feabd03baaee7cb21efa7c1cd7f3bce8d331","observation_id":"9be0dbc0-dffa-4ffc-bd02-7b2bcbd03805","resolution":{"observed_at":"2026-08-06T17:38:08.441321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.446112Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.446112Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:ab874f6625d8bff7186aa5c4985269ba35db733cf2f144befc506111f6aab5e9","observation_id":"0d74fd91-b732-438e-9738-e3e29007b4d2","resolution":{"observed_at":"2026-08-06T17:38:08.446112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.451743Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.451743Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5be8acde63d591619ef177d2952e97edb1ee94d3ea7de868c4ae20cfc024f24f","observation_id":"e0b8066e-ae1b-4b8d-9c37-3bc05e6197c8","resolution":{"observed_at":"2026-08-06T17:38:08.451743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.456723Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.456723Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5e9c88b619abab93d1aff5ee86a55dcfffb44b78c0f0476dda06cae5e543f0d7","observation_id":"ff28f647-fce1-4165-b189-c0f6987ee57f","resolution":{"observed_at":"2026-08-06T17:38:08.456723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T17:38:08.462031Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.462031Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:6f31a7c7c55e8afe7d0d165232e5e634f7c9deb9dcf9aff3c4efcf89daeb8e74","observation_id":"8ce1829e-3992-4c40-a77e-ceede585ea50","resolution":{"observed_at":"2026-08-06T17:38:08.462031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.467360Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.467360Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5e577967578720bad29952a4c1779e83946a79207c30e1756f72905dc9184c80","observation_id":"2e7a9fd3-f47e-42ae-b0c6-d0e3959c92e1","resolution":{"observed_at":"2026-08-06T17:38:08.467360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:08.472983Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.472983Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5f59adba3ae76ee9764085a8f5da6f9646bd67e94c6406b4589e461f27853567","observation_id":"1c77e7fd-1097-4540-899f-aa2cab4421b4","resolution":{"observed_at":"2026-08-06T17:38:08.472983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:16.125395Z","title":null,"venue":null,"work_id":"aa376814-ed43-4d1d-95bb-10e1ab32d4b5","year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.481122Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:fc6b8eac1d752f896e09abd5045f7f59a03eeb7e63bdefd5751f5f3f806f9565","observation_id":"f86eb583-ce7e-4e79-8006-3b5e96b38c23","resolution":{"observed_at":"2026-08-06T17:38:16.192817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:16.031002Z","title":null,"venue":null,"work_id":"ed991014-918a-43fd-82b2-1038ec9e1515","year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.486218Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:63a5fcfd37bcacded064ecdd4305eb0ce0839e8aabc1c2aa8d7cdf0167828aaf","observation_id":"4296c05e-420a-413b-9213-f0a8cae43c78","resolution":{"observed_at":"2026-08-06T17:38:16.089150Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.857190Z","title":null,"venue":null,"work_id":"f2c973cb-2193-4088-ac9d-89c171087aec","year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.492636Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:fabce2b882b7c489ab01b8b069b0fc0c99fa3c1ff20611fd74a1f1f92dce0135","observation_id":"1f57dd93-6921-4d45-90e5-64f0be791201","resolution":{"observed_at":"2026-08-06T17:38:15.964684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.697271Z","title":null,"venue":null,"work_id":"29c9669a-c8df-4cea-8f3a-c0aeaa1d1edf","year":2021},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.497865Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:5a12314f3345765cff2a3d7ef434b3ee59a8f0888ae41b5b469e88f3c6d8869e","observation_id":"6fe1e250-03d0-4feb-9a94-8866ddc14d8d","resolution":{"observed_at":"2026-08-06T17:38:15.782717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.548421Z","title":null,"venue":null,"work_id":"5089fa1f-5c23-47cf-b7d5-31f7ff316684","year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.503454Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:46200700759a4b027f67e4006085bd0e8b6ab519c3bf5b3d3dc7be0421ec1fc8","observation_id":"4134c3b1-d6c3-4341-9e33-3e33d5e84675","resolution":{"observed_at":"2026-08-06T17:38:15.615355Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.433652Z","title":null,"venue":null,"work_id":"71e2a77d-fdc9-48ea-af4b-bc7793250540","year":2024},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.509040Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:4eb62ff42787162475e0e3b7a2f5e17df559b7fd83b88a9812bf91e1a3307e89","observation_id":"81ba4452-2788-4a66-b94d-d10a8932cd8f","resolution":{"observed_at":"2026-08-06T17:38:15.475476Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.283581Z","title":null,"venue":null,"work_id":"4243688e-9170-416a-8fdd-a5c5d3a3823e","year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.514379Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:63897044828b8038182d2664e81919436ffaa2a0642cad7ce4c8f45a514199f6","observation_id":"f8c5dc95-dd24-4e24-8a14-eb920b0f7e6b","resolution":{"observed_at":"2026-08-06T17:38:15.379922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:15.088335Z","title":null,"venue":null,"work_id":"02fe0bd5-b3e1-4837-ae7e-a621b2f91c02","year":2019},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.519190Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:0097bd2c9c5fc81a8fa61da9a1378c39b83d8e97ffc7e1baa54998cbcf1dcaaf","observation_id":"9fde0a5d-7b9a-4c35-a6c5-76a45d8c7796","resolution":{"observed_at":"2026-08-06T17:38:15.185745Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.932333Z","title":null,"venue":null,"work_id":"11ec7089-8186-4286-8233-a56c5cf69651","year":2008},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.524703Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:d2cf4fc7317d5aaae77e881549f639c8676d7302fbccb6cf867be8fda4c0c6ad","observation_id":"ff42e294-9075-4485-a219-1771b995cdbf","resolution":{"observed_at":"2026-08-06T17:38:15.023233Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.770040Z","title":null,"venue":null,"work_id":"b0427be0-e676-47dd-90e0-247d2a48bf3d","year":2008},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.529989Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:bb6a255768cc5301bf927660bc48460ca7c41a776c9475e40bd7fca66a73622a","observation_id":"05c987ac-b04d-44b2-b11f-636592255608","resolution":{"observed_at":"2026-08-06T17:38:14.831776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.594314Z","title":"Puterman","venue":null,"work_id":"b07da894-a3fc-46a3-bae1-131805be153b","year":1994},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.535424Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:69b21a35470dba858fb6cca252e147fc1c56ceeaad4a2d4c87b09451aa134abc","observation_id":"19d90b25-5d90-421c-85e0-082558da7d06","resolution":{"observed_at":"2026-08-06T17:38:14.672799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.437482Z","title":null,"venue":null,"work_id":"4ca8a17d-ff0b-4e72-936a-31333cac8ba0","year":2014},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.540241Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:f7378815cf92c942f8567034daf5ac391782f4b2a3fb0bc2c77b000d1cf0f5eb","observation_id":"8c20e6eb-1203-4157-94e1-7cfb937e8dc6","resolution":{"observed_at":"2026-08-06T17:38:14.514205Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.267962Z","title":null,"venue":null,"work_id":"43de909c-d21d-41af-943c-1efbba0950c6","year":2025},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.545025Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:469a08c4603df29e00e5c9e6fdb9b1edf3162a004c8972ba06daf2e605dbbb0c","observation_id":"92337ec7-20b8-4912-957a-fe33acbe1652","resolution":{"observed_at":"2026-08-06T17:38:14.333038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:14.109429Z","title":null,"venue":null,"work_id":"aa46d18b-3a7e-4dbf-a99e-f8e5ed8b5591","year":2023},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.549929Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:84af0ffbf3c1c5b2d02d64559677d7a597d37e0ef9baf5dcbb0917f3e9b696e5","observation_id":"90e083c5-31e1-4c25-8b6b-0a9b8a419abe","resolution":{"observed_at":"2026-08-06T17:38:14.176736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:38:13.933600Z","title":null,"venue":null,"work_id":"ba58fc68-d8e0-40dc-b4cc-3ab88e7c1735","year":2020},"citing_paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T17:38:08.555316Z"},"links":{"citing_paper":"/paper/2507.12483"},"observation_digest":"sha256:ce8db2630f42a0ce0715d151340bd035f27a3682de5fe6448b383af03f8b7891","observation_id":"1eb59c02-3a0d-40c9-a1eb-ad1f95621a5f","resolution":{"observed_at":"2026-08-06T17:38:14.025580Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12483","last_updated":"2025-07-14T14:28:37Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-06T17:31:45.623107Z","submitted_at":"2025-07-14T14:28:37Z","title":"A Survey of Reinforcement Learning for Software Engineering"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":159},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 159 outbound references and 3 inbound Pith citation observations for arXiv:2507.12483."}