{"as_of":"2026-08-13T05:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:26ef67213056fb6e567a7d3e9f6f4f0b801930881f41bf7e79c9e17b1f1a5f7f","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T15:53:32.157604Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:30:33.405381Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T00:30:33.915193Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.01307","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.01307","snapshot_observed_at":"2026-08-12T00:30:33.915193Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","venue":"cs.LG","work_id":"3517f1cb-5072-422b-b727-b1c3f8562f0b","year":2025},"citing_paper":{"arxiv_id":"2608.08158","last_updated":"2026-08-08T14:35:29Z","snapshot_observed_at":"2026-08-13T05:12:24.721980Z","submitted_at":"2026-08-08T14:35:29Z","title":"A Unified Framework for Dynamic Reward Shaping in Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T00:30:33.405381Z"},"links":{"cited_paper":"/paper/2502.01307","citing_paper":"/paper/2608.08158"},"observation_digest":"sha256:bcb5d0fe2239ef10e25c2f8883ecabc583ab5d5a6fad396fd49f941ce215f5aa","observation_id":"b7ba16a5-905d-445e-8ee6-73f009a8f600","resolution":{"observed_at":"2026-08-12T00:30:33.920720Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.01307/citation-record","integrity":"/paper/2502.01307/integrity","json":"/paper/2502.01307/citation-record.json","paper":"/paper/2502.01307"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.666512Z","title":"Barto, Richard S","venue":null,"work_id":"fe38bf16-dbcb-4aca-ab3a-ace48064a983","year":1983},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.723317Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:d78a349857b26142801641cfd24adde9af6c2f67036dc7308eb5edf705f2fd04","observation_id":"ca539b16-a978-4f86-b227-c4a58930fbce","resolution":{"observed_at":"2026-08-09T15:53:32.670906Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:33.109615Z","title":"Taylor, and Ann Nowé","venue":null,"work_id":"31471d9d-7e97-4829-8654-317dd0b36b9d","year":2015},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.728137Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:ed7e08017a519b2e1ee23c95385c1a0143d4b86af94574514f1f235c10b13edb","observation_id":"d0a6af8f-694e-472b-9d9c-10fa0d15fc5d","resolution":{"observed_at":"2026-08-09T15:53:33.113435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.969446Z","title":null,"venue":null,"work_id":"d141b611-3c39-4cec-9b59-356f7521130e","year":2012},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.732529Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:e0c7c3a5e4e1edaf521bef8d6f9de733a5056398b4cc2752d59067703364e9c0","observation_id":"8e34cd33-e1cd-47fb-9a16-3e5d30f80580","resolution":{"observed_at":"2026-08-09T15:53:33.047341Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00521-022-07396-x","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Neural Computing and Applications","work_id":"8f3280ef-f1f9-4ecb-9055-e461922df0bf","year":2022},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.736522Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:64be7cb646646f74cc294cadcc0515cf7a1b3ee877252a8720c03bff6a10e358","observation_id":"d036e21c-6d30-4d33-97dd-e0c6e8039f35","resolution":{"observed_at":"2026-08-09T15:53:32.284105Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.826411Z","title":null,"venue":null,"work_id":"290af7d4-990d-47dc-9bb5-504e68e6e350","year":2017},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.740764Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:50846f71932b844529e231a147ad05822b18034da8993506cdfea7b4ac3d419a","observation_id":"4fb57fc7-c6a4-4377-ad3e-846adc982648","resolution":{"observed_at":"2026-08-09T15:53:32.878896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:31.744642Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.744642Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:9746e92cf6b380423a12d9c0259eba9397683e2d25690d5e628b4ba0e23597eb","observation_id":"27da9c99-abfb-4c81-a7a4-655e2594a991","resolution":{"observed_at":"2026-08-09T15:53:31.744642Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.783538Z","title":"Melham, and Daniel Kroening","venue":null,"work_id":"43b45511-dc4c-4d6d-badc-ebdd7b523c9f","year":2021},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.750137Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:abc6ba4d59ffcdf2107644671576b5f15649aa2217cd400ca94877859ee2f6b0","observation_id":"517a11bb-d2b8-490d-a49d-aa0aa849a971","resolution":{"observed_at":"2026-08-09T15:53:32.787309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.771185Z","title":"Laurent, and Nadine Le Fort-Piat","venue":null,"work_id":"6b2b3a0f-fe86-4938-9bc5-657937fc9cf3","year":2006},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.754118Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:35f009b5c2eebe23462fe5f986be3302ea19629585c753b5f9ba1e0d16ce1bae","observation_id":"05e56b6b-e337-4292-aed2-21a0146ecfa3","resolution":{"observed_at":"2026-08-09T15:53:32.775993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-12T14:28:10.961989Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-09T15:53:31.757246Z","title":"Riedmiller","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.757246Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:27f240eca48e33534be8e1f1d15e875bb4521a7c22c13c74937c3fc848cdc9c8","observation_id":"b3e88653-8908-4611-a075-b91676d5afee","resolution":{"observed_at":"2026-08-09T15:53:31.757246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.759759Z","title":null,"venue":null,"work_id":"12c82000-557e-407a-8f4a-0c74965e35d6","year":1990},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.763272Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:8f079b98bcc5d13d477c66a3a533f11715d94026bbf0b4602555e25c6b3b0f96","observation_id":"78abee11-8c22-4474-831b-f699461d0b96","resolution":{"observed_at":"2026-08-09T15:53:32.763619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.747519Z","title":null,"venue":null,"work_id":"7fcdaa9f-1c6f-4a3f-8641-eabf89553c3b","year":2025},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.766619Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:b57c279c24cace7a947d18014a0a6b9e9edbfc100327add62a5bb2a6c91bfc5b","observation_id":"50d6bddc-13ad-4f31-8bda-331d9335364b","resolution":{"observed_at":"2026-08-09T15:53:32.751895Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.734661Z","title":"Ng, Daishi Harada, and Stuart J","venue":null,"work_id":"2fdd096c-f402-4445-9984-956746bd39bc","year":1999},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.834229Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:71b61a0a2dc3fd8d9280d4f416d75b0490c58a885e4a3052cad4cb9f2a3c3cc2","observation_id":"4abc8205-a6f3-4a41-a878-3e2ee6017e18","resolution":{"observed_at":"2026-08-09T15:53:32.738373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.721667Z","title":null,"venue":null,"work_id":"07287764-1ae7-4bcf-8822-f64acae7f3b9","year":2021},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.882421Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:227312283e03dbfb026710595bea9d5e97f095685f115a8d605715a625e199a9","observation_id":"06282a0c-a527-47de-b42e-00fbf7ed0cdc","resolution":{"observed_at":"2026-08-09T15:53:32.726273Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.709659Z","title":"Taylor, and Sonia Chernova","venue":null,"work_id":"d680f2c1-cfdd-4eb4-9246-e625e067e5ac","year":2016},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:31.930428Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:46c307e64fa3ef66e1a68dae22a2e7336a392e34b758ae5b212d85f19058b62d","observation_id":"2c64ae1b-9483-4111-a55f-4931da379fe4","resolution":{"observed_at":"2026-08-09T15:53:32.713261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.695694Z","title":null,"venue":null,"work_id":"493689c5-df29-4f42-a342-1e3775bcac64","year":2022},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:32.009046Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:e16025a6cb78424c93a6e10702ef8284ac741c14cdbbfc6cb62af78ddaaf5f73","observation_id":"ef672d9a-60d6-4e2f-9099-f593593cc487","resolution":{"observed_at":"2026-08-09T15:53:32.701059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.680431Z","title":null,"venue":null,"work_id":"7524c353-5dd6-48b4-bcb3-4325448259eb","year":2023},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:32.067072Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:15114c7feb52071799c75fb111c11637df540dc510167f23a37a665d5da994e5","observation_id":"5f1d56ae-afaa-489a-a991-e5e9724ed641","resolution":{"observed_at":"2026-08-09T15:53:32.684648Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.111397Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:32.111397Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:59c2609d0454700ed87dfe1cca3ebcd91f2135909344d59dc85eb4f9a609ea63","observation_id":"64a50466-0a8f-4377-a7f9-ee7578729082","resolution":{"observed_at":"2026-08-09T15:53:32.111397Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:53:32.326979Z","title":null,"venue":null,"work_id":"63267924-a78d-4c2f-87ae-7f0239be3ef1","year":2021},"citing_paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T15:53:32.157604Z"},"links":{"citing_paper":"/paper/2502.01307"},"observation_digest":"sha256:30752465be4163fbba9350dc5c1b1beeb0d92e558e0f1194b091f5eb79fde206","observation_id":"00ff156b-3326-4267-94aa-3accd532ef45","resolution":{"observed_at":"2026-08-09T15:53:32.331509Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.01307","last_updated":"2025-02-03T12:32:50Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T00:47:18.407870Z","submitted_at":"2025-02-03T12:32:50Z","title":"Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":3,"verified_fuzzy":5},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 1 inbound Pith citation observation for arXiv:2502.01307."}