{"as_of":"2026-08-11T15:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a4babb2a4f6b60aaf31c6fa8e854e36b658686d1c172199b175139d63586ba5c","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:12:39.393962Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.03487/citation-record","integrity":"/paper/2507.03487/integrity","json":"/paper/2507.03487/citation-record.json","paper":"/paper/2507.03487"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.00577","last_updated":"2023-11-27T15:57:06Z","snapshot_observed_at":"2026-08-09T16:10:30.032242Z","submitted_at":"2023-06-01T11:45:45Z","title":"TorchRL: A data-driven decision-making library for PyTorch","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00577","snapshot_observed_at":"2026-08-06T20:12:39.323473Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.323473Z"},"links":{"cited_paper":"/paper/2306.00577","citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:47ec37fbedf771142989c72fae9bdafa4ae361fd2f0627fc4faf542e8867bc84","observation_id":"39cfc245-b787-46fa-a6c2-5420fe5d9f36","resolution":{"observed_at":"2026-08-06T20:12:39.323473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.327517Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.327517Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:9f33c44b7f4664be4d1c70213d60efced8217b4aff64c4e022e83757def06b20","observation_id":"061c7f0f-86a3-4ef9-962a-ef010bc44589","resolution":{"observed_at":"2026-08-06T20:12:39.327517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.626855Z","title":"Ciosek, Q","venue":null,"work_id":"9db67d45-2a43-40b6-a397-7549c8d56082","year":2019},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.330579Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:a24e76318257249796def8870c2e78a73b47d41e2f130f7cdf6d16852f002688","observation_id":"82463abc-c3b9-4648-a200-061b08f70f13","resolution":{"observed_at":"2026-08-06T20:12:39.630531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.615902Z","title":"D'Eramo, D","venue":null,"work_id":"9f696c49-771b-4b00-98b3-8dbcc0cc3062","year":2021},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.333514Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:45f2f5629b906ee4cc4caf0134dbfa78be2503c7a1e3526a9a1c05973c82f5c2","observation_id":"16bdaace-7a72-4e4f-83b7-5cf7c9a78905","resolution":{"observed_at":"2026-08-06T20:12:39.619884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.603825Z","title":"Eschmann, D","venue":null,"work_id":"f12f54bd-a9ef-41c1-9489-938b969b034f","year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.336648Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:dca89b7e24b64306e4dc68181de4734dff9dfbf2ce8777f699dd864eff13fb50","observation_id":"c2fdecae-aaec-4506-ae33-8ca047666330","resolution":{"observed_at":"2026-08-06T20:12:39.607558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.594259Z","title":"Fujimoto, H","venue":null,"work_id":"4cfebc5c-8d83-433e-9345-4c0b0b241826","year":2018},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.340694Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:771850ec22d1b657e04bb84435446d7a4d1971837819b2a629839d9f9b55676e","observation_id":"2c126fed-08d2-4600-86b8-32683f442e28","resolution":{"observed_at":"2026-08-06T20:12:39.597486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.343880Z","title":"Haarnoja, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.343880Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:cf92b6d18c2145ffb755a70685b8a9e56d68032403438f32dccf8f0c5019b97b","observation_id":"724d2cfd-47a7-4142-afe9-ab9b0777c8b8","resolution":{"observed_at":"2026-08-06T20:12:39.343880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.579351Z","title":"Huang, R","venue":null,"work_id":"02f1e4ba-12dd-47ec-80c5-3333a3a5dc45","year":2022},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.346709Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:821a1ccbd253c98ffa3ff9c52ab934a086b1d5494f810dfbd1e462de8f9d8de5","observation_id":"67fde5d9-20bc-4476-9911-b9e2992efb6a","resolution":{"observed_at":"2026-08-06T20:12:39.582532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.569235Z","title":"Liang, R","venue":null,"work_id":"1d39fd53-7592-4ee4-856b-94589dc1dfc6","year":2018},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.349438Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:850f40227566ac8bc61cd76b76140bef4a3296a8229192922c4c3ee95fd42c45","observation_id":"349274ae-85ad-4c60-bdd4-61a23d3defeb","resolution":{"observed_at":"2026-08-06T20:12:39.573841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.559799Z","title":null,"venue":null,"work_id":"323110d1-364c-4276-b2e4-45b8eaec665c","year":2016},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.352183Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:6409ba8dd27f66fd8f551f38a6864f9e04337d201f0c01f063b821adf1ed6cee","observation_id":"172e5ded-fda5-4aa3-9588-dacc830f0467","resolution":{"observed_at":"2026-08-06T20:12:39.563549Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.550844Z","title":null,"venue":null,"work_id":"497dd112-71cc-4db9-a8c0-4c5d2549ee80","year":2015},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.354942Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:64c0c361490bd4c3ad5587581db1c5e606508f65d33bfd4dbf5f734f43e5c946","observation_id":"10a5f654-9a6c-4126-b23c-e48e6ff39023","resolution":{"observed_at":"2026-08-06T20:12:39.554209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.541168Z","title":"Raffin, A","venue":null,"work_id":"992d4619-7208-428e-85b0-c7fb88101964","year":2021},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.357646Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:7ff5d92c3427399d6ec82498688077c8142324773f3083d5bf7d7be427a4e282","observation_id":"696ece65-2736-4f35-85ee-be673fd65cb2","resolution":{"observed_at":"2026-08-06T20:12:39.544512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.530591Z","title":null,"venue":null,"work_id":"267e4d47-ddf0-4c2e-bbf5-1250ebff1576","year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.360418Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:845735ac4774e8bfb8ccc7a88cc97e71eefc4351d1f3dbe4cd2905ca22dccb51","observation_id":"34c5c8bf-1d57-4a89-bb06-93e646a097b9","resolution":{"observed_at":"2026-08-06T20:12:39.534009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T20:12:39.364471Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.364471Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:4414cbe2261aad75aac42b50ead1b9ffbd34d466ee912da3647cc46752556851","observation_id":"24f3991a-e7dc-45ec-bfec-a1158faa05ca","resolution":{"observed_at":"2026-08-06T20:12:39.364471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.520616Z","title":"Serrano-Mu \\ n oz, D","venue":null,"work_id":"9889eca0-38c4-4ad3-bd09-7add6fe2dfc3","year":2023},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.368580Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:7ae1c2ba2c4b2bad10d072e00cb1b391d2db70ed70922aabf3ae5ba6620ed41a","observation_id":"9ecbbc17-c7aa-4d14-a745-c184a2711c61","resolution":{"observed_at":"2026-08-06T20:12:39.524313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.511853Z","title":"Smith, I","venue":null,"work_id":"2c35c322-a3b5-42e4-88ae-c5d41e18870d","year":2023},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.371374Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:317c61ec354bc29d312cf400a54e2dd0559b61ec15ef9c0053fff6b0f6624a67","observation_id":"6f530449-22aa-4230-a384-26b3bf5b559f","resolution":{"observed_at":"2026-08-06T20:12:39.514910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.501621Z","title":null,"venue":null,"work_id":"f870b593-5411-4e11-b504-e391c375787a","year":2018},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.373848Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:927c1f6835a256bd4ef55449c1c16de597e1d68e6d48923ff2ca7fe0f9658816","observation_id":"02505c29-3a4c-4353-a11a-d5adb64be135","resolution":{"observed_at":"2026-08-06T20:12:39.505674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03055","last_updated":"2025-08-20T07:52:22Z","snapshot_observed_at":"2026-08-06T20:40:18.407512Z","submitted_at":"2024-02-05T14:42:45Z","title":"Deep Exploration with PAC-Bayes","version":5},"cited_work":{"arxiv_id":"2402.03055","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.03055","snapshot_observed_at":"2026-08-06T20:12:39.423615Z","title":"Deep Exploration with PAC-Bayes","venue":"cs.LG","work_id":"ee79bac3-457a-4621-a27d-8393402eeecc","year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.376428Z"},"links":{"cited_paper":"/paper/2402.03055","citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:19d71795de2149a11f30295998a4738af7a875798b6c4a032d80fa0c7c75b8ea","observation_id":"41b532c0-9ed2-4768-81a4-ae46cd8e0766","resolution":{"observed_at":"2026-08-06T20:12:39.429094Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.491440Z","title":"Todorov, T","venue":null,"work_id":"ffe5342f-e04e-4269-a0ff-2c10c4dfff34","year":2012},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.379432Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:a0e26dd596be3135f8631e624acb24193c8142ba092a0150acf249ff88ffb270","observation_id":"c945b5b7-78c8-4fed-a06c-d7d34ae756af","resolution":{"observed_at":"2026-08-06T20:12:39.494398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-06T20:12:39.381986Z","title":"Towers, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.381986Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:97a8bebd462fe236d1826dd8495f41bdda6c7bf568ae122f6017e7b392e767b7","observation_id":"96f2a5c3-af0b-4775-b5ba-d73dd3ecf20a","resolution":{"observed_at":"2026-08-06T20:12:39.381986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.480870Z","title":null,"venue":null,"work_id":"ffd0af9f-5d59-44ce-8dee-d2597e9dccd0","year":2023},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.385310Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:028d2c9a43e84df5e58c6a0961894bc38bb5bfe381b1fa844a9cd28cd78a8823","observation_id":"c0097115-9507-4720-9555-0aaa652a110b","resolution":{"observed_at":"2026-08-06T20:12:39.484506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.471493Z","title":null,"venue":null,"work_id":"4a33b741-e004-4fef-bfe1-ab04344b1266","year":2022},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.388573Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:8c4033766bec8947e2fff388c19b4c5c68e32443b48328971f41d7b0a866302e","observation_id":"d4713f1e-3b1f-41e0-bd19-afe8383f2891","resolution":{"observed_at":"2026-08-06T20:12:39.474633Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.462154Z","title":null,"venue":null,"work_id":"2c90d79f-4ec0-4504-8f53-6f3b0b681d95","year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.391279Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:bd386316c8ece6b09b610ffa9a976d0b053419914ea836a2b5c3de00e2df02f3","observation_id":"e0b3fe47-9d80-462f-90d3-7609ba13b098","resolution":{"observed_at":"2026-08-06T20:12:39.465207Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:39.452644Z","title":null,"venue":null,"work_id":"b5a27a06-ec24-44c7-9939-8ad59ea23fd0","year":2024},"citing_paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:39.393962Z"},"links":{"citing_paper":"/paper/2507.03487"},"observation_digest":"sha256:6cc564f69d26c9080b28953f5a48e9ab6a0a13dd13efe25b87cb2bda47758b7c","observation_id":"d58c4c43-a7b0-4978-9952-1768b95557d4","resolution":{"observed_at":"2026-08-06T20:12:39.456356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.03487","last_updated":"2025-07-04T11:27:52Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T16:11:09.947495Z","submitted_at":"2025-07-04T11:27:52Z","title":"ObjectRL: An Object-Oriented Reinforcement Learning Codebase"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2507.03487."}