{"as_of":"2026-08-08T11:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bb6ee3e8fdb4b7b6bb324398419a161c5c6bf670d5d89abdf08d68f7da0dfe36","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:12:46.244220Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.22040/citation-record","integrity":"/paper/2507.22040/integrity","json":"/paper/2507.22040/citation-record.json","paper":"/paper/2507.22040"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.17168","last_updated":"2024-01-22T00:12:20Z","snapshot_observed_at":"2026-08-07T19:16:38.755649Z","submitted_at":"2023-10-26T05:49:13Z","title":"Learning an Inventory Control Policy with General Inventory Arrival Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17168","snapshot_observed_at":"2026-08-06T12:12:46.194341Z","title":"Learning an inventory control policy with general inventory arrival dynamics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.194341Z"},"links":{"cited_paper":"/paper/2310.17168","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:b2e42130a187ee1bba738b33fc9941cc21ed0efa1fa2c8752f61badd19beb6a2","observation_id":"05b2c852-8e4a-4f2f-ad38-72e8d7e528ee","resolution":{"observed_at":"2026-08-06T12:12:46.194341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03137","last_updated":"2022-11-28T22:29:58Z","snapshot_observed_at":"2026-07-06T14:01:25.012788Z","submitted_at":"2022-10-06T18:00:25Z","title":"Deep Inventory Management","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03137","snapshot_observed_at":"2026-08-06T12:12:46.227068Z","title":"Foster, and Sham M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.227068Z"},"links":{"cited_paper":"/paper/2210.03137","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:ee08ddc5c9b3352e460f2be27ac3ae499dc4dd75ca18ae9dc6c43684b580fb9b","observation_id":"9e406a1f-0e5d-4dc8-92de-31b22329086a","resolution":{"observed_at":"2026-08-06T12:12:46.227068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.02264","last_updated":"2019-02-27T05:38:15Z","snapshot_observed_at":"2026-07-06T06:48:42.017421Z","submitted_at":"2018-07-06T06:03:06Z","title":"Variance Reduction for Reinforcement Learning in Input-Driven Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.02264","snapshot_observed_at":"2026-08-06T12:12:46.230856Z","title":"Variance Reduction for Reinforcement Learning in Input-Driven Environments","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.230856Z"},"links":{"cited_paper":"/paper/1807.02264","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:ae075b7d28518a7cd08bd8c51e45c2082af4c80616549e2c95e8cd6e2273a8cf","observation_id":"7349e878-9e80-4453-8320-521c9158b415","resolution":{"observed_at":"2026-08-06T12:12:46.230856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-06T12:12:46.240981Z","title":"Wavenet: A Generative Model for Raw Audio.arXiv preprint arXiv:1609.03499, 12,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.240981Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:593a173e7e10d60fd604d355b7621436c6de36dac4aac1089ef1227bfbeaf61e","observation_id":"fc164ae6-e5f3-47aa-9a36-026069e57751","resolution":{"observed_at":"2026-08-06T12:12:46.240981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11246","last_updated":"2025-09-10T21:32:10Z","snapshot_observed_at":"2026-08-02T12:02:04.782439Z","submitted_at":"2023-06-20T02:58:25Z","title":"Deep Reinforcement Learning for Inventory Networks: Toward Reliable Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11246","snapshot_observed_at":"2026-08-06T12:12:46.198333Z","title":"Neural inventory control in networks via hindsight differentiable policy optimization.arXiv preprint arXiv:2306.11246,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":1951,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.198333Z"},"links":{"cited_paper":"/paper/2306.11246","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:a03a450530ca0031527b3aac2eca2494bff708b26fd17e05198c27c8a6136bed","observation_id":"3df5bba4-b0a5-407b-b6e5-fedcd6ece0b9","resolution":{"observed_at":"2026-08-06T12:12:46.198333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T12:12:46.219761Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":1960,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.219761Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:76892c5a1d1a25139b1927bc63bf28c32e9ef6129b728e45a438f6569e334c53","observation_id":"dbec1f3a-0c03-458d-baac-af2ef0ef5510","resolution":{"observed_at":"2026-08-06T12:12:46.219761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10662","last_updated":"2019-12-03T00:08:17Z","snapshot_observed_at":"2026-08-02T08:13:46.167365Z","submitted_at":"2019-09-24T00:24:23Z","title":"How to Incorporate Monotonicity in Deep Networks While Preserving Flexibility?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10662","snapshot_observed_at":"2026-08-06T12:12:46.216238Z","title":"How to incorporate monotonicity in deep networks while preserving flexibility? arXiv preprint arXiv:1909.10662,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.216238Z"},"links":{"cited_paper":"/paper/1909.10662","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:b80b4ff3474f453cd1e61b9c61c2eef35c76de0473b168c95db61c111cf77fa1","observation_id":"106eef19-5796-41ff-9dd8-8fb842ce39ba","resolution":{"observed_at":"2026-08-06T12:12:46.216238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12182","last_updated":"2022-07-22T11:36:17Z","snapshot_observed_at":"2026-07-06T13:34:59.210380Z","submitted_at":"2022-07-22T11:36:17Z","title":"Effective Dual-Sourcing Through Inventory Projection","version":1},"cited_work":{"arxiv_id":"2207.12182","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.12182","snapshot_observed_at":"2026-08-06T12:12:46.426603Z","title":"Effective Dual-Sourcing Through Inventory Projection","venue":"math.OC","work_id":"b2de38bb-c5f3-43ad-bfba-47db9ed9ecb2","year":2022},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.205491Z"},"links":{"cited_paper":"/paper/2207.12182","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:32aa4f307b27191e46e4a6e96db0374baa199fd17494b9fcf15cc8353529b3b1","observation_id":"982f9912-44ac-4f2b-81a4-4fb83ac32411","resolution":{"observed_at":"2026-08-06T12:12:46.432778Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.01783","last_updated":"2016-06-16T16:38:45Z","snapshot_observed_at":"2026-07-06T04:45:11.148515Z","submitted_at":"2016-02-04T18:38:41Z","title":"Asynchronous Methods for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.01783","snapshot_observed_at":"2026-08-06T12:12:46.223383Z","title":"Lillicrap, Tim Harley, David Silver, and Koray Kavukcuoglu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.223383Z"},"links":{"cited_paper":"/paper/1602.01783","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:688d16b3df0a9d214da17f94a5105a3f2c1779491a380649c1b1821bbbfe0690","observation_id":"3b64227f-f450-4e22-a94e-ac4bc865b0ab","resolution":{"observed_at":"2026-08-06T12:12:46.223383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.10641","last_updated":"2019-12-01T23:50:12Z","snapshot_observed_at":"2026-07-06T08:39:35.002141Z","submitted_at":"2019-11-24T23:49:48Z","title":"ORL: Reinforcement Learning Benchmarks for Online Stochastic Optimization Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.10641","snapshot_observed_at":"2026-08-06T12:12:46.201951Z","title":"ORL: Reinforcement Learning Benchmarks for Online Stochastic Optimization Problems","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.201951Z"},"links":{"cited_paper":"/paper/1911.10641","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:9de82cb8a7245c13625dd131d87fcfc8d8d9c51aa37d93506bab740d36c782b2","observation_id":"2479b434-f850-4bf6-b985-c99485db8e00","resolution":{"observed_at":"2026-08-06T12:12:46.201951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.01806","last_updated":"2020-10-21T19:16:36Z","snapshot_observed_at":"2026-08-04T07:19:10.424944Z","submitted_at":"2020-04-03T22:59:25Z","title":"On the convergence of physics informed neural networks for linear second-order elliptic and parabolic type PDEs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.01806","snapshot_observed_at":"2026-08-06T12:12:46.234443Z","title":"On the convergence of physics informed neural networks for linear second-order elliptic and parabolic type pdes","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.234443Z"},"links":{"cited_paper":"/paper/2004.01806","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:8cb3e15b19146b1aafdb3b3ddeb09c65cc2466a44d405260784c003b271da82c","observation_id":"319bc03a-a1cc-4dd8-b8d0-0ebf4d9b1e63","resolution":{"observed_at":"2026-08-06T12:12:46.234443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T12:12:46.237815Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.237815Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:151810092e49b910399130e0f62e808d9bac7365a14b46f3c13f3823dfb58ca4","observation_id":"a9c5d09a-bfd8-4734-823f-5b0631e18d58","resolution":{"observed_at":"2026-08-06T12:12:46.237815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:12:46.244220Z","title":"VC theory for inventory policies.arXiv preprint arXiv:2404.11509,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.244220Z"},"links":{"citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:1f8b6ace494bbbad379538489a6abee6c97eb5bbf13d846e6d9df6831ce5d7c5","observation_id":"ed92f707-0961-49b1-9312-230e91b0f871","resolution":{"observed_at":"2026-08-06T12:12:46.244220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02817","last_updated":"2024-09-24T16:23:10Z","snapshot_observed_at":"2026-07-06T19:27:16.301809Z","submitted_at":"2024-09-24T16:23:10Z","title":"Neural Coordination and Capacity Control for Inventory Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02817","snapshot_observed_at":"2026-08-06T12:12:46.208776Z","title":"Neural coordination and capacity control for inventory management.arXiv preprint arXiv:2410.02817,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.208776Z"},"links":{"cited_paper":"/paper/2410.02817","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:e0e39358d063a27a0b62c8b1b748a58a6373f1c2a8e18e6cc82c3b74f4a80198","observation_id":"7cc77b74-c586-4f1f-8888-26808122f5d9","resolution":{"observed_at":"2026-08-06T12:12:46.208776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14799","last_updated":"2022-01-27T03:02:39Z","snapshot_observed_at":"2026-07-06T10:00:17.079229Z","submitted_at":"2020-09-30T17:12:46Z","title":"MQTransformer: Multi-Horizon Forecasts with Context Dependent and Feedback-Aware Attention","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14799","snapshot_observed_at":"2026-08-06T12:12:46.212767Z","title":"MQTransformer: Multi-horizon forecasts with context dependent and feedback-aware attention","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.212767Z"},"links":{"cited_paper":"/paper/2009.14799","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:76e603fb4f3d9874daf712ead9c2ac3a9f42d7347c747a3d16672ca4629d7b7d","observation_id":"5bff861f-4b41-423d-8967-2d9d703a3217","resolution":{"observed_at":"2026-08-06T12:12:46.212767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T18:45:21.774662Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2507.22040."}