{"as_of":"2026-08-08T23:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:169af7c582bda82df77b59957dd0351d3b6de6022ed706505209e3c3cae1b8c0","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:29:16.402684Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T05:02:56.825004Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:39:50.829089Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"cited_work":{"arxiv_id":"2507.02698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02698","snapshot_observed_at":"2026-07-04T13:39:50.829089Z","title":null,"venue":null,"work_id":"36081b6d-1ef4-461a-aa22-b833522aa891","year":2025},"citing_paper":{"arxiv_id":"2606.26787","last_updated":"2026-06-25T09:21:42Z","snapshot_observed_at":"2026-07-07T00:01:05.946912Z","submitted_at":"2026-06-25T09:21:42Z","title":"AIGP: An LLM-Based Framework for Long-Term Value Alignment in E-Commerce Pricing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T05:02:56.825004Z"},"links":{"cited_paper":"/paper/2507.02698","citing_paper":"/paper/2606.26787"},"observation_digest":"sha256:875f174e1fe071766df7d4058144b47a7927b84cd493cbe6e75d87ea68feb297","observation_id":"edac2389-7b61-44b2-aeab-288cf5ea79d9","resolution":{"observed_at":"2026-07-04T13:39:50.830522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.02698/citation-record","integrity":"/paper/2507.02698/integrity","json":"/paper/2507.02698/citation-record.json","paper":"/paper/2507.02698"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:25.640259Z","title":"Snellius: de Nationale Supercomputer","venue":null,"work_id":"1f06f33a-99c4-415c-ab9b-4f30b6b8ea0f","year":2025},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.004183Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:496cb80ccb03822cb7a3fe6003e56575e646f9c858c51bfb2a898eaf16702b2a","observation_id":"f9b33be4-66e2-4264-91ab-556638d9865b","resolution":{"observed_at":"2026-08-06T20:29:25.780529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.7717/peerj-cs.2078","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:19.817254Z","title":null,"venue":null,"work_id":"4dee2103-08b6-4b12-988e-69e536707589","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.136596Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:54952a7ae0d915d87bfe09a1769fd32a2ffdc14e99cb708b8b0ce080288e2750","observation_id":"130c883b-500d-4ac0-bb6d-9665e46057b7","resolution":{"observed_at":"2026-08-06T20:29:19.871012Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9442.00151","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:21.654620Z","title":null,"venue":null,"work_id":"812759e2-1f86-4591-af5a-955286553223","year":1999},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.249287Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:5d04967e71f1f4ace71f08655091a9ad1d8de3f2651904c655e5c9b369f271e9","observation_id":"9e34861d-2eb6-4727-9f03-cabefa2a09a8","resolution":{"observed_at":"2026-08-06T20:29:21.754111Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.11289","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:21.231596Z","title":null,"venue":null,"work_id":"c1f8e3a4-1549-4311-b863-025bd6bb54f4","year":2020},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.372267Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:dbe4f950c81295e40c5d33897ba02e6aeb039ff44258c917a098e475819ecf1c","observation_id":"01a73798-de4e-4272-a6c3-a62d54d4a92f","resolution":{"observed_at":"2026-08-06T20:29:21.412869Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:08.532013Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.532013Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:294a1061ad67ca29f8f334dd2ecf6ccb952041e7e86a5199be694d39e7aaceef","observation_id":"c6ffe257-82e9-4760-af19-67e278ee98bd","resolution":{"observed_at":"2026-08-06T20:29:08.532013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ifacol.2015.06.391","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:19.676322Z","title":null,"venue":null,"work_id":"ba24f0a5-433e-440f-b2c4-d2dc4ccc7e2c","year":2015},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.672609Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:091acb4acbc727ff782492cecb19783e44efb5f097cef09a241b5732ed6fa9c6","observation_id":"fb148c67-26c4-46dd-ad6c-a6c5e19f4a98","resolution":{"observed_at":"2026-08-06T20:29:19.724333Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:08.782014Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.782014Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:b69061b79c0d69a62678c08157b56f000593ce920992c61367366200874bb753","observation_id":"559f5252-d5a9-4d2b-9b35-6eceef60f269","resolution":{"observed_at":"2026-08-06T20:29:08.782014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:25.446472Z","title":null,"venue":null,"work_id":"21343496-c761-4a47-b693-cc4308f0c52d","year":2010},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.953291Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:0a5000998394cc9bb203b525596551dc2ef9c12b635fdd5cc381d6ead62e3229","observation_id":"3133395b-21f5-4b31-960a-af74084e2f6b","resolution":{"observed_at":"2026-08-06T20:29:25.572508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:09.129755Z","title":null,"venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.129755Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:01321c6410799eb243d7e5f3fa004f41cf0956c8696c9929f8efc1fe318757a4","observation_id":"c186cff5-f5bd-43ba-9da3-9e91ff8643ce","resolution":{"observed_at":"2026-08-06T20:29:09.129755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:09.285434Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.285434Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:56540185ac24537986e74b4cd71f63dbe862a877de96e852137a5f47fcb762c5","observation_id":"40c94f40-993f-4fd1-b2ac-c3dcfc969951","resolution":{"observed_at":"2026-08-06T20:29:09.285434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1504/ijbfmi.2015","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:19.550414Z","title":null,"venue":null,"work_id":"33b9c3b3-2f03-4194-82ea-48e8e7eae695","year":2015},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.408280Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:41b3c5c4738098c41eafbe6083b0b4ecf046330d946e794ae47b248b6f32d231","observation_id":"92e2f868-1c65-412a-9641-502c793b38be","resolution":{"observed_at":"2026-08-06T20:29:19.590005Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:09.546123Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.546123Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:8b31674b4829dc3d7ba92473870f3a8b62fd81296bf210017373b4601350f6c2","observation_id":"4f105b3c-38e8-4090-846a-d2fc5619d556","resolution":{"observed_at":"2026-08-06T20:29:09.546123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:09.682850Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.682850Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:4752d85ba04d310fd2c8882a9c181dd29a11f80c5ae69abac36c7f11d991a875","observation_id":"aba7199e-4514-436a-acac-144f44ef72fa","resolution":{"observed_at":"2026-08-06T20:29:09.682850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:25.261768Z","title":null,"venue":null,"work_id":"97f614f7-e0d7-40c7-afb2-5470d07ba52d","year":null},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.834168Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:5ebd31ab761ba8331f5434b8a574afe1b297646ba35657581251577baf609d1a","observation_id":"5f94116c-e09d-41a4-9052-34dee9332ecc","resolution":{"observed_at":"2026-08-06T20:29:25.361611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.37547/tajet/volume06issue12-15","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:19.329148Z","title":null,"venue":null,"work_id":"f8ff3c94-5991-4b7e-8a55-f49c45f5c3bd","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.162402Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:3c1ad11a8cd67a8b88f9926a1f6251d8acc327eb6762933b4378c6499ec2b02a","observation_id":"4b19c71b-0265-461d-aeb2-c1522b35ebee","resolution":{"observed_at":"2026-08-06T20:29:19.421258Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:10.315459Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.315459Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:f2d2d3a381e921172b9938b0a9eef5939ffa59cdf62a624bbb16bff246c97d1d","observation_id":"3ab3a4a3-f7f7-40c3-a24b-b41fc8a6003c","resolution":{"observed_at":"2026-08-06T20:29:10.315459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0529.2023","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:20.839880Z","title":null,"venue":null,"work_id":"02b54106-55bf-48cd-bdb2-899c08af52aa","year":2023},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.440000Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:1bd262c4e3bccab98acb096fbab996b0a92efdb5c7431b6cce46ebb1864ba425","observation_id":"1f9bfaba-3906-45c8-832f-1643718d1f6e","resolution":{"observed_at":"2026-08-06T20:29:20.878731Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"publication/3863826","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:20.602538Z","title":null,"venue":null,"work_id":"d2c4577f-cec9-4925-9683-fd52c23fc871","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.557031Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:ef2895f1c3191023b75cd4b6d2b83eff187d9e8cb5a0923039c5f456e8071e6c","observation_id":"b2d0d898-025b-461c-8ac1-22a393bb5017","resolution":{"observed_at":"2026-08-06T20:29:20.689007Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.06676","last_updated":"2016-05-24T18:16:56Z","snapshot_observed_at":"2026-07-06T04:57:08.358661Z","submitted_at":"2016-05-21T17:20:04Z","title":"Learning to Communicate with Deep Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.06676","snapshot_observed_at":"2026-08-06T20:29:10.678948Z","title":"Foerster, Yannis M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.678948Z"},"links":{"cited_paper":"/paper/1605.06676","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:6687d2b7779cb100f852c5c4617b66ecf8dc0bb77db47ca93ea71da020d6a7d6","observation_id":"fc5813b1-70e2-4afc-adf0-64f1ed1159d5","resolution":{"observed_at":"2026-08-06T20:29:10.678948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3115/v1/p14-1047","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:19.056115Z","title":null,"venue":null,"work_id":"4126f6b4-702c-4078-a4b0-317753e6c858","year":2014},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.806992Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:e6590e7beca0413019e00c776e5481f96d65399b0b28aca0021cc9ee1fa40e9f","observation_id":"48013670-e915-4484-bc7d-d924f163b261","resolution":{"observed_at":"2026-08-06T20:29:19.184640Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.procs.2014.09.060","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:18.815795Z","title":null,"venue":null,"work_id":"b5e86acf-82f7-4dba-9b79-d1ff3cedf791","year":2014},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.969017Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:5d2d7da6dab9c6cc00334f3c6b81ef1cb32cc607568bef153d798f3e879cbab3","observation_id":"1aec220c-27c7-4825-82f4-da67fae82123","resolution":{"observed_at":"2026-08-06T20:29:18.940791Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:24.939879Z","title":null,"venue":null,"work_id":"30b79f1f-85ac-4d68-82ce-494fde05742d","year":2012},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.135560Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:6f366fa79ddb9b09b289c63e155200f34ae16dfe10eed65042d16c55bcb3c89a","observation_id":"2c6957b9-f0d1-4f66-a66b-5a02ed697d60","resolution":{"observed_at":"2026-08-06T20:29:25.082320Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:11.255292Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.255292Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:afb835f821fdf42885c325354c325086860d0b0d00f02685e5174c57550cb721","observation_id":"1565b1f2-d0c2-487b-bace-ed11ace02a2f","resolution":{"observed_at":"2026-08-06T20:29:11.255292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:11.380332Z","title":"Hendricks and Kate W","venue":null,"work_id":null,"year":1936},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.380332Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:a698c1ccd919734875bdaf72aebfdf3774ff27c92da4f505c045d9fb21d47ed0","observation_id":"b7dfd59c-3cc2-4fe2-990f-f78697cd1a64","resolution":{"observed_at":"2026-08-06T20:29:11.380332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13442","last_updated":"2023-02-19T01:24:51Z","snapshot_observed_at":"2026-08-06T01:50:31.974402Z","submitted_at":"2023-01-31T06:38:53Z","title":"Scaling laws for single-agent reinforcement learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13442","snapshot_observed_at":"2026-08-06T20:29:11.556414Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.556414Z"},"links":{"cited_paper":"/paper/2301.13442","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:4e8518535cfab617c5e75075272ef7bde548d60621e23cb1ddb01b623d9e8572","observation_id":"5aac830d-c546-4b4f-ac10-3be925a83dfc","resolution":{"observed_at":"2026-08-06T20:29:11.556414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.indmarman.2003.10.006","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:18.654512Z","title":null,"venue":null,"work_id":"af3823cd-c744-4a28-ab46-e5a24235389a","year":2004},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.716782Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:d97f2bdbb58580df3b7220b909486a0aedea21fe54c493eeb9bb05e7198caf73","observation_id":"3783fd37-06d1-4669-bd6f-623111f0a000","resolution":{"observed_at":"2026-08-06T20:29:18.704392Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/1-4020-5263-4_24","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":null,"venue":null,"work_id":"813a5386-1152-437f-8830-90f9ac5996f6","year":2006},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.896483Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:1c3f3cf450b8f6701b9835226d81d63a27a7cb4f5786806393fbaea6ff4756db","observation_id":"8b6ebe7a-adbe-47eb-9c7c-18dbc1b63198","resolution":{"observed_at":"2026-08-06T20:29:18.593097Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:24.706468Z","title":null,"venue":null,"work_id":"91d5ca56-5c4d-4db1-8554-706f0f010dc1","year":1984},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.028638Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:afc35df15d6cdcb24638537e8a73d515e980f467f7521954d7b73b6a3690978a","observation_id":"da103f51-ec98-424b-9f5b-34e99cb19b40","resolution":{"observed_at":"2026-08-06T20:29:24.813285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1108/17410380810869923","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:18.421747Z","title":null,"venue":null,"work_id":"b9fe6b69-35ee-4249-b080-c3a74da2cc07","year":2008},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.215638Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:9367ab4becbdd318a948eec4b5e908a63375c05ce1202d7e58174f0050bd87f0","observation_id":"a85e6260-0ec4-4a9b-8b37-f8283aec0154","resolution":{"observed_at":"2026-08-06T20:29:18.460653Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:24.350258Z","title":null,"venue":null,"work_id":"b310579f-002a-4bbd-8363-6f81de52a6b0","year":2017},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.331390Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:d9ccada40bb50f122a810b01ff1e64ea89ea1cbb2b3cc891d61bb18af0c590e7","observation_id":"44191092-5e80-421f-bfec-a87690815afb","resolution":{"observed_at":"2026-08-06T20:29:24.543379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:12.442184Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.442184Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:cc777f202dcee816b400146a0c39c530bb588abcb46043ddd6dd173a14d9cecc","observation_id":"d24e8000-2c92-4f0d-8371-fde89eb8571e","resolution":{"observed_at":"2026-08-06T20:29:12.442184Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:24.020806Z","title":"Konda and John N","venue":null,"work_id":"70c1daf1-1faf-42db-a8bc-11e43ad55f6c","year":2003},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.551281Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:d7a1f46baeedf15c69c0a7b459364b1f56d4ff3090a5e5d66cf7ea9aeace10b1","observation_id":"629e5f4c-f436-422f-a328-33fbbbf43bb7","resolution":{"observed_at":"2026-08-06T20:29:24.195442Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:23.691718Z","title":null,"venue":null,"work_id":"9aa3ba62-bcf6-4372-a7d1-77e849e5e3ef","year":2001},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.717425Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:2755ef526182cd47a74912b270e5a87dc4ae8e4c3548ae8f643df075ac02d3d4","observation_id":"4198f2bf-1acf-493d-b826-4ae7bf93f792","resolution":{"observed_at":"2026-08-06T20:29:23.854475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:23.274579Z","title":null,"venue":null,"work_id":"7e2d9987-b7fe-4392-b649-6935e4ffb1c4","year":2021},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.914533Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:6bea9310f9c8c967f18c190631d0dc4165b4b5e3045b3e513bb7c3788f61c699","observation_id":"2e656425-c613-4a2f-b113-1f116bdf49fc","resolution":{"observed_at":"2026-08-06T20:29:23.532678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-24264-4_37","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":null,"venue":"Lecture notes in computer science","work_id":"e95ccaed-e675-4c9f-bfa2-0fe5112fc590","year":2015},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.060715Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:4c8e9d382ad9b939dafcddfbe85aeaffc85851ad4a9748149677575699ae0ba2","observation_id":"e9dabf95-f8b4-4c16-8475-98ee32f6d760","resolution":{"observed_at":"2026-08-06T20:29:18.372843Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:13.171498Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.171498Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:8b8dfc750046ba1acb21d817f4743fc8edf6908340e469dc32dfee39ac5c6679","observation_id":"265b050b-b237-4871-bdbe-d4e05bd60f54","resolution":{"observed_at":"2026-08-06T20:29:13.171498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02572","last_updated":"2021-08-31T01:42:10Z","snapshot_observed_at":"2026-07-06T08:42:19.246046Z","submitted_at":"2019-12-05T13:41:03Z","title":"Dynamic Pricing on E-commerce Platform with Deep Reinforcement Learning: A Field Experiment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02572","snapshot_observed_at":"2026-08-06T20:29:13.303844Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.303844Z"},"links":{"cited_paper":"/paper/1912.02572","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:2d1d66c4dae9d18aad129b7abbd09c33113c1e19d36118550f49c0b30c298ec8","observation_id":"0b8970af-e32b-4697-9083-cd73952bf2a1","resolution":{"observed_at":"2026-08-06T20:29:13.303844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:13.662558Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.662558Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:95a6a5b7d5b04fa24eec2fb9511d889fbb18c049f7ccf1abd5af6c218c6a23d8","observation_id":"9ac9bda0-bb6a-4a68-b6c5-ea9e83d48d8c","resolution":{"observed_at":"2026-08-06T20:29:13.662558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.30574/gjeta","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:18.079971Z","title":null,"venue":null,"work_id":"8216187b-c7ef-4677-b804-dbb9ce615b20","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.984067Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:ab966aeee0515017377834dd24e6d1dff1901e78633dd3c6d25b269e3de00ac9","observation_id":"8cb0c83f-cb0f-4ef2-948f-5f53fd4afc3f","resolution":{"observed_at":"2026-08-06T20:29:18.177842Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.147667Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.147667Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:b84526effa69b704ba1b195af29f4b1bbd03f599a8d6aaa2f8c0b5dd98ae44bc","observation_id":"1d8e33d3-1b1f-41ed-af6c-b5e94d42cdc7","resolution":{"observed_at":"2026-08-06T20:29:14.147667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:22.642830Z","title":"https://github.com/openai/maddpg Archived codebase provided as-is, based on the NeurIPS 2017 paper","venue":null,"work_id":"b7f4a696-2c15-4c9d-a04a-f4186d4874c7","year":2017},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.887246Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:c994790449a14013c81cc9a5ac9b5d3b1bcb1393901d5215d3f9b680d3a2cb3f","observation_id":"4952db4d-da68-4135-a4ae-2ee46f75fe64","resolution":{"observed_at":"2026-08-06T20:29:22.769099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:22.310591Z","title":null,"venue":null,"work_id":"38b671c7-7ebc-4474-89bd-c5c978ff1213","year":2005},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.385078Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:93ca58f87fc636622dfc8b72e9ec796b37e957e5e2f161037af63abab4bc5a96","observation_id":"2cb7e7bf-0f90-4ba3-a85b-7e5371a0af0b","resolution":{"observed_at":"2026-08-06T20:29:22.471240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.456991Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.456991Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:0c55488bc9e5b854b9a083cd2a94a1f44320eea1d4eb7cdc8d576d50a9271ec7","observation_id":"58a15160-1d0d-450b-9635-22da1f0ec849","resolution":{"observed_at":"2026-08-06T20:29:14.456991Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.299632Z","title":null,"venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.299632Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:544af9ea8351ab4fa9f0a8eff493f13712a359de303ba265721773270ab6b92e","observation_id":"ab1dc2ac-904a-4720-9104-66b764d8aa8e","resolution":{"observed_at":"2026-08-06T20:29:14.299632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.697760Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.697760Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:adf01a62af3b0db6a1ce2736e7891b562f1b86c766035f575d3f49cdc3494e71","observation_id":"cddb635d-4787-4a39-a0fb-120a6dfb91bf","resolution":{"observed_at":"2026-08-06T20:29:14.697760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.804378Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.804378Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:00dcddd2d81844459e6b4dd507cd235b2a1da9d88781973ef0ca72641ad46e96","observation_id":"77ff5e8f-6f23-4b66-a98e-c981134394d6","resolution":{"observed_at":"2026-08-06T20:29:14.804378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.11485","last_updated":"2018-06-06T17:58:09Z","snapshot_observed_at":"2026-08-06T12:03:41.509273Z","submitted_at":"2018-03-30T14:23:39Z","title":"QMIX: Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.11485","snapshot_observed_at":"2026-08-06T20:29:14.571680Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.571680Z"},"links":{"cited_paper":"/paper/1803.11485","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:c02a27eee921946f6cb2a709354bd4ce20e7612a434250418339d53ecdb5c888","observation_id":"b32f4b0c-3907-41a0-a7e1-c7ce722d5905","resolution":{"observed_at":"2026-08-06T20:29:14.571680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.982126Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.982126Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:83868600e5c43bb4e2df90d49ae5a755722a44c9cedbbfcc8e9ef22d33d38e84","observation_id":"adbe308b-3f23-46e7-91fa-7338549d1c08","resolution":{"observed_at":"2026-08-06T20:29:14.982126Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:15.119548Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.119548Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:629f25d31bc027bb9992ed7a1b9ebfe2c390acaa6948f02f8f03ce2c98c0a9fb","observation_id":"df34b0e2-df6a-4900-991b-fd32ebce6154","resolution":{"observed_at":"2026-08-06T20:29:15.119548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.07478","last_updated":"2017-11-20T16:40:33Z","snapshot_observed_at":"2026-07-06T06:10:25.736483Z","submitted_at":"2017-11-20T16:40:33Z","title":"Implementing the Deep Q-Network","version":1},"cited_work":{"arxiv_id":"1711.07478","doi":"10.48550/arxiv.1711.07478","metadata_source":"pith","pith_arxiv_id":"1711.07478","snapshot_observed_at":"2026-08-07T06:16:28.064256Z","title":"Implementing the Deep Q-Network","venue":"cs.LG","work_id":"f5517430-e65b-4f70-9150-63dba8fed7e6","year":2017},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.864682Z"},"links":{"cited_paper":"/paper/1711.07478","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:85a1966943a6f2c888dbf620eaf711e7ab02823a2ccaa405839d7d04b1407fad","observation_id":"938d2c47-21cc-4864-a734-f4adea139a82","resolution":{"observed_at":"2026-08-06T20:29:17.885898Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"publication/3848058","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:20.030159Z","title":null,"venue":null,"work_id":"213af0ae-d1d7-4540-9a74-737ff373a459","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.338760Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:1f7919622ff44e8ac3376c5f96dc92e0b03a60cdf616cc145209f111957fae20","observation_id":"789d9cc6-724a-4400-a367-7ab64cd6539f","resolution":{"observed_at":"2026-08-06T20:29:20.090430Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07378","last_updated":"2024-10-09T18:53:17Z","snapshot_observed_at":"2026-08-05T11:41:10.476072Z","submitted_at":"2024-10-09T18:53:17Z","title":"Static Pricing for Online Selection Problem and its Variants","version":1},"cited_work":{"arxiv_id":"2410.07378","doi":"10.48550/arxiv.2410.07378","metadata_source":"pith","pith_arxiv_id":"2410.07378","snapshot_observed_at":"2026-08-07T06:16:28.064256Z","title":"Static Pricing for Online Selection Problem and its Variants","venue":"cs.GT","work_id":"aed4152e-cbcd-4de0-a2a4-52404f178db4","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.475625Z"},"links":{"cited_paper":"/paper/2410.07378","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:d6a10f2d20455e267ab1a5d0debabdef7a47ad95064b9f4ec7624c505e97d961","observation_id":"e8df9342-8a68-425b-963a-9e4f20d5d4c2","resolution":{"observed_at":"2026-08-06T20:29:17.348694Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-95786-9_24","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"Graves, Douglas A","venue":"Lecture notes in computer science","work_id":"3e5fd4a1-1e00-427c-841f-facac9b69296","year":2018},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.201620Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:c80bdd2b0addf052929d27a6883b563fa4a30168f2c8f19e260429fa2be66cde","observation_id":"50a388a4-6110-4555-ad9f-e552e592439a","resolution":{"observed_at":"2026-08-06T20:29:17.615685Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.4144905","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:16.796539Z","title":null,"venue":null,"work_id":"b2166aed-b607-4578-8c7f-cc98a7572902","year":2023},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.751883Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:b6b16931eec2cc76db45d26220163186e3cd032c455f0986c7374e061e640008","observation_id":"d4ceb7cc-3946-4cbe-938c-a57ddeffd2af","resolution":{"observed_at":"2026-08-06T20:29:16.896585Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1509/jmr.16.0453","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:16.558403Z","title":null,"venue":null,"work_id":"0ae75813-038d-43e6-90db-2e85324d00e7","year":2018},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.888540Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:440642bed68752f4376cbfb565183655d529b684f6d1f1396505870c4520ebc4","observation_id":"62a276e2-5047-40ad-8b21-17f31ae9dd5e","resolution":{"observed_at":"2026-08-06T20:29:16.644044Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1108/02635570210414631","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:17.012006Z","title":null,"venue":null,"work_id":"8cb3ca6f-0f8d-4a06-b7f7-3f0f318ba73c","year":2002},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.612360Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:29e2b7a7696413b0851a560c2b920b8d2fe304518bded723b5b9a3557c50ab44","observation_id":"604340aa-9ed8-420c-824f-1cb6e478a121","resolution":{"observed_at":"2026-08-06T20:29:17.098375Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:16.072731Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:16.072731Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:723f2020ed658d1e7455673a3127004558a8efb7bac2c3733cc0ff09dc861d41","observation_id":"a3f585e8-25e4-47bf-baa6-c88266b1eb76","resolution":{"observed_at":"2026-08-06T20:29:16.072731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:16.186185Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:16.186185Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:af213b355967e46dce6588e5015b7ad5d45ffd2c90ec1dce90b430d451d44a6c","observation_id":"c49fe91a-fe4e-4a43-9951-8f8c817427a4","resolution":{"observed_at":"2026-08-06T20:29:16.186185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:15.990002Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.990002Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:ba5a2bf7821c2bd79fa1d8ed6550ddbed21994b483e1a0ad8c4099b545c81530","observation_id":"6c0955f4-5cc2-496a-a96b-f1db5f1a76d6","resolution":{"observed_at":"2026-08-06T20:29:15.990002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10091","last_updated":"2023-05-17T09:53:13Z","snapshot_observed_at":"2026-07-06T15:28:36.294775Z","submitted_at":"2023-05-17T09:53:13Z","title":"Multi-Agent Reinforcement Learning: Methods, Applications, Visionary Prospects, and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10091","snapshot_observed_at":"2026-08-06T20:29:16.402684Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:16.402684Z"},"links":{"cited_paper":"/paper/2305.10091","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:03ffba725fdde026f6a05b3938068d36d48187ed518512dc0f5d5e08a57bf981","observation_id":"e7aba37b-c24b-4741-8c36-486532749ae4","resolution":{"observed_at":"2026-08-06T20:29:16.402684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:21.917841Z","title":"2016.Automated Pricing Agents in the On-Demand Economy","venue":null,"work_id":"51b9a689-d6d7-4670-b901-8e9b62940a23","year":2016},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:16.275881Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:9379de9af08fc21f9a4ab06e2e5a0a1d9d38afa9d92aa955ad856bde7cc00008","observation_id":"d2dfb5f8-a62b-4cbc-a7ac-3e81f9d1653f","resolution":{"observed_at":"2026-08-06T20:29:22.102766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:22.944734Z","title":"In Advances in Neural Information Processing Systems , Vol","venue":null,"work_id":"18c57120-ead3-48e2-b12d-aed19aa996a4","year":2017},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.571233Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:fe7166c704927a27961a1c38bb21d7de40901ee739d97d08c323e36b737bc6c9","observation_id":"54fad510-e79a-4083-a5e2-2e6e77d7508d","resolution":{"observed_at":"2026-08-06T20:29:23.108572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:09.966441Z","title":"INFORMS Journal on Applied Analytics 51, 1 (2021), 76–89","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.966441Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:75c581b84a21a93d864179df3c027409f46b734048e306d7cec90c5e33de6b61","observation_id":"17bdd902-c895-40e5-9916-90d55aad232a","resolution":{"observed_at":"2026-08-06T20:29:09.966441Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T22:01:12.989389Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":7,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":31,"verified_exact":20,"verified_fuzzy":4},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 1 inbound Pith citation observation for arXiv:2507.02698."}