{"as_of":"2026-08-21T21:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0d625a495686f09f94a462e35fca82ade3e1857ac21a124511e9dba349807a97","coverage":[{"denominator":117,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:15:09.732151Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.18680/citation-record","integrity":"/paper/2507.18680/integrity","json":"/paper/2507.18680/citation-record.json","paper":"/paper/2507.18680"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.227641Z","title":"Electronic trading in financial markets,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.227641Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:a97f4c82c7c1ccab9a527320d9068d85d8f59e0ef3c1d37be7d0ac9bade052e0","observation_id":"7bd9c669-9c52-422a-956e-0c1e292cba2c","resolution":{"observed_at":"2026-08-15T18:15:09.227641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1142/9789812701022_","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.518003Z","title":"A simple approach to arbitrage pricing theory,","venue":null,"work_id":"663a067d-e2d0-46dc-b5bd-9c6be24dc20d","year":2005},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.233772Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:7ce97bd288bbc8230eb15c38a17b2cc7eb2508e3142f9c32b62f8a45fa493fc2","observation_id":"7200f1bb-1ecf-46cd-9bc8-b0bf9fb840e3","resolution":{"observed_at":"2026-08-15T18:15:10.523662Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.2278347","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.501750Z","title":"High-frequency trading,","venue":null,"work_id":"3ad66560-fe1e-4938-8e2a-2e3127102a07","year":2013},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.238824Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:c196f357dbcd03d4f01aed240504be76be38afc869ca4a9909c37b482112fc11","observation_id":"39690ad1-3558-4aa9-9a8c-ed01a020f119","resolution":{"observed_at":"2026-08-15T18:15:10.507236Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3574.19936","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:12.698310Z","title":"Market making and mean reversion,","venue":null,"work_id":"b8270612-397e-493e-a039-e8f29b1fa784","year":2011},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.244278Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:33308fc9fea4275a071ba269414786ebc16902f28c0956defb106ac5965fd688","observation_id":"60353f80-d4e2-4080-864d-b7d24f3b1466","resolution":{"observed_at":"2026-08-15T18:15:12.706495Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.249034Z","title":"market makers,https : / / web","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.249034Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:71911ca496fe13ed2e056821fc1514fcd00c3550ec9f645ac48a9afc984c0b45","observation_id":"d779a752-fd3b-4af8-94d0-06513ce780fe","resolution":{"observed_at":"2026-08-15T18:15:09.249034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.254308Z","title":"alphatrade","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.254308Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:e85fade9e95f5d78ce07f9e5d69edd18d5af80298eafb5e1fa058aacb3777783","observation_id":"a8eca693-8a8f-45e6-83a1-71eb01da9101","resolution":{"observed_at":"2026-08-15T18:15:09.254308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.259621Z","title":"Information effects on the bid-ask spread,","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.259621Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:b6a191f29c784fe2d5d63cb8185020687d4d7170ab9cf0b2854ad8b5efd7c03d","observation_id":"538452a2-9cab-417a-9cc4-761e72f3cf08","resolution":{"observed_at":"2026-08-15T18:15:09.259621Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.265085Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.265085Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:3a6e9acc6b9eb71e66a89e62294d2e0286da5f4e7cab96f5fc60e076cb440b89","observation_id":"026da88f-f7da-4a61-bfc3-5ba8e7a95b66","resolution":{"observed_at":"2026-08-15T18:15:09.265085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.271707Z","title":"Can alphago be apt subjects for praise/blame for","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.271707Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:748eed3b41a56666e513d7010016a6bacded23f02c5ccf6be76dcf613d38090b","observation_id":"5536be8c-f19b-4687-a966-1ce2e4f925ef","resolution":{"observed_at":"2026-08-15T18:15:09.271707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.276894Z","title":"Learning from delayed rewards,","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.276894Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:2cc44c1231ec37cd5513f1a1661b3ace9ef215d348259a1b3266afd5314aaaeb","observation_id":"89d6acd3-1b74-4e00-99aa-6b1a7a066f33","resolution":{"observed_at":"2026-08-15T18:15:09.276894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.282095Z","title":"Revisiting fundamentals of experience replay,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.282095Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:f5cb23adc61bc1d4a1b8fb3e3cb03d83549c77f2bbbe445a0e8da0c70934715f","observation_id":"59abfe7c-f0fe-4547-b273-3219f0c6b1f7","resolution":{"observed_at":"2026-08-15T18:15:09.282095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.287582Z","title":"Peeking inside the black-box: A survey on explainable artificial intelligence (xai),","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.287582Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:f569cd7e4f06bd617660af33fb892b06217cce44d0842240d3915525a3cc5d78","observation_id":"616c3877-afa2-428c-b422-103fcc6fda1f","resolution":{"observed_at":"2026-08-15T18:15:09.287582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.292263Z","title":"Simple statistical gradient-following algorithms for connectionist reinforcement learning,","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.292263Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:f2f72ed00f4f8d0e7d80e7926b536d759ef77173320ce312b2f0a535034d5968","observation_id":"6be03edc-218c-4e81-9a0b-655242eb1af0","resolution":{"observed_at":"2026-08-15T18:15:09.292263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.297865Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.297865Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:20d336393718d9aba9b3d9f6a5442c48bd0eeae3df976c9fa35b99b442eb58b1","observation_id":"cbd6b88d-c2ab-4cbc-ac48-834db0891f3a","resolution":{"observed_at":"2026-08-15T18:15:09.297865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T18:15:09.302789Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.302789Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:5b42bdfa570dd642aac3759f340753bf8671ea560bd4a576b7b4ac34d40b7bd2","observation_id":"b5ab94a3-b8d9-431f-8bdc-83a7e4f5c1ca","resolution":{"observed_at":"2026-08-15T18:15:09.302789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.309054Z","title":"A survey of monte carlo tree search methods,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.309054Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:61aab6f28188419bbd71752602bd5baa904dea75160a8e7ede5f1735a99637e6","observation_id":"4829c622-c7ac-4876-992b-13e45ddb8169","resolution":{"observed_at":"2026-08-15T18:15:09.309054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.314522Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.314522Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:611a1b3c1bef042d688c9c7dcec10a6d0d0e6171109de0bd927fb0f7a31fe171","observation_id":"c832dacb-f573-4b61-8f45-7669a4bd515e","resolution":{"observed_at":"2026-08-15T18:15:09.314522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.323147Z","title":"A survey of multi- objective sequential decision-making,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.323147Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:2781354fcebfe0ed6d79a50aac6da49fce829d7bd024ee0c4362ee9e32a1a417","observation_id":"ca5d9dbb-e83f-42c6-ae0b-ba57a8820942","resolution":{"observed_at":"2026-08-15T18:15:09.323147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.327707Z","title":"Jin,Multi-objective machine learning","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.327707Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:b3b3053d04a2379a9561a35a34cf527937e50b8e73ba0c8d85578aaf566d5c96","observation_id":"155b4760-0833-4063-803b-46aeb1f75292","resolution":{"observed_at":"2026-08-15T18:15:09.327707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.332311Z","title":"Multi-objective optimization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.332311Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:994bcaa2e2fc9caa2e64c88fb907f3b99ece3c94850dd8ba574c54fddcd7df99","observation_id":"d2e2297b-6d06-4266-9aab-64b4911ca805","resolution":{"observed_at":"2026-08-15T18:15:09.332311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.336038Z","title":"A multi-objective deep reinforcement learning framework,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.336038Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:7d017a5c0c632bf10a1e4a04e20e93fbab4581c84a36d79f9eb6ede4f66b4105","observation_id":"86321f47-6e52-46db-8585-082b17aac159","resolution":{"observed_at":"2026-08-15T18:15:09.336038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.340101Z","title":"Multi-objective reinforcement learning using sets of pareto dominating policies,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.340101Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:26d56866c5f6bd8020028425ea7db90877bc28d8d42a621f0343e0d5f5d2b420","observation_id":"b85423e8-9402-4e69-880f-7b8b081cd474","resolution":{"observed_at":"2026-08-15T18:15:09.340101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.345095Z","title":"A practical guide to multi-objective reinforcement learning and planning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.345095Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:14ee4ce5d8829a8715eeec68cef1836376f965daf26af980f6716adbcddeac99","observation_id":"ad03bbd7-5cbe-46a1-a9fd-a043e41dd9a4","resolution":{"observed_at":"2026-08-15T18:15:09.345095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.349993Z","title":"Reinforcement learning and the reward engineering principle,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.349993Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:19a84e4e03e34228ba376abf0d3705ee5aa8fb9f3f863de798b7f4e9434d4a67","observation_id":"dcfed933-a289-490e-bcdd-9cc2e9e07e82","resolution":{"observed_at":"2026-08-15T18:15:09.349993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-41188-6_3","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":"Reward function design in reinforcement learning,","venue":"Studies in computational intelligence","work_id":"7269d074-3c0c-4030-a5d8-8a551ca8e770","year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.355099Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:701173c6eae269cdba3f6992af04ebf8b2b5782bbe504cb07102befea10f3493","observation_id":"594fec30-af54-4939-85c9-14581a3940c0","resolution":{"observed_at":"2026-08-15T18:15:10.470267Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.359946Z","title":"Scalar reward is not enough: A response to silver, singh, pre- cup and sutton (2021),","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.359946Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:9e78f977712f0cce88469c93964e822f4e9f98aa19a1a87b288c0cdcf4a154ab","observation_id":"5bdc91e6-ec34-4bb2-8493-9a049d4a4bee","resolution":{"observed_at":"2026-08-15T18:15:09.359946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.365081Z","title":"Incremental rein- forcement learning for multi-objective robotic tasks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.365081Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:a8b4a473674d06ffd9036f049322ec3a15fe37e3ba16fd5f390fa5fcfe15b449","observation_id":"7561303d-3999-44e0-87c0-4cc047f24eed","resolution":{"observed_at":"2026-08-15T18:15:09.365081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.370227Z","title":"A dynamic penalty function approach for constraint-handling in reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.370227Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:d169189e026d17052c7d55531b4fa19fa2c624e3bc501405640041b86f4d3170","observation_id":"1a0340d8-64a9-4258-994b-9cc759f9492c","resolution":{"observed_at":"2026-08-15T18:15:09.370227Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.375087Z","title":"A study of multiple reward function performances for vehicle collision avoidance systems applying the dqn algorithm in reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.375087Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:e076f27194479fe119e60d4512ec46e83866b25146ef62df94be8b2b163521b2","observation_id":"6e1efc19-abb1-4c39-b63c-1d2936d505c1","resolution":{"observed_at":"2026-08-15T18:15:09.375087Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.engappai.2020","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.425351Z","title":"Learning adversarial attack policies through multi-objective reinforcement learning,","venue":null,"work_id":"19189915-74c4-4d87-a5a7-876481c982ab","year":2020},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.379436Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:1f485a207a0a774c954a529becd889bf0e0aa16b148d55904af95d2ac0edecf7","observation_id":"929987b0-8659-4b0a-8dcd-7c579bff1218","resolution":{"observed_at":"2026-08-15T18:15:10.431383Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.384022Z","title":"Pareto multi objective optimization,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.384022Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:5db419de4bb7dd977aa6a905de2f41195845fb95817f41fecaa3471907de68ce","observation_id":"cf63bbdc-fd22-48c8-a21c-47bef29a3fa9","resolution":{"observed_at":"2026-08-15T18:15:09.384022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.388261Z","title":"An evolutionary multi-objective optimization of market structures using pbil,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.388261Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:f4325978848c409b22d53850180602c4de6ea5b68fc474ec0bb41c799b9daecf","observation_id":"e6437896-9bc2-4545-b271-81a85291ab82","resolution":{"observed_at":"2026-08-15T18:15:09.388261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.392769Z","title":"Pareto multi objective optimization,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.392769Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:e323e2df7442ac0fb39c3b9e4d44c502b88ea33259b8679e4d4a41fef741eda8","observation_id":"11523267-d698-447b-a115-293fb3f32e39","resolution":{"observed_at":"2026-08-15T18:15:09.392769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.84777","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:12.309638Z","title":"Sampling reference points on the pareto fronts of benchmark multi-objective optimization problems,","venue":null,"work_id":"f3eaa77b-7721-41c9-a490-4fbf2cd3e8d5","year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.397544Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:2a67471554673ac904fc47b183e2d21224844bb9664a48a652f5dfbe0bc1d276","observation_id":"bb9d79be-a523-4659-92b1-70164b58813e","resolution":{"observed_at":"2026-08-15T18:15:12.317743Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.402458Z","title":"An easy-to-use real-world multi-objective opti- mization problem suite,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.402458Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:e91b3ef5f96ee14a3707612355859108b5a881b1089aee7770a8977939347387","observation_id":"9e76ebbf-20aa-41fa-8a87-d03b0d1b53af","resolution":{"observed_at":"2026-08-15T18:15:09.402458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.407086Z","title":"A survey of reinforcement learning algorithms for dynamically varying environments,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.407086Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:61f49fd67afb8f25d1b86edc31754cf87d8038dceb6e3aa69bc911a5cc72e5fa","observation_id":"f6225dca-89a8-4e31-bd45-3ff8f9b813ce","resolution":{"observed_at":"2026-08-15T18:15:09.407086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.411614Z","title":"Addressing environment non-stationarity by repeat- ing q-learning updates,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.411614Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:7a10aee6856548964a303f0c5b2900c6d3cdb21bf120374ae8523f73b2a2159a","observation_id":"8e899f42-c8cd-45cc-8996-a8d030564d50","resolution":{"observed_at":"2026-08-15T18:15:09.411614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-642-11814-2_5","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":"Recursive adaptation of stepsize parameter for non-stationary environ- ments,","venue":"Lecture notes in computer science","work_id":"b38fac0e-0b38-4ec8-8f5d-7dd34fd26bdb","year":2009},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.416264Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:69094d01c509788f5db91ab5aaec86c2040214d06f90972b8b586935c46191da","observation_id":"f5397d2d-20aa-4f5b-b8c7-42bd6b7f689b","resolution":{"observed_at":"2026-08-15T18:15:10.396890Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10994-006-8365-9","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-19T11:03:45.297681Z","title":"Adaptive stepsizes for recursive estimation with applications in approximate dynamic programming,","venue":"Machine Learning","work_id":"fd7e694a-2089-4c39-8f33-aacf41df92f6","year":2006},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.421726Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:31db257aeffe13519cb80ece2ac34144c2b5cca0445e35fe7becf8a1be942cc1","observation_id":"30eb3328-9f7f-4e77-a7e2-a45fd2b1b6fd","resolution":{"observed_at":"2026-08-15T18:15:10.378717Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ins.2020","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.356665Z","title":"Adaptive stock trad- ing strategies with deep reinforcement learning methods,","venue":null,"work_id":"874b5fd7-e4d4-44cf-b5f5-e355b2f035fc","year":2020},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.426798Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:683edd56167d3854fbc3b814fd31c89f05f848827124ca219a345a32e62ecad3","observation_id":"f9cf296a-fff4-43f6-8be6-5ad5de732795","resolution":{"observed_at":"2026-08-15T18:15:10.362234Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.436344Z","title":"Sequential decision-making under non- stationary environments via sequential change-point detection,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.436344Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:f64565e3051237ca23e2cd3125bfb99e9780f22be49f3f89bff56c94ff18e815","observation_id":"2283d741-2e2e-4844-b511-d1055afcd856","resolution":{"observed_at":"2026-08-15T18:15:09.436344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.440698Z","title":"Hidden-mode markov decision processes for nonstationary sequential decision making,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.440698Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:32f2a44e190c58bc35afbc1890afb99c12b180e123081b441017c0af6a5baa6c","observation_id":"b35050b5-c05a-46bc-a6c3-8f2238e79856","resolution":{"observed_at":"2026-08-15T18:15:09.440698Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.03970","last_updated":"2020-05-19T09:48:13Z","snapshot_observed_at":"2026-08-17T15:46:57.684985Z","submitted_at":"2019-05-10T07:05:27Z","title":"Reinforcement Learning in Non-Stationary Environments","version":4},"cited_work":{"arxiv_id":"1905.03970","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.03970","snapshot_observed_at":"2026-08-15T18:15:12.151757Z","title":"Reinforcement Learning in Non-Stationary Environments","venue":"cs.LG","work_id":"93d1544f-dfe6-451d-811c-040d00dc270d","year":2019},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.445242Z"},"links":{"cited_paper":"/paper/1905.03970","citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:984100d426ceb9755ec1bbbd5c0ab6a29f988c246bb78cb86d90cd7ee0fb68b8","observation_id":"595e3e07-94f0-49d4-ad39-03674592d8d4","resolution":{"observed_at":"2026-08-15T18:15:12.157664Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.449710Z","title":"Change point de- tection for compositional multivariate data,","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.449710Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:ee4126fbf0dd151ee39a2e950722e2d38e3973f7df0478bea2598b9e25d6e5a9","observation_id":"e3a1a094-c81f-4495-9f85-df2916af9799","resolution":{"observed_at":"2026-08-15T18:15:09.449710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.454136Z","title":"A continual learning survey: Defying forgetting in classifica- tion tasks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.454136Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:605cd0aa31930119c82892746fd9b9a8164117ff680cd000662e864d67f24e3d","observation_id":"c7ef85a3-c903-402d-8e1d-c55551615056","resolution":{"observed_at":"2026-08-15T18:15:09.454136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.458060Z","title":"Continual learning and catastrophic forgetting,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.458060Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:b9d823827da80f99413407af45eab3c6ef6ea3a1ce3ee338ba1e7037d19216b4","observation_id":"bd43e2ab-5149-48de-997c-3192b31d1729","resolution":{"observed_at":"2026-08-15T18:15:09.458060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.462604Z","title":"Catastrophic forgetting in connectionist networks,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.462604Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:0d9df60c9d08a7885e825765d4ed272f857f38147f29e168e9c44d952c013acd","observation_id":"45c7129c-6cc2-447b-bc6d-8825795f76e2","resolution":{"observed_at":"2026-08-15T18:15:09.462604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.467842Z","title":"Selective freezing for efficient continual learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.467842Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:13e119082876a062eb626f9cca23f9ed856d4882c053e01b4e9a68550a84c464","observation_id":"eaf914e3-14f4-4a97-9d18-55f14d6cb7d9","resolution":{"observed_at":"2026-08-15T18:15:09.467842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.472870Z","title":"Catastrophic forgetting, rehearsal and pseudorehearsal,","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.472870Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:1fd94bdc382c3f89e064dade9cca650552cdad9393f07b006843139b98560fba","observation_id":"77f090ff-f75b-40cf-99f8-9127769aabcc","resolution":{"observed_at":"2026-08-15T18:15:09.472870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.477428Z","title":"Rethinking experience replay: A bag of tricks for continual learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.477428Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:cb70106581eb4cba5b3896b77a75502fe203a2917509c10984eb80333b07f327","observation_id":"f5fbe32d-2a52-4a7c-9d0f-004fee45fbc9","resolution":{"observed_at":"2026-08-15T18:15:09.477428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.481825Z","title":"Pseudo-rehearsal: Achiev- ing deep reinforcement learning without catastrophic forgetting,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.481825Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:33aa41a6d75fa2b91e4c819a58749e4faa5cbec7d345de0eee2ddb72b2bac97c","observation_id":"3b1d59b7-32b1-4fc2-b562-37ba46efb148","resolution":{"observed_at":"2026-08-15T18:15:09.481825Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1073/pnas.1611835114eprint:https://www.pnas","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.267287Z","title":"Overcoming catastrophic forgetting in neural networks,","venue":null,"work_id":"ce3ba446-fcf5-4995-af85-3bb9acce9018","year":2017},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.487207Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:aba9bbee184406420ec90f2192f1c70bc8997701cd14fd705ee99795cb28eff9","observation_id":"ca150651-98ba-4b1a-a869-97bea324f438","resolution":{"observed_at":"2026-08-15T18:15:10.273045Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.492124Z","title":"Order-book modelling and market making strategies,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.492124Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:51ddbb6e93c3dbe0fc4f2cf3ec929cd48ffad8d0e52a7603dc284271c1a8c48d","observation_id":"dc37747a-f2b2-45b6-b2c3-53373ee9b691","resolution":{"observed_at":"2026-08-15T18:15:09.492124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0167-2789(96)00139-x","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.250523Z","title":"Stationarity and nonstationarity in time series analysis,","venue":null,"work_id":"c22d84c7-c34d-4e72-8f56-146e51e50711","year":1996},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.502498Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:4d46cfcc947fbd5c17b614969848c3e5ed400c56d0f5d8cc9c5aaef9df0a1abd","observation_id":"48e7389f-e43e-41fa-b703-449ecab5b0ee","resolution":{"observed_at":"2026-08-15T18:15:10.255925Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.irfa.2008","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.234472Z","title":"Nonstationarity of efficient finance markets: Fx market evolution from stability to instability,","venue":null,"work_id":"7a8ccc1b-d3c6-4dfc-9150-6e287d7600e1","year":2008},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.507316Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:ebf3660f1c6d995b041c5dc09df40058a06849f9b207fd40e587e10d42d93796","observation_id":"70166280-959e-4ae3-b02f-2d059d099e9c","resolution":{"observed_at":"2026-08-15T18:15:10.239465Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.511744Z","title":"Non stationarity and market structure dynamics in financial time series,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.511744Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:c6bfecffde0888805858a53029a8b42e8944ae66f4259aa8f49ad84dbfede199","observation_id":"7bf986d1-23c3-4e1f-966a-177f6ed0ed3a","resolution":{"observed_at":"2026-08-15T18:15:09.511744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.517223Z","title":"Non-stationarity in finan- cial time series: Generic features and tail behavior,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.517223Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:4aec3485f7290ef01be93fb967c3c44f57fdd284c283d38b23dc7e9eeabe2fc6","observation_id":"86c3c4d0-f4d8-41fc-9801-0dae1a0b7ab6","resolution":{"observed_at":"2026-08-15T18:15:09.517223Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s1058-3300(02","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.203366Z","title":"After-hours trading of nyse stocks on the regional stock exchanges,","venue":null,"work_id":"c65c3433-34b4-420a-829a-6c5fcbcce714","year":2002},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.522728Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:9885f9552d6ac9ea7014ebce129f9c7f1d55088aad140856d78ba5a896c7e40c","observation_id":"f415f9e6-0214-44ce-a4ba-f6313e5d2f65","resolution":{"observed_at":"2026-08-15T18:15:10.210906Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.527700Z","title":"Information sources, news, and rumors in fi- nancial markets: Insights into the foreign exchange market,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.527700Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:26113075cf1ffb7358ba2321d19ada270947523087d2f6cb04fddc74e0257222","observation_id":"7c3047b8-74ba-4945-b2e0-444af853fabc","resolution":{"observed_at":"2026-08-15T18:15:09.527700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/0093650217705528","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.182512Z","title":"Intraday news trading: The recipro- cal relationships between the stock market and economic news,","venue":null,"work_id":"91250d30-642b-41fa-9364-61f2a9467776","year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.531697Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:195686b8094768d29b34f9d3a4359512460f7bc475cf7d4bfb12048af518f7ca","observation_id":"5235c7f0-3525-4764-9552-3f5bc9a4d803","resolution":{"observed_at":"2026-08-15T18:15:10.190307Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.535756Z","title":"High-frequency trading in a limit order book,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.535756Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:8186043add03f7f16d90be9a83b400215458878495b8d7b00d2c1248d9c93c72","observation_id":"389fe434-c96f-45ee-96e7-44e091ae7081","resolution":{"observed_at":"2026-08-15T18:15:09.535756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.540208Z","title":"Optimal dealer pricing under transactions and return un- certainty,","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.540208Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:d8df7d5eaab9b4150da7ae18a3f4048e3a3822a0790dc380b7cd4db6563b1d42","observation_id":"86a8e6b8-7a60-40fc-8b81-d18647d62e65","resolution":{"observed_at":"2026-08-15T18:15:09.540208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.545326Z","title":"Dealing with the inventory risk. a solution to the market making problem,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.545326Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:0752ea6bf7a760a99093f443cb179986bcf367ed5d0bdcf6465322643cc6a604","observation_id":"fa8f26a6-4c30-4073-99e5-ccddc603b21e","resolution":{"observed_at":"2026-08-15T18:15:09.545326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2017.13425","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:11.831637Z","title":"Optimal market making,","venue":null,"work_id":"04a869d1-ea77-4d4c-946a-f74ec5102f83","year":2017},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.550151Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:c7e4275dfffe7278a524e2813839ef693dd084112fc4748ae86e90cc7c2e2150","observation_id":"627f14e2-b2b4-4e57-bdf1-6b62bced61d1","resolution":{"observed_at":"2026-08-15T18:15:11.839575Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.2908438","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.121427Z","title":"High frequency market making: Implications for liquidity,","venue":null,"work_id":"42e02ba6-b3bf-4b34-b390-2c0fd8593676","year":2017},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.554654Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:6b578721809071afcb6cf94b41ec7b6d6dc4a1cbeae0c6b8573a8deef8ce6c37","observation_id":"e5e371d0-40b9-4d6d-93a9-d8c2e5ca02d3","resolution":{"observed_at":"2026-08-15T18:15:10.126904Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11704-014-3312-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-20T11:03:42.707129Z","title":"An intelligent market making strategy in algorithmic trading,","venue":"Frontiers of Computer Science","work_id":"b8cf1d24-b1d6-47dd-ba13-6e757d6a9009","year":2014},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.559041Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:cfd4f6061a4bfd5e2fd6bbe12b447b13af9b712ebf3798c5b2f943c64545ecc4","observation_id":"fc98368b-f5c0-4d51-bd0c-111bf83cacf1","resolution":{"observed_at":"2026-08-15T18:15:10.102840Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.2868473","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.065640Z","title":"High frequency market making with machine learning,","venue":null,"work_id":"bf0c2c94-d763-48c1-a04f-5e61ca718bdc","year":2017},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.563623Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:05f7f01e09b3be03443ff0ee1ee4711d58efc0b60fcdaaecaa9530636dfb2601","observation_id":"80084dfa-9c5e-4513-b24c-2cf016ae74cb","resolution":{"observed_at":"2026-08-15T18:15:10.071994Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.567892Z","title":"An electronic market-maker,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.567892Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:141e360ef8bb9de89a29eaab20247f75ec4886d66cd9461b92b7fbda6177f648","observation_id":"1efbafcf-0c38-476a-a5b1-8bdfcd6827a7","resolution":{"observed_at":"2026-08-15T18:15:09.567892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.10252","last_updated":"2018-12-26T07:29:10Z","snapshot_observed_at":"2026-08-14T17:38:24.732671Z","submitted_at":"2018-12-26T07:29:10Z","title":"Optimizing Market Making using Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1812.10252","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.10252","snapshot_observed_at":"2026-08-15T18:15:11.756920Z","title":"Optimizing Market Making using Multi-Agent Reinforcement Learning","venue":"q-fin.TR","work_id":"1313f78f-3ad3-4d05-bd60-8e3f2b325497","year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.572350Z"},"links":{"cited_paper":"/paper/1812.10252","citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:2cd5f1fa7ad729338398006d65888e76c192804a978d5232cf3a0e8feda718ac","observation_id":"beb36cc0-953a-4bf5-8ac3-7cc381636950","resolution":{"observed_at":"2026-08-15T18:15:11.762694Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.04216","last_updated":"2018-04-11T20:46:33Z","snapshot_observed_at":"2026-08-14T19:26:52.725899Z","submitted_at":"2018-04-11T20:46:33Z","title":"Market Making via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.04216","snapshot_observed_at":"2026-08-15T18:15:09.578047Z","title":"Market making via rein- forcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.578047Z"},"links":{"cited_paper":"/paper/1804.04216","citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:9e7fbf7930267194e85966055e5c35adb2257706326e4843cab91a1929f1e0f1","observation_id":"a70eaf0c-367f-4c24-b9db-38a8497a28f3","resolution":{"observed_at":"2026-08-15T18:15:09.578047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2991/fred-19.2020.52","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.047148Z","title":"Reinforcement learning ap- proach for market-maker problem solution,","venue":null,"work_id":"77363765-6b99-42c2-a5ec-0843e0729efd","year":2019},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.583072Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:f0d5712931a46b502fef39006940e44f0493c369a6ad918f15064af09410e28d","observation_id":"8bdddf0e-6f22-459d-9fc2-caa936dfbda7","resolution":{"observed_at":"2026-08-15T18:15:10.052380Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2011.61600","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:11.719881Z","title":"The agent-based simulation of inventory-based model’s impact on market maker trading mechanism,","venue":null,"work_id":"850d073b-b507-45fa-9e30-e463d75d632a","year":2011},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.587604Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:c464aff073ac873e1fb44c332dcd4314afa9723f2d7aa48eb99cf3c44ac077bc","observation_id":"585288c0-8d31-4fce-bb02-537abf3168ed","resolution":{"observed_at":"2026-08-15T18:15:11.727187Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12066","last_updated":"2019-04-26T22:41:03Z","snapshot_observed_at":"2026-08-14T16:40:43.929615Z","submitted_at":"2019-04-26T22:41:03Z","title":"ABIDES: Towards High-Fidelity Market Simulation for AI Research","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12066","snapshot_observed_at":"2026-08-15T18:15:09.597659Z","title":"Abides: Towards high-fidelity market simulation for ai research,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.597659Z"},"links":{"cited_paper":"/paper/1904.12066","citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:ab189e575d4a7f5919113b60d2d69f29cc750642a62c551a2e6162fc97c215f0","observation_id":"071f379c-0b49-4b11-9645-54fbb510601f","resolution":{"observed_at":"2026-08-15T18:15:09.597659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2020/615","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.029557Z","title":"Data-driven market-making via model- free learning,","venue":null,"work_id":"58abc288-c6eb-47fc-93a8-5fcc8423eeeb","year":2020},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.603083Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:a07acd9c8c2a81d5c5c82ce45a4cc5bfb22bbba5a8547a4084bec33018bb68c6","observation_id":"e13b4b0d-78a0-4d55-9c5b-382232d173d8","resolution":{"observed_at":"2026-08-15T18:15:10.036050Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.3829984","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:10.009775Z","title":"Optimal market making by reinforcement learning,","venue":null,"work_id":"8892a209-756e-4978-b880-1cc05e54e6ae","year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.608782Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:37d92f631db5ae55aa5b3b6b632428b8365302aa3e5e3e8da3ee3340741858df","observation_id":"734006d5-70c0-4ea4-8822-ab8257941d2d","resolution":{"observed_at":"2026-08-15T18:15:10.015990Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.30747","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:11.606188Z","title":"Market making with signals through deep re- inforcement learning,","venue":null,"work_id":"73e87ba3-5794-4543-94ba-97bb3ae8119f","year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.614658Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:0fdb95b8c135cd700a219fce8e1b76c6f13105ed2e7ac333cb69e60bb1a39183","observation_id":"a86915ab-3554-4cb9-b5ea-e6869393fa42","resolution":{"observed_at":"2026-08-15T18:15:11.613535Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.619230Z","title":"Lim and D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.619230Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:9c2fa91848c4b74cca8d138cbaee9affb5172eb4264a5ce073f2ff64ccc5c840","observation_id":"19fa530b-2579-4272-b6b9-f1bbf09a1400","resolution":{"observed_at":"2026-08-15T18:15:09.619230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.623419Z","title":"Reinforcement learning for optimal market making with the presence of rebate,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.623419Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:98a4edff937296ca808bd5da5b8579bccc4c0350e204a2fd2ff35a1b5a9e0801","observation_id":"c12f1904-2928-4739-b59f-07d62b9472c9","resolution":{"observed_at":"2026-08-15T18:15:09.623419Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.627565Z","title":"Applications of reinforcement learning in automated market-making,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.627565Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:1fe6727f7538e0e783792c83a74b071564492f0d391eedaed04a111013663847","observation_id":"9289dc20-2dde-499b-af61-c38f0823227f","resolution":{"observed_at":"2026-08-15T18:15:09.627565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.631786Z","title":"Sim-to-real trans- fer of robotic control with dynamics randomization,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.631786Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:f4374080b422aab58f32fcc625f67978efdf576f82f70cc8cb54a00d66043e60","observation_id":"6a94f0c0-58f6-4160-84cf-a0215c01dc00","resolution":{"observed_at":"2026-08-15T18:15:09.631786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.636274Z","title":"Sim2real in robotics and automation: Applications and chal- lenges,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.636274Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:e92184b6ea7f7af87f4f37bc0211d792719f221f39afd1eaea68724e663dd8ff","observation_id":"9fce7b54-0de8-4672-9784-018e95ba71f0","resolution":{"observed_at":"2026-08-15T18:15:09.636274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.640928Z","title":"Abides- gym: Gym environments for multi-agent discrete event simulation and application to financial markets,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.640928Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:a6b51db2796b72a87b86243e656d6b75144685997d9850ebe30754b608dd33b2","observation_id":"6c1190c3-c5fb-4985-987b-58d5e0dc5c9b","resolution":{"observed_at":"2026-08-15T18:15:09.640928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.650481Z","title":"Improving generalization in reinforcement learning–based trading by using a generative adversarial market model,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.650481Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:4710c2926418f947f4a4480edc4037a2ab8d9b7db8f1fcdd249532c05a2e52e0","observation_id":"c448b84f-4f3d-4bfd-8d23-d2adf860d588","resolution":{"observed_at":"2026-08-15T18:15:09.650481Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.19677","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:11.240599Z","title":"Deep learning for market by order data,","venue":null,"work_id":"1a9000f2-f5c3-49cb-9043-53b960654d02","year":2021},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.655461Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:add84192d3a1a003a7213fec735cb3b4bfd23628d7f60bd6a0a73134184321cd","observation_id":"f3541021-2ae4-43c3-9d4e-3ed0c33ead3b","resolution":{"observed_at":"2026-08-15T18:15:11.249909Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.05892","last_updated":"2019-11-14T01:55:31Z","snapshot_observed_at":"2026-07-06T08:36:54.434076Z","submitted_at":"2019-11-14T01:55:31Z","title":"Reinforcement Learning for Market Making in a Multi-agent Dealer Market","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.05892","snapshot_observed_at":"2026-08-15T18:15:09.660057Z","title":"Re- inforcement learning for market making in a multi-agent dealer market,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.660057Z"},"links":{"cited_paper":"/paper/1911.05892","citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:d3ab54ebac4c0ea778d5de7ef90b96a8cff7fb875c1b6b5944b8789401832835","observation_id":"04e544b4-9b43-49c9-b0e6-1d4aaef47a47","resolution":{"observed_at":"2026-08-15T18:15:09.660057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.665340Z","title":"Empirical eval- uation methods for multiobjective reinforcement learning algorithms,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.665340Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:bca03351d18194b74e2fd82d84dfa0f47d9c7227b1415272eb035ba813ed3b51","observation_id":"03a1978e-2d7b-469d-96bc-5a672ccbc8d7","resolution":{"observed_at":"2026-08-15T18:15:09.665340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10489-023-04647-9","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-19T11:03:45.297681Z","title":"Automated market maker inventory management with deep reinforcement learning,","venue":"Applied Intelligence","work_id":"3db15127-23bf-42b9-b79a-a7cc1859caa7","year":2023},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.669769Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:6374b746492af4f3702a2ca163dd40a37135a5a5ece1171c5bef1eca62de6707","observation_id":"80b146c7-4583-4de6-aa87-51c4c1719541","resolution":{"observed_at":"2026-08-15T18:15:09.984421Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.674510Z","title":"Cournapeau,Scikit-learn (machine learning in python), https://scikit-learn.org/stable/, 2007","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.674510Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:533ab9812755f4d843faa71b6a4626455b6ad8775a6000f315ec74139341064d","observation_id":"cb43efb6-243d-458e-a52b-a97e43eff1ea","resolution":{"observed_at":"2026-08-15T18:15:09.674510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.679110Z","title":"Lundberg,Shap (shapley additive explanations), https://shap.readthedocs.io/en/latest/index.html, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.679110Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:8d9d47a4b3d020ff7dae4d09206d55aeeece897b2213509beeef3b21ec20d8b2","observation_id":"c95b994e-8e68-4009-8ad6-e473f3d4c5a9","resolution":{"observed_at":"2026-08-15T18:15:09.679110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.684468Z","title":"Movemo: A structured approach for engineering reward functions,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.684468Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:065100263e30025eb24a0f733d2a1ad26c62032f5e28f76d3933f7176770c332","observation_id":"5a963d4a-a216-467b-a9eb-1514f9ebde54","resolution":{"observed_at":"2026-08-15T18:15:09.684468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.688991Z","title":"Deep reward shaping from demonstrations,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.688991Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:9fc9bedff0a3476a89c3eb239ba00daa41281cea8d24c56fc8b90b5840002fcc","observation_id":"9ad185ce-fb7b-40e1-8198-42c20a0cf5a8","resolution":{"observed_at":"2026-08-15T18:15:09.688991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.693606Z","title":"A survey of inverse reinforcement learn- ing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.693606Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:553ebf5d43071b4863c8c864f0efa94289ff246c9990f68e86a6dd1c4f0c1b5f","observation_id":"d6881bd9-3aed-4ec6-a167-0ea7dc313d6a","resolution":{"observed_at":"2026-08-15T18:15:09.693606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00521-021-06259-1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-18T11:03:46.223893Z","title":"Pol- icy invariant explicit shaping: An efficient alternative to reward shaping,","venue":"Neural Computing and Applications","work_id":"3fe6c4ed-1309-4dd5-998f-7af1687a78ff","year":2022},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.697950Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:84567cbd862e891df4f304113d3fe3e65a5a77eade66259a8c14d1801a490328","observation_id":"990a73c2-2abe-4a97-9974-c1add50d2a26","resolution":{"observed_at":"2026-08-15T18:15:09.968958Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.703424Z","title":"Trend-following trading strategies in commodity futures: A re-examination,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.703424Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:22649f6a63d9c14ab21aae5e1e10908184154de3f9ce776f9c38493e3c9256b2","observation_id":"28d341a4-1ab7-4552-b7ee-028848416971","resolution":{"observed_at":"2026-08-15T18:15:09.703424Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.707561Z","title":"Momentum and trend follow- ing trading strategies for currencies revisited-combining academia and industry,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.707561Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:ec60ad2f59720c5822d0296c29c1f4384a0b6ca21460141d1158f178d5f0fb9c","observation_id":"6153a553-e0d0-4fa8-b3f5-422fa5cff6b5","resolution":{"observed_at":"2026-08-15T18:15:09.707561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/ncm.2009.402","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.937626Z","title":"The application of trend following strategies in stock market trading,","venue":null,"work_id":"d933a7b1-e4c2-460c-8f04-a57124520f8a","year":2009},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.713618Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:9eebb19f5146d4837169b4c5a239bbf0f365cc111178797cb067d12f8d63919c","observation_id":"edc507a4-bcf6-4fe1-bf86-86b4233f3e6a","resolution":{"observed_at":"2026-08-15T18:15:09.942409Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-540-89378-3","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-17T11:03:46.409680Z","title":"On the limitations of scalar- isation for multi-objective reinforcement learning of pareto fronts,","venue":"Lecture notes in computer science","work_id":"d33eaf11-e9a5-4a9c-8166-33e18bf7e78f","year":2008},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.718465Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:9f84851f3a432cd6cfa229fbfafbb8fa9cd39906f4b35f5e64100f7a69932b48","observation_id":"9015fa83-71a7-4a35-98af-f2a5a535aad6","resolution":{"observed_at":"2026-08-15T18:15:09.926255Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.722950Z","title":"Performance metrics in multi-objective optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.722950Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:ff0fd48b09f65557cb12f0d188118de34661b07f928f0614a75b754c3e613cbe","observation_id":"bc95e0b4-d972-4070-bc75-7c8c088ad911","resolution":{"observed_at":"2026-08-15T18:15:09.722950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1142/s0219622019500093","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.904393Z","title":"Directed exploration in black-box optimization for multi-objective reinforcement learning,","venue":null,"work_id":"647437a4-90b7-45a7-bc87-c86dc0b3f7df","year":2019},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.727599Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:0db9f13b0a9914cb33a1c2f45b0599f962c893c8ae3addad3770e83c70a56a34","observation_id":"b40bacdd-69c2-47a6-bae0-c91a8361c722","resolution":{"observed_at":"2026-08-15T18:15:09.908731Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:15:09.732151Z","title":"A new model for the multi-objective mul- tiple allocation hub network design and routing problem,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-15T18:15:09.732151Z"},"links":{"citing_paper":"/paper/2507.18680"},"observation_digest":"sha256:30300c87a8d35e53c65907c9bf412f6d491efa3006f330b872d271b353f5080d","observation_id":"6c61bdb1-5c32-4722-8de2-8757f960a70b","resolution":{"observed_at":"2026-08-15T18:15:09.732151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18680","last_updated":"2025-07-24T16:17:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T01:05:14.276008Z","submitted_at":"2025-07-24T16:17:49Z","title":"Market Making Strategies with Reinforcement Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":9,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":60,"verified_exact":25,"verified_fuzzy":0},"total_outbound_references":117},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 100 of 117 outbound references and 0 inbound Pith citation observations for arXiv:2507.18680."}