{"as_of":"2026-08-05T03:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c2b19a240b58adbe970e6754ee90ed13db83f05762dcb77afdb0cd1cbbb413c5","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T06:47:25.303458Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.13604/citation-record","integrity":"/paper/2606.13604/integrity","json":"/paper/2606.13604/citation-record.json","paper":"/paper/2606.13604"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"Transportation Science , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:f77e8a69cff7fd12531e5fc8e883768c41f7a0cc500507eac16b24fa34c5e268","observation_id":"80ec4d6d-b100-4b1f-9407-358bb6ebc729","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"Transportation Research Part C: Emerging Technologies , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:0c02d3f6ba0433e3ae59a35d1ccde087e6a8c573ee74b489a818a55843da45ef","observation_id":"fef0caa4-91e0-4b20-8fdc-4ecd773e1a64","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"Tsinghua Science and Technology , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:feb3dd5a7c4e13459d58edc883f4791acd22cb0e10f0690178e451dd3c9e6a27","observation_id":"c0ce16f8-7da8-4587-a77a-3dc35fe4336e","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"Knowledge-Based Systems , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:becab016f99cb77203042bdde70ae012ea3e13bff281bfd647107e32ea20b2ee","observation_id":"52afc320-7e57-4f50-b07d-f5c239b23a2c","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"Applied Intelligence , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:33b511ae887b66e9fe7c8b0e176d2c2239919e27b2e5cdcca3c5999db1c4de5c","observation_id":"06cbe522-283c-4bed-a28f-cdc8b61bfe0a","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"2018 , howpublished =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:cbbf98f6ac179e711eab830c1fb6e6e80a994a04b03af2bb6e4d92c6ac730737","observation_id":"8a791108-ad90-43fc-8682-dc7738340958","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"2025 , howpublished =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:b60934ce6b4b25c710c41545a84998fd5e2296f1053c6ac5e2f00c9fbd1ce088","observation_id":"d475833b-025e-40be-b479-6ab26adbe51e","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"2018 , howpublished =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:19ad9f575ad30c5ad4badd6c4b54cdcc4e4f9c4ea7f01d6573ae2ecd2725095e","observation_id":"fa681152-311a-44da-94a0-be8294318f53","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"2023 , howpublished =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:e0e1849d00daf4089dbf9c0d29626642a23a4f3fa549c6ee755b2df8ab4b5e33","observation_id":"4340ef0d-04f4-4865-931b-32e517fe4fa4","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"Computers & Industrial Engineering , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:904430b0d1d751af2a3300c66d5db361bf1d557ebc118713d3102a0dcda99923","observation_id":"2ac6560a-24fc-4678-bb07-0da1812b0bc2","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"Proceedings of the IEEE Real-Time Systems Symposium (RTSS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:757cb5fcd7b7f385d21fa464ca6dc7dff7414111002e42be8b26e5c7ff70fb5f","observation_id":"da71e8f0-a5ae-462f-9187-de091106f66a","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"International Journal of Transportation Science and Technology , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:6d4422adca169074209c8f2c4b57acbd508e6bd6e0fed3401be661808fa0a260","observation_id":"2a1135c2-4b96-420d-9816-7e47266f619b","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:1ced68394909a99263a96e80934acd85267161e455966cb613eac255de3d0779","observation_id":"ba7af13e-0640-4138-bdc7-60d9bbe2a4bb","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"Rusu and Joel Veness and Marc G","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:576e436b62492f6ba0d3d850aa98f919b5bbae585348ca01217a2f897614bd26","observation_id":"399fb3a0-b32b-49f6-afbf-0ce4f9d02232","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:09b8192b26547d1e09c32db309e1f420bd10c789e47a28bf1e9fdcf6d1aa3aab","observation_id":"4aa6abea-9b0d-449a-8b2c-178deb715917","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:70fe8d76667d51d172e0cde8284ef8a7e5ce9ffb7d20ef0e30735ec17981f887","observation_id":"5940305a-51e1-4196-bc84-3c431b88c617","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:b2037024846b004c4c64535f37bf4d3ed37d1c361b5ddbae1ee4ebff1357f9b5","observation_id":"5236fc81-7c0d-4890-98d7-fdabc2e3d45d","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T06:47:25.303458Z","title":"Management Science , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-27T06:47:25.303458Z"},"links":{"citing_paper":"/paper/2606.13604"},"observation_digest":"sha256:26f3049ca5c23d03ece824fe904cd110ebf8842cddd1e63fb5a954fe1f9613a6","observation_id":"00302eb0-6d06-4991-b5d5-99a11fbec8a1","resolution":{"observed_at":"2026-06-27T06:47:25.303458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.13604","last_updated":"2026-06-11T17:21:20Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-01T09:32:15.654934Z","submitted_at":"2026-06-11T17:21:20Z","title":"Multi-Agent Reinforcement Learning from Delayed Marketplace Feedback for Objective-Weight Adaptation in Three-Sided Dispatch"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2606.13604."}