{"as_of":"2026-08-07T10:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5374e788ee048e7ee447ec730f8d6de48cf5cc3096e38a60a81b1d7fe2b93c61","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T13:26:36.752567Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19117/citation-record","integrity":"/paper/2607.19117/integrity","json":"/paper/2607.19117/citation-record.json","paper":"/paper/2607.19117"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:35.242154Z","title":"Inverted files for text search engines,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:35.242154Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:505594aad29d7c790be56bd97ffb0db24fad131c5305793a5440fc8c3d2da9b5","observation_id":"ba3ef24f-2f12-433b-9d63-8da2d168593c","resolution":{"observed_at":"2026-08-01T13:26:35.242154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:35.289319Z","title":"Optimizing query evaluations using reinforcement learning for web search,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:35.289319Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:2de649b129d5cc87b5dc21b7dc7b2599288bf3e04e516f3698ca4ed7969917e4","observation_id":"2fd1768d-494d-4787-9a8f-3c17145e1b40","resolution":{"observed_at":"2026-08-01T13:26:35.289319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:35.407271Z","title":"Match plan generation in web search with parameterized action reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:35.407271Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:c315148dc2ee1683f005b6f3c21c317402dfe3bb0300cc0aa6ac686d611879d6","observation_id":"739e0249-b598-411d-bb9a-997e9a52b007","resolution":{"observed_at":"2026-08-01T13:26:35.407271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:35.552587Z","title":"Exploration in deep rein- forcement learning: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:35.552587Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:5e19474a84026893732241347c3c20cf9d6f22c757f56623ed240863cdbf4aee","observation_id":"d15371c1-e53e-4cfb-befb-10854a0edc11","resolution":{"observed_at":"2026-08-01T13:26:35.552587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:35.649642Z","title":"Actor-critic reinforcement learning in the songbird,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:35.649642Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:511a9fdfb9a28e0ef400456e62fd22fd48df838bcbf2c805cb37d4b3587e0344","observation_id":"f5dbbf36-a97c-47c7-b704-0a0a76cae701","resolution":{"observed_at":"2026-08-01T13:26:35.649642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:35.726901Z","title":"Asynchronous methods for deep reinforcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:35.726901Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:8aaf308338e29da73f19b4b40caed7c4ba6d512880ce243b20cc461569c37a8e","observation_id":"815a6aa9-9c61-417d-9ae7-99cd464739e5","resolution":{"observed_at":"2026-08-01T13:26:35.726901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:35.785470Z","title":"Averaged soft actor-critic for deep reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:35.785470Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:b2a118fedd5f826aec07090ea89c960e35754666357b676c719599baf7b829b6","observation_id":"6db0b653-7d36-4fb7-a3bf-dedc97b3bd3c","resolution":{"observed_at":"2026-08-01T13:26:35.785470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.09103","last_updated":"2023-02-28T23:14:34Z","snapshot_observed_at":"2026-08-07T01:31:47.689479Z","submitted_at":"2018-10-22T06:35:03Z","title":"Greedy Actor-Critic: A New Conditional Cross-Entropy Method for Policy Improvement","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.09103","snapshot_observed_at":"2026-08-01T13:26:35.867303Z","title":"Greedy actor-critic: A new conditional cross-entropy method for policy improvement,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:35.867303Z"},"links":{"cited_paper":"/paper/1810.09103","citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:b528999d8353efaab3af757704bb4fcb90775641af0bb6ab7623b7a7bbdf3a84","observation_id":"9db87256-d5e8-4940-8048-7a70a96fd17d","resolution":{"observed_at":"2026-08-01T13:26:35.867303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:35.956907Z","title":"Drl trading with cpt actor and truncated quantile critics,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:35.956907Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:2c30a1a91d03174c6fc73fa12424592c8889a18e8515a84e20f23e94c5414ff1","observation_id":"6ec7c875-e4a0-452c-af01-b9f2fd0ce9a8","resolution":{"observed_at":"2026-08-01T13:26:35.956907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:36.037993Z","title":"Multi-pass q-networks for deep reinforcement learning with parameterised action spaces,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:36.037993Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:5fa90aaed431360c0020054889e0450cc67829838fe9ab43c3c94a12d64116d7","observation_id":"2958a923-026f-4edc-93d2-938f129fdaae","resolution":{"observed_at":"2026-08-01T13:26:36.037993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:36.226059Z","title":"Comparative analysis of parameterized action actor-critic reinforcement learning algorithms for web search match plan generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:36.226059Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:581930c6d8fa29993c42c3b00d5ff1467dd9a871e8d28e3fb7aa7dd52e860aa2","observation_id":"ba0cf248-bca5-4da1-a4d4-03ebbb91f226","resolution":{"observed_at":"2026-08-01T13:26:36.226059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1049/rpg2.12782","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Research on load frequency control of multi-microgrids in an isolated system based on the multi-agent soft actor-critic algorithm,","venue":"IET Renewable Power Generation","work_id":"f85146c0-f93b-4e96-ad09-e3c5b58e62f7","year":2024},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:36.312425Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:df5cbc2a5bf1ac3a29344871c42e72120d548a55489f035aa99034d43be78b73","observation_id":"ca4758fa-4407-4740-af0d-992513decf9a","resolution":{"observed_at":"2026-08-01T13:29:33.824953Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:36.432228Z","title":"Multi- agent actor-critic for mixed cooperative-competitive environments,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:36.432228Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:09170e947450c216ed79a45722fcfbfb73d85efeb404988e4ce4d9fdc7c0336b","observation_id":"5a50993d-7dca-4deb-854d-204b4c9e76de","resolution":{"observed_at":"2026-08-01T13:26:36.432228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:36.507535Z","title":"Monotonic value function factorisation for deep multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:36.507535Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:5ac30d06c9999b65226563f7711f375d3da8155cce55d787416b9550832ceb4d","observation_id":"92227f2f-1b88-4ebb-83ce-3f04e8c606c8","resolution":{"observed_at":"2026-08-01T13:26:36.507535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:36.589390Z","title":"The surprising effectiveness of PPO in cooperative multi-agent games,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:36.589390Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:46a986dbc5c14607ad7cc3a6acd3f7b9809ef3c749d72b819187cf432784f423","observation_id":"2a3357aa-ee94-4cd2-9806-335793ab36b8","resolution":{"observed_at":"2026-08-01T13:26:36.589390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T13:26:36.665513Z","title":"Parametrized deep q-networks learning: Reinforcement learning with discrete-continuous hybrid action space,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:36.665513Z"},"links":{"citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:069cd23538c9571a278100035a053d933bfaaba94feb2e09f44a0ed6580040fb","observation_id":"cdf268cf-3561-4a62-ab96-65cd8243703c","resolution":{"observed_at":"2026-08-01T13:26:36.665513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.06394","last_updated":"2018-10-10T07:38:44Z","snapshot_observed_at":"2026-08-01T19:14:30.742141Z","submitted_at":"2018-10-10T07:38:44Z","title":"Parametrized Deep Q-Networks Learning: Reinforcement Learning with Discrete-Continuous Hybrid Action Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.06394","snapshot_observed_at":"2026-08-01T13:26:36.752567Z","title":"Available: https://arxiv.org/abs/1810.06394","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:36.752567Z"},"links":{"cited_paper":"/paper/1810.06394","citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:e9a8d7653ba62188bc4d0592dbdb2fc4be8d0dcbc56aa5429af239f060e3c5ed","observation_id":"55e60834-feb9-4ab3-8ad5-c9ef8fa278cb","resolution":{"observed_at":"2026-08-01T13:26:36.752567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.04388","last_updated":"2019-05-10T21:57:41Z","snapshot_observed_at":"2026-08-06T00:37:59.730492Z","submitted_at":"2019-05-10T21:57:41Z","title":"Multi-Pass Q-Networks for Deep Reinforcement Learning with Parameterised Action Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.04388","snapshot_observed_at":"2026-08-01T13:26:36.138168Z","title":"Available: https://arxiv.org/abs/1905.04388","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-01T13:26:36.138168Z"},"links":{"cited_paper":"/paper/1905.04388","citing_paper":"/paper/2607.19117"},"observation_digest":"sha256:460d585294e75e0b829a8cb4c5185bfe7116c055537b3a68e6e718a3f71bd408","observation_id":"02b15e76-67d1-4ee6-aefe-1e393f3a7f9b","resolution":{"observed_at":"2026-08-01T13:26:36.138168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19117","last_updated":"2026-07-21T14:03:29Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-01T13:26:34.837171Z","submitted_at":"2026-07-21T14:03:29Z","title":"Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2607.19117."}