{"as_of":"2026-08-11T13:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d3831d4ecd434f02143cb336902032dceba7e81f3440d1a5fcf4ee3dd97772a2","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T18:54:19.227490Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.10938/citation-record","integrity":"/paper/2501.10938/integrity","json":"/paper/2501.10938/citation-record.json","paper":"/paper/2501.10938"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:20.089109Z","title":"A reinforcement learning method for human-robot collaboration in assembly tasks,","venue":null,"work_id":"99a37659-5a0f-47a8-bb59-f22783f62251","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:18.975964Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:30bb6feb3f1117ae5f1ef102907cbb42be02ca258e0d55c08d560fa293dcca2c","observation_id":"1b36eabe-b713-473a-b152-9f742ef26701","resolution":{"observed_at":"2026-08-10T18:54:20.094013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:20.073000Z","title":"IoT sensor selection for target localization: A reinforcement learning based approach,","venue":null,"work_id":"e61a5be3-7823-4e9c-a048-dac622f16e63","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:18.981313Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:999f3b66ee5a8f72d4ca06b9769fc945e88a10a5217a9eebdb1f269aa667f20b","observation_id":"04fed452-9fe5-4dad-94f0-a0f2c4ca2c5e","resolution":{"observed_at":"2026-08-10T18:54:20.078359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:20.057302Z","title":"Self- supervised online and light-weight anomaly and event detection for iot devices,","venue":null,"work_id":"827df8bc-cfc0-4f01-88de-99993c9afc29","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:18.986492Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:125d735c30349be11c9877a8f879796ec4fca2e5c056342e158ef8855f7f8274","observation_id":"f8d50044-7601-4622-aa79-c0bc0c864ca1","resolution":{"observed_at":"2026-08-10T18:54:20.062564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:18.991666Z","title":"Mastering the game of go without human knowledge,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:18.991666Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:297b5df7a453a326a588fdc6c880a91a7e97670d6038be2b1fabe942e5e74253","observation_id":"e1761ab0-e548-4a9a-a317-ffc6a7f8f1c5","resolution":{"observed_at":"2026-08-10T18:54:18.991666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-10T18:54:18.997231Z","title":"Dota 2 with large scale deep reinforcement learning,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:18.997231Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:6eb7837cd2562bb65238e533f256b9d2d6265aafdce1070907413b8b411c81c1","observation_id":"713fb8e3-3f70-4bf2-b1b8-f6436955e3a9","resolution":{"observed_at":"2026-08-10T18:54:18.997231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.002789Z","title":"Multi-agent deep reinforcement learning to manage connected autonomous vehicles at tomorrow’s inter- sections,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.002789Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:0b7e7b1c6353f5a6b9b4af4297bd1c498903146603ff36da0c461f8f55af2c1f","observation_id":"4f40ba40-dca8-41b5-a0ac-01049c1bd02a","resolution":{"observed_at":"2026-08-10T18:54:19.002789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.008107Z","title":"Target lo- calization using multi-agent deep reinforcement learning with proximal policy optimization,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.008107Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:e1108cdf8170beda166d147a0256eed082d0010cdb09f0c35416af224b4582c5","observation_id":"9f1b34a7-47c5-42e7-9aaa-47c1c1496ed4","resolution":{"observed_at":"2026-08-10T18:54:19.008107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:20.011067Z","title":"Fault- tolerant federated reinforcement learning with theoretical guarantee,","venue":null,"work_id":"afd458f1-1d62-4ab5-b2a2-e5fe9d5f82b6","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.012763Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:3557eb329fba6d1c2c804eaea11c071cd13add57d0dfdafada19dc3a4269c594","observation_id":"b9929436-c00a-4b71-9e0e-eebf61745336","resolution":{"observed_at":"2026-08-10T18:54:20.016473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.994179Z","title":"Resource allocation in iot edge computing via concurrent federated reinforcement learning,","venue":null,"work_id":"17f53a3e-530d-46de-9813-dce4cc649405","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.017471Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:39077c4eec191ff0c269869707069cf584a5a0ff36617205dbd40a3e2409c838","observation_id":"bee9843b-de19-4629-bfa3-14220e450d86","resolution":{"observed_at":"2026-08-10T18:54:19.999842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.976992Z","title":"Federated reinforcement learn- ing for fast personalization,","venue":null,"work_id":"933276fc-3787-43dc-9741-21034442ee59","year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.022139Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:76b3a2ad492f27572737934de29f7add22e96555b1a5c933fc254afb25aedeaa","observation_id":"1c3d613e-ffa2-4084-b849-03d26e0fd8bb","resolution":{"observed_at":"2026-08-10T18:54:19.982037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.960710Z","title":"Deep reinforcement learning for multiagent systems: A review of challenges, solutions, and applications,","venue":null,"work_id":"198fd052-4842-490d-a1cf-e90ff2ff0441","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.027684Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:2d5eadffd8e51c53c29a051b82bdaa3dbd9245acaf0bb8c6b153c924055ea7a0","observation_id":"5f636dd2-1368-46e4-8a63-a2302e8f6942","resolution":{"observed_at":"2026-08-10T18:54:19.965846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.943700Z","title":"Learning to utilize shaping rewards: A new approach of reward shaping,","venue":null,"work_id":"3a34a5ce-832a-4a30-a03a-d27f71e65b10","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.032289Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:9b8bac0ed3e8c13a2bf36f619c2ee1962c27a225667a6af9f3121df7345e15e6","observation_id":"9f09f157-6264-44c4-b2c0-d4272e4a8f12","resolution":{"observed_at":"2026-08-10T18:54:19.948821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.927138Z","title":"Graph convolutional recurrent networks for reward shaping in reinforcement learning,","venue":null,"work_id":"0e530ecd-6612-4ac5-ad87-a2eec894083f","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.037706Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:0f2ab88c24ca67bf3235e516646f4f3fc847a3d20b1893bae9c20d60c6c98d2e","observation_id":"abcf40a3-55e0-45a8-ae1d-8d96b4a48e39","resolution":{"observed_at":"2026-08-10T18:54:19.932315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16956","last_updated":"2022-10-30T21:28:22Z","snapshot_observed_at":"2026-08-10T12:58:13.282641Z","submitted_at":"2022-10-30T21:28:22Z","title":"Reward Shaping Using Convolutional Neural Network","version":1},"cited_work":{"arxiv_id":"2210.16956","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.16956","snapshot_observed_at":"2026-08-10T18:54:19.333581Z","title":"Reward Shaping Using Convolutional Neural Network","venue":"cs.AI","work_id":"932aef08-9d62-4203-ba1f-d09524b704b5","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.042501Z"},"links":{"cited_paper":"/paper/2210.16956","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:73d9d79fa813353455d6164f1bb408bd6acb9984080e6d6e5bc110357a68ab26","observation_id":"0dacecef-2c40-46aa-9e6f-94008007921d","resolution":{"observed_at":"2026-08-10T18:54:19.341068Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.909910Z","title":"Federated learning for internet of things: A comprehensive survey,","venue":null,"work_id":"6d9939b8-5e80-4852-8d86-bce4e04d3a52","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.047831Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:e3cd25a7d6d92397af72ba9cd9f0f834c5e8a927b1a0e955baba38251dabb390","observation_id":"87332c17-9d06-4394-ac23-fdb50d036692","resolution":{"observed_at":"2026-08-10T18:54:19.915409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.053345Z","title":"Knowledge distillation: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.053345Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:d9668dcd6594cc5cb75caf2e9599703a93701c4e79834c3e8082e5b9fcbc49fb","observation_id":"6cee09f1-8dd1-4a7b-afc3-80657def30f2","resolution":{"observed_at":"2026-08-10T18:54:19.053345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.11887","last_updated":"2021-10-24T19:02:03Z","snapshot_observed_at":"2026-07-06T11:41:48.795143Z","submitted_at":"2021-08-26T16:22:49Z","title":"Federated Reinforcement Learning: Techniques, Applications, and Open Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.11887","snapshot_observed_at":"2026-08-10T18:54:19.058241Z","title":"Federated reinforcement learning: Techniques, applications, and open challenges,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.058241Z"},"links":{"cited_paper":"/paper/2108.11887","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:ace86c6697dbe8db3875c798a2be80670ce3b955c554a5c9ed229e5dc449b381","observation_id":"2e3eef1e-6bd8-49b4-add6-b890f1b7c7b4","resolution":{"observed_at":"2026-08-10T18:54:19.058241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.883921Z","title":"Overcoming exploration in reinforcement learning with demonstrations,","venue":null,"work_id":"b7d4219b-b1b7-4355-83b9-3936c3e3c875","year":2018},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.063277Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:dfb39aba0dd332e2335e87a37994dc61e44918a4317f87b929a3b776952f31d7","observation_id":"2e819415-e1df-4440-ac19-07042cd00a5d","resolution":{"observed_at":"2026-08-10T18:54:19.889012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.08817","last_updated":"2018-10-08T13:38:52Z","snapshot_observed_at":"2026-08-10T07:54:23.821978Z","submitted_at":"2017-07-27T11:16:53Z","title":"Leveraging Demonstrations for Deep Reinforcement Learning on Robotics Problems with Sparse Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.08817","snapshot_observed_at":"2026-08-10T18:54:19.067832Z","title":"Leveraging demonstrations for deep reinforcement learning on robotics problems with sparse rewards,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.067832Z"},"links":{"cited_paper":"/paper/1707.08817","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:5c6c60ccaef5d933fd4551029af7523828b4a07df4c8b7b62324b73fbd27c6e3","observation_id":"49ffafec-7dd3-4c35-9776-5e0d80eaf403","resolution":{"observed_at":"2026-08-10T18:54:19.067832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.072667Z","title":"Federated learning meets blockchain in edge computing: Opportunities and challenges,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.072667Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:df6bab75d5d62b13e0ba08eacc18d3f20cceeb7bd0e0656f014179ebb746bb63","observation_id":"75b54225-ec3d-46e0-9e0f-5d7eeafecbf6","resolution":{"observed_at":"2026-08-10T18:54:19.072667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.856456Z","title":"A context-aware blockchain-based crowdsourcing framework: Open challenges and op- portunities,","venue":null,"work_id":"52b871a0-3757-4127-9d39-431ba153e91d","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.077521Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:8ed8afc674c753ce24e59ad31ba6d14d30ad25e0a518b3a32c1bc4c053144562","observation_id":"64cc76fc-eb81-4d71-9092-47e6931f6960","resolution":{"observed_at":"2026-08-10T18:54:19.861715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.838801Z","title":"Federated multiagent actor– critic learning for age sensitive mobile-edge computing,","venue":null,"work_id":"ad84c4bb-7884-4b66-9e62-75aa7d2c4b86","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.082304Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:14e55b5527552d26755baf0574bd8b747f3ee235965aa85caef24ad311843308","observation_id":"89093bfd-5ab0-4232-b90a-2bb2cdfb7240","resolution":{"observed_at":"2026-08-10T18:54:19.845145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.087158Z","title":"In-edge ai: Intelligentizing mobile edge computing, caching and communication by federated learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.087158Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:1be56b861d39d1b32782a63a821a27cf6b7bb148ee19e6beb16cf9af06417cd3","observation_id":"721ced6c-738d-40fd-a907-d40473d8754c","resolution":{"observed_at":"2026-08-10T18:54:19.087158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.809307Z","title":"When deep rein- forcement learning meets federated learning: Intelligent multitimescale resource management for multiaccess edge computing in 5g ultradense network,","venue":null,"work_id":"317f00fa-3ff7-4f81-820f-e948ba1776e0","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.091648Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:5efffa9e3350da8260c1e44f065fbcf987d046202ee867879da9012cab2ece4d","observation_id":"84603e51-9e1d-451a-883e-0051d11be0f0","resolution":{"observed_at":"2026-08-10T18:54:19.815015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.096204Z","title":"Lifelong federated reinforcement learn- ing: a learning architecture for navigation in cloud robotic systems,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.096204Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:abda6297e9e7489c5d2a8275fcabf7d9b4d6db7c2837f809996748cfa645477a","observation_id":"333c33f0-e8be-4544-a456-6170a51ef34f","resolution":{"observed_at":"2026-08-10T18:54:19.096204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.780204Z","title":"Federated transfer reinforcement learning for autonomous driving,","venue":null,"work_id":"f8bb0848-77f3-4188-8161-76e8e7d68fda","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.100611Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:d64d5f7ddcd8d4a36915beab97ecde2e867f6e662c5f7f36cab00779b36e2c81","observation_id":"01bae6c8-747f-4b10-a295-7b787fe6a43a","resolution":{"observed_at":"2026-08-10T18:54:19.785513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.764472Z","title":"Double Q-learning for radiation source detection,","venue":null,"work_id":"a14faaa4-0ea2-4f71-9071-8493948be16c","year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.105106Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:29cdb651645e90fc62d0d7e5bc9e275da0fe8aa41df60c77a66514ee9d7fee38","observation_id":"5f9261eb-37b4-4adc-8709-4997df232c40","resolution":{"observed_at":"2026-08-10T18:54:19.769754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.748158Z","title":"Multi- agent deep reinforcement learning with demonstration cloning for target localization,","venue":null,"work_id":"b430235d-65a7-4f54-916e-a52c7351d309","year":2023},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.109500Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:6432e6ac94d4eac153554d7da8ef7481bfbfa7db902eb9721902037013cb8dea","observation_id":"a57a4cdc-d343-48e2-98e7-ce220606d3e4","resolution":{"observed_at":"2026-08-10T18:54:19.753153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.732120Z","title":"Emergent tool use from multi-agent autocurricula,","venue":null,"work_id":"c8050306-58a7-4e45-b169-b664b82df924","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.114251Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:a6cb3223597757fef5590fa8d1564468956d3f38dd74bb0b8cbaeddf1f6f39c0","observation_id":"106687d1-a1a6-48e3-b236-76bf925afb16","resolution":{"observed_at":"2026-08-10T18:54:19.737171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.715842Z","title":"Principled reward shaping for rein- forcement learning via lyapunov stability theory,","venue":null,"work_id":"b82c34aa-3c10-49b4-9f1d-4bebf0e4d68b","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.119798Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:f69d7703a1383a6170ee19f3cb22e36ea68338cc8dd9eccad6d225a7c8d0d950","observation_id":"ad1434d7-786b-4588-bd38-cc1b79844032","resolution":{"observed_at":"2026-08-10T18:54:19.721438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.699635Z","title":"Primal: Pathfinding via reinforcement and imitation multi- agent learning,","venue":null,"work_id":"f65f253e-0a6a-46da-aab4-166e906b251b","year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.124284Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:52ae2960e85ed25be1affe3a4b5859cfa56ab3b207bf71c456243405f7b139a7","observation_id":"9f12947d-118e-4b60-8314-400a3dccea29","resolution":{"observed_at":"2026-08-10T18:54:19.705047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.683410Z","title":"Primal 2: Pathfind- ing via reinforcement and imitation multi-agent learning-lifelong,","venue":null,"work_id":"b05e594b-d2e2-462f-b15e-804b13770ee7","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.128770Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:cdecc4692172e72294c9cbc1a9781820a9dceadefbdb7928fcb633304669be9c","observation_id":"17214677-742f-45fb-a36b-97c2d5d9b664","resolution":{"observed_at":"2026-08-10T18:54:19.688654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.661566Z","title":"Multi-agent deep reinforcement learning: a survey,","venue":null,"work_id":"ff8485b3-9f1d-40d1-a008-b5f8d5419ec7","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.133139Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:a289c05ac3d026094f3a3a1545517885f48d97991d5359b0ad89aca76b233e23","observation_id":"bf3725d7-bf9a-4a3a-8ed2-a6e2c2a03077","resolution":{"observed_at":"2026-08-10T18:54:19.667066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-10T18:54:19.137689Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.137689Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:d15d298c18f776659387a28f6cd4ece57c3c37b76941fded9bd394fff112bc6e","observation_id":"8fb34b76-d77f-4721-89c3-69fa944ab3c7","resolution":{"observed_at":"2026-08-10T18:54:19.137689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.645037Z","title":"High- dimensional continuous control using generalized advantage estimation,","venue":null,"work_id":"a6d22013-23f6-4f3e-9104-1f44d12f871c","year":2016},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.142508Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:4e99523868354d2f11f764403d138fba40f5cc3d3ab762a31a83ff1f554c3792","observation_id":"6afa10c5-0bca-47bc-abc2-05b9aa6e7d47","resolution":{"observed_at":"2026-08-10T18:54:19.650794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.629390Z","title":"Roulette-wheel selection via stochastic acceptance,","venue":null,"work_id":"156ccc00-ea34-4e62-904d-0f281d4a07a7","year":2012},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.147059Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:99f03f81591c0258796348576795e821906e958139db900cfb1a31f4c242afab","observation_id":"203277c9-6b80-4c61-8689-633d8481f284","resolution":{"observed_at":"2026-08-10T18:54:19.634122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.614208Z","title":"Influence-and interest- based worker recruitment in crowdsourcing using online social net- works,","venue":null,"work_id":"bb3bed79-7131-411e-b70b-10df584ab1bf","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.151682Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:12d752f2639c9be80451ae34447fa76521c98ddd96f61eb9af4e1f666fa074f4","observation_id":"a0e0f091-cc78-46fa-95dc-93724b49187d","resolution":{"observed_at":"2026-08-10T18:54:19.619133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.598769Z","title":"On- chain behavior prediction machine learning model for blockchain-based 14 crowdsourcing,","venue":null,"work_id":"cff89014-9517-4970-8cdd-3994d756167b","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.156708Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:664a83aee85674ebe711dbd1f3b2b00987e437d9b81bf395df02d74909c98dbb","observation_id":"7ef7c5fe-5936-4faa-9999-a6c98522c20c","resolution":{"observed_at":"2026-08-10T18:54:19.603783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1407.3561","last_updated":"2014-07-14T08:31:05Z","snapshot_observed_at":"2026-07-06T03:48:55.296019Z","submitted_at":"2014-07-14T08:31:05Z","title":"IPFS - Content Addressed, Versioned, P2P File System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1407.3561","snapshot_observed_at":"2026-08-10T18:54:19.161376Z","title":"Ipfs-content addressed, versioned, p2p file system,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.161376Z"},"links":{"cited_paper":"/paper/1407.3561","citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:67d5bc0eb2c1f2f5e89af40f20aac71203d8f8df51c3cb4a0b806eb966f9f36f","observation_id":"25a3a1ec-5c9b-4d84-ace9-077da33274b5","resolution":{"observed_at":"2026-08-10T18:54:19.161376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.582794Z","title":"An optimization and auction-based incentive mechanism to maximize social welfare for mobile crowdsourcing,","venue":null,"work_id":"71e329aa-20b2-4f3d-9806-da539fc888d7","year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.166316Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:3723b539fa939f41ceb9bcf87b9556bebd37f5ecb74441b9edb6092c51ee36e4","observation_id":"3dac2287-c7b9-48ba-b0a5-2ae5018f6a58","resolution":{"observed_at":"2026-08-10T18:54:19.587956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.567595Z","title":"A worker-selection incentive mechanism for optimizing platform-centric mobile crowdsourcing sys- tems,","venue":null,"work_id":"73954467-ccbc-4de5-88d0-ce92821db227","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.170880Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:73f471a82d6692265a1842d72bf75a5d7a105d82f5e5f44fcb8f02484f848c18","observation_id":"dcf82a82-0968-4408-89b4-951a9d354ad9","resolution":{"observed_at":"2026-08-10T18:54:19.572389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.551693Z","title":"Auction fever: Rising revenue in second-price auction formats,","venue":null,"work_id":"f483228c-2fbc-4235-8dde-c660007b162b","year":2015},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.175427Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:4dee0bbf6c52e72ae133cd51dc2ab02e6068d4e21e44ead4c026c3e90ca88d5d","observation_id":"8d1aadb1-45c7-4140-85cb-98bc59c70dff","resolution":{"observed_at":"2026-08-10T18:54:19.556907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.536022Z","title":"Path planning and scheduling for a fleet of autonomous vehicles,","venue":null,"work_id":"3b47528f-e89a-4f30-af3d-7a29ac1eeb70","year":2016},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.180100Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:3698898e63ac1832a332956885470b7ff9eea73c235bec28802c99a525fd6ec4","observation_id":"baf3eb19-fa66-4c0e-b766-c0477e1e65e4","resolution":{"observed_at":"2026-08-10T18:54:19.541367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.519852Z","title":"Autonomous vehicle fleet coordination with deep reinforce- ment learning,","venue":null,"work_id":"40023914-8e90-411e-a8bc-3cc52ea8027a","year":2018},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.184827Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:25395c9a6b3c83d01aab68414f32cf248efbf5ab1cfc33ffeb914f436578e11c","observation_id":"d36e07c8-173e-4559-b7e0-245ae5563799","resolution":{"observed_at":"2026-08-10T18:54:19.524954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.503317Z","title":"Multi-agent reinforcement learning with di- rected exploration and selective memory reuse,","venue":null,"work_id":"d12a73d3-454f-4c0f-bf84-ce8baec7a816","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.189811Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:c0c7889bf64c97d388105738300c2869009937418a3e279e521abe90817db4b8","observation_id":"e7411301-cd24-4f55-8dff-89f4059d99f7","resolution":{"observed_at":"2026-08-10T18:54:19.508189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.487162Z","title":"Data-driven dynamic active node selection for event localization in IoT applications-a case study of radiation localization,","venue":null,"work_id":"9c436100-4d62-4293-97ca-82291a2e7d6d","year":2019},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.194537Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:1c2c0c461b841bff8f76597ca66776cba522ba760f37acf5fdccae033aa9fecd","observation_id":"54bc74fb-09dc-4983-ba4b-b025b353f818","resolution":{"observed_at":"2026-08-10T18:54:19.492301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.470843Z","title":"Reinforcement learn- ing framework for uav-based target localization applications,","venue":null,"work_id":"d6161639-51c3-4e47-a685-7517cd9f5106","year":2023},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.199215Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:b73257831c6a4d20a587bb5dbd44afbd3982ca5eb7d4a0d188c2afac45af3256","observation_id":"6169b1ea-8a36-41dc-bac5-1a1d70eb9666","resolution":{"observed_at":"2026-08-10T18:54:19.476036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.453031Z","title":"A predictive target tracking framework for iot using cnn–lstm,","venue":null,"work_id":"db8e281f-3f7c-4d7f-b9b6-76f0b36cfd68","year":2023},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.204055Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:20f53eb30653889cf51e5add9ece064a7eb306a5e2907023463bf4d0f58e7fef","observation_id":"154a7028-4964-4d4e-b027-b3e51978723b","resolution":{"observed_at":"2026-08-10T18:54:19.459449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.435371Z","title":"RFLS-resilient fault- proof localization system in IoT and crowd-based sensing applications,","venue":null,"work_id":"b4e91e5e-66fc-4b46-8b56-9a000384fd44","year":2020},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.208581Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:a62881ebaa80cca5296f1417df97e20577edeb57412628f46bab02ce63ed44d2","observation_id":"fe7d37f9-527a-4b16-acfc-20f125bc31ff","resolution":{"observed_at":"2026-08-10T18:54:19.441035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.419578Z","title":"SDRS: A stable data-based recruitment system in IoT crowdsensing for localiza- tion tasks,","venue":null,"work_id":"dce62b6c-0008-4eed-b93d-6abf8b241696","year":2021},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.213049Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:7f5dd686a14be23844d3dd0263dfa83ed1d75129c0cbcecaf06c64c453fdaaf5","observation_id":"f3954c10-3e49-4e6a-86bb-7c335cbbfb93","resolution":{"observed_at":"2026-08-10T18:54:19.424868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.403643Z","title":"A uav- assisted search and localization strategy in non-line-of-sight scenarios,","venue":null,"work_id":"ef18b856-8677-407b-87da-5cc5026c3c52","year":2022},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.217885Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:0c162121ed52f43632f5fd2408401168657398aec2333e019e915b1e47748709","observation_id":"fafdc694-aa35-45ce-b5d1-81f1ed07bd5e","resolution":{"observed_at":"2026-08-10T18:54:19.408887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.387220Z","title":"A matching game-based crowdsourcing framework for last-mile delivery: Ground-vehicles and unmanned-aerial vehicles,","venue":null,"work_id":"69853156-6220-407b-af65-3abc9f45b037","year":2023},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.222608Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:36d3580bacce5fd0dfa9539b0ba38b8179aac991154c309be4b44bf7ef8a4da6","observation_id":"e3f0d804-a321-4884-a6b0-94382ca5ef84","resolution":{"observed_at":"2026-08-10T18:54:19.392639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:54:19.371170Z","title":"Lenet-5, convolutional neural networks,","venue":null,"work_id":"e8902c34-b6f9-483b-bcdc-222aca312bb3","year":2015},"citing_paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T18:54:19.227490Z"},"links":{"citing_paper":"/paper/2501.10938"},"observation_digest":"sha256:e5a228c9d5e38ff4f1666b0d64aa3a31849a1173af99de7587807687d801f80e","observation_id":"e665bd22-862b-4479-9081-3a6e27cc0ed0","resolution":{"observed_at":"2026-08-10T18:54:19.376243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.10938","last_updated":"2025-01-19T04:20:24Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T18:46:21.107912Z","submitted_at":"2025-01-19T04:20:24Z","title":"Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":40},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2501.10938."}