{"as_of":"2026-08-10T22:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e57b140c1a79e7264c54b8aa3536ae45227db2bdadb8319790e58f97b2175076","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:31:58.425533Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.00870/citation-record","integrity":"/paper/2502.00870/integrity","json":"/paper/2502.00870/citation-record.json","paper":"/paper/2502.00870"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.103241Z","title":null,"venue":null,"work_id":"1e11dff3-cc15-4f1f-ab4a-3b29600c3f4c","year":2016},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.198799Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:3d959a12fa7e723a5fd79fe1ad0d8748eaf7d39a07c67959397953a96c210ff0","observation_id":"b97ce03b-67fe-41d4-9dfb-13b57bac94df","resolution":{"observed_at":"2026-08-09T17:31:59.106951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.092123Z","title":null,"venue":null,"work_id":"12377847-1f77-45f2-be88-398bb2233ce6","year":2001},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.203701Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:b399b93dd18294697230a96585abbdfe8d11bfc589b6912d633880d4510ee1b7","observation_id":"3c292e61-145a-4175-b212-c1cd852f5378","resolution":{"observed_at":"2026-08-09T17:31:59.095841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-09T23:24:21.399948Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-09T17:31:58.207707Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.207707Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:7629c28a4f6a7de22323de2c57b6c5e9fdf19453f231dd9649d90c60da44ac0a","observation_id":"5b196c5d-158e-4335-9baa-a68c056b54f8","resolution":{"observed_at":"2026-08-09T17:31:58.207707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.081079Z","title":null,"venue":null,"work_id":"00dc0eec-d7e2-453d-9b93-90430121383f","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.212231Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:7aa7aa09c8f778eebe37164faaf1ea7ba77d1af3a2cec465cef74e162ab14d29","observation_id":"d1126db9-5bab-4e55-a34e-18eafb005f13","resolution":{"observed_at":"2026-08-09T17:31:59.084621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.069752Z","title":null,"venue":null,"work_id":"100b90b5-d3ad-4b5a-a44f-9ecb39134efa","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.216363Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:3a355fed602952c5905da0e3cf380c14b5afae17617cba1883a1e17d8b41c6b9","observation_id":"f8741767-cb6a-4c14-9214-8b8e54b353cb","resolution":{"observed_at":"2026-08-09T17:31:59.073682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.220259Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.220259Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:df82c107bc0f58e8630dee1ff7350d5fd29e9df60dad1262585415b4d14c9278","observation_id":"dbda2a6c-cc9d-4354-9b88-2b7c4d7b8ce0","resolution":{"observed_at":"2026-08-09T17:31:58.220259Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.058092Z","title":null,"venue":null,"work_id":"ec4ec9ff-ac99-48a7-a209-ae0f22af76cb","year":2017},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.224597Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:5c15ccbbfaa72d8e9f0345c8c845b406bf627182fba70d24a44392456199db69","observation_id":"34a16894-c5da-4f59-a72a-6fb9c490e4b4","resolution":{"observed_at":"2026-08-09T17:31:59.062202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.046810Z","title":null,"venue":null,"work_id":"6dbf1ac7-98b8-4aa2-a78d-57420d8c6cd8","year":2021},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.228374Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:cbb01858c7e9e24a31e07a71b5dc3c62d79630a524b0265bb85f820ebec61ede","observation_id":"ee50c94e-15fc-4d6d-bd31-7a6056efc6f7","resolution":{"observed_at":"2026-08-09T17:31:59.050438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.035406Z","title":null,"venue":null,"work_id":"47d9aab6-532d-4bdc-a120-37e2e4401d1f","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.232290Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:d03d205f8a5a1fd0e595631671532e54a16f2530a23160e3426d18ada34df35d","observation_id":"b3bcea4b-a175-4c08-a27e-1e919fa4970d","resolution":{"observed_at":"2026-08-09T17:31:59.039210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15538","last_updated":"2025-02-08T02:34:08Z","snapshot_observed_at":"2026-08-09T21:34:17.862009Z","submitted_at":"2024-12-20T03:56:31Z","title":"FedRLHF: A Convergence-Guaranteed Federated Framework for Privacy-Preserving and Personalized RLHF","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15538","snapshot_observed_at":"2026-08-09T17:31:58.236005Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.236005Z"},"links":{"cited_paper":"/paper/2412.15538","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:ba2c578ecfc18f1dd5b1c3872665309ba3b3c672474b97711f2f16550c259b3c","observation_id":"41634c53-34ff-4888-8aaa-04d1f54b36d6","resolution":{"observed_at":"2026-08-09T17:31:58.236005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.023910Z","title":null,"venue":null,"work_id":"32ad1203-afad-4d27-b106-fae8e9da6cde","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.240064Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:6c48998daae7988bdd5ff962a92a2ed24d04f3740eab9f3bc2333b9c4bb03bff","observation_id":"bd0b92a4-b859-4b77-968b-f02f0d22de33","resolution":{"observed_at":"2026-08-09T17:31:59.027642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:59.012268Z","title":null,"venue":null,"work_id":"088aaa5f-5ca5-4506-8bb7-25b475f9b9f8","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.244036Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:68eaffef61ced3627c21075fa80da4bc8ef2e5fc8bcb1a98cd61f6918a85a8b6","observation_id":"bdc586ec-283d-464d-9a56-ca44d0454d97","resolution":{"observed_at":"2026-08-09T17:31:59.016436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.247929Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.247929Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:ea0f6696b95e0086ad58bdc5d76512b5f6cd5d56d3cc105ab811ec109cdd703f","observation_id":"5c85e29c-58bf-4dbf-b323-160361033203","resolution":{"observed_at":"2026-08-09T17:31:58.247929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.992560Z","title":null,"venue":null,"work_id":"d7587729-c83e-409d-98b7-b2085323ab55","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.251945Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:55430d59c27c00d666d9c297808e9fc99853b250e1b423ba8fbee5c89325f524","observation_id":"3a9d9b2c-25fd-4df8-8435-93219d405ea3","resolution":{"observed_at":"2026-08-09T17:31:58.996852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.255711Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.255711Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:b51a845f4a74207925c4d3f09fbe268178bb92f6757fda860131620fc7cedf72","observation_id":"e3e7e635-0428-4e4d-8746-e9dd90600dbe","resolution":{"observed_at":"2026-08-09T17:31:58.255711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-09T17:31:58.259556Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.259556Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:a41f55deff87fdb05e4f317e89abf67ff293d67d69e916e074b796f22ee22ab9","observation_id":"61df8393-0644-4ee0-9568-a5f9d9e14c17","resolution":{"observed_at":"2026-08-09T17:31:58.259556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.974194Z","title":null,"venue":null,"work_id":"56a9acd0-4797-4445-ad4a-4a9492f11f49","year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.263504Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:0d5003cf30381ae9708a4cd44c7bd3175fcbb0d7924757da48179a67205065c7","observation_id":"13823ccd-a14b-4244-968b-fd05fa4b85fd","resolution":{"observed_at":"2026-08-09T17:31:58.977841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.962977Z","title":null,"venue":null,"work_id":"c76d57b4-f58b-47f2-afff-fa5da53d56d6","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.267014Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:e7d368c08a9ad20518a30939446c5b0e7aea680c69f4a2a88a8695f250ad1320","observation_id":"4dca1744-71f3-48fc-a042-2a1b211f3ebf","resolution":{"observed_at":"2026-08-09T17:31:58.966881Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.951571Z","title":null,"venue":null,"work_id":"46a1a4bb-0402-4148-8ccb-be48443508df","year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.270730Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:4fe7ba96825f06bd3ccb17ff46c37a23ffb44e6d78981ef0706506a72a518639","observation_id":"fd76266e-a387-47c3-8bbd-2d876ec7c242","resolution":{"observed_at":"2026-08-09T17:31:58.955546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.939847Z","title":null,"venue":null,"work_id":"13ae51f8-6b1c-492f-8084-6fc4b1e8641e","year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.274244Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:21e4a7b5f92fdcdcf9db9327e866d7ae2ec38820ef6ee81fe75b2a8e65c4c34d","observation_id":"9a01fb5a-bed3-4196-ade2-241dba36d7be","resolution":{"observed_at":"2026-08-09T17:31:58.943874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.916975Z","title":null,"venue":null,"work_id":"2a662bdd-b1a5-409e-8556-08cb3d3a405c","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.281802Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:bba4769b7535ccbcdd84bd8716da517fdcc8ee9ec481e946de7d536dc677eaae","observation_id":"60e0a0d9-24fa-46c5-8126-8850bc6f954f","resolution":{"observed_at":"2026-08-09T17:31:58.920768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-09T17:31:58.285592Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.285592Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:73f3166db6f672c0dc871f792bbc5f6f06dc7150547538bfce039c29a5826d9d","observation_id":"00317cb7-3fef-4b8b-bcc2-be5badf2dba8","resolution":{"observed_at":"2026-08-09T17:31:58.285592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03581","last_updated":"2019-10-08T18:00:00Z","snapshot_observed_at":"2026-08-08T12:31:54.297762Z","submitted_at":"2019-10-08T18:00:00Z","title":"FedMD: Heterogenous Federated Learning via Model Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03581","snapshot_observed_at":"2026-08-09T17:31:58.289813Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.289813Z"},"links":{"cited_paper":"/paper/1910.03581","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:faea595770f91be2692b4c0a8fe438c67a1959bf40f2c84ce0590a549f2adcb4","observation_id":"1ab93efb-5daf-4d5e-8994-8bdbe05014a5","resolution":{"observed_at":"2026-08-09T17:31:58.289813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.905004Z","title":null,"venue":null,"work_id":"2b83e34d-0c4a-480f-8572-837c3cef4cbf","year":2020},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.294066Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:3eeeea58d0390808a1dd8088fd802d2bc146a90287bc008013530c374939691b","observation_id":"2ad867f9-897f-45ff-ab22-71b6d3efdf4f","resolution":{"observed_at":"2026-08-09T17:31:58.909459Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.892234Z","title":null,"venue":null,"work_id":"1f596f48-5a3d-4fa8-afcc-d12868aeb59d","year":2016},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.297866Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:7025e4018986e1db0a6da70ff7e4e0275168b6c1f9733de4dc9727150120fa3c","observation_id":"1278d98b-f9e8-4934-b187-893cefe50b6c","resolution":{"observed_at":"2026-08-09T17:31:58.896788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.880201Z","title":null,"venue":null,"work_id":"70c1a8ff-5eb0-4194-9047-85bc4faa6199","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.301366Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:c2cb62ef3197d81e15ae0142a3f7803e4ea836c613cac8df25d3eda899a3a058","observation_id":"930d8d1d-e56c-46f5-abac-663877e78352","resolution":{"observed_at":"2026-08-09T17:31:58.884381Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20156","last_updated":"2024-04-16T20:31:16Z","snapshot_observed_at":"2026-08-09T19:28:38.452731Z","submitted_at":"2024-03-29T13:05:59Z","title":"CAESAR: Enhancing Federated RL in Heterogeneous MDPs through Convergence-Aware Sampling with Screening","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20156","snapshot_observed_at":"2026-08-09T17:31:58.304920Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.304920Z"},"links":{"cited_paper":"/paper/2403.20156","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:ecf0fdf15f6b666f8e21e5bd6504916a40cff0c6bdf453c409963ccf3aea7ed4","observation_id":"c3f16ce6-7cdd-4983-9480-af081099980b","resolution":{"observed_at":"2026-08-09T17:31:58.304920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.868435Z","title":null,"venue":null,"work_id":"927cd1b3-8eba-4cb5-95b2-60413bbc0cce","year":2017},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.309157Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:7deb8c0e788dcdae1ab0d922ac78057392e4c96890aebfd571d3f9970363f187","observation_id":"eaec9fa6-f2e6-4ad2-a42a-0b418292b5fb","resolution":{"observed_at":"2026-08-09T17:31:58.872226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.01783","last_updated":"2016-06-16T16:38:45Z","snapshot_observed_at":"2026-07-06T04:45:11.148515Z","submitted_at":"2016-02-04T18:38:41Z","title":"Asynchronous Methods for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.01783","snapshot_observed_at":"2026-08-09T17:31:58.313102Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.313102Z"},"links":{"cited_paper":"/paper/1602.01783","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:4e9f16a6a196f3aeb1873c8270a9c25a21a7fb48497107d58f4a1caf223629ba","observation_id":"5a10a953-c197-4bd2-8f65-696442f513e3","resolution":{"observed_at":"2026-08-09T17:31:58.313102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.855504Z","title":null,"venue":null,"work_id":"4b7431d4-8167-44c0-a04a-e89263159d95","year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.317445Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:e20cce89a25f6e5f1ac66c86ff69d18b861a4279bf6af54508648875e855ebd8","observation_id":"19aa02b9-d3c8-4f92-8ca4-e1a2c21c002b","resolution":{"observed_at":"2026-08-09T17:31:58.859464Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.830493Z","title":null,"venue":null,"work_id":"ed2703d8-3569-433d-bba7-64ca1bf9c57d","year":2018},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.325496Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:8f94d20d0b8a5fb3a9920e32fbdf5d5ba8ad40a4b0c02f30d440ce92292f4f51","observation_id":"fdb6345f-0262-46ba-b648-223abc158f38","resolution":{"observed_at":"2026-08-09T17:31:58.834122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.818974Z","title":null,"venue":null,"work_id":"27e823e2-c2f6-4f0a-aea7-6593a72260a7","year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.329478Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:d62d484acb3cbccd4b6b486dbf65d7ce59f74efddf2ffa2bb67f58ec312aa509","observation_id":"889744e9-7b95-4024-887d-88b1fdd60615","resolution":{"observed_at":"2026-08-09T17:31:58.822700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.806843Z","title":"Reddi, Ahmed Hefny, Suvrit Sra, Barnabas Poczos, and Alex Smola","venue":null,"work_id":"5b296649-fb0d-481e-9e35-d3e930a61fde","year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.333085Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:056fa5e80e9c9b2b3e7f2694f5a26f2ba98bfe84ab420211ae80ed2cdd4b5024","observation_id":"6e8b90f3-cd7c-4714-afbf-e9ab320c1755","resolution":{"observed_at":"2026-08-09T17:31:58.811112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06295","last_updated":"2016-01-07T18:43:03Z","snapshot_observed_at":"2026-07-06T04:37:06.738855Z","submitted_at":"2015-11-19T18:38:47Z","title":"Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06295","snapshot_observed_at":"2026-08-09T17:31:58.340982Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.340982Z"},"links":{"cited_paper":"/paper/1511.06295","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:37337daf70e399debf881c1cb972c664a4fa5ea09c99d585fdd9363dd2767fff","observation_id":"cdec8aac-6a9c-45c7-acff-63564435e191","resolution":{"observed_at":"2026-08-09T17:31:58.340982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.779284Z","title":null,"venue":null,"work_id":"5484f69a-dc1a-4077-be31-7cc30643dab4","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.344924Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:7d76991396e2ee8f7bee4ad346519f48b4631fd679de58e73c0a42c9b2102cd0","observation_id":"bc4984e2-774d-4f92-af02-db4aaa69c518","resolution":{"observed_at":"2026-08-09T17:31:58.783624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.348564Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.348564Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:ace7b741a9a8c25a9adc42055411faeb1e2d471a385679d2a34b208f995d20b4","observation_id":"7ca1a4f2-933a-4520-999e-01a8a60d669e","resolution":{"observed_at":"2026-08-09T17:31:58.348564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.356450Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.356450Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:4bfb8cb3eb3e0b2e1a3a3b74e3efc6cff986aad2cf65ce70f4a76a8725126857","observation_id":"01c854df-64a4-4ed6-bca9-cddebac40343","resolution":{"observed_at":"2026-08-09T17:31:58.356450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.738694Z","title":null,"venue":null,"work_id":"a2b0da1e-0e96-4fad-8c0d-7c6461a0b5c5","year":2014},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.363784Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:9769eae203736411fb44b068bb6ac8f71e85d92863c75f99869351693c09f444","observation_id":"7be6b9fc-cf7d-4414-9482-3ff91d2e6734","resolution":{"observed_at":"2026-08-09T17:31:58.742943Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.727251Z","title":null,"venue":null,"work_id":"81ddcc38-f16f-4f7d-9c91-408ceef65d45","year":2021},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.367651Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:eda3c17be8fc9a1e29e93821ea8db5a6e8496592e453522a017604156f3f212d","observation_id":"81768005-7d30-4ced-bbe4-2effeb50ba4e","resolution":{"observed_at":"2026-08-09T17:31:58.731072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.371544Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.371544Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:87ee1532b84e545e193db9c16a927958247edeadb856e2d99c55670fd52a9542","observation_id":"266406d9-3f4a-4abd-99ea-572d6b5a6aaa","resolution":{"observed_at":"2026-08-09T17:31:58.371544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.708147Z","title":null,"venue":null,"work_id":"e39ac2a7-6e56-42e7-85b0-74afc802961e","year":2020},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.375244Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:5e40962ba132095f98ef6cf38a9181e9a0a723df92bf60489fcca0fde3b86e90","observation_id":"49005417-1d1c-4439-a2c7-67748cca9e8c","resolution":{"observed_at":"2026-08-09T17:31:58.711850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.696536Z","title":null,"venue":null,"work_id":"5f149af8-26a1-4bd9-8040-995ad877034d","year":2019},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.378862Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:1ad47862a54d69f01371b9bc7be1252f74c76a81b2163d2183d1d20128822769","observation_id":"7551c5ef-83e6-42d5-b1a6-864f82309463","resolution":{"observed_at":"2026-08-09T17:31:58.700392Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.683128Z","title":null,"venue":null,"work_id":"01a6b624-2f08-4068-8b6d-59dec002eb38","year":1992},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.386444Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:27af49fd25c18cbcc7f6dabaebb4de3130ad8075fd45fccd7e2ec7226b6d41d9","observation_id":"0956b8bc-e9ef-41c0-bb10-f4b93860eb6b","resolution":{"observed_at":"2026-08-09T17:31:58.688160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.671679Z","title":null,"venue":null,"work_id":"d60c4a24-b67c-42bf-85d9-c4fb2d547a88","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.390348Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:b89c50fb8811013805e83828aefd40a23a3f2d64db94f74e805118e4faa56831","observation_id":"3963498e-c196-47c3-8a67-60dd524647d7","resolution":{"observed_at":"2026-08-09T17:31:58.675407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.660642Z","title":null,"venue":null,"work_id":"d98114c6-fb71-460d-8354-0f880bb24215","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.394015Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:aa57f05a601e1500768eea0456386926e1aaa13b5aa6b7e6af7cc3660afac739","observation_id":"75c89570-a232-405c-b6a4-8878bf499542","resolution":{"observed_at":"2026-08-09T17:31:58.664220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.649485Z","title":null,"venue":null,"work_id":"e67ed5b9-72cf-4dc0-859d-a69874800bd8","year":2020},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.398437Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:990d683ff325dd13c57ea57473d96ae168c8139d40c6912361651b4d4a66c9d1","observation_id":"d8f9c2d6-318c-4f18-a73c-ba3101503936","resolution":{"observed_at":"2026-08-09T17:31:58.653345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.638173Z","title":null,"venue":null,"work_id":"9aa9d7c6-4f7e-49aa-8b11-d910b658ee1f","year":2023},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.402132Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:9d0a9c2f9b3468f025be22f1943057ccebb2c14bb2829a5ca5b70fd10c22df7a","observation_id":"fa793a0e-54cc-4875-a5f7-a1fec141cc9a","resolution":{"observed_at":"2026-08-09T17:31:58.642045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.626084Z","title":null,"venue":null,"work_id":"a86436cf-92df-477d-b503-015d7092533e","year":2018},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.406148Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:3f4ecb9b8938f4425cd780b7994b1944416b8a87658ebd4b44609a38a002bcac","observation_id":"21ae6a97-5327-49f1-9898-c68097ac6f19","resolution":{"observed_at":"2026-08-09T17:31:58.630283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.613025Z","title":"Gower, and Alessandro Lazaric","venue":null,"work_id":"e5d472ac-61ab-4de5-9a67-6bb9ba111d13","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.409970Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:0ea69cf7cd72e6aa8c69a48e3d68345e87c976b93e4417ac98bbd1b36fd3a127","observation_id":"7f27f11f-b3c9-48c0-9453-b2c8982c0f08","resolution":{"observed_at":"2026-08-09T17:31:58.617086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.600740Z","title":null,"venue":null,"work_id":"6a20bbc1-077e-4c42-b9e8-b97eb012607a","year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.413743Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:f33775d62a6b316cbbd3e400a906db7ed0401942f975fc90122cb5ee9d1a855f","observation_id":"ce916336-016b-46d5-a3b0-1fae83a39697","resolution":{"observed_at":"2026-08-09T17:31:58.604904Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.589297Z","title":null,"venue":null,"work_id":"c8fd8fae-6101-4b6b-98d6-e3557090b291","year":2024},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.417870Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:33044e1f5f73bf745fcad2aeced04013c689564417015eff14eb9cb8f03bcddf","observation_id":"77ef1d6d-9688-4ae1-9b54-b564a2548ef8","resolution":{"observed_at":"2026-08-09T17:31:58.593116Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.577893Z","title":null,"venue":null,"work_id":"35d9a7d5-38d6-47b0-af54-392cd0c7d695","year":2021},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.421599Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:5ff6f4971389d1d28daf7a6eac061d6a26356315d456c1eb206e1f701fced535","observation_id":"47d57751-ed93-4d64-a834-6a703a02d40c","resolution":{"observed_at":"2026-08-09T17:31:58.581699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.564856Z","title":"∑︁ 𝑠,𝑎 𝜋𝜃(𝑎|𝑠) log 𝜋𝜃(𝑎|𝑠) 𝜋𝑔𝑙𝑜𝑏𝑎𝑙(𝑎|𝑠) !# = ∑︁ 𝑠,𝑎","venue":null,"work_id":"30bcbfef-8bd9-4a88-887e-22f177563112","year":2000},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.425533Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:030bad451724b18f7ba7138c1b03e6097cb72077ca1529d48bb4b9100f30ca71","observation_id":"0e91414d-b1b1-49f0-a94a-dfc29e52f2d5","resolution":{"observed_at":"2026-08-09T17:31:58.569969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.757829Z","title":"In International Conference on Machine Learning, Vol","venue":null,"work_id":"be129a9f-0b90-4176-8616-68a72e2e26cf","year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.352390Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:9e550217af03e29f1d63a79a9766145cce18f9bf1539b50b814e7466f94f6402","observation_id":"6fb14700-28d9-4a4d-9ca0-f0b377859a55","resolution":{"observed_at":"2026-08-09T17:31:58.762795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.791888Z","title":"In Interna- tional Conference on Machine Learning , Vol","venue":null,"work_id":"b2f70989-e860-4c6a-a993-85284ed00c7f","year":null},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.336898Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:8982d4aea5e77bcad5f4d62a83dcb430757ace26d7b8ab2edb2665340ee4cd7d","observation_id":"cc6b1b71-7592-492f-8203-8bb9d815f3e4","resolution":{"observed_at":"2026-08-09T17:31:58.796382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T17:31:58.360002Z","title":"arXiv preprint arXiv:1707.06347 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.360002Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:95c52a2299572b3fd2aa0d703c7881e3f7cb312fcd06b1fec349d22818f38843","observation_id":"0aadf7e7-0560-4af0-a151-3d09739a8a44","resolution":{"observed_at":"2026-08-09T17:31:58.360002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.842918Z","title":"In AAMAS 2019, Vol","venue":null,"work_id":"cf4cf760-4000-4b95-b610-764a4c24da03","year":2019},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.321568Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:e1a015835a157ed35eab6559cbda80793ab17675c63cea3abdaa39ea9960dff0","observation_id":"92abb098-efad-426e-bbe7-1f40c7896dc2","resolution":{"observed_at":"2026-08-09T17:31:58.846851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:31:58.929037Z","title":"Nature Machine Intelligence 4, 12 (2022), 1077–1087","venue":null,"work_id":"b90c5285-a328-4e56-8961-c0a5dc6a010f","year":2022},"citing_paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T17:31:58.278056Z"},"links":{"citing_paper":"/paper/2502.00870"},"observation_digest":"sha256:76b44adfac13879782b8eabfbfbf7746e4528a86e50408bd01fed390ae71f4ea","observation_id":"8cc9f15d-0834-4581-b28b-25c4dff52a8c","resolution":{"observed_at":"2026-08-09T17:31:58.932760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.00870","last_updated":"2025-02-02T18:44:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T17:21:53.435855Z","submitted_at":"2025-02-02T18:44:08Z","title":"FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2502.00870."}