{"as_of":"2026-08-18T06:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:be993b615ec10deaec421737eff02809bde92b2581bb0c4dc940f3355c2ff72c","coverage":[{"denominator":11,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:21:34.908018Z","state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.21088/citation-record","integrity":"/paper/2412.21088/integrity","json":"/paper/2412.21088/citation-record.json","paper":"/paper/2412.21088"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:35.148516Z","title":"Impact of relational networks in multi-agent learning: A value-based factorization view,","venue":null,"work_id":"f2b5084e-90c3-4b2a-b098-fcb86a6cd6bd","year":2023},"citing_paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T23:21:34.847002Z"},"links":{"citing_paper":"/paper/2412.21088"},"observation_digest":"sha256:a709b59c7586bb4df547446cc0c74fa1944353034065cb34077ab87f991dc8d7","observation_id":"29d1ebb6-b7af-4f5a-a4ea-4bcf467bae72","resolution":{"observed_at":"2026-08-10T23:21:35.154480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05886","last_updated":"2022-07-14T01:02:46Z","snapshot_observed_at":"2026-08-16T16:46:27.033529Z","submitted_at":"2022-07-12T23:27:42Z","title":"Reward-Sharing Relational Networks in Multi-Agent Reinforcement Learning as a Framework for Emergent Behavior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05886","snapshot_observed_at":"2026-08-10T23:21:34.854326Z","title":"Reward-sharing relational networks in multi-agent reinforcement learning as a framework for emergent behavior,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T23:21:34.854326Z"},"links":{"cited_paper":"/paper/2207.05886","citing_paper":"/paper/2412.21088"},"observation_digest":"sha256:fe0bc20911d30c58203f74a75e4258a194f3a5f7ba0255511dcb2c5daa648be6","observation_id":"497b2dbe-8f28-45a9-b278-fba3bb8ba4aa","resolution":{"observed_at":"2026-08-10T23:21:34.854326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:35.130691Z","title":"Online discovery of auv control policies to overcome thruster failures,","venue":null,"work_id":"fa435949-2b49-4cde-b3dd-2c1e9e0c2213","year":2014},"citing_paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T23:21:34.860774Z"},"links":{"citing_paper":"/paper/2412.21088"},"observation_digest":"sha256:3cc093645650635a285547c73f6e399b4309161a208117bd67680d0955deca85","observation_id":"df12967b-680e-4b93-b84d-774be563cf60","resolution":{"observed_at":"2026-08-10T23:21:35.136797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:35.110790Z","title":"Multi-objective reinforcement learning for auv thruster failure recovery,","venue":null,"work_id":"59aaed3b-8d78-4f3a-b1fc-a47b67d1b982","year":2014},"citing_paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T23:21:34.867356Z"},"links":{"citing_paper":"/paper/2412.21088"},"observation_digest":"sha256:38a7a684ef98fa3ddc36a05dae5aad4a26573779ae0c3fa96a7e3976a8e6a47d","observation_id":"c8cd932b-5181-4a6e-b717-ce5b455e5d75","resolution":{"observed_at":"2026-08-10T23:21:35.118267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:35.086376Z","title":"Collaborative adaptation: Learning to recover from unforeseen malfunctions in multi-robot teams,","venue":null,"work_id":"4daf6327-29cc-4aac-96f8-fb1c0055959a","year":2023},"citing_paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T23:21:34.873203Z"},"links":{"citing_paper":"/paper/2412.21088"},"observation_digest":"sha256:a6da89e2ee92d5fd3cbbe7a9d547f25bb1331953d9cbc993da6452881b30b245","observation_id":"661ee6c6-e1be-468a-9b25-97791818fe65","resolution":{"observed_at":"2026-08-10T23:21:35.093056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:35.065234Z","title":"Influence of team interactions on multi-robot cooperation: A relational network perspective,","venue":null,"work_id":"63f03362-f249-43b1-938b-70e0c681cc0b","year":2023},"citing_paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T23:21:34.878934Z"},"links":{"citing_paper":"/paper/2412.21088"},"observation_digest":"sha256:550c1c2736587b923533ca083e56cde84d8559994bdeb027e5630c7e8cfc0483","observation_id":"e483bd4d-f89e-4543-8883-eaeb34814260","resolution":{"observed_at":"2026-08-10T23:21:35.071864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07752","last_updated":"2024-02-12T16:21:50Z","snapshot_observed_at":"2026-08-16T14:19:17.606611Z","submitted_at":"2024-02-12T16:21:50Z","title":"Mixed Q-Functionals: Advancing Value-Based Methods in Cooperative MARL with Continuous Action Domains","version":1},"cited_work":{"arxiv_id":"2402.07752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.07752","snapshot_observed_at":"2026-08-10T23:21:34.947257Z","title":"Mixed Q-Functionals: Advancing Value-Based Methods in Cooperative MARL with Continuous Action Domains","venue":"cs.MA","work_id":"b65c81cf-3b72-45d7-be6d-41b9f8398ec7","year":2024},"citing_paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T23:21:34.886315Z"},"links":{"cited_paper":"/paper/2402.07752","citing_paper":"/paper/2412.21088"},"observation_digest":"sha256:5b2c4541c4b3afb38b93aa704c430e341f55766ce771e4710a8fe648fb0f9431","observation_id":"dd9a256c-537b-468d-b1de-4b71e5c6fcae","resolution":{"observed_at":"2026-08-10T23:21:34.955121Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:35.046512Z","title":"Robot learning for persistent autonomy,","venue":null,"work_id":"60583d57-4701-4eb0-8019-8fb53a100003","year":2015},"citing_paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T23:21:34.891825Z"},"links":{"citing_paper":"/paper/2412.21088"},"observation_digest":"sha256:370e82481e60b37dee6f200b751c8210054cd187b0ccfd11f707fc36f27dd070","observation_id":"e36ea0e2-1f82-4e19-a6c6-bc08e1a35fdf","resolution":{"observed_at":"2026-08-10T23:21:35.052179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:35.028150Z","title":"Relational q-functionals: Multi-agent learning to recover from unforeseen robot malfunctions in continuous action domains,","venue":null,"work_id":"ce3e714b-7859-418b-bbef-6f936fadaa07","year":2024},"citing_paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T23:21:34.897219Z"},"links":{"citing_paper":"/paper/2412.21088"},"observation_digest":"sha256:202c72a44df12986085f5073d7ca042c5d19ec92758ca35a77548fa9b361e09f","observation_id":"a3531230-af77-40d0-96ec-04068ed7fa3c","resolution":{"observed_at":"2026-08-10T23:21:35.033654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:35.008256Z","title":"Relational weight optimization for enhancing team performance in multi-agent multi-armed bandits,","venue":null,"work_id":"4ded93d0-8cb3-44ce-99bc-868a2e7e75f5","year":2024},"citing_paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T23:21:34.902613Z"},"links":{"citing_paper":"/paper/2412.21088"},"observation_digest":"sha256:4a6fce47314cf52235910ad7a65ead811bda3da572f5550741558dd2d5184aa5","observation_id":"c5fea787-56b2-4929-a4a6-41ed48f1588c","resolution":{"observed_at":"2026-08-10T23:21:35.015182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:21:34.988287Z","title":"Graph attention inference of network topology in multi- agent systems,","venue":null,"work_id":"f62b310e-afdd-465d-ab1f-c551d698b84d","year":2024},"citing_paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T23:21:34.908018Z"},"links":{"citing_paper":"/paper/2412.21088"},"observation_digest":"sha256:6ec00049b8ef89fdda01260c0934ce1f371a6c770b8669fdf640276cedf24611","observation_id":"de4b3b6e-93d1-41be-9a5c-f84bb5edf697","resolution":{"observed_at":"2026-08-10T23:21:34.994220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.21088","last_updated":"2024-12-30T17:08:05Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-17T21:38:12.096632Z","submitted_at":"2024-12-30T17:08:05Z","title":"Advances in Multi-agent Reinforcement Learning: Persistent Autonomy and Robot Learning Lab Report 2024"},"reference_resolution":{"displayed":11,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":1,"verified_fuzzy":9},"total_outbound_references":11},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 11 of 11 outbound references and 0 inbound Pith citation observations for arXiv:2412.21088."}