{"as_of":"2026-08-11T12:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8f2c66a7828ded75b7521fdb3e86a702a7331e98e5eb3893ec811ffb06ff0347","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T15:22:56.158296Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:25:40.062465Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-10T05:30:23.456663Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-10T05:30:23.456663Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01711","snapshot_observed_at":"2026-08-03T19:53:34.832426Z","title":"Oliehoek, F","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.22581","last_updated":"2026-06-04T20:49:42Z","snapshot_observed_at":"2026-08-09T12:09:20.638410Z","submitted_at":"2025-11-27T16:13:27Z","title":"High entropy leads to symmetry-equivariant policies in Dec-POMDPs","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T19:53:34.832426Z"},"links":{"cited_paper":"/paper/2502.01711","citing_paper":"/paper/2511.22581"},"observation_digest":"sha256:f953d02af108c6c188afdfedef6131ad43375d70693164437b3310c0df07dbab","observation_id":"c6efbaa4-3752-47df-888f-899d2bf47054","resolution":{"observed_at":"2026-08-03T19:53:34.832426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"cited_work":{"arxiv_id":"2502.01711","doi":"10.48550/arxiv.2502.01711","metadata_source":"pith","pith_arxiv_id":"2502.01711","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Expected Return Symmetries","venue":"cs.MA","work_id":"5e4b74ca-cb91-4790-b563-baf57b88f951","year":2025},"citing_paper":{"arxiv_id":"2608.03644","last_updated":"2026-08-04T13:29:00Z","snapshot_observed_at":"2026-08-11T03:36:19.110855Z","submitted_at":"2026-08-04T13:29:00Z","title":"Is Inter-Seed Cross-Play Enough? Evaluating the Robustness of Zero-Shot Coordination Algorithms to Implementation Details","version":1},"reference_index":168,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:40.062465Z"},"links":{"cited_paper":"/paper/2502.01711","citing_paper":"/paper/2608.03644"},"observation_digest":"sha256:6e93c67d48d4d6ab81ba1c882b582d4fb9818a9610af0815f488b6bed5862a82","observation_id":"802816a9-c783-4318-a5aa-6212bbcc73c8","resolution":{"observed_at":"2026-08-05T15:28:37.026418Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.01711/citation-record","integrity":"/paper/2502.01711/integrity","json":"/paper/2502.01711/citation-record.json","paper":"/paper/2502.01711"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:55.553053Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.553053Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:d5a120e39b1b328d427f510ac79c46e78ac6227030f5f55061b53a65ed388818","observation_id":"91f482f2-9992-47b2-b836-bc1b94bc3edb","resolution":{"observed_at":"2026-08-09T15:22:55.553053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02711","last_updated":"2025-02-09T01:23:59Z","snapshot_observed_at":"2026-08-04T13:52:53.694737Z","submitted_at":"2023-09-06T04:47:46Z","title":"Addressing imperfect symmetry: A novel symmetry-learning actor-critic extension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02711","snapshot_observed_at":"2026-08-09T15:22:55.558563Z","title":"Addressing Imperfect Symmetry: a Novel Symmetry-Learning Actor-Critic Extension","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.558563Z"},"links":{"cited_paper":"/paper/2309.02711","citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:808df321509dbdbf66bae8dc49bf35bbefdfc41777aa02ba484964518b758fb1","observation_id":"bf420a6a-93c8-4100-8234-513fd8735689","resolution":{"observed_at":"2026-08-09T15:22:55.558563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.668291Z","title":"The Hanabi Challenge: A New Frontier for AI Research","venue":null,"work_id":"cc063120-c8bc-4d63-98ae-6e7a0146207a","year":2020},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.562899Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:34712df66e8a554e0e6d95b3b6a76e9890c49d2ca1a06db8cec247fcae08be83","observation_id":"e3d3f441-b280-44e8-9bce-c12fc3a4ce95","resolution":{"observed_at":"2026-08-09T15:22:56.672416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13478","last_updated":"2021-05-02T16:16:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-04-27T21:09:51Z","title":"Geometric Deep Learning: Grids, Groups, Graphs, Geodesics, and Gauges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13478","snapshot_observed_at":"2026-08-09T15:22:55.566945Z","title":"Geometric Deep Learning: Grids, Groups, Graphs, Geodesics, and Gauges","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.566945Z"},"links":{"cited_paper":"/paper/2104.13478","citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:02094464e894657b353e1a766a25d8e148edfe4a908446a69d8b77729f09c684","observation_id":"fdbb5073-16d8-4e8e-8d2a-9b4f85301fd3","resolution":{"observed_at":"2026-08-09T15:22:55.566945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.655709Z","title":"A Cognitive Hierarchy Model of Games","venue":null,"work_id":"4c976378-b197-409b-8b02-de43789ab593","year":2004},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.599603Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:6bc0219de606a44dc112bd3b82a7d68af8a58c7e08de8e2ff490b78e66d58c28","observation_id":"bcc19a94-b5b7-48f9-8085-d47a082dde3a","resolution":{"observed_at":"2026-08-09T15:22:56.659865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.644122Z","title":"On the Utility of Learning about Humans for Human-AI Coordination","venue":null,"work_id":"8cc7cc09-09c0-4163-8bff-88f0ab9bc925","year":2019},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.627913Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:7cb5525968e4c24233183e598598ee524fdfe83e4058b5cfd2003661bf72f837","observation_id":"e2100c51-c7bc-424d-be09-14f763aef05b","resolution":{"observed_at":"2026-08-09T15:22:56.648225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.629474Z","title":"The Worst And The Best Chess Handshakes Of World Cup 2021","venue":null,"work_id":"5b011ca0-96e9-4c20-a998-32532759b8eb","year":2021},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.642773Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:95e312030890a309005ee07650b53d6264fbfe20a5f975cc702d16cdac60f398","observation_id":"b6ae0c84-b3a3-4df8-b482-087f5e0906fd","resolution":{"observed_at":"2026-08-09T15:22:56.634044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.617955Z","title":"Gauge Equivariant Convolutional Networks and the Icosahedral CNN","venue":null,"work_id":"2cc82e93-6fae-4513-a1ab-effbb5d2d77c","year":2019},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.670974Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:749a91890b003f1fe84f7a81f129866c65e9219568fca8d312c911808159917f","observation_id":"707e717f-ca5b-4fba-b914-2e9fbdac4429","resolution":{"observed_at":"2026-08-09T15:22:56.622094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.605773Z","title":"K-level Reasoning for Zero-Shot Coordination in Hanabi","venue":null,"work_id":"089c8ec9-784b-439f-a580-b6334aa91d27","year":2021},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.674842Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:7e05a5f99c0bd287579fad8193c1a2d5247f831108bae9edf499fea3ac1e437a","observation_id":"bc74f943-9354-4567-92eb-db91ae11ef1d","resolution":{"observed_at":"2026-08-09T15:22:56.610252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.594422Z","title":"Adversarial Diversity in Hanabi","venue":null,"work_id":"c7c09440-3119-4591-877c-a1e6f76d6b24","year":2023},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.678309Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:186a993947e31cc486bbbee6bebc3287504270bb898743098a991bf26f004ce7","observation_id":"9d98e241-28cd-48bd-9026-a90d1a2ab11a","resolution":{"observed_at":"2026-08-09T15:22:56.598442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.582827Z","title":"Generalizing Convolutional Neural Networks for Equivariance to Lie Groups on Arbitrary Continuous Data","venue":null,"work_id":"9fa6d428-e075-4c7f-a74a-d9dd04f090e6","year":2020},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.682068Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:a0daed687fad17b5c1b4afe169bec51d1d21a59ccf8686fe7f99e2e004687d66","observation_id":"e57d4886-7aba-44fd-b6b6-ad8ffe00a740","resolution":{"observed_at":"2026-08-09T15:22:56.586995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.572549Z","title":"OvercookedV2: Rethinking Overcooked for Zero-Shot Coordination","venue":null,"work_id":"46101aa5-bf2c-4ec0-95d4-8cf8cf1ba4be","year":2025},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.685840Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:bf8351cb80890c639e1665ab118f5658e721953c4a4de34bb221b821daace48d","observation_id":"49332981-a9a9-4d18-9af7-c128cf300139","resolution":{"observed_at":"2026-08-09T15:22:56.575925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.562099Z","title":"Proper Value Equivalence","venue":null,"work_id":"43809db6-fee5-44ce-8a14-28898b171c59","year":2021},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.689485Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:de5338e957c38b02a5769812f61724d7d003a7c85e87cd67f798f52dbc1aff85","observation_id":"0b779465-6d3d-4496-aa5d-d0b8c330c6bf","resolution":{"observed_at":"2026-08-09T15:22:56.565351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.552453Z","title":"Other-Play","venue":null,"work_id":"2115128b-4820-491f-8ac7-11bcf2ede3e9","year":2020},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.692794Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:ecedb73c268045f32ac2c72192d8a2095d9195821601134a2b09cb94d56889dd","observation_id":"b460ef24-06e3-4980-8939-ccb9bc0be0ed","resolution":{"observed_at":"2026-08-09T15:22:56.555549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.542694Z","title":"Off-Belief Learning","venue":null,"work_id":"d5298c43-abe6-43f7-8345-d905eadced98","year":2021},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.696179Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:f4a8a9540f628054798c74c4c94648a72dc0d483a19d74933314b45e9e74a4f2","observation_id":"f5243fa0-5b9f-40c8-b1eb-b34bcaee5ebf","resolution":{"observed_at":"2026-08-09T15:22:56.545830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19852","last_updated":"2025-04-04T11:14:49Z","snapshot_observed_at":"2026-08-05T20:02:35.087707Z","submitted_at":"2023-10-30T15:52:15Z","title":"AI Alignment: A Comprehensive Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19852","snapshot_observed_at":"2026-08-09T15:22:55.699941Z","title":"AI Alignment: A Comprehensive Survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.699941Z"},"links":{"cited_paper":"/paper/2310.19852","citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:1eaceda1d281fc1b58b737ba7d90273d40bf4b2540f8cea44eb204256b64b668","observation_id":"7aa7d582-d491-4207-8a32-bfc0ad4cc713","resolution":{"observed_at":"2026-08-09T15:22:55.699941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.533062Z","title":"Open-source AI Assistant for Cooperative Multi-agent Systems for Lunar Prospecting Missions","venue":null,"work_id":"fff41619-8d4e-422f-9ae0-52ad772e045d","year":2019},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.703876Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:75fbfc459c983619880cefcd041b61b2365802044bda19d1b34726bf8fa84e37","observation_id":"68a58f64-4fff-40d0-83ec-4e8e56b61448","resolution":{"observed_at":"2026-08-09T15:22:56.536461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.522881Z","title":"ImageNet Classification with Deep Convolutional Neural Networks","venue":null,"work_id":"99a9a15b-6503-45dc-abe9-fd20bd82d909","year":2017},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.707394Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:e7b831f883304045c1cc1481dff8bc32ff6c4c0b1136f04807cda55c52d04b17","observation_id":"8c08c0e1-a339-486d-b714-1d3898d73d03","resolution":{"observed_at":"2026-08-09T15:22:56.526250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.513042Z","title":"Towards a Unified Theory of State Abstraction for MDPs","venue":null,"work_id":"e41679da-a2cc-464d-a504-456ebf576d64","year":2006},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.711069Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:ba8fa361f068f8a9d6658a629a483c94b639384ca272cbb0af6bf197b6d7953f","observation_id":"6763c6d0-e5d4-4e34-9a65-372a5ac9fe9d","resolution":{"observed_at":"2026-08-09T15:22:56.516561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.501347Z","title":"Trajectory Diversity for Zero-Shot Coordination","venue":null,"work_id":"36394942-f258-4b7e-a3bc-99c9fa6c738f","year":2021},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.714864Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:be3a8e31fa35fcb88de9bcc46df9f9709ad0d1e1b30f6ffaf76f3913b9e28766","observation_id":"0aa55d5b-b59e-4330-b78f-15504978d822","resolution":{"observed_at":"2026-08-09T15:22:56.505610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.489447Z","title":"Coordination of Autonomous Vehicles: Taxonomy and Survey","venue":null,"work_id":"38bdd7b6-a182-4b4f-963b-17a1094e7036","year":2021},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.718958Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:b45a10ec65d06bd05d22efc6ca834432fea82307b0fd7f84848d797732df7564","observation_id":"2d0c098a-26a0-4679-b518-9fec3e51d3df","resolution":{"observed_at":"2026-08-09T15:22:56.493566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.477998Z","title":"Equivariant Networks for Zero-Shot Coordination","venue":null,"work_id":"39e73e62-3dd1-42a2-b840-fe911d50f82c","year":2022},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.722428Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:a1d3215002c80f62745e01eb523368d3c6fd8846eb9593f1c37280ebbec8cf68","observation_id":"7915a25d-1f30-443a-a618-2da95d77a95e","resolution":{"observed_at":"2026-08-09T15:22:56.482075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.466528Z","title":"Generalized Beliefs for Cooperative AI","venue":null,"work_id":"52cfa3e1-0e04-49d2-930a-c2e839b8f205","year":2022},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.725853Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:40839de1dc16b6979988b1bf3e053e159f2d32bd5b1b44a9b38a099dae95327b","observation_id":"ac3db61c-ac44-45e9-8408-1668f091d9d6","resolution":{"observed_at":"2026-08-09T15:22:56.470588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.454573Z","title":"On the hardness of finding symmetries in Markov decision processes","venue":null,"work_id":"b3a8733b-8629-47c0-ba40-5840adee6e58","year":2008},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.729206Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:8e02969a67a93982e05317e5a9ab0e7e2e13a6434163115864dbe42957bc443f","observation_id":"d21a9459-7e52-4ffb-8ce0-cb6491f94df5","resolution":{"observed_at":"2026-08-09T15:22:56.458854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.442777Z","title":"Continuous Coordination As a Realistic Scenario for Lifelong Learning","venue":null,"work_id":"a840c8f5-29c7-4b43-b973-b3d9d3d91632","year":2021},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.732460Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:249012a024f74547938134fc7fd9b2db1dcb4e2df37f2c01c67fb612f861302b","observation_id":"166b5873-8fd8-43ff-aa9e-bb94164972a6","resolution":{"observed_at":"2026-08-09T15:22:56.446938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.431294Z","title":"Towards Few-shot Coordination: Revisiting Ad-hoc Teamplay Challenge In the Game of Hanabi","venue":null,"work_id":"a2d43350-1abe-47ce-bf10-0aa7a1e3d22d","year":2023},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.735572Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:1e55f1a8118bab014d6b1c6f76ebd8de7a739b11015531546f961282f0d1291a","observation_id":"b0749e6a-4a69-4369-b699-152f2b901d06","resolution":{"observed_at":"2026-08-09T15:22:56.435514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18002","last_updated":"2024-04-29T19:00:56Z","snapshot_observed_at":"2026-07-06T17:36:36.437597Z","submitted_at":"2024-02-28T02:30:59Z","title":"Symmetry-aware Reinforcement Learning for Robotic Assembly under Partial Observability with a Soft Wrist","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18002","snapshot_observed_at":"2026-08-09T15:22:55.739027Z","title":"Symmetry-aware Reinforcement Learning for Robotic Assembly under Partial Observability with a Soft Wrist","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.739027Z"},"links":{"cited_paper":"/paper/2402.18002","citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:abe6f5828d8feb74b41a479bf93b0174373408da3bd91ec8cc26983f8be3ad88","observation_id":"f149ca72-42cc-4163-87d1-656ae3d04f0f","resolution":{"observed_at":"2026-08-09T15:22:55.739027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.419963Z","title":"Dec-POMDPs with delayed communication","venue":null,"work_id":"f44f97c7-716e-4bd9-87bc-5e407d787ff9","year":2007},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.743131Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:0a0d3ae2d772499613b686befae2dfaca5211aed881b2c02d876b380568739b0","observation_id":"4b67f128-1dfb-4e3d-82ab-b5f101224a1e","resolution":{"observed_at":"2026-08-09T15:22:56.423977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07178","last_updated":"2018-08-14T12:35:41Z","snapshot_observed_at":"2026-07-06T06:34:19.449844Z","submitted_at":"2018-04-19T14:02:07Z","title":"Vehicle Communication Strategies for Simulated Highway Driving","version":2},"cited_work":{"arxiv_id":"1804.07178","doi":null,"metadata_source":"pith","pith_arxiv_id":"1804.07178","snapshot_observed_at":"2026-08-09T15:22:56.217487Z","title":"Vehicle Communication Strategies for Simulated Highway Driving","venue":"cs.MA","work_id":"4b20f7ed-2789-427a-bd4c-48b2904c7ce3","year":2018},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.746478Z"},"links":{"cited_paper":"/paper/1804.07178","citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:9c138145b8fc3716b83fdf6666a8c9fbdc1f376a5c3b7a993bf24ceb63c791d6","observation_id":"c9c06810-b3b7-4294-a6a8-86e10d90d194","resolution":{"observed_at":"2026-08-09T15:22:56.224952Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.408979Z","title":"Continuous MDP Homomorphisms and Homomorphic Policy Gradient","venue":null,"work_id":"f49b2859-9b47-4fac-8745-f6d14e19e112","year":2022},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.750565Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:826aa8a922aaf7236a34b33d8794efefe667ea2ee57bda27ffab56c868f54511","observation_id":"a4aaeef7-3db9-4ef3-9668-e1f6edb18fdb","resolution":{"observed_at":"2026-08-09T15:22:56.412812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10090","last_updated":"2026-07-04T05:19:25Z","snapshot_observed_at":"2026-08-09T03:06:29.095333Z","submitted_at":"2023-11-16T18:58:43Z","title":"JaxMARL: Multi-Agent RL Environments and Algorithms in JAX","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10090","snapshot_observed_at":"2026-08-09T15:22:55.754092Z","title":"JaxMARL: Multi-Agent RL Environments and Algorithms in JAX","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.754092Z"},"links":{"cited_paper":"/paper/2311.10090","citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:de492e7c442101b15ab4865300c8d24ee888ad9381ca6d80b645ad0b8924b2f9","observation_id":"bba360d6-0ff2-46bc-8d97-e42d16b51c1c","resolution":{"observed_at":"2026-08-09T15:22:55.754092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.396894Z","title":"Some Studies in Machine Learning Using the Game of Checkers","venue":null,"work_id":"da5dd759-7da3-4f94-89bb-52f90b9596fb","year":1959},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.758184Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:db714072a3d7aa12439ea014ef04e8a9ee664b153358e9231cb83d705f6f33c5","observation_id":"9b51cf25-b4ca-4abe-94b3-57c234f85c7a","resolution":{"observed_at":"2026-08-09T15:22:56.400405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.386079Z","title":"Policy Gradient Methods for Reinforcement Learning with Function Approximation","venue":null,"work_id":"f40d248a-4825-49b9-b201-1565c97fe955","year":1999},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.762011Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:be084054444cf21426f9ba8054ceae50c1ee8e759fc8db7caab420a8f5c05a2c","observation_id":"af45da29-0777-4218-a083-9081f485892d","resolution":{"observed_at":"2026-08-09T15:22:56.389626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.375911Z","title":"Multi-Agent Reinforcement Learning: Independent vs","venue":null,"work_id":"760919fe-8498-4b7e-bd26-d22619c4a5d5","year":1993},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.774555Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:bf0bbaecd478522581303d794ac45f2c38cc01c9ffe06b53f805c514c696249c","observation_id":"5efcbf9d-679f-4f37-9ff5-5b88c984bded","resolution":{"observed_at":"2026-08-09T15:22:56.379235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.365091Z","title":"Temporal difference learning and TD-Gammon","venue":null,"work_id":"771c2800-1859-4634-ab79-200819ef55bc","year":1995},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.805938Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:c4607cfe6f5829151c64de1560338564be6a078c758e2d96919181f54ba53ad0","observation_id":"742f7693-a2cf-4d34-a457-f2472d8932b5","resolution":{"observed_at":"2026-08-09T15:22:56.368842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.353833Z","title":"A New Formalism, Method and Open Issues for Zero-Shot Coordination","venue":null,"work_id":"b81085d7-5473-43e6-a930-90cc2711c507","year":2021},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.850499Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:061641913b923761cad6746b1e23a445b276fb368f4a6d548df8a9c2846640fb","observation_id":"817c3eec-7f89-40c0-98bb-7e318ebbb6a0","resolution":{"observed_at":"2026-08-09T15:22:56.357357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.343410Z","title":"MDP Homomorphic Networks: Group Symmetries in Reinforcement Learning","venue":null,"work_id":"3e7e8f86-3bba-479e-909a-1dbdaa1f71fa","year":2020},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.892755Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:c60e69ad14aeca20eb2bb499ca2875e4aa4c5a943044bb6090cd2a830715b120","observation_id":"0916ae13-4a56-4a65-998b-9d0a250e9f5c","resolution":{"observed_at":"2026-08-09T15:22:56.346976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.331420Z","title":"Multi-Agent MDP Homomorphic Networks","venue":null,"work_id":"41abe7ee-a229-4efc-8ab4-da09d01fc193","year":2021},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.916760Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:7f5078cea84c6e1696383a3581e4c3c4eb4f3edff7ddc82d9a5a03176e3be79f","observation_id":"ee338db9-5367-4458-993a-11a8d526544b","resolution":{"observed_at":"2026-08-09T15:22:56.335649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.318722Z","title":"The Surprising Effectiveness of PPO in Cooperative, Multi-Agent Games","venue":null,"work_id":"0f8eb6c0-5cb5-45ca-8eeb-0321c649663d","year":2022},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:55.969614Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:40343de635b6e1a355f8401d87ec483542ef7c22b2254ef998aad865dbfbbf29","observation_id":"00a5a781-e320-490d-8188-338480c94807","resolution":{"observed_at":"2026-08-09T15:22:56.323144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.305790Z","title":"Leveraging Partial Symmetry for Multi-Agent Reinforcement Learning","venue":null,"work_id":"2434413a-c51b-425c-9d66-3f1315a4afec","year":2024},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:56.040492Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:69701c1e6000850f5e82918b47abc331b956c3df307c98799f5de792dc1ab814","observation_id":"70004be6-6a8e-4e44-a33a-06fcca756a88","resolution":{"observed_at":"2026-08-09T15:22:56.310449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.09468","last_updated":"2022-02-18T23:04:57Z","snapshot_observed_at":"2026-07-06T12:39:25.252398Z","submitted_at":"2022-02-18T23:04:57Z","title":"Sample Efficient Grasp Learning Using Equivariant Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.09468","snapshot_observed_at":"2026-08-09T15:22:56.103290Z","title":"Sample Efficient Grasp Learning Using Equivariant Models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:56.103290Z"},"links":{"cited_paper":"/paper/2202.09468","citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:4dc388df906197f27037e26d4b3e1302d759e46e2968667ccf53ec4ddce36585","observation_id":"93d6ce48-67da-4f79-9143-efdb1024e313","resolution":{"observed_at":"2026-08-09T15:22:56.103290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.150822Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:56.150822Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:803c4c7f4efe3b91da02535e8b500c4ea9d98fe5bece8e83d9cc607a72e8db3a","observation_id":"0d509f15-39ae-442d-8006-2ebb708fc3d9","resolution":{"observed_at":"2026-08-09T15:22:56.150822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.154701Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:56.154701Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:ae2fdac7c2fc0eb71ca411503f07e4d21425a18436693f2f8474bc1678a0c3dc","observation_id":"84d86720-4e34-4a08-b27b-fd41f67537b1","resolution":{"observed_at":"2026-08-09T15:22:56.154701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T15:22:56.278534Z","title":"J^w >V ؅m./9gOݳ3 <3","venue":null,"work_id":"f785d07c-d0e3-4eda-8938-78a6565daf2c","year":null},"citing_paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T15:22:56.158296Z"},"links":{"citing_paper":"/paper/2502.01711"},"observation_digest":"sha256:db5a418a25f68a2ab8c5487fd99b959d7bb405fae433603c86cce53c9614948e","observation_id":"d4c5e197-80e8-4929-a431-3107f8770691","resolution":{"observed_at":"2026-08-09T15:22:56.282793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.01711","last_updated":"2026-06-03T12:22:28Z","latest_version":3,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-11T00:05:16.095596Z","submitted_at":"2025-02-03T15:22:51Z","title":"Expected Return Symmetries"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 2 inbound Pith citation observations for arXiv:2502.01711."}