{"as_of":"2026-08-13T06:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d1deccbfcf23c8e30588bb6ebab6497bb2887bfa351accc9ce9539d1d929c8a","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:06:27.178808Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.10593/citation-record","integrity":"/paper/2501.10593/integrity","json":"/paper/2501.10593/citation-record.json","paper":"/paper/2501.10593"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:29.057420Z","title":"Basis for intentions: Efficient inverse reinforcement learning using past experience, 2022","venue":null,"work_id":"90c17cd3-7ff8-4ba3-952a-7097280c68d0","year":2022},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.736762Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:28166d63181bfff87bcca9488f4eed1da33b49ed2a6e88717e022d4c85e8d723","observation_id":"d537b2b4-f8f2-4c17-9e38-338ea14f1ee1","resolution":{"observed_at":"2026-08-10T19:06:29.064232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:29.011617Z","title":"Albrecht and Subramanian Ramamoorthy","venue":null,"work_id":"83b6d5f4-7761-43cb-a96c-163fba346632","year":2015},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.746894Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:6d0e60c535e359cc293c08062093e1fff76ac42b409c9f322df274bd00f1818b","observation_id":"7a89f7a3-5005-4e9b-91da-30d964261d5b","resolution":{"observed_at":"2026-08-10T19:06:29.017281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05789","last_updated":"2020-01-09T00:51:44Z","snapshot_observed_at":"2026-08-12T04:09:22.211968Z","submitted_at":"2019-10-13T17:17:52Z","title":"On the Utility of Learning about Humans for Human-AI Coordination","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05789","snapshot_observed_at":"2026-08-10T19:06:26.752581Z","title":"Ho, Thomas L","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.752581Z"},"links":{"cited_paper":"/paper/1910.05789","citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:0f264dc9d6760b1908dddd194a11e5b3b3ae414b96bbc2b35a585abf1bc788ce","observation_id":"f3242f02-021c-4f88-961e-d0361f63e8e7","resolution":{"observed_at":"2026-08-10T19:06:26.752581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-12T16:12:05.550917Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-10T19:06:26.778989Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.778989Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:357ddb164d3a9cadea76c958836e5b1de8165668d869b0e7ab9bf7d9e5c54d7f","observation_id":"28190281-ef35-429a-b64f-fe07fe9e79e9","resolution":{"observed_at":"2026-08-10T19:06:26.778989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.970901Z","title":"Emergent complexity and zero-shot transfer via unsupervised environment design, 2021","venue":null,"work_id":"92de89f1-da9e-47cb-b76e-852a0900898b","year":2021},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.786278Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:e4abf51e9a684f733b89c4d438e32c918632b6fe433d66958c24767d18f5b113","observation_id":"4ad79d62-4ff7-4c76-acc4-ab5a830543dd","resolution":{"observed_at":"2026-08-10T19:06:28.978784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.935116Z","title":"Counterfactual multi-agent policy gradients, 2017","venue":null,"work_id":"cdc9767c-750a-4f4e-990f-da1ca927586a","year":2017},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.818117Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:6cd31df7f40f3c97709b332c6e8047f39f0d15acdc1ca3632df80ded932a98f7","observation_id":"696fb80f-8639-428e-8cbd-89b48b18b58c","resolution":{"observed_at":"2026-08-10T19:06:28.943528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:26.828973Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.828973Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:e82e9ccccbecffea1f35da91c8ad5e54e4b7fee7fe16176acbb70583a5191048","observation_id":"18b4baed-7607-44b5-91c4-13a243e35499","resolution":{"observed_at":"2026-08-10T19:06:26.828973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.866787Z","title":"The evolution of cultural evolution","venue":null,"work_id":"c9ea7f54-3f34-421a-ac67-2f336203a0f5","year":2003},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.836328Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:c7c709725e3b52403da0ff9d699b5643f4a96bab01a643cbf7366c02b36668d8","observation_id":"3694a783-74b9-491e-940f-8dc193a0fc09","resolution":{"observed_at":"2026-08-10T19:06:28.881357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.818646Z","title":null,"venue":null,"work_id":"c6f53cb4-194e-426f-bb89-630f12c1386d","year":2019},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.846414Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:359d1092b9187fd878ed2eb3d9fbacec2e512e43df869c51d5c6217f645377de","observation_id":"ba55ccc7-2f1a-4dcd-b82e-cada4a6cc873","resolution":{"observed_at":"2026-08-10T19:06:28.836315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.769638Z","title":"Reinforcement learning with unsupervised auxiliary tasks, 2016","venue":null,"work_id":"09657109-29d0-4086-b899-0526a9864dd3","year":2016},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.857339Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:95579d1b6a4c2e5b5707e40338f2e89babc02174a0ec6ab7382e48b1035053d7","observation_id":"861f1a24-9d73-4110-b6b9-ea501e3081fd","resolution":{"observed_at":"2026-08-10T19:06:28.781669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.689187Z","title":"Czarnecki, Iain Dunning, Luke Marris, Guy Lever, Antonio Garc´ıa Casta˜neda, Charlie Beattie, Neil C","venue":null,"work_id":"6ac2dc0b-e291-40c3-aa17-02fbd5377052","year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.868220Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:8b846efa8191804466f07754e9437d0f7d4056719cdb56456da3700562e90829","observation_id":"fb0918b5-983d-4fa2-8d0e-2c38e1180c19","resolution":{"observed_at":"2026-08-10T19:06:28.721807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:26.880253Z","title":"Recursive bayesian human intent recognition in shared-control robotics","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.880253Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:422413a073874b1dd5af3625eefcf5f9c5a0feb8249dbc851414a8499edbd940","observation_id":"f7a2753b-44eb-4b42-bcdf-5aa763ea501e","resolution":{"observed_at":"2026-08-10T19:06:26.880253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.663583Z","title":"Losey, and Dorsa Sadigh","venue":null,"work_id":"6f9f5ee8-142d-4ec9-897b-0572223719ec","year":2020},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.888108Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:db783cdc243ff4d9d15bb94c5af1b1d772de05b2321a6158ba84f48a79fea808","observation_id":"c21e5ce3-3bbc-4023-9cfc-b3d1657398eb","resolution":{"observed_at":"2026-08-10T19:06:28.670905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.615008Z","title":"Learning dynamics model in reinforcement learning by incorporating the long term future, 2019","venue":null,"work_id":"d30eef33-d4db-4937-aae1-daacf59bad11","year":2019},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.905877Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:c5f238536ea4e035931e4ea0642094fa4c281f107be106306fdfde490ebfe6f8","observation_id":"d077819f-cd94-43bc-98e4-fa3b906f03d8","resolution":{"observed_at":"2026-08-10T19:06:28.635298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.587788Z","title":"Multi-agent reinforcement learning with multi- step generative models, 2019","venue":null,"work_id":"4723a8c9-05e7-48ed-b946-5d3cb3e86e6e","year":2019},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.911966Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:a9d9a2a8b27f1da660a525c578b1b3d4a4c5f9835bf3cca71c3d9c97c6f135b4","observation_id":"6d49a3f2-990c-4dd7-84ad-83ba94f7f69a","resolution":{"observed_at":"2026-08-10T19:06:28.598765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:26.917903Z","title":"Social learning strategies","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.917903Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:a33fc039ccd64d923226eae76eaaf42f19395e172cbc59f0fbb112aaf6c2a90f","observation_id":"6161702c-d913-4fa4-8997-27b3a7f2f943","resolution":{"observed_at":"2026-08-10T19:06:26.917903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.481193Z","title":"Generalization and network design strategies","venue":null,"work_id":"23258ff9-75d4-47cb-85e2-194c0345fe22","year":1989},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.923958Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:a63a898e3905a1304a03cc5c242e840bae5863b07401a442189b205b9ad86102","observation_id":"a56f853e-6062-473d-b088-c8eaa831ca3b","resolution":{"observed_at":"2026-08-10T19:06:28.508780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.421685Z","title":"Rectifier nonlinearities improve neural network acoustic models","venue":null,"work_id":"f268dd05-3f12-4821-b8d1-ea1cbdae83ff","year":2013},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.929333Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:c06971b5daf9b13bf76336e9506cbaa0a2222e15bd5c2a8e7b2df9236fc20731","observation_id":"129e91d5-557d-48d8-9146-3c3e908aa58e","resolution":{"observed_at":"2026-08-10T19:06:28.453366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.354996Z","title":"Emergence of grounded compositional language in multi- agent populations, 2018","venue":null,"work_id":"2ee42021-2d06-48cf-bb11-6c265e3c8bf1","year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.936560Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:53670993ce44ece740c8ba53de6d9323d1c365ca1756f5a59b18f6ad4f5233df","observation_id":"c26c8b57-50ca-4be1-b317-1a35c8410603","resolution":{"observed_at":"2026-08-10T19:06:28.370840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.319488Z","title":"Emergent social learning via multi-agent reinforcement learning, 2021","venue":null,"work_id":"1e64b488-fb65-4c90-badb-d9f8fdc5655d","year":2021},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.947585Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:a6c1397c1017421501508aa159532591c88428c4cbea00151029a2f32e4bfbc0","observation_id":"b61c1c8b-7e1b-4ca6-92ba-9a9ae73d3ceb","resolution":{"observed_at":"2026-08-10T19:06:28.332017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.288905Z","title":"Srinivasa","venue":null,"work_id":"212f2067-f10d-41d7-b917-7dbd83b1aa5d","year":2017},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.962941Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:d6163eb72d75440e08d6d47c920452335dcb16a377d3c743a9dcc3061c56b0f5","observation_id":"eeae4ba5-5d80-493a-a368-b540d19c68b1","resolution":{"observed_at":"2026-08-10T19:06:28.296403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.232465Z","title":"Albrecht","venue":null,"work_id":"12d75d6e-3b39-4fcc-b5c5-93b0f5fef8be","year":null},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.982192Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:41af4eeee94e9e677cc5ad3486cadcd28706352e9c57cbc5bc7d624cf8eefef9","observation_id":"f00b01da-f6db-4277-9387-0382f7875662","resolution":{"observed_at":"2026-08-10T19:06:28.250550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.162354Z","title":"Tenenbaum, Sanja Fidler, and Antonio Torralba","venue":null,"work_id":"f6c771e1-4804-42c0-9b51-31cb2f24afff","year":2021},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.011753Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:ae217752a6e4c409d15f07fdaa236f66426ed1f98a997fd355c97f92308e49c9","observation_id":"dc68b850-5a84-4e86-98e7-7f65d2f45bb3","resolution":{"observed_at":"2026-08-10T19:06:28.181958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:28.100529Z","title":"Modeling others using oneself in multi-agent reinforcement learning, 2018","venue":null,"work_id":"46279ecf-e6c3-4601-b33c-c506cb892afb","year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.026167Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:18bac926aac730e7f60d69b63d61642d393e1217b0595826f97d1ec2bd5d660c","observation_id":"b08e9966-4202-4252-be82-8c096ead850a","resolution":{"observed_at":"2026-08-10T19:06:28.125248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.034876Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.034876Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:fbb11b25edb5d0ac0481829f096b3b6dc4ceddff6b46be7d817488f3cca69bb7","observation_id":"2673280f-6d84-4a65-a09b-c6cee5f12feb","resolution":{"observed_at":"2026-08-10T19:06:27.034876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.982048Z","title":"Loss is its own reward: Self-supervision for reinforcement learning, 2017","venue":null,"work_id":"baf03905-ced4-44c2-b68c-0c3b52a97121","year":2017},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.046728Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:74e41380d5fc00eecad45ca6f5cfe5233a2f8a2c1b2838dfa7cd5fd2030b79d7","observation_id":"af535b3f-c668-4f6e-a907-9bba527059b1","resolution":{"observed_at":"2026-08-10T19:06:27.994120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.058046Z","title":"Zhao, Archit Sharma, Karl Pertsch, Jianlan Luo, Sergey Levine, and Chelsea Finn","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.058046Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:caaf98a2928cd2b335ae89379a970699e2be8967c32ec031b25c34987b0f764d","observation_id":"96d206e5-8946-4903-8469-b644aa0c6ee6","resolution":{"observed_at":"2026-08-10T19:06:27.058046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.072016Z","title":"Message-passing approach for threshold models of behavior in networks","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.072016Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:3f5f62850533d1b1c3bb5a65de350c1fc1998f690ac25e6dde7a22b2afc723fb","observation_id":"1cbbcdb1-cd8c-42ef-b820-3a27a3bb2390","resolution":{"observed_at":"2026-08-10T19:06:27.072016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.080776Z","title":"Mastering chess and shogi by self-play with a general reinforcement learning algorithm, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.080776Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:d975af67715a1abf8ab0d27eb8004afb208cf067171fcee1875f949ef06eb293","observation_id":"4068f696-d52e-414c-b6f1-74108fd1f5e1","resolution":{"observed_at":"2026-08-10T19:06:27.080776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.904039Z","title":"Smallwood and Edward J","venue":null,"work_id":"29d682cf-d444-47a9-8ac3-0c49229c47ce","year":1973},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.094921Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:24633c395ce817fcf4a3881938543fd3da142c1c9638d2804467630726671871","observation_id":"0e5e48d1-68a2-4b52-bbe4-7563b449296d","resolution":{"observed_at":"2026-08-10T19:06:27.918249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.866963Z","title":"McKee, Matt Botvinick, Edward Hughes, and Richard Everett","venue":null,"work_id":"e8b9aa72-9244-48a3-bb2f-a681466e3fb6","year":2022},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.103156Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:9617b83d4aea7d77b27bf2420b343f129a94e23b1e1afcbbdfb5b2b2b301ece9","observation_id":"6d44c7e6-4d02-4634-baa4-49da968a5114","resolution":{"observed_at":"2026-08-10T19:06:27.878794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.109331Z","title":"Pettingzoo: Gym for multi-agent reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.109331Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:5a02a0f3b5987d0075ee7cd68c117063053290561e97f640c5d2fc2301706e69","observation_id":"be4d5c22-43f9-46aa-8646-0eff70c945bb","resolution":{"observed_at":"2026-08-10T19:06:27.109331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.01753","last_updated":"2019-02-21T01:17:31Z","snapshot_observed_at":"2026-08-10T09:06:00.813932Z","submitted_at":"2019-01-07T11:28:36Z","title":"Paired Open-Ended Trailblazer (POET): Endlessly Generating Increasingly Complex and Diverse Learning Environments and Their Solutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.01753","snapshot_observed_at":"2026-08-10T19:06:27.125935Z","title":null,"venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.125935Z"},"links":{"cited_paper":"/paper/1901.01753","citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:52a3809f08fb7279f91215319d8acd0c70de33092b6bf59e089eb7c830f151b3","observation_id":"fe531969-7b1a-44a8-9409-6e6f0018e467","resolution":{"observed_at":"2026-08-10T19:06:27.125935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.825159Z","title":null,"venue":null,"work_id":"7e59051f-53f6-4b41-a118-8dbb105246dd","year":2018},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.151138Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:5cd29e2bdaa02b14709e231f303739836ed00fd50d5dcfec40cd21306b6bac8d","observation_id":"dc7e7e4a-e1b2-4294-bcfd-d658448eb67e","resolution":{"observed_at":"2026-08-10T19:06:27.831658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.770308Z","title":"Towards generalizability of multi-agent reinforcement learning in graphs with recurrent message passing, 2024","venue":null,"work_id":"e934292a-3bed-4021-8ca9-94d5d2d2689d","year":2024},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.166033Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:40c648478f48880a510da9fae5445f19a9b18cfcbbbe4cd9815820a8b08b3631","observation_id":"10948f30-246e-4d58-bc53-08f5d4e22f80","resolution":{"observed_at":"2026-08-10T19:06:27.782180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:06:27.682370Z","title":"The surprising effectiveness of ppo in cooperative, multi-agent games, 2021","venue":null,"work_id":"57245203-cc6a-48a9-b8f1-9eb7a023459d","year":2021},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:27.178808Z"},"links":{"citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:cd3f67afed0e0b728c520ca8164b86ac83d7f89a1042f5a96d819ce5ed1505f7","observation_id":"12201486-51f9-4452-a6b7-4276c427015c","resolution":{"observed_at":"2026-08-10T19:06:27.717210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-08-09T21:21:10.717989Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-08-10T19:06:26.997151Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T19:06:26.997151Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2501.10593"},"observation_digest":"sha256:a4459d00d44f141bfa82c20d6b7d9ef2ef2484d3541315224bfa1b0a7c279be0","observation_id":"58a30f00-1af9-4bc3-bc2e-861941e7d3c0","resolution":{"observed_at":"2026-08-10T19:06:26.997151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.10593","last_updated":"2025-01-17T22:55:33Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-12T23:31:27.731051Z","submitted_at":"2025-01-17T22:55:33Z","title":"ColorGrid: A Multi-Agent Non-Stationary Environment for Goal Inference and Assistance"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2501.10593."}