{"as_of":"2026-08-08T03:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eaf4bb48566f8ab0ddc71038bbb3d5b9192c6c01838de7b42d6a551b91267f28","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:11:16.587910Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00228/citation-record","integrity":"/paper/2506.00228/integrity","json":"/paper/2506.00228/citation-record.json","paper":"/paper/2506.00228"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.13746","last_updated":"2023-10-31T00:06:14Z","snapshot_observed_at":"2026-07-31T17:57:44.437235Z","submitted_at":"2022-11-24T18:23:28Z","title":"Melting Pot 2.0","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13746","snapshot_observed_at":"2026-08-07T12:11:13.910003Z","title":"P., Vezhnevets, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:13.910003Z"},"links":{"cited_paper":"/paper/2211.13746","citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:c9d84b7c63e7d2aaa3280e496bc5ee2980ce2787d1db677656edb16098ac8523","observation_id":"21a3df4e-59ed-4801-bbe1-383d9630ae0d","resolution":{"observed_at":"2026-08-07T12:11:13.910003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.989924Z","title":null,"venue":null,"work_id":"b7e43c76-a13e-4b38-aab8-ee10cf54a50b","year":2018},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.011634Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:4043f535559ab24adc522304145a7976365f866434f930de4fa39574591b87ff","observation_id":"9890b7aa-e2c6-4eb4-a934-b2358fb8764f","resolution":{"observed_at":"2026-08-07T12:11:21.067079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.801924Z","title":null,"venue":null,"work_id":"2f59e4d3-eef5-41c7-8f6b-f3a1a0c6b38d","year":1985},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.093188Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:4feebe306d6cc02814b0b0f1ddc713bfb2a7f4ec3572cdd1e88af7f664a51f5e","observation_id":"4f31128d-047a-462b-81e2-af00671feb3c","resolution":{"observed_at":"2026-08-07T12:11:20.862541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.655808Z","title":null,"venue":null,"work_id":"47a5b624-1247-46b8-b2bf-db4180bd6a84","year":2009},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.156107Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:6b14926565238a91da47d0c65a5a8dd708c909cec861f778a914b338dff4ee07","observation_id":"4871ed52-95db-46a3-bfbe-0adb79f32873","resolution":{"observed_at":"2026-08-07T12:11:20.717717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.461712Z","title":"J., Leary, C., Maclaurin, D., Necula, G., Paszke, A., VanderPlas, J., Wanderman-Milne, S., & Zhang, Q","venue":null,"work_id":"10f178f2-51b2-430a-8f58-37af9e93a00e","year":2018},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.257188Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:6ff6ba049f9c112c1398d8449217b653a1c831aa58ebf7343d433d9b0f331b62","observation_id":"d89fe5e4-aec0-4ca7-a50d-8efac7df9647","resolution":{"observed_at":"2026-08-07T12:11:20.543953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-07T12:11:14.342823Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.342823Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:0394dfd4d85863d53b7fae58f9f8c5b8249f19ec5f6962897a3c73e220068fef","observation_id":"9fe2ef36-3193-43c3-820e-7a350ad26f42","resolution":{"observed_at":"2026-08-07T12:11:14.342823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.288180Z","title":"L., & Feldman, M","venue":null,"work_id":"733d2692-63aa-4787-8a99-4a443c2ab5d4","year":1981},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.452303Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:ca7a311b1d50f9932d556afca5f39e49a0992e93c5a0b0f370dccc56e8bd50f4","observation_id":"f872eca9-dce9-41e5-a22b-a11a2209abbd","resolution":{"observed_at":"2026-08-07T12:11:20.361782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:20.097539Z","title":null,"venue":null,"work_id":"a53e525b-ecc6-4187-8ba8-239fee7da924","year":2018},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.576770Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:636b5e6715ec8e6ff30b2e7a9a4892a0957823f4cf538cb0bdf484b31de5eb9c","observation_id":"d22c0bbe-ea69-4e13-b200-8c2a728b17fb","resolution":{"observed_at":"2026-08-07T12:11:20.172866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05162","last_updated":"2023-12-08T16:42:15Z","snapshot_observed_at":"2026-07-06T16:58:55.520897Z","submitted_at":"2023-12-08T16:42:15Z","title":"A Review of Cooperation in Multi-agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05162","snapshot_observed_at":"2026-08-07T12:11:14.721088Z","title":"Z., Islam, U., Willis, R., & Sunehag, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.721088Z"},"links":{"cited_paper":"/paper/2312.05162","citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:85d44347705e1eae532bf2abb965ddf41c76e5dda0f7dd1507c1b40474a43572","observation_id":"75ced97b-248b-4a0c-abb2-8c72f6ae46b4","resolution":{"observed_at":"2026-08-07T12:11:14.721088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.921886Z","title":null,"venue":null,"work_id":"158138c9-d625-43e2-9061-b763809313b0","year":2019},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.797219Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:73a05c9840250ae12ab854dbf226f1d5c3228966c6bb971aa798ece49595d410","observation_id":"74c673e1-1f46-4db3-b686-3af8084bfc4c","resolution":{"observed_at":"2026-08-07T12:11:19.988255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.775430Z","title":"A., & Leibo, J","venue":null,"work_id":"2b6adec4-b715-415f-868f-35805de15e56","year":2025},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:14.901379Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:7daced2ba2333b01768015455e9fb63ab11d3cce3ebc93c05592fe84a49522b3","observation_id":"9e83f0b4-239b-48b0-83d7-eef69aab15d6","resolution":{"observed_at":"2026-08-07T12:11:19.830322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.653462Z","title":null,"venue":null,"work_id":"d697661d-16c4-4388-948d-31e36c92229d","year":2018},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.002775Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:3a03225db672bbb8879c60e440d7e5df928fb24d2e15af1cced2b508f1c3d8d0","observation_id":"c4fffaba-a455-4641-a5b9-9f351a9e1a21","resolution":{"observed_at":"2026-08-07T12:11:19.706581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.517887Z","title":null,"venue":null,"work_id":"a366a84c-5e91-48b2-ba93-ae79f4657b5b","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.104515Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:bc6014d7475e449c1e3234d00e732fecb1f95f56c6c87e241fcde160cb24dc28","observation_id":"b296e7e4-1870-4e00-b0fd-bdcd6e53e87b","resolution":{"observed_at":"2026-08-07T12:11:19.573503Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.393722Z","title":"Z., Dueñez-Guzman, E","venue":null,"work_id":"d6fdf174-60d9-4caa-b632-4f508f397595","year":2021},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.249337Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:fcd9c9aeff3ae732a8c1e6913f944e8512341ea48be68222a0df2818d9f537a8","observation_id":"ea03b244-352c-4005-83e7-c5ed8782cfcd","resolution":{"observed_at":"2026-08-07T12:11:19.455778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.01068","last_updated":"2018-03-02T14:39:55Z","snapshot_observed_at":"2026-07-06T05:49:43.427852Z","submitted_at":"2017-07-04T17:02:05Z","title":"Maintaining cooperation in complex social dilemmas using deep reinforcement learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.01068","snapshot_observed_at":"2026-08-07T12:11:15.305521Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.305521Z"},"links":{"cited_paper":"/paper/1707.01068","citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:1873e7d89984a690e6906c0b83cd7ee72b61cf2d11a1ed9b896f21a9a85e3347","observation_id":"bb177233-f6ff-4583-bb72-6c176464d91c","resolution":{"observed_at":"2026-08-07T12:11:15.305521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.301984Z","title":"M., & Laland, K","venue":null,"work_id":"8a304046-ca60-41cf-86ca-ab89930b722c","year":2012},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.389287Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:d879819a830a63bca268e783cd5549227389603cb798c551a308b14594c2c0c3","observation_id":"d3f31d28-e60b-4166-84d1-1304d9fcba8b","resolution":{"observed_at":"2026-08-07T12:11:19.352597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.172411Z","title":null,"venue":null,"work_id":"c9694c6d-0cc4-4d2e-9352-16522ee53b05","year":2022},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.435299Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:7c09968eedbf5f10dd8aad70496781aa800708d6f494567a0bcc8f4c5b90d2ba","observation_id":"46dc3daa-1ebd-46d9-be32-18c54378099f","resolution":{"observed_at":"2026-08-07T12:11:19.193494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:19.132322Z","title":null,"venue":null,"work_id":"15bf223e-7959-481b-bb9b-eaa907a5cf3a","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.505391Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:43a5164ba7641bf5a94a3f8352a7757391f0aa381b9e406729b7df737be74dbd","observation_id":"8dd7abf4-7d84-4235-b877-69e28704bd0c","resolution":{"observed_at":"2026-08-07T12:11:19.143369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:18.974175Z","title":"S., Souly, A., Bandyopadhyay, S., Samvelyan, M., Jiang, M., Lange, R","venue":null,"work_id":"edd17e23-bd1b-4f64-b414-5e4178625b5e","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.612298Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:e58a7e8f434623d75caed7d0be60bdeb576a3cde2b8a39a2903436ce64989edc","observation_id":"2cf2a67e-164b-40db-82c1-87822df64395","resolution":{"observed_at":"2026-08-07T12:11:19.048742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:18.765888Z","title":null,"venue":null,"work_id":"68861b29-b48d-4380-bf9e-a3280b64f720","year":1971},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.740501Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:e60ad3233bd337dfeb8da2c6ace51622357b783b8787cdabdd08227cda43058e","observation_id":"329f953e-3520-49f6-9f70-c90c7de40f29","resolution":{"observed_at":"2026-08-07T12:11:18.856624Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:18.569691Z","title":null,"venue":null,"work_id":"f6564adc-e549-444b-8708-4182e3345723","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.872814Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:679166c955246b80dbaf5687faa9f7251b54b2f41218844096394bb271e94017","observation_id":"c40b56fa-1751-4832-823b-c99cf95f872b","resolution":{"observed_at":"2026-08-07T12:11:18.632753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:18.320977Z","title":null,"venue":null,"work_id":"5231009e-3775-40bd-8b77-46a798e58b6d","year":2021},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:15.981676Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:96794195ed09dd695d9801cbeaf8593671b1aaea196ae29034c2ca3f30249b0e","observation_id":"cbb68f4d-54ab-407a-9082-b66e9093c6c6","resolution":{"observed_at":"2026-08-07T12:11:18.421534Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-07T12:11:16.127892Z","title":"U., De Cola, G., Deleu, T., Goulao, M., Kallinteris, A., Krimmel, M., KG, A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:16.127892Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:dc683817ca50eb6896f7d73b5141782e87c8416d8e8d0b5ce0044142091210fc","observation_id":"60054f90-5e71-45c4-914f-bee56d776d3c","resolution":{"observed_at":"2026-08-07T12:11:16.127892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:17.946986Z","title":"P., Duéñez-Guzmán, E","venue":null,"work_id":"d4c79659-c67d-4154-8b8b-03636828a131","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:16.260881Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:785d1f5b9882b82d5dabd64d87165c01c1d64cdcb543b44c95656cc9dd84c067","observation_id":"52784d61-2f72-4f82-87d1-194e0fea8459","resolution":{"observed_at":"2026-08-07T12:11:18.140204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:17.555127Z","title":null,"venue":null,"work_id":"308216ce-bf32-4766-911c-d5366c18a556","year":2020},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:16.352479Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:80fa4f0b2dcc3ceb94708b77459a63acf124892c26c6a965a6b79bb92a9657c5","observation_id":"fe259235-7db7-46aa-bca3-d83c05ae942e","resolution":{"observed_at":"2026-08-07T12:11:17.697533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:17.225107Z","title":null,"venue":null,"work_id":"510eb93f-3c6e-473d-9c56-b604f5853c26","year":2021},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:16.483503Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:d501b4c2cfc9c5358a8bf7ffc994c14ffca4c96870bba420f7b757d8e999b7af","observation_id":"e5c7d6fe-83da-4753-a2ba-cb75375f7600","resolution":{"observed_at":"2026-08-07T12:11:17.355131Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:17.014779Z","title":"V ., & Plaat, A","venue":null,"work_id":"a8285e00-01e6-4ae3-9d6a-f3b051b65e59","year":2023},"citing_paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:16.587910Z"},"links":{"citing_paper":"/paper/2506.00228"},"observation_digest":"sha256:40b54f40ca327430bcdbfbff2ebc8857a1e072ef855b4d19ca6c04209406a9ce","observation_id":"a53893f8-368f-4a27-b6d6-90c43068b67e","resolution":{"observed_at":"2026-08-07T12:11:17.092687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00228","last_updated":"2025-05-30T21:04:47Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-07T12:07:25.546045Z","submitted_at":"2025-05-30T21:04:47Z","title":"Sorrel: A simple and flexible framework for multi-agent reinforcement learning"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2506.00228."}