{"as_of":"2026-08-09T16:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7d5ab509cf2dfc67392ba8b9a780bab86fb0fe7d2d21d4b88b45335946af72bd","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T13:41:33.048760Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.24423/citation-record","integrity":"/paper/2605.24423/integrity","json":"/paper/2605.24423/citation-record.json","paper":"/paper/2605.24423"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.376902Z","title":"org/CorpusID:258845718","venue":null,"work_id":"70a65e7a-124b-4b68-891e-663ad927683c","year":2020},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:2f1ee13dc16fcdb5743c938b6bd436611e2598e461dc68ffe4be66b9b30c1fd9","observation_id":"2994aa2f-ea39-486b-9bbb-c0ae1fbbb9ca","resolution":{"observed_at":"2026-07-09T01:05:50.377952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":"1606.08415","doi":"10.18653/v1/n19-1122","metadata_source":"pith","pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gaussian Error Linear Units (GELUs)","venue":"cs.LG","work_id":"0466fd22-03a1-4a61-af0a-a900e77bb023","year":2016},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:b49c805e59979dd1ca37005e94d9aa4a0f670dee7f3e77130d8227fae8d2f7cd","observation_id":"265e1385-03b7-47fa-b88a-ab2b6308995f","resolution":{"observed_at":"2026-06-30T13:44:40.646681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09846","last_updated":"2017-11-28T16:16:21Z","snapshot_observed_at":"2026-07-06T06:11:24.949724Z","submitted_at":"2017-11-27T17:33:27Z","title":"Population Based Training of Neural Networks","version":2},"cited_work":{"arxiv_id":"1711.09846","doi":"10.48550/arxiv.1711.09846","metadata_source":"pith","pith_arxiv_id":"1711.09846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Population Based Training of Neural Networks","venue":"cs.LG","work_id":"252bc4d9-2cae-4a9a-98ba-b954ab35a78b","year":2017},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"cited_paper":"/paper/1711.09846","citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:787b381ae1b26f25813dc252b1952647a1c344cd8952bbddc47e76a5ff8a3e5d","observation_id":"8f643b94-2f42-4010-9287-9968208ae998","resolution":{"observed_at":"2026-06-30T13:44:40.655360Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:52:59.706755+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:52:59.706755+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.378471Z","title":"org/CorpusID:235313679","venue":null,"work_id":"e239de45-dfbc-4fe4-9340-9268e6df01c3","year":2021},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:30bd4b92773f611a2b6e278d7a10eeab00320c7d1ec16e01baaaf209550ff90c","observation_id":"16824615-afb9-47c1-9d37-92f47a96f050","resolution":{"observed_at":"2026-07-09T01:05:50.379622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.375189Z","title":"Lee, K.-H., Nachum, O., Yang, M","venue":null,"work_id":"dcc422c0-b1d5-4e60-b437-0a1ec6965bc2","year":2022},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:da5448caa6094b494fdfbaadf8d3abc1152dcb0c5c369aaaca3f1c69db141e07","observation_id":"a8845882-9b53-45fb-b7da-d223bc92992c","resolution":{"observed_at":"2026-07-09T01:05:50.376310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07978","last_updated":"2025-02-11T21:52:19Z","snapshot_observed_at":"2026-08-08T20:41:10.087154Z","submitted_at":"2025-02-11T21:52:19Z","title":"A Survey of In-Context Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.07978","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07978","snapshot_observed_at":"2026-06-30T13:44:40.651347Z","title":"arXiv preprint arXiv:2502.07978 , year=","venue":null,"work_id":"24545a57-6974-4e7f-9d8e-949eb859bee3","year":2025},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"cited_paper":"/paper/2502.07978","citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:b0835fbab1deb4686a06c15be98091ff6cd75d7f1b9ac07e04c4c1668da355ee","observation_id":"9d35b37b-59e1-43eb-9bb7-aa9eedff9f76","resolution":{"observed_at":"2026-06-30T13:44:40.652995Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.380170Z","title":"Nikulin, A., Zisman, I., Zemtsov, A., and Kurenkov, V","venue":null,"work_id":"20af6136-b5cc-4776-a629-e8d02a893e56","year":null},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:323cc9e7fba54dc094059b7458fb500e85c8a512e4c0694ec8eeafde5aaf6ada","observation_id":"fdddb94a-055c-40ba-a3a0-bf0bb16f9ce6","resolution":{"observed_at":"2026-07-09T01:05:50.381274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.383558Z","title":"Papoudakis, G., Christianos, F., Sch¨afer, L., and Albrecht, S","venue":null,"work_id":"6326d7b7-72fa-4389-a8db-9373fc065b68","year":2021},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:65abfc3ce20f3d2a9f5915492356713f97c8d60327c2f7a517361bb0c604f12f","observation_id":"3cf610d3-6094-4450-b28e-6c46046c07d0","resolution":{"observed_at":"2026-07-09T01:05:50.384709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.381844Z","title":"Rahman, A., Fosong, E., Carlucho, I., and Albrecht, S","venue":null,"work_id":"5f0f8580-47a6-4610-8648-aafefaae4fe9","year":2023},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:f0dada814b7a1dade4fb6a1392cd39485369d46cae67b74bd04dbc4983f3bddc","observation_id":"094f98ac-c233-4892-81d0-2936901bb134","resolution":{"observed_at":"2026-07-09T01:05:50.382977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.385224Z","title":"Rahman, M., Cui, J., and Stone, P","venue":null,"work_id":"97dc3d27-3c91-41e4-b5ba-7e9c4b96793c","year":2024},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:b4213aebae6a9e51679aac9669c25b459c1e30d74b96b878cf238f4424ada2cc","observation_id":"8c372c56-e4e3-46d5-9d5f-629fc0451f94","resolution":{"observed_at":"2026-07-09T01:05:50.386230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:401e2e102d1992d92e7f7292f2a38349f6da715c534f3399f50ae3bf7ff37c90","observation_id":"68c6b7eb-5f46-4fe6-a84f-fd68489ca1ed","resolution":{"observed_at":"2026-06-30T13:44:40.650034Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2011.00583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-07-04T09:29:44.152952Z","title":"arXiv preprint arXiv:2011.00583 , year=","venue":null,"work_id":"33a12617-fa67-4a9a-acdf-7907f223631e","year":2020},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:1cdfc8299b745bdf739eacb0879c87fb2e6525126e76353cc1de3394f61faa8c","observation_id":"1622cf25-36bc-4b78-ac98-ee0b0c320d51","resolution":{"observed_at":"2026-06-30T13:44:40.658304Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.368349Z","title":"13 Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork A","venue":null,"work_id":"dda7b902-c08c-467a-9a8e-8c58cfc46c32","year":2025},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:2e36e6e2d3e3f696c65fafc5904860190a04ef1ba8d20ac0b82e0f1662a9f9ac","observation_id":"297e9e37-ef01-4313-b3fc-9ccc8ac17698","resolution":{"observed_at":"2026-07-09T01:05:50.369574Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.370155Z","title":null,"venue":null,"work_id":"4a1ddf72-79fc-4adf-bbd7-846c7ca05c3d","year":null},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:4389f1d5e22b2bbedf660e58f9b19c418d5bacd4dbc89da71e00108b758a08e0","observation_id":"257aa6cb-219e-4e42-9005-ebe973523059","resolution":{"observed_at":"2026-07-09T01:05:50.371255Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.371862Z","title":null,"venue":null,"work_id":"9d046a6c-0218-43f3-8ffb-8a69ce897d63","year":2023},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:e50426eef7b05f277a512689f1113c1eacab2a378511c3f563a4bfb277d5a489","observation_id":"b726f50b-16e6-439b-8866-9d280035ccb8","resolution":{"observed_at":"2026-07-09T01:05:50.372914Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.373448Z","title":"These layers perform channel-wise feature transformation without spatial mixing","venue":null,"work_id":"e71f7f3e-f4d2-428d-bae3-bcee315d0d7f","year":null},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:fa827413f5e75b97fb10acb10dea5d165124bcef99c76daf0aae5c68e218907e","observation_id":"1d53bfb5-76d2-4fab-af37-51755952b90b","resolution":{"observed_at":"2026-07-09T01:05:50.374630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T01:05:50.366619Z","title":"with prior","venue":null,"work_id":"ae7987c1-002a-4eb5-b3b4-bec7752a49ff","year":2014},"citing_paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T13:41:33.048760Z"},"links":{"citing_paper":"/paper/2605.24423"},"observation_digest":"sha256:ff6b3ca8ffde116fbf964962df69688b59c1917e566483843e303ffceac837bf","observation_id":"c178aa6a-d8fe-46b7-a1db-799a383de70a","resolution":{"observed_at":"2026-07-09T01:05:50.367729Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.24423","last_updated":"2026-05-23T06:39:21Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T00:56:47.482154Z","submitted_at":"2026-05-23T06:39:21Z","title":"Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":3,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":1,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2605.24423."}