{"as_of":"2026-08-07T07:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:548019d187df4fe1786598c4a93195ffce13123a6eec1efe009de0301d46a6cf","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:20:32.169248Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18537/citation-record","integrity":"/paper/2506.18537/integrity","json":"/paper/2506.18537/citation-record.json","paper":"/paper/2506.18537"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:28.311324Z","title":"Foerster, G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.311324Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:8a924c4f96de01ced45c20fdda22fb3d1caa00d5340dc29b90a8da9880242fda","observation_id":"5b9d98e1-2f13-4a8b-8fb4-7e2a6f47ae76","resolution":{"observed_at":"2026-08-06T23:20:28.311324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:38.477073Z","title":null,"venue":null,"work_id":"71aaf202-9b63-4a3f-8e02-732d57db9156","year":2017},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.366523Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:cc9e81c229f1ced48b66247c4acb4653df05ec444a6956662d0b71be4178fe27","observation_id":"670b9cf7-041f-435a-b87d-4fd94af0e41f","resolution":{"observed_at":"2026-08-06T23:20:38.550524Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:38.356609Z","title":null,"venue":null,"work_id":"27b7ef04-c046-4f22-a8a5-852a417dcbd2","year":2022},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.450660Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:052d1b614d1a4a5e1c41916c1d5933f7aa728aa040f4671e9a3af4f5dc0d80f0","observation_id":"892c0908-7457-4ed2-b477-2495d8df3d51","resolution":{"observed_at":"2026-08-06T23:20:38.421622Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:38.187578Z","title":"Rashid, M","venue":null,"work_id":"b0e5a671-b910-4054-997e-d01e004d6ce4","year":2020},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.521090Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:e76ffee799be50b84ecadf7aae2fa9aae412232c12f9bdf922b64c2842b76ff6","observation_id":"7086a3b2-c44a-4683-8ea7-b2911993b7b4","resolution":{"observed_at":"2026-08-06T23:20:38.230715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:38.034044Z","title":null,"venue":null,"work_id":"407c359d-14bf-43ee-b56b-46c677acf4bb","year":2021},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.562989Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:6e212a9efdf25fe3d5d9023140041137d2d5914a4ee4f893c21a9a62665ca422","observation_id":"7ca7ab7e-ec9f-4e6c-b95c-a76f32fe5141","resolution":{"observed_at":"2026-08-06T23:20:38.098300Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.872290Z","title":null,"venue":null,"work_id":"eb267a01-64d3-4387-a2ff-90ae4c7c747d","year":2019},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.624855Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:472e40da7509d3aec83700405475e6f2d7c37525d32d6d7cab473fe1da96e303","observation_id":"51b1d0c6-6538-43a4-8d92-cdacd102bf9b","resolution":{"observed_at":"2026-08-06T23:20:37.949118Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.690579Z","title":"Sunehag, G","venue":null,"work_id":"e052b22b-01b0-4e81-908f-6fc3546e86fb","year":2018},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.696489Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:71f973d405b5c30748517d07460c46a19826472d0ab23db1eab53439be3831d0","observation_id":"bcc92c2c-ac51-40c4-8e86-91aebc4546b2","resolution":{"observed_at":"2026-08-06T23:20:37.772354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.481577Z","title":"Hernandez-Leal, B","venue":null,"work_id":"264e7e4f-55f7-4a24-8f36-1768e14cf90b","year":2020},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.769153Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:6fc9a34a592ae8abc83156bddfc1dced01ab2c4dca3af00fba24a0d379317099","observation_id":"f03313aa-1f87-42ec-b468-756ec9790148","resolution":{"observed_at":"2026-08-06T23:20:37.555190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:28.803514Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.803514Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:91482baacf073e3fa80437fc9624c7ba7d08cfe3546ce213e95cb3931ffcb10c","observation_id":"62c69c87-b74b-41cc-a208-ef9d7c55579c","resolution":{"observed_at":"2026-08-06T23:20:28.803514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.309816Z","title":null,"venue":null,"work_id":"da23dbd7-c1c8-4883-b37c-0ce0b2481905","year":2022},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.817421Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:c4e06445294ef3e6a59251901143d49f4add6ca3ccb1ac3a6d264271b55c0146","observation_id":"7702dffd-a447-4a1c-94a4-2ee8706b91c6","resolution":{"observed_at":"2026-08-06T23:20:37.354835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:37.081625Z","title":"Egorov, A","venue":null,"work_id":"d65be87c-f781-4f5b-a838-8d003d13dfee","year":2022},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:28.890898Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:1aa4e90c490248f6995744886f2a572ac270326661bb0587a24c4611eff3e020","observation_id":"4ddf7ce3-a302-4ad3-8304-5d4aeb044141","resolution":{"observed_at":"2026-08-06T23:20:37.196178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15836","last_updated":"2025-09-02T08:16:33Z","snapshot_observed_at":"2026-08-06T22:05:24.604541Z","submitted_at":"2024-06-22T12:40:03Z","title":"Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models","version":2},"cited_work":{"arxiv_id":"2406.15836","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.15836","snapshot_observed_at":"2026-08-06T23:20:32.660906Z","title":"Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World Models","venue":"cs.LG","work_id":"26dfc0c8-8422-441d-b43a-d2b1eaf9c515","year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.004887Z"},"links":{"cited_paper":"/paper/2406.15836","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:ec2e93c987b962312b9dc8dd35da0cd26caa4cfbf5358bfac2380e03caefc8df","observation_id":"78fe9301-a32b-410b-85db-9b54424ff29b","resolution":{"observed_at":"2026-08-06T23:20:32.702325Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.856912Z","title":null,"venue":null,"work_id":"ca0386fa-ab4c-401c-affd-5964b9ea0c56","year":2019},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.078472Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:a3919c5ea21366a0e8f4d21bafaa210174670b2336a6a7548e98c3582d43624e","observation_id":"ec09dc8c-c50d-436b-a0a7-b1398fb45a70","resolution":{"observed_at":"2026-08-06T23:20:36.937261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.623552Z","title":"Zhang, G","venue":null,"work_id":"f025a12a-18e8-4680-872f-3d7aad6b8aed","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.184049Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:3501054279e38fa0686110b4914c962f13e86263a8a557d29ee75227e507e98c","observation_id":"f34b69ad-927f-4bdb-8911-999c70ec660c","resolution":{"observed_at":"2026-08-06T23:20:36.767503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-06T23:20:29.283214Z","title":"Hafner, T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.283214Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:38539087135cebddaaa2ea755d49965e8cb53f3f06e7a6b38566e23a328ddc41","observation_id":"aa327fd1-8690-4a44-9268-1fe9e3f21bfb","resolution":{"observed_at":"2026-08-06T23:20:29.283214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-06T23:20:29.344519Z","title":"Hafner, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.344519Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:defb2bef26dfef063f80f30508821218b42d7c225c51c2d31d52d9c70bd9e338","observation_id":"8405a811-c03a-4b27-9035-0d95d19af726","resolution":{"observed_at":"2026-08-06T23:20:29.344519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.411915Z","title":"Robine, M","venue":null,"work_id":"2c819f60-4a7c-4da4-a375-8fa3a7ff0ae5","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.406224Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:e5778c11841ab23e6e415d9321dc58d1f60a4b169dcb34ee97503d8d5ef47392","observation_id":"8102a6c5-1fb3-41d1-b4be-b2dcc2f3f801","resolution":{"observed_at":"2026-08-06T23:20:36.506890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:36.205313Z","title":"Vaswani, N","venue":null,"work_id":"c37792a4-7eea-42de-89f8-131bcf7bdac3","year":2017},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.536183Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:2c2957bf326458757a29eebdc678553eb3506c0c90e5cceb76638d765bf8d0dc","observation_id":"47055219-0b33-4145-acdf-f327c2c81e86","resolution":{"observed_at":"2026-08-06T23:20:36.285500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:35.830225Z","title":null,"venue":null,"work_id":"e81cbd04-2f9f-46ef-8666-90cbb719fdbd","year":2016},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.685619Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:d4507e5ce62e35f624cfbc4e9a1c5f3c6e24f732f4e633168d21c75eecd33072","observation_id":"753ab512-5a5a-4986-8682-de0db114877a","resolution":{"observed_at":"2026-08-06T23:20:36.000493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11260","last_updated":"2025-09-10T14:02:23Z","snapshot_observed_at":"2026-08-07T05:28:26.048880Z","submitted_at":"2025-01-20T04:00:02Z","title":"A Survey of World Models for Autonomous Driving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11260","snapshot_observed_at":"2026-08-06T23:20:29.802749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.802749Z"},"links":{"cited_paper":"/paper/2501.11260","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:9c6638737579c87b47ab4bd27e963e0d8a1c70780658f98f062978f994093cb5","observation_id":"45d3a010-12e4-4047-8c27-7c6228b5ec26","resolution":{"observed_at":"2026-08-06T23:20:29.802749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:35.533006Z","title":null,"venue":null,"work_id":"16be6bc4-dc87-478f-81ae-1cdde9f0f64a","year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:29.923185Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:cf4406c3bd5f3297afac6bc095a80f81e75ad10908c60d8cb1b00e91f9c18a1e","observation_id":"5d65e8b3-7495-439c-876c-ee9891189759","resolution":{"observed_at":"2026-08-06T23:20:35.604750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:35.380346Z","title":null,"venue":null,"work_id":"61fc7e99-cb1e-4953-9819-e391f652cc7f","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.015588Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:43e9ec669c7389036e21f8c9420c1568493409d45d1a2cb05afb2e3571cd2d48","observation_id":"7f3c1df7-7ece-4c0e-8ff3-70f7d30b48ef","resolution":{"observed_at":"2026-08-06T23:20:35.439578Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:35.158411Z","title":null,"venue":null,"work_id":"ea384ed3-d9a9-4f15-a09a-2da92d35c241","year":2025},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.117925Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:29faa680498303e0d58d587889e3a2c9f092dfe8cc06f7f7474c2d0b08ba97f2","observation_id":"e0305426-09ee-41c8-ba35-497340364e5d","resolution":{"observed_at":"2026-08-06T23:20:35.267342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:34.974884Z","title":null,"venue":null,"work_id":"b800395d-71f4-49f0-b68a-bccf13d6b173","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.187134Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:892c762f47b4a4f0bd327101fe57ef828f124d9556b2ba0f574dbb396397b2d9","observation_id":"d56e01c4-570c-437f-a3be-409fa6f8e06f","resolution":{"observed_at":"2026-08-06T23:20:35.065567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:34.788599Z","title":null,"venue":null,"work_id":"b336f8f8-5d4a-4a77-b170-d64b2e1a4ca8","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.226022Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:f8cc3e10a0983bc560823f99b6b409f494c01e83bd4377cc9f4a9a91d7b80424","observation_id":"63d6670e-ecd6-4555-97bf-536d9f267df8","resolution":{"observed_at":"2026-08-06T23:20:34.884792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:30.305724Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.305724Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:bd328aec31c65823306f3a9a28f0a7f5e595d8b09531a413478e95681a872702","observation_id":"69867348-7969-4bbc-95f1-24cb4116f468","resolution":{"observed_at":"2026-08-06T23:20:30.305724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:34.545074Z","title":null,"venue":null,"work_id":"f06774ef-7423-4ede-afe8-618f732ff955","year":1986},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.326286Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:c8d535de24e377c870d521c51dfa8b89267c5772c607c48e9fef0763ebfaaca4","observation_id":"9e14a86e-bb17-4ae6-9f95-b0650677a5e3","resolution":{"observed_at":"2026-08-06T23:20:34.687038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:34.371560Z","title":"Kaiser, M","venue":null,"work_id":"c4b3d02d-df67-414b-a3a6-ba10851fee95","year":2020},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.387216Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:e8736f0298aff7be83e3bf8ccf878e80167bb18db23f49d02da92085a2c4c736","observation_id":"29ef450f-0f10-48ee-967a-420008cda3ec","resolution":{"observed_at":"2026-08-06T23:20:34.431278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-03T15:20:23.515607Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-06T23:20:30.455023Z","title":"Hafner, T","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.455023Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:1a56570518ee52bf1a2100e71a0e0116475ccaed1f88ef056b86255a267f53ff","observation_id":"a85dcc65-b8d3-42e7-9cb1-57d9d49a8948","resolution":{"observed_at":"2026-08-06T23:20:30.455023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:34.182870Z","title":"Micheli, E","venue":null,"work_id":"ea1ead68-9a77-4b13-a69a-8e1d6d3a0ad9","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.660794Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:2a47144ff1f223bab223a251eb5863b630ef3fbd21038e2ca12c55f456a8d259","observation_id":"d6887050-c496-42b9-b1cb-97dab50519cc","resolution":{"observed_at":"2026-08-06T23:20:34.293068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.990615Z","title":null,"venue":null,"work_id":"e44a6eec-2c63-446d-9581-bc99738960d7","year":2022},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.717149Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:c060981330f583e44e64efe6bb735927e0a17bc6def0c0c1564056391ff8e0dd","observation_id":"83cba1cd-5af4-40a8-a889-c6fa7942aa32","resolution":{"observed_at":"2026-08-06T23:20:34.083836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:30.812755Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.812755Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:549c4ff4cd50766ec6df5506b8781adb6e16f09013142e85967db4c5b4607f03","observation_id":"cdcf0096-8500-4471-be57-a2a7f69f86ba","resolution":{"observed_at":"2026-08-06T23:20:30.812755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.873877Z","title":null,"venue":null,"work_id":"070fd1d2-e987-4c40-a6ef-2d825ca5cdf8","year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:30.944783Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:a9860b955d4baaa5f84d7a6188997222dde42c00a950c479a21a3311d97d4100","observation_id":"3c067b8d-2b56-494a-847b-ebb110e9221a","resolution":{"observed_at":"2026-08-06T23:20:33.925377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:31.028162Z","title":"Schrittwieser, I","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.028162Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:9e487dc11993686f83a7b2a8660398a22bd921c9fb42193688e655d231326c3c","observation_id":"b5843f77-6448-457d-bbb3-e64d2aaf2308","resolution":{"observed_at":"2026-08-06T23:20:31.028162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.711919Z","title":"Jaegle, F","venue":null,"work_id":"8a99ec54-bfd0-46de-821f-6c3a72da274d","year":2021},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.081223Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:024c172e746b9045a73523c6ca6f84ceaa297a62b92c446d6fca9b9734286fa8","observation_id":"9d48df79-19b7-48b7-ad84-6515c0db7b00","resolution":{"observed_at":"2026-08-06T23:20:33.804133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T23:20:31.164693Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.164693Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:77f66728280ffc7fceb48587c8d50b48a7161e6d3bfd926cfd526360dd651b14","observation_id":"00f35743-d668-45c1-b0f3-afe9be41a040","resolution":{"observed_at":"2026-08-06T23:20:31.164693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.00255","last_updated":"2019-06-17T12:45:41Z","snapshot_observed_at":"2026-08-03T16:46:39.547308Z","submitted_at":"2019-02-01T09:59:10Z","title":"Policy Consolidation for Continual Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.00255","snapshot_observed_at":"2026-08-06T23:20:31.219011Z","title":"Kaplanis, M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.219011Z"},"links":{"cited_paper":"/paper/1902.00255","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:11cc08e22a8a25704c54b888a70f443a4d14377148eb5edb90099d89251825ed","observation_id":"f6c7e6c7-a0e5-42fc-8024-a970b62bd7da","resolution":{"observed_at":"2026-08-06T23:20:31.219011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.588101Z","title":null,"venue":null,"work_id":"1b2c403b-796a-42e2-b38e-7f70087e916a","year":2021},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.255948Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:c4855812c0892aca5b191de421cfee6445411837a6dcc94b1fdb40b779e780e3","observation_id":"82f832ce-301b-4726-a849-9592a7234465","resolution":{"observed_at":"2026-08-06T23:20:33.640682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-06T23:20:31.310103Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.310103Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:3fe470ef3053f2c8fefe682c7bdfc02e492056d135ac786a38471610593bf523","observation_id":"a37fddcc-757e-4d52-a820-677a86314d8d","resolution":{"observed_at":"2026-08-06T23:20:31.310103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.486212Z","title":"van den Oord, O","venue":null,"work_id":"7f345ad7-fccf-4aa1-9c52-6dc423a0bef8","year":2017},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.367005Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:05ecc0b475ba990454d56af78286b468c16f3d89a1526180f3f726951b07329b","observation_id":"5be1d56b-27d8-41ef-a37e-6c2a4112c066","resolution":{"observed_at":"2026-08-06T23:20:33.526786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1612.03801","last_updated":"2016-12-13T12:19:48Z","snapshot_observed_at":"2026-07-06T05:22:21.129782Z","submitted_at":"2016-12-12T17:32:49Z","title":"DeepMind Lab","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.03801","snapshot_observed_at":"2026-08-06T23:20:31.423861Z","title":"Beattie, J","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.423861Z"},"links":{"cited_paper":"/paper/1612.03801","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:94cf27c90de34a53b20d25b4146b13dcc943420c5f10e582f357baf658367db9","observation_id":"97aea435-9078-4de1-8748-a7caad63346d","resolution":{"observed_at":"2026-08-06T23:20:31.423861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.367108Z","title":null,"venue":null,"work_id":"d0154d72-619b-4e6c-a9d9-d1972395767c","year":2024},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.486552Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:52549e8670e7e1137cc43869b88392c92addb30a4f63674f448963f922eb4924","observation_id":"09bed2c9-ca32-47ab-ae08-7ff29f7001c8","resolution":{"observed_at":"2026-08-06T23:20:33.416713Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01144","last_updated":"2017-08-05T22:45:19Z","snapshot_observed_at":"2026-08-01T18:34:23.156273Z","submitted_at":"2016-11-03T19:48:08Z","title":"Categorical Reparameterization with Gumbel-Softmax","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01144","snapshot_observed_at":"2026-08-06T23:20:31.535334Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.535334Z"},"links":{"cited_paper":"/paper/1611.01144","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:dae6add9f5770ff0560f74290abfea22d33f349a355edba3faab84c0250f3926","observation_id":"09d6e2b7-d554-411d-9174-89e35ab71755","resolution":{"observed_at":"2026-08-06T23:20:31.535334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:31.619481Z","title":"LeCun, B","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.619481Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:9e93e38a206750eda09be6608fd1e9bd00d8177e2e2c7989039b06cfcba25b6d","observation_id":"592c5658-206b-4f0f-9b53-e57bd0aa7a3d","resolution":{"observed_at":"2026-08-06T23:20:31.619481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-06T23:20:31.697779Z","title":"Bengio, N","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.697779Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:da3845b1d7f578df181856f1e4a175c5e26228585451cf53dd98fcbf1f7dbabd","observation_id":"7430370c-5a14-4f31-84b9-d241af7e2256","resolution":{"observed_at":"2026-08-06T23:20:31.697779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.215391Z","title":null,"venue":null,"work_id":"3cd0673b-e329-4397-9a10-a3fb20df3b72","year":1998},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.790288Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:c59f16dc4fecd9db091e64c35b5c86818706ced197d70c9e585d39f483182ca7","observation_id":"20a7be27-0e4f-4fa7-a9ba-3e49864a3458","resolution":{"observed_at":"2026-08-06T23:20:33.283106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:33.086838Z","title":"Samvelyan, T","venue":null,"work_id":"c077f851-9293-4e45-9389-592368cbcf78","year":2019},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.851998Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:bb6ca9ce6cb89bfa39762653652f7863c23286a5d4610a0ed2ad368bdc74464f","observation_id":"d37b0c5b-51df-4556-9e2d-bf6fb873780c","resolution":{"observed_at":"2026-08-06T23:20:33.129379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:32.968916Z","title":null,"venue":null,"work_id":"bfe00c64-cf5c-4873-b264-23d839b72a08","year":2021},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:31.969512Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:c3aa701251f7ca9eab8cbcc8fdc3e7c779ab8bcf773623eb40c934ea740878c0","observation_id":"642f466d-0bc1-470e-aa98-edaad5891daa","resolution":{"observed_at":"2026-08-06T23:20:33.007884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13746","last_updated":"2023-10-31T00:06:14Z","snapshot_observed_at":"2026-07-31T17:57:44.437235Z","submitted_at":"2022-11-24T18:23:28Z","title":"Melting Pot 2.0","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13746","snapshot_observed_at":"2026-08-06T23:20:32.017785Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.017785Z"},"links":{"cited_paper":"/paper/2211.13746","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:7f9c780ab43bdd612d2853c5498da0427c1d488be02dd65ed4d5aed391c8b6b7","observation_id":"ccb30152-bd25-4b84-b799-820587482dd7","resolution":{"observed_at":"2026-08-06T23:20:32.017785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-08-06T23:20:32.068608Z","title":"Papoudakis, F","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.068608Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:973884b941305f2c08ff3c84ff6cfcc77e091fffc150e7b10fe9cc624cb3bfdc","observation_id":"75e6f2ae-b847-4c12-9093-6f0199de36f7","resolution":{"observed_at":"2026-08-06T23:20:32.068608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04773","last_updated":"2025-07-03T18:43:16Z","snapshot_observed_at":"2026-07-06T20:32:43.707713Z","submitted_at":"2025-02-07T09:17:02Z","title":"An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks","version":2},"cited_work":{"arxiv_id":"2502.04773","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.04773","snapshot_observed_at":"2026-08-06T23:20:32.296923Z","title":"An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative Tasks","venue":"cs.LG","work_id":"fcbceb90-4d09-4b75-bee4-126b122e85c5","year":2025},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.100038Z"},"links":{"cited_paper":"/paper/2502.04773","citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:6f41a73b9843c6496c3e719bf0e289e6b875b313eea5f55b93cf9c0dfe6a1c61","observation_id":"6b60707d-1f0a-403e-8d8c-30a975cfb7ad","resolution":{"observed_at":"2026-08-06T23:20:32.326732Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:32.830199Z","title":"Formanek, A","venue":null,"work_id":"1e1d70e6-db8f-41c7-bf7f-1bd215c13745","year":2023},"citing_paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:32.169248Z"},"links":{"citing_paper":"/paper/2506.18537"},"observation_digest":"sha256:7a138a6e2d3148b8342b850c01ab5dd8a02c5548010cdd295c68ea84c5ffbd0e","observation_id":"3fd8aaa9-eb35-4385-bc22-6b4d0790554c","resolution":{"observed_at":"2026-08-06T23:20:32.887100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.18537","last_updated":"2025-06-23T11:47:17Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T23:13:44.334527Z","submitted_at":"2025-06-23T11:47:17Z","title":"Transformer World Model for Sample Efficient Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":2,"verified_fuzzy":13},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2506.18537."}