{"as_of":"2026-08-07T10:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c83a46caae10de30f89a3f17462f75ab05402b59ff584a5e31c6722c5abd84f4","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:39:48.597389Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.06659/citation-record","integrity":"/paper/2508.06659/integrity","json":"/paper/2508.06659/citation-record.json","paper":"/paper/2508.06659"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:45.037158Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:45.037158Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:29b7c53d4e13deda47732b7e1076cbdac263c264f971feac4c8fae8430e813e8","observation_id":"c9f2c5e1-3ea8-4e09-9cfd-c0fdbeb8ac6e","resolution":{"observed_at":"2026-08-05T22:39:45.037158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:45.101891Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:45.101891Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:df79ad010723d4b40e1782c4a90a6dcdb25dc56f1882b417427d4b45b6baa073","observation_id":"82fdc10e-4870-4ef2-bf71-0379e17b066f","resolution":{"observed_at":"2026-08-05T22:39:45.101891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.220982Z","title":null,"venue":null,"work_id":"e222bb60-32da-429f-8319-1c49b68ed0f0","year":2023},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:45.253014Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:0e34e4bb60a83aa4f3d52d766613e2d24dd732b93c3c36241b03e1ddf86d9d06","observation_id":"82b4842c-e2f0-4ddf-838c-e2a8edb2e121","resolution":{"observed_at":"2026-08-05T22:39:49.224061Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.211158Z","title":"J.; Leary, C.; Maclaurin, D.; Necula, G.; Paszke, A.; Vander P las, J.; Wanderman- M ilne, S.; and Zhang, Q","venue":null,"work_id":"97179f59-17e7-4e2b-83ab-a9e2c94b0f35","year":2018},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:45.370556Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:7912ad0a904f2ef8a2e447f0c5b6c2d9263fd72d14f3e271972841436dbdc9f5","observation_id":"b6edb23e-ade9-49a3-9f3c-e1ec74cada93","resolution":{"observed_at":"2026-08-05T22:39:49.214555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.201565Z","title":null,"venue":null,"work_id":"9254548c-25a8-4f91-b3a9-24940b006c69","year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:45.485644Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:80fa128a0d9f5bdd918026ca4fdff02e8538ca5279df1c261c9fe5337d278f69","observation_id":"937d04a6-05b2-47ed-8a4b-5ca56e0fd702","resolution":{"observed_at":"2026-08-05T22:39:49.204825Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.192411Z","title":null,"venue":null,"work_id":"a22c3e16-d82e-47ba-8a4d-d8c2d6acf4e0","year":2021},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:45.562696Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:c3a3a5c963f8bb051266a4dafe75978e84b994104606b6fe9ff716d724d905ba","observation_id":"9e1b90c1-a3fb-4b2c-873d-3dbe8d6210ef","resolution":{"observed_at":"2026-08-05T22:39:49.195059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.183326Z","title":"S.; and Terry, J","venue":null,"work_id":"216fdc42-a2b8-492f-9104-c82f7b349a28","year":2023},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:45.640886Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:bf948f4d8a6d5859fb2cb70d124b0ef49424b26777c30647b0782c3e4154e433","observation_id":"1257ab98-e5a1-4c32-8c23-1b5baaa16ec8","resolution":{"observed_at":"2026-08-05T22:39:49.186166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.3555","last_updated":"2014-12-11T06:46:53Z","snapshot_observed_at":"2026-08-03T11:40:51.182181Z","submitted_at":"2014-12-11T06:46:53Z","title":"Empirical Evaluation of Gated Recurrent Neural Networks on Sequence Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.3555","snapshot_observed_at":"2026-08-05T22:39:45.712710Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:45.712710Z"},"links":{"cited_paper":"/paper/1412.3555","citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:ad7118b4da3db2e0027893701dbd34089718b5bab719fbb23a0289b0001322c2","observation_id":"05771e7c-4670-47fd-a69c-d8986891c441","resolution":{"observed_at":"2026-08-05T22:39:45.712710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.172907Z","title":null,"venue":null,"work_id":"889dae1b-4cb1-496c-b781-f988f921bb9e","year":2020},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:45.792918Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:9000c25fb97421e7d8b6db46b41821bda29d9e063d66eff1669aedd7863d7e47","observation_id":"9d7da363-b97d-4495-8556-6a44f67099e0","resolution":{"observed_at":"2026-08-05T22:39:49.176992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.162802Z","title":"P.; and Sobel, J","venue":null,"work_id":"e9d9ddef-19c0-459d-9d8d-2ec3e1d6bc29","year":1982},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:45.903437Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:0638beee7fc764e28a9776dcb7eb9ab66f4465341ef58b04dc05ade4de66329f","observation_id":"7cad8035-5f6e-4e94-9732-9b1201312a73","resolution":{"observed_at":"2026-08-05T22:39:49.166369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.152309Z","title":null,"venue":null,"work_id":"bcc79e66-8080-4ed4-9f13-c3afcb5cdb1d","year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:45.986911Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:a513011c2fbdbaa621b3425bc9da80c1692df3c6d95d87309ff210fbbfb29789","observation_id":"717c0461-847e-4870-b145-0085a4bffc64","resolution":{"observed_at":"2026-08-05T22:39:49.155969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.142891Z","title":"L.; Sutskever, I.; and Abbeel, P","venue":null,"work_id":"ad2219d0-0b37-45cd-9a45-7b2c1934b29e","year":2016},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:46.070952Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:27fd3b67e6c33bd1f055e1f48ea1068e82f0ccee48b70170a612dd1793c85188","observation_id":"2496343b-ce7a-4c18-852b-1d02dc244c1e","resolution":{"observed_at":"2026-08-05T22:39:49.145676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.134670Z","title":null,"venue":null,"work_id":"edffa2ec-47f3-42c9-9276-7e764a6275ce","year":2018},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:46.151557Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:2c93029b85091a8e17bfb3218aa7870d984e4fe4762fbdda9fa4bdeaef24bf04","observation_id":"bbb60da9-630b-47f2-864d-7d7b0059d273","resolution":{"observed_at":"2026-08-05T22:39:49.137426Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.125976Z","title":null,"venue":null,"work_id":"32bffcd9-973f-410c-8ed4-0ab0f7293096","year":2022},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:46.254845Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:f3babc27b615706f8797e5accbb8752b4c8709300b91e5990a24d0d1f35ea25b","observation_id":"fd767ba3-6308-4ea2-a26c-cea15cfdf23c","resolution":{"observed_at":"2026-08-05T22:39:49.128829Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.115504Z","title":null,"venue":null,"work_id":"fb696517-0be1-4c21-b708-5a3838eaafd3","year":2021},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:46.341860Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:4f199fd2c17f096b9e23dcb8d4c57070f86aa5c69c797395c9fc7368043f9921","observation_id":"2e5df821-dc60-47ef-9234-739d5ff940af","resolution":{"observed_at":"2026-08-05T22:39:49.119192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.105006Z","title":null,"venue":null,"work_id":"496938da-cc0e-4e78-b50c-96168d051e05","year":2017},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:46.440911Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:7ff5fdc1f757d4f5b58ae6c64886eba26b2ba1057b02b891d27bd86c1039eb9b","observation_id":"4822acc7-c3c1-4d05-acd1-1d0ec8854985","resolution":{"observed_at":"2026-08-05T22:39:49.107968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.095191Z","title":null,"venue":null,"work_id":"295e4c7b-5987-4dea-b5be-e133913513d3","year":2021},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:46.530566Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:43c7dcebd994c07e8c546c60bd88ef3dac6b6ccacceea9db536c1fe21c8cfcf9","observation_id":"d357e248-b66d-4ec0-885c-9224ae6f501e","resolution":{"observed_at":"2026-08-05T22:39:49.097975Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.086501Z","title":null,"venue":null,"work_id":"237e69b8-bc31-42cb-ad7a-9caaca0a45e0","year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:46.636882Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:d291a3085138de2683f6fec8d4a58e1967c7834342925bac8e7e3aefc03db86d","observation_id":"3dbe7702-97f6-4ec7-8e72-2fd99fbf8532","resolution":{"observed_at":"2026-08-05T22:39:49.089130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.077813Z","title":null,"venue":null,"work_id":"00c308a2-d77f-4b87-89ca-e72d0d13e9e8","year":2018},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:46.753166Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:3a45256edd7a843249d0348779cd1b0f2d83bd2f6242ffde46556ab359149162","observation_id":"e0d384ef-5cb6-43df-a8e2-d4d19a0a6061","resolution":{"observed_at":"2026-08-05T22:39:49.080649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.068706Z","title":null,"venue":null,"work_id":"34c71721-87c2-493c-aff6-a71be4cc8641","year":2020},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:46.837047Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:627fbf109e0d840994651d33e6a1d5ff93611f39ba5e35bd2e6fb54c1a9f835c","observation_id":"46f10cdb-564a-4bf7-b2f1-c6f25dd8d169","resolution":{"observed_at":"2026-08-05T22:39:49.071754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.058870Z","title":null,"venue":null,"work_id":"527a1ee8-3261-42af-87e4-1c48976137d1","year":2019},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:46.940472Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:f2724d06d67a595f521f810c1c483778b88fb58a45671b65ee41ef1a84247cad","observation_id":"632b3fb6-3c27-49c8-9fbb-aa8d7ee0cab3","resolution":{"observed_at":"2026-08-05T22:39:49.061487Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.049606Z","title":null,"venue":null,"work_id":"dc6dbe85-215c-4dfe-b01b-5398c85a8b2f","year":2025},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:47.059583Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:f6c20ce7b6c7490923790b8a45e4c4da110c8a319ff46681415f7f5f5908143d","observation_id":"5fd79b3b-feee-468c-8513-78f47033fe46","resolution":{"observed_at":"2026-08-05T22:39:49.052641Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.040366Z","title":null,"venue":null,"work_id":"8cbbaab6-b47f-46c2-8303-1039ffc27d13","year":2025},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:47.173166Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:9d121d9df953c75c0da664c60a234b9273741e0cd8996c66b62443bdf5306aae","observation_id":"968b59cc-bf7d-44f5-a21c-4b96de6d6429","resolution":{"observed_at":"2026-08-05T22:39:49.043265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.029810Z","title":"v.; Modayil, J.; and Silver, D","venue":null,"work_id":"9f1e3d34-5d11-4316-8b88-bed92179d282","year":2019},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:47.176719Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:610416e0eb512c3e99ff3f8a4a81a42a3d5e3579217e268d37d41294ab1b9591","observation_id":"8107a4c5-b134-4a93-a911-390829b305ee","resolution":{"observed_at":"2026-08-05T22:39:49.033604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.019827Z","title":null,"venue":null,"work_id":"a7284aa2-f403-434c-ac4e-bd85ff0d286d","year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:47.216761Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:7aad26caa8e0c11ef3fb13390eab8a6169d88896b8483978ebd63025280c3531","observation_id":"d0257c05-e59e-49c9-a34d-fbb3f8c02361","resolution":{"observed_at":"2026-08-05T22:39:49.023234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.010659Z","title":null,"venue":null,"work_id":"8971ace3-8647-423d-a35a-71004fb811c3","year":2015},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:47.344823Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:1c73cf87538537a55235c23dfaa82ac16b530a98884eb6028ebd85015316d38f","observation_id":"34e1c847-a035-4dce-b3fc-27378ab1d01e","resolution":{"observed_at":"2026-08-05T22:39:49.013860Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:49.000695Z","title":"P.; Littman, M","venue":null,"work_id":"3f7505d2-034d-4e59-af05-02066800a02e","year":1998},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:47.422842Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:fc8aa099ebc169079b1f70468c1f45e7d8c7b9af6c592780406aeb0b255ffba4","observation_id":"1f263870-0123-4e51-9b81-042bc8f85e26","resolution":{"observed_at":"2026-08-05T22:39:49.004302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.991370Z","title":"J.; Zhang, C.; and Slivkins, A","venue":null,"work_id":"1dab8d4a-1546-453a-86ec-67eca2ffbff3","year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:47.550840Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:6c56d6b48128f90f56b015191bd47d4f8befec3d1154bdcfc0b81ee3a2fe80bc","observation_id":"5496bdbc-3c7c-427d-9a05-ea5762b963bc","resolution":{"observed_at":"2026-08-05T22:39:48.994516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.980362Z","title":"S.; Filos, A.; Brooks, E.; maxime gazeau; Sahni, H.; Singh, S.; and Mnih, V","venue":null,"work_id":"8ad3d074-3e3e-4327-9c78-f13b588699f7","year":2023},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:47.678196Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:7e9e0d1632bea5ab2740fd1383b8bb09b5d28283d8178451af4b8bb4a85794de","observation_id":"13dfe71c-19a1-444f-bcac-ce8589b3469a","resolution":{"observed_at":"2026-08-05T22:39:48.983579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.970539Z","title":null,"venue":null,"work_id":"c847c255-7180-4896-9222-83799b415e2b","year":2023},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:47.775691Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:d31ebfdf9e850da931b0af6a6c2c7a52f7f099e60c5aac6e6391bb6065cd0173","observation_id":"6814470f-7c6e-4d0d-aa41-f0d99aa115ac","resolution":{"observed_at":"2026-08-05T22:39:48.973002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.960883Z","title":null,"venue":null,"work_id":"1891942b-8b4c-41c1-acbf-7321d88fba20","year":2025},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:47.909998Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:6d965ecf18dd78a6b8c51650a0227dda313a64dfbba6233df1a327cf75a7f23a","observation_id":"57495216-2c67-4909-b418-11691882a433","resolution":{"observed_at":"2026-08-05T22:39:48.963595Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.951378Z","title":null,"venue":null,"work_id":"e8761c1c-90db-4ab4-b9a0-fbfb4fc66ab2","year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.014528Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:179fc5a433cd1b71e0c0947ac1f6777dfb37d994f56cc00f70efca043db134c7","observation_id":"d7b40c88-fa18-4b58-80fa-ddcb9460eabb","resolution":{"observed_at":"2026-08-05T22:39:48.954717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22365","last_updated":"2025-06-27T16:26:29Z","snapshot_observed_at":"2026-08-06T22:03:17.193342Z","submitted_at":"2025-06-27T16:26:29Z","title":"Reinforcement Learning with Physics-Informed Symbolic Program Priors for Zero-Shot Wireless Indoor Navigation","version":1},"cited_work":{"arxiv_id":"2506.22365","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.22365","snapshot_observed_at":"2026-08-05T22:39:48.703125Z","title":"Reinforcement Learning with Physics-Informed Symbolic Program Priors for Zero-Shot Wireless Indoor Navigation","venue":"cs.LG","work_id":"228853eb-d1cc-40d5-b9b2-ae3dbf6a641a","year":2025},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.097418Z"},"links":{"cited_paper":"/paper/2506.22365","citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:f7c5cf65fe8b46f0973c71c7969bfd7c8e695094a6de7a068369b08b264a04b5","observation_id":"759b882a-82ff-4b0a-935f-51874d2a2cfd","resolution":{"observed_at":"2026-08-05T22:39:48.706648Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.941529Z","title":null,"venue":null,"work_id":"77b05734-fd2c-4a9e-bc1c-7404aace4954","year":2023},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.184090Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:b86d4284c4390ceaa2b4965a26ffaf4f991ec0598f10528e86e52c3b3b9a3f80","observation_id":"f247a299-ce7a-469b-b946-2d188b7439b8","resolution":{"observed_at":"2026-08-05T22:39:48.944439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17431","last_updated":"2024-10-22T21:08:28Z","snapshot_observed_at":"2026-07-06T19:38:09.286994Z","submitted_at":"2024-10-22T21:08:28Z","title":"Meta Stackelberg Game: Robust Federated Learning against Adaptive and Mixed Poisoning Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17431","snapshot_observed_at":"2026-08-05T22:39:48.291594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.291594Z"},"links":{"cited_paper":"/paper/2410.17431","citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:b22c4734956c4d8a7c1fcb5eeb39e2b781032dfa0f63f6b971b78ff39bee50fd","observation_id":"895a7f7d-4b4a-4d52-9de0-ac2a67659c29","resolution":{"observed_at":"2026-08-05T22:39:48.291594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.931221Z","title":null,"venue":null,"work_id":"eb39db60-e8e9-4608-bf1c-73cf23c20f6b","year":2022},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.377691Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:e1a022f98010d0322e56753b9278feab9a0333ca5071c91d30650e847f5866a2","observation_id":"55ee3ead-8daa-4b54-8c5f-ecb2def60d42","resolution":{"observed_at":"2026-08-05T22:39:48.934449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.919039Z","title":null,"venue":null,"work_id":"9c638f4d-6440-4028-8663-646f4cbe3d5e","year":2023},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.494699Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:87059865d46c10aec797f5561b81689efd492a81401679584c7f9c1bd18466dc","observation_id":"3a91f180-76ab-49fe-8b11-21d3f109bc7c","resolution":{"observed_at":"2026-08-05T22:39:48.921774Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10570","last_updated":"2024-08-19T00:52:20Z","snapshot_observed_at":"2026-07-06T17:45:27.526239Z","submitted_at":"2024-03-14T20:17:57Z","title":"Symbiotic Game and Foundation Models for Cyber Deception Operations in Strategic Cyber Warfare","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10570","snapshot_observed_at":"2026-08-05T22:39:48.504727Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.504727Z"},"links":{"cited_paper":"/paper/2403.10570","citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:b312311e5007339d66e139897278476d69749ef1dbfda2d1bc0659eca9538433","observation_id":"e7b4880d-d47e-4c72-9213-efaede1ad5c9","resolution":{"observed_at":"2026-08-05T22:39:48.504727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.907804Z","title":null,"venue":null,"work_id":"0c55fff6-0826-46c9-b474-9854e97957bf","year":2019},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.529741Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:2a56d3d779e5489d486c6caaac4dd83e66bb648e514ce2b631e13163b292ead5","observation_id":"bd75d4af-314b-4241-ab98-1b8af8166b0c","resolution":{"observed_at":"2026-08-05T22:39:48.910511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.898307Z","title":null,"venue":null,"work_id":"da47d267-f360-4490-a327-5e52b3c13922","year":2022},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.533017Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:21f27effb16b9aee47a6011212b8db450a0be057a6d407887d0938c38cf67b83","observation_id":"6939a6c7-6c5b-44c4-b73f-eccca38d9fc3","resolution":{"observed_at":"2026-08-05T22:39:48.901451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.887644Z","title":null,"venue":null,"work_id":"741b0ebb-f46c-4f24-b241-9217612e57d9","year":2023},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.535344Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:098479827a6291a9b6ac096ab1cc85b41e4990e63d73652490797a403bc222ee","observation_id":"90c37970-0813-4ca4-b93f-84bff36370f1","resolution":{"observed_at":"2026-08-05T22:39:48.890773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.877661Z","title":"A.; Veness, J.; Bellemare, M","venue":null,"work_id":"32ab7541-85c1-440d-8d26-14805f5f1f23","year":2015},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.538125Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:c918ee1da61c2082302d7abf9283ee3660758d4abc8e87690cdc8bf7e81d6c09","observation_id":"3f613e76-579e-4b98-9919-1b338cde599c","resolution":{"observed_at":"2026-08-05T22:39:48.880743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07978","last_updated":"2025-02-11T21:52:19Z","snapshot_observed_at":"2026-07-06T20:35:02.935416Z","submitted_at":"2025-02-11T21:52:19Z","title":"A Survey of In-Context Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07978","snapshot_observed_at":"2026-08-05T22:39:48.540944Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.540944Z"},"links":{"cited_paper":"/paper/2502.07978","citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:387dd23ac67e81272975984270a76c6da97efb17acd55eea7158c58053259b59","observation_id":"6de6714d-47c2-47d4-8036-ac7410f5e057","resolution":{"observed_at":"2026-08-05T22:39:48.540944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00385","last_updated":"2025-03-01T07:17:39Z","snapshot_observed_at":"2026-07-06T20:44:49.893232Z","submitted_at":"2025-03-01T07:17:39Z","title":"Model-Agnostic Meta-Policy Optimization via Zeroth-Order Estimation: A Linear Quadratic Regulator Perspective","version":1},"cited_work":{"arxiv_id":"2503.00385","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.00385","snapshot_observed_at":"2026-08-05T22:39:48.655850Z","title":"Model-Agnostic Meta-Policy Optimization via Zeroth-Order Estimation: A Linear Quadratic Regulator Perspective","venue":"eess.SY","work_id":"1e5cc8a0-b8ca-4def-bcf9-c14f776cdfe9","year":2025},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.543747Z"},"links":{"cited_paper":"/paper/2503.00385","citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:294be5c27876fd33611165c56d3c65773319e1b187e0fcf142902617353418e9","observation_id":"1f541c4c-778b-421f-b35b-057cd76ae471","resolution":{"observed_at":"2026-08-05T22:39:48.661001Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19396","last_updated":"2024-07-28T04:39:18Z","snapshot_observed_at":"2026-07-06T18:52:51.827101Z","submitted_at":"2024-07-28T04:39:18Z","title":"NAVIX: Scaling MiniGrid Environments with JAX","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19396","snapshot_observed_at":"2026-08-05T22:39:48.546970Z","title":"T.; Lu, C.; Castro, P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.546970Z"},"links":{"cited_paper":"/paper/2407.19396","citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:abd8ec8c4b8a30d9c7ec07cd0f82c63e21c020abf4c15e2e2e6deff60c5c91d0","observation_id":"3b28e50e-105d-4fe1-8c90-fdcc0ccf15e7","resolution":{"observed_at":"2026-08-05T22:39:48.546970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.866730Z","title":"C.; Hambro, E.; Kirk, R.; Henaff, M.; and Raileanu, R","venue":null,"work_id":"464e687c-23dc-4947-9c44-3d3364bef5f2","year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.549714Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:2f7600a142275f7227235de5372323450034bc952e0057c23d597c6eca1af38e","observation_id":"ed6db75a-4179-42c5-9aa2-ba125c89440c","resolution":{"observed_at":"2026-08-05T22:39:48.869810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.857480Z","title":null,"venue":null,"work_id":"71522494-975d-4cef-961f-c2c4589c72f2","year":2022},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.552687Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:31477422520e0e7d86fdf6befe01768dfae26cb794a60e507dae86ba85578578","observation_id":"5e5acaff-42d3-4db7-a822-ba0fb1ec2bc5","resolution":{"observed_at":"2026-08-05T22:39:48.860721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.848053Z","title":null,"venue":null,"work_id":"44482720-9f31-46db-92fc-a3f0d88b61e7","year":2023},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.555638Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:8160d697173abb0daff89169790fe4e72322f47c18a1b3fc94cfdd124e757528","observation_id":"405c2cfa-8f0d-44ea-a359-f183ff4dbd0a","resolution":{"observed_at":"2026-08-05T22:39:48.850632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.837961Z","title":null,"venue":null,"work_id":"9f154306-590d-4028-854d-0378f4a8bb08","year":2020},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.558557Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:7da964fbc16a096e90078e64f20e0ee447ebee5289d0c5890f756c1d848e5f59","observation_id":"2caa0435-33b6-4952-afd2-e545f674f057","resolution":{"observed_at":"2026-08-05T22:39:48.841136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.827243Z","title":null,"venue":null,"work_id":"aa6a09d3-5e73-4188-90c1-ee1b677eaec5","year":2021},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.560952Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:eb8f03c3c87b60ecd9fa50f6174ddd31c086df8b9db475c7b4afaabe12fe8bab","observation_id":"cd0a460a-15d1-4419-8d40-2e2cf4b26fe7","resolution":{"observed_at":"2026-08-05T22:39:48.830161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-05T22:39:48.563655Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.563655Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:ac57e0e7516537072f7da7deb615739f369a0c27222401028e9facca50726d33","observation_id":"fa3466d6-f038-413f-844e-84c3a261f477","resolution":{"observed_at":"2026-08-05T22:39:48.563655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T22:39:48.566736Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.566736Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:fcb104611e92ebdad2b4ab2e846cc115575728edd953eb7f89fc9e7f67a09d4a","observation_id":"f404ca42-36cf-435b-a183-7b79ceb75c4c","resolution":{"observed_at":"2026-08-05T22:39:48.566736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.817575Z","title":"D.; Bachman, P.; and Courville, A","venue":null,"work_id":"d88c6e2d-ec6b-4f71-bae8-9d147fd1f0da","year":2021},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.569515Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:6bd873ad2be389896dcfd2d4f7ee0875819a8e7dc7dac5c4df81dc37710aa1b3","observation_id":"d10855f4-9a21-4fcb-8dac-c51e2b33a7fe","resolution":{"observed_at":"2026-08-05T22:39:48.820719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.806766Z","title":null,"venue":null,"work_id":"0cb5522c-3ef6-40ff-8114-0f65dd19d23a","year":2021},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.572741Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:b41b28ae6b9029050361fe9a4177546580d134130cd1d44ea61752a751150fcc","observation_id":"e282ff5e-fd73-459c-8400-b4111a6ede16","resolution":{"observed_at":"2026-08-05T22:39:48.810322Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.794961Z","title":null,"venue":null,"work_id":"06719edb-535c-40e3-9941-a91a6ef57dec","year":2016},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.576513Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:74a79a82afed134cdf4cc7847878ad05c53838b3a71a3b42316044c263350548","observation_id":"5f931f02-27f7-4854-b926-dce4e171d81f","resolution":{"observed_at":"2026-08-05T22:39:48.798385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.783293Z","title":null,"venue":null,"work_id":"291db3ce-e56b-47af-a8de-cea98f390ae2","year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.579690Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:5a4067b832275e7bfa964f8a7fdb03b7de7664b067f1f8fd69c64c546821f062","observation_id":"09164379-eb46-4af5-bc37-74b6f3622377","resolution":{"observed_at":"2026-08-05T22:39:48.786670Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.582743Z","title":"N.; Kaiser, .; and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.582743Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:d05ac37d80276e382438e3eb828ebef68908726acef990707f063031c7c50ed6","observation_id":"099d7c70-1b13-4b25-adf4-2f6c552c23ae","resolution":{"observed_at":"2026-08-05T22:39:48.582743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.763788Z","title":"H.; Daneshmand, H.; and Zhang, S","venue":null,"work_id":"17243634-760b-4d1b-8718-f8a81c6129cb","year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.585289Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:cfec47d3bbe5ccdb7d9e86f1e809d3eade16b635979e1a1b9a37fed9adc7f097","observation_id":"f28c99fb-7021-4d68-b689-5c45c6e08821","resolution":{"observed_at":"2026-08-05T22:39:48.766949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.753315Z","title":"X.; Kurth-Nelson, Z.; Tirumala, D.; Soyer, H.; Leibo, J","venue":null,"work_id":"8048d5ea-537e-4eee-a9bb-50154d9d6102","year":2016},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.588447Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:56beaf4959a23d5de4b6d46c3682babc4f44f7d08a97f730d3bb6bbb6cd970dc","observation_id":"c9069b21-03e1-4432-800d-5fc3eaba7029","resolution":{"observed_at":"2026-08-05T22:39:48.756783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.744142Z","title":null,"venue":null,"work_id":"465e5771-1048-4ccf-86b8-47075b081026","year":2022},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.591590Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:ed630d783368a2049263f73548216afdec34d80460d77d01751a39cc1a75e93f","observation_id":"e68a9297-65d8-4b39-a67f-08488ec2e4ec","resolution":{"observed_at":"2026-08-05T22:39:48.747073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.732760Z","title":null,"venue":null,"work_id":"26d8a914-6c89-4cb7-8776-8e19ea9abf1b","year":2025},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.594243Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:10975b19d2188c4f333bbc067eb53fad33fd90e947d2afd74ad1023823768a11","observation_id":"6cdda72d-588d-43db-9b6e-80ffbf7722d0","resolution":{"observed_at":"2026-08-05T22:39:48.736593Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:39:48.723769Z","title":null,"venue":null,"work_id":"44b73bba-4d1c-4f8e-8fcd-a18e76160cfc","year":2024},"citing_paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-05T22:39:48.597389Z"},"links":{"citing_paper":"/paper/2508.06659"},"observation_digest":"sha256:50fc1db638ead8049ac71f8501adbf249157094549a85b450ef6d55fd10a7525","observation_id":"e7562ec4-0e0e-4b33-bd76-6490be2ae0f6","resolution":{"observed_at":"2026-08-05T22:39:48.726669Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.06659","last_updated":"2026-06-07T16:02:19Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T22:39:35.998060Z","submitted_at":"2025-08-08T19:23:23Z","title":"In-Context Reinforcement Learning via Communicative World Models"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":2,"verified_fuzzy":13},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2508.06659."}