{"as_of":"2026-08-08T01:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:145c9c8b7b3a1f6fec5ca90d2779e1bcb3cc1d9051f437fcc87b0e8c495dfc1a","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:13:25.243758Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01456/citation-record","integrity":"/paper/2608.01456/integrity","json":"/paper/2608.01456/citation-record.json","paper":"/paper/2608.01456"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:31.253305Z","title":null,"venue":null,"work_id":"25ab4ad1-0491-4e7e-ad1c-6a81b3e4fb65","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:18.452242Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:6e001c011cf942d4982fbb6d32a65075f7176644d933cc304563a62eb211d125","observation_id":"bc73b0fb-7c32-4c3f-b38c-187759f7c1a7","resolution":{"observed_at":"2026-08-06T00:13:31.341780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:18.538136Z","title":"2021 , url =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:18.538136Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:13076d8a3abca5e67c8ddab429dc275200f6f9f90555710070a766df6cff8259","observation_id":"6e805e04-e0be-425a-87e8-b46e44c166cd","resolution":{"observed_at":"2026-08-06T00:13:18.538136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:18.645867Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:18.645867Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:5fe5dafe7eb5172b680862c76c7063fc3315177a0686535b451f20bbd3ce2b54","observation_id":"80d0d5fa-8573-4b6d-bb9d-76f1ab09fe37","resolution":{"observed_at":"2026-08-06T00:13:18.645867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:18.846578Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:18.846578Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:1fbb062f33f85153b754e82b616d6da1a23f672f33f666f06af17c9a96e7d193","observation_id":"41c34807-81d5-4b3c-9731-924c408cbc8b","resolution":{"observed_at":"2026-08-06T00:13:18.846578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:19.573745Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:19.573745Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:98560e7c19434e8182978715682c9232989e84fa18c4b5a5277564e433c956d1","observation_id":"150b38fb-0e37-4d13-bf32-9d8529cf5564","resolution":{"observed_at":"2026-08-06T00:13:19.573745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:19.666122Z","title":"Conference on Robot Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:19.666122Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:142d2d7839804f93a6ab262682e4f074afa9e7af97a77e3d1cc5455e11544791","observation_id":"3a7f86fb-3824-429a-8299-3c2f8021c384","resolution":{"observed_at":"2026-08-06T00:13:19.666122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:31.036024Z","title":"Journal of health psychology , volume=","venue":null,"work_id":"3bca88df-90cc-4363-97f9-1a0796611599","year":2020},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:19.889981Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:d7066850934e2213dffff555c3979484dea05008590bf5ee0ac534d0d402481c","observation_id":"a442e3e7-284e-4bb7-bf63-a2778bea0ec9","resolution":{"observed_at":"2026-08-06T00:13:31.131296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:30.842482Z","title":"2024 , institution=","venue":null,"work_id":"81dd74e6-7198-4c09-8075-d098c2afd636","year":2024},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.062614Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:798104a73cde6f947066868e56da1288f09f244fd235135b94203469a010607c","observation_id":"33040ada-63ec-48ee-bda6-1aab5071a5ce","resolution":{"observed_at":"2026-08-06T00:13:30.945016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:30.705495Z","title":"2026 , institution=","venue":null,"work_id":"7ea91a25-2f2e-4a92-bc83-1db7b8e05a40","year":2026},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.163208Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:2a37ba3faa418826d1eaf6c5f6922105c599a8150658bd560c882f4cb20afc5f","observation_id":"cf760974-b963-4cba-b66d-937c7008f725","resolution":{"observed_at":"2026-08-06T00:13:30.762832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-06T00:13:20.273436Z","title":"arXiv preprint arXiv:2507.06261 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.273436Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:8d84e179888de459159a9cd23aec1652a2a8222c5f315d30cf5db34d0f652769","observation_id":"643ba184-16c9-4252-80c5-efb6291998cb","resolution":{"observed_at":"2026-08-06T00:13:20.273436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-06T00:13:20.378471Z","title":"arXiv preprint arXiv:2511.21631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.378471Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:b5039f30695db8fb19277d41caccf4ac2d64bc63dd617d63539f3532105679d9","observation_id":"8e94e94b-9463-4a79-8ebb-8e2383890e98","resolution":{"observed_at":"2026-08-06T00:13:20.378471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:30.502956Z","title":"2025 , eprint=","venue":null,"work_id":"cef170fa-c78f-4c70-9bb7-7012a0f5018f","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.445967Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:9e2dce90bb98964b7f8e4bb0096be0a131ca9dfb3970899875585110fdb51e5f","observation_id":"9efc8d9c-4bdb-4ad1-8e80-35a90c51edaa","resolution":{"observed_at":"2026-08-06T00:13:30.603227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:30.300812Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"9490d61f-310d-496b-8378-7c3f8d352bce","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.679191Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:ffa7b73fc5c3a4df3f68b2e642f46f98265afcabe840ad604ad9f7938020476f","observation_id":"7eccf257-c0aa-45d7-882b-ed3e496ead22","resolution":{"observed_at":"2026-08-06T00:13:30.377996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:30.011054Z","title":"2026 , eprint=","venue":null,"work_id":"35e27c92-8413-4cd7-a3a7-9d9effb465fe","year":2026},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.775680Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:a7ea69110a21cd76b60977f2c989a61e371c7a178b9360f8bdd95470030f6383","observation_id":"32b624aa-7b48-48b7-875f-2e252a36fe5a","resolution":{"observed_at":"2026-08-06T00:13:30.135091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:29.797150Z","title":null,"venue":null,"work_id":"bb2ff9b5-f5ba-4ebd-bd9c-c7c327561f25","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.080516Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:61417b8c85ed75e923463c2a3a4af8f759355471ecc8f53716a37ffcbe884568","observation_id":"07c3b2c1-0906-4356-bb6f-1f56af4b92f0","resolution":{"observed_at":"2026-08-06T00:13:29.916776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00081","last_updated":"2024-10-31T17:53:12Z","snapshot_observed_at":"2026-07-06T19:43:09.889618Z","submitted_at":"2024-10-31T17:53:12Z","title":"PARTNR: A Benchmark for Planning and Reasoning in Embodied Multi-agent Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00081","snapshot_observed_at":"2026-08-06T00:13:21.218440Z","title":"arXiv preprint arXiv:2411.00081 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.218440Z"},"links":{"cited_paper":"/paper/2411.00081","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:d7472a08db069d606726cb0194ee0813f71c613f25a5350d3a10501188c32315","observation_id":"d959edc4-cab0-491d-80f4-c34d7d274ea8","resolution":{"observed_at":"2026-08-06T00:13:21.218440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-industry.149","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:25.628662Z","title":"V esta B ench: An Embodied Benchmark for Safe Long-Horizon Planning Under Multi-Constraint and Adversarial Settings","venue":null,"work_id":"0bdd74e7-0365-45c3-9580-e0eb8054a461","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.333574Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:397b66a1e0de894fbd91183bb02192d2e93117f92db712e4015fafa52a68ecb8","observation_id":"5c4ca0b2-481f-4040-afaf-6bc1b87d196a","resolution":{"observed_at":"2026-08-06T00:13:25.698733Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:29.573972Z","title":"OpenEQA: Embodied Question Answering in the Era of Foundation Models , booktitle =","venue":null,"work_id":"14e40cfb-35d1-4a77-a0b3-3b7496f4471e","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.488250Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:397294074bc2d7f1d56159643847dd6bc5e0a0b4a5d68a0ecc22a0095ace294d","observation_id":"1b75831c-ff33-4a0a-b726-0cd781c3ed42","resolution":{"observed_at":"2026-08-06T00:13:29.679902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:29.409838Z","title":"2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) , pages=","venue":null,"work_id":"3f16ad80-ca0e-44e4-8da9-5c26eb302f7f","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.561128Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:144d1f4df4153965692def9486ecafd5be3b3169e18378f3c824a56cfc4256f0","observation_id":"402f120a-9b27-4297-ac21-42f8c5ff6cb4","resolution":{"observed_at":"2026-08-06T00:13:29.478835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15941","last_updated":"2024-07-07T19:40:31Z","snapshot_observed_at":"2026-08-07T02:26:46.173562Z","submitted_at":"2024-03-23T22:04:03Z","title":"Explore until Confident: Efficient Exploration for Embodied Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15941","snapshot_observed_at":"2026-08-06T00:13:21.746846Z","title":"arXiv preprint arXiv:2403.15941 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.746846Z"},"links":{"cited_paper":"/paper/2403.15941","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:141cd94f959e2bb0cb6683fca3cb7a28a08735f1bb444fcbc7e7ed38656a0047","observation_id":"3b4a2d98-186e-4600-815d-8c92d68759b1","resolution":{"observed_at":"2026-08-06T00:13:21.746846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:29.207013Z","title":"2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) , pages=","venue":null,"work_id":"bf3a9a5a-3a42-4ad2-a727-14b75a824c84","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.841686Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:b21813a58f6bcd30bd85acbd1298bb089e1537d3682cbfe98da55f983981d866","observation_id":"99fb8774-752b-4013-8c8a-fdd548f1e0d0","resolution":{"observed_at":"2026-08-06T00:13:29.330690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:29.020568Z","title":"2025 , doi =","venue":null,"work_id":"902a60c8-aeb4-46b4-9ba0-9c953913b805","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.946733Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:c9efab28658b6b86ceefad16e772972794c8c44c3cd04bf18c0a3a6f54ad1d70","observation_id":"61829477-2777-48a2-b568-f05490f4eb56","resolution":{"observed_at":"2026-08-06T00:13:29.067164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:28.851347Z","title":"2025 IEEE International Conference on Robotics and Automation (ICRA) , pages=","venue":null,"work_id":"357d31b3-d139-4a17-bbc3-05e7cd39113b","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.032708Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:cb4261dc8b31de9704d974669cb7348f2e91fe9056575e3c047e18d7ec9e9216","observation_id":"49066960-a1fe-4089-95f0-48b47b2f7f27","resolution":{"observed_at":"2026-08-06T00:13:28.934290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:28.687289Z","title":"2025 , publisher =","venue":null,"work_id":"d700078a-9094-4653-b2e0-735a709ad9b0","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.130618Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:4627663213d32d9b74d2f9aad7ac994ea91b530336f21950a458754cd9084462","observation_id":"bf2bc5be-1f40-454b-a7f7-694318c5d56e","resolution":{"observed_at":"2026-08-06T00:13:28.758937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:28.511047Z","title":"Proceedings of The 9th Conference on Robot Learning , series =","venue":null,"work_id":"8f47c76b-6468-49e3-ba68-d1b31ea205f4","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.231874Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:557a280778c4a01e05821f49f8ce747ba051bdb9aa872c6cecfd51a6a1268bf3","observation_id":"05965000-a873-499b-b701-42a74195460f","resolution":{"observed_at":"2026-08-06T00:13:28.593654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15513","last_updated":"2026-03-02T14:17:33Z","snapshot_observed_at":"2026-08-07T20:44:49.748480Z","submitted_at":"2026-02-17T11:41:28Z","title":"HIMM: Human-Inspired Long-Term Memory Modeling for Embodied Exploration and Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15513","snapshot_observed_at":"2026-08-06T00:13:22.296384Z","title":"arXiv preprint arXiv:2602.15513 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.296384Z"},"links":{"cited_paper":"/paper/2602.15513","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:e8f0e1d7dd02e87e649c907eb20fa619b13119ce5600b0e37d9e40a0fa52a061","observation_id":"1c9ce600-e7f7-4756-9b70-ec0228b71927","resolution":{"observed_at":"2026-08-06T00:13:22.296384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:28.232746Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"b2432354-bf95-45ec-b5a4-34b2692b4aa7","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.377457Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:0d0c898780c56ca68583ddcd733b8d4005d49ffbbbc30dc51f5ce70f36f05cb4","observation_id":"62856a61-dd79-4eb9-845e-5405bf44e3e1","resolution":{"observed_at":"2026-08-06T00:13:28.389224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:27.965177Z","title":"Findings of the Association for Computational Linguistics: NAACL 2025 , pages=","venue":null,"work_id":"a511507d-6f53-4712-ada7-fd191d84ea40","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.460711Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:3caf76dddba9807b998ba915597e6b6629afae1e1606f04abdcaa802a7a5ba6f","observation_id":"d12d9d77-dbe8-4ed8-95b3-05877306eb15","resolution":{"observed_at":"2026-08-06T00:13:28.098668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:27.712275Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"5438b2d2-4235-4ac8-ab86-1e9eeea622a8","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.544559Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:2d1c08c2fdfdcf917120af544d73b229b30f71455cb76391973ea9bc3b8eabe9","observation_id":"ee6a31fc-2a43-45cd-be31-3889ae58e3dc","resolution":{"observed_at":"2026-08-06T00:13:27.840852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00574","last_updated":"2025-07-13T16:21:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-31T18:01:23Z","title":"VideoChat-Flash: Hierarchical Compression for Long-Context Video Modeling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00574","snapshot_observed_at":"2026-08-06T00:13:22.601162Z","title":"arXiv preprint arXiv:2501.00574 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.601162Z"},"links":{"cited_paper":"/paper/2501.00574","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:5d70b6d9e2773df2345907934f5557b3edafecddda1936cbffee7c3b78bf905e","observation_id":"d3b7f910-a70e-4475-b4e6-7f994cd1d712","resolution":{"observed_at":"2026-08-06T00:13:22.601162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:27.490463Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"bedb3e37-2fde-4276-a351-a33ff46ae6b2","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.696464Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:b40e492fd0e615b2e6d300c30068cceda8c724e2d9fb3c13c214f402213c8bdf","observation_id":"0447e351-738a-4d8c-9c5d-7491b668f57d","resolution":{"observed_at":"2026-08-06T00:13:27.589532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:22.851924Z","title":"arXiv preprint arXiv:2603.15167 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.851924Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:20e1cab59013b019dfaa855a9f1d0571968b7b1793a4012b5e27fb16a6a65598","observation_id":"ec85da70-42d2-491d-b538-e7844e9f1230","resolution":{"observed_at":"2026-08-06T00:13:22.851924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:22.946013Z","title":"arXiv preprint arXiv:2603.02096 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.946013Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:a99122a7a29856c6f16e735921c34234090b44c0c5d76b2fe89f8025b4c860c5","observation_id":"c99dfeaa-cb13-418e-a6e4-a6928342e45d","resolution":{"observed_at":"2026-08-06T00:13:22.946013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.09000","last_updated":"2026-04-23T08:05:34Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T06:11:34Z","title":"StreamMeCo: Long-Term Agent Memory Compression for Efficient Streaming Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.09000","snapshot_observed_at":"2026-08-06T00:13:23.002550Z","title":"arXiv preprint arXiv:2604.09000 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.002550Z"},"links":{"cited_paper":"/paper/2604.09000","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:fb5e95e1701b1d47a734ec335145010992014b28a73f5601d54cc8fe05f1e925","observation_id":"e1816bda-7b24-4391-b538-14c7102fc73d","resolution":{"observed_at":"2026-08-06T00:13:23.002550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.08272","last_updated":"2019-12-19T15:44:33Z","snapshot_observed_at":"2026-07-06T07:09:15.174187Z","submitted_at":"2018-10-18T20:48:08Z","title":"BabyAI: A Platform to Study the Sample Efficiency of Grounded Language Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.08272","snapshot_observed_at":"2026-08-06T00:13:23.118998Z","title":"Babyai: A platform to study the sample efficiency of grounded language learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.118998Z"},"links":{"cited_paper":"/paper/1810.08272","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:914230397000759e9fc082643fc06b8552d27de8c1debafb010eaf702e733b75","observation_id":"b631ade4-3698-4af9-bf15-705a5dac37a6","resolution":{"observed_at":"2026-08-06T00:13:23.118998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:27.267236Z","title":"ProcTHOR : Large-scale embodied ai using procedural generation","venue":null,"work_id":"b3312772-24fb-4a62-b788-499bd65c66a9","year":2022},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.197524Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:005d4a2fa796462b3aa486fb3978494299a34b7ed0c45d029476a99e5f1ec4df","observation_id":"74b43f40-ed34-4a61-9d7e-4d8cc95ffcf2","resolution":{"observed_at":"2026-08-06T00:13:27.362569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15677","last_updated":"2025-07-29T22:40:49Z","snapshot_observed_at":"2026-08-06T23:49:24.463717Z","submitted_at":"2025-06-18T17:58:17Z","title":"Embodied Web Agents: Bridging Physical-Digital Realms for Integrated Agent Intelligence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15677","snapshot_observed_at":"2026-08-06T00:13:23.324201Z","title":"Embodied web agents: Bridging physical-digital realms for integrated agent intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.324201Z"},"links":{"cited_paper":"/paper/2506.15677","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:816d439a5401ae314728bc708b9dbe166df15049a8f171e79e50b4bbc829f82a","observation_id":"5b6f1b39-6f58-496d-aa72-f697fe8a2caf","resolution":{"observed_at":"2026-08-06T00:13:23.324201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:23.441619Z","title":"3dllm-mem: Long-term spatial-temporal memory for embodied 3d large language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.441619Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:e5a93734500388dbdf2867a2de2c3b1dadfd3130585dabbfa50510cf57d71d81","observation_id":"8aab4ed6-37b2-48cd-92a8-d705f6df5495","resolution":{"observed_at":"2026-08-06T00:13:23.441619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.24731","last_updated":"2026-06-23T06:21:28Z","snapshot_observed_at":"2026-08-07T10:47:42.784656Z","submitted_at":"2025-12-31T08:58:30Z","title":"EchoFoley: Event-Centric Hierarchical Control for Video Grounded Creative Sound Generation","version":2},"cited_work":{"arxiv_id":"2512.24731","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.24731","snapshot_observed_at":"2026-08-06T00:13:26.072965Z","title":"EchoFoley: Event-Centric Hierarchical Control for Video Grounded Creative Sound Generation","venue":"cs.CV","work_id":"d36e054f-e577-4cae-b5bc-593efb8b9aae","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.533166Z"},"links":{"cited_paper":"/paper/2512.24731","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:ee655d2cbfa48c776f571abb3d36237c286a1821caf58b4d0d801d2d5f1098dd","observation_id":"f6e12665-6840-4bd2-8ba0-721e322fb5fc","resolution":{"observed_at":"2026-08-06T00:13:26.146920Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:27.054743Z","title":"Metal: A multi-agent framework for chart generation with test-time scaling","venue":null,"work_id":"dc793448-14d9-4d86-b5f9-1bbd9043cf16","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.711213Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:16b2b98447982602535ba605bbd6cd6076a247b7c8261546b5d86d7e52b68674","observation_id":"ee392cd4-c2dd-4ab9-93e0-80b48178e350","resolution":{"observed_at":"2026-08-06T00:13:27.157260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11957","last_updated":"2026-06-23T06:39:00Z","snapshot_observed_at":"2026-08-03T10:02:14.175452Z","submitted_at":"2026-01-17T08:19:18Z","title":"PEARL: Self-Evolving Assistant for Time Management with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11957","snapshot_observed_at":"2026-08-06T00:13:23.867852Z","title":"Pearl: Self-evolving assistant for time management with reinforcement learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.867852Z"},"links":{"cited_paper":"/paper/2601.11957","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:d5843d645f13dd97f83988d4e735a64bc14c098d5a8d8f708a7ca2bee8fc4a37","observation_id":"d54e4d95-a460-4eb1-ab9d-6ec24b042be2","resolution":{"observed_at":"2026-08-06T00:13:23.867852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:26.887000Z","title":"Embodied agent interface: Benchmarking llms for embodied decision making","venue":null,"work_id":"91c5de69-1d73-4391-81a9-df2f57ff783b","year":2024},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.970631Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:91c7a82247beae3639528501eaa0001d7d1f43138ccb1a2d010955bbfd71687c","observation_id":"0f72dbda-f872-4b22-abb6-10fc59762c25","resolution":{"observed_at":"2026-08-06T00:13:26.967422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:24.070707Z","title":"Osexpert: Computer-use agents learning professional skills via exploration, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.070707Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:fbbf2540178e5b49e1b159dd45e399390f45d43070a3d59e4c55d77de3011fd9","observation_id":"ea32b4bb-07f7-4716-b7fd-e69bd7445df6","resolution":{"observed_at":"2026-08-06T00:13:24.070707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:26.699519Z","title":"Decision fatigue: A conceptual analysis","venue":null,"work_id":"957185d4-d2c1-4468-9ef3-bfc492e9898b","year":2020},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.148213Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:d44506879c22d53ecc64a80923e895f82ed7f5a0ec9ec3d6c88ed4a774efd7e4","observation_id":"e1280388-4d51-4f67-8983-127ff83a669a","resolution":{"observed_at":"2026-08-06T00:13:26.756272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22034","last_updated":"2025-07-29T17:34:12Z","snapshot_observed_at":"2026-08-07T20:29:47.386254Z","submitted_at":"2025-07-29T17:34:12Z","title":"UserBench: An Interactive Gym Environment for User-Centric Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22034","snapshot_observed_at":"2026-08-06T00:13:24.345125Z","title":"Userbench: An interactive gym environment for user-centric agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.345125Z"},"links":{"cited_paper":"/paper/2507.22034","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:e4f5fbeba594e93433e9ad23bebdd882f7a7099e1419df0fe33a5d6ee67eea95","observation_id":"c969f1aa-d0aa-4e6a-be7a-1d872897054f","resolution":{"observed_at":"2026-08-06T00:13:24.345125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:26.398599Z","title":"Alfred: A benchmark for interpreting grounded instructions for everyday tasks","venue":null,"work_id":"2d166589-fafd-4d14-8468-94e7e72fea2c","year":2020},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.449820Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:988eac1b83a55a34738275acde42cbd521bd8cf70a601c4c88e42646d571dd9f","observation_id":"272180e6-a89b-44d4-8ca5-514bd879bda5","resolution":{"observed_at":"2026-08-06T00:13:26.523498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03768","last_updated":"2021-03-14T22:44:38Z","snapshot_observed_at":"2026-07-06T10:02:33.297722Z","submitted_at":"2020-10-08T05:13:36Z","title":"ALFWorld: Aligning Text and Embodied Environments for Interactive Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03768","snapshot_observed_at":"2026-08-06T00:13:24.530451Z","title":"ALFWorld: Aligning Text and Embodied Environments for Interactive Learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.530451Z"},"links":{"cited_paper":"/paper/2010.03768","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:0631f08f539df18c8020c00ebe1f830913939be7f8f1b1ca8524914bf02c2a3a","observation_id":"5065bf6e-b338-4b3f-ab46-be5640614074","resolution":{"observed_at":"2026-08-06T00:13:24.530451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09560","last_updated":"2025-06-05T07:22:50Z","snapshot_observed_at":"2026-07-06T20:36:12.548343Z","submitted_at":"2025-02-13T18:11:34Z","title":"EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09560","snapshot_observed_at":"2026-08-06T00:13:24.699600Z","title":"Embodiedbench: Comprehensive benchmarking multi-modal large language models for vision-driven embodied agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.699600Z"},"links":{"cited_paper":"/paper/2502.09560","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:9e3874bed3bb420b9594b38cbc336ae1d7d3c3c1ca95449953bb3083ae49e04f","observation_id":"ac8bf5ec-4b22-432b-bf15-3e24b956d6e0","resolution":{"observed_at":"2026-08-06T00:13:24.699600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-06T00:13:25.243758Z","title":"Webarena: A realistic web environment for building autonomous agents","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:25.243758Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:2470534152fdf6b9508ae7c9227322cde5a461e40ebfd8e9428e7637479182c6","observation_id":"6edebceb-77b1-47bd-8594-5306967cee3e","resolution":{"observed_at":"2026-08-06T00:13:25.243758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T15:56:28.722179Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":2,"verified_fuzzy":22},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2608.01456."}