{"as_of":"2026-08-08T12:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:97a177be333af4bc234bb137d10293aa67539d7902707b8ac801f5ec0ba70d33","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:36:57.791208Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.10415/citation-record","integrity":"/paper/2506.10415/integrity","json":"/paper/2506.10415/citation-record.json","paper":"/paper/2506.10415"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:55.842851Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:55.842851Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:7f794f45daf9c1ddb8387943e2491c3ea1f23252ea0d9a17b4850ed57fd68550","observation_id":"31c65fd3-40c8-4b8d-858a-08d5bda3d075","resolution":{"observed_at":"2026-08-07T04:36:55.842851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:55.910445Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:55.910445Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:b83b622304ba8391e21b21147b5a178d2080e31067146ff833e1054f63fb9bda","observation_id":"b5e898a2-cd89-4029-b420-8c86610052cf","resolution":{"observed_at":"2026-08-07T04:36:55.910445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T04:36:55.968362Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:55.968362Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:8c64034fc1fab3bf6ec7ba64a514109168e8820be13090ff7b89d714170c46a8","observation_id":"90da2a9b-2ad0-4a37-81c4-fcba53e4aa8d","resolution":{"observed_at":"2026-08-07T04:36:55.968362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:36:56.005935Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.005935Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:19fe52ee626a9f4be15b1e341a676426f82395c021b4520c2006b2a79272f235","observation_id":"aa144632-b19d-4ee2-892e-12eaceb40209","resolution":{"observed_at":"2026-08-07T04:36:56.005935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.093486Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.093486Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:181fa054216024bc0b06ce22e42ff97e9389eff48952ecf69e57837cb47b1209","observation_id":"d384cc06-f01b-4501-9b84-265165211a64","resolution":{"observed_at":"2026-08-07T04:36:56.093486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-long.87","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.845100Z","title":null,"venue":null,"work_id":"f5aabdb2-979e-4567-ad9e-7cbb7adef165","year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.141937Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:409e3e50ab140fb789d011c6431e8820ea25fc811e3f68b721f7b6de58a5d5dc","observation_id":"26f63b4d-6496-40e8-924d-82df3d97b04a","resolution":{"observed_at":"2026-08-07T04:36:57.849183Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.303173Z","title":null,"venue":null,"work_id":"2a33239c-db47-4869-9736-65b10bf5c56b","year":2025},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.185800Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:77f389430661459d2c2878c049a8270e42661a0dfc0c6bef6be7acb94785649e","observation_id":"a4ed913e-e0ba-4396-8743-f4378946d707","resolution":{"observed_at":"2026-08-07T04:36:58.306506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.228030Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.228030Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:7989390400f1f8f2213cb9ff984b7c3eed75f8a1e0734d40a269a9d5d327ca78","observation_id":"19f9dbbe-8ed9-411c-bb04-0d4f57fc7fb6","resolution":{"observed_at":"2026-08-07T04:36:56.228030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.286373Z","title":null,"venue":null,"work_id":"d6947d30-c294-4524-99ef-cb73a24b2a33","year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.267735Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:a8c258179ca7a30ec0119f2f90c1e2b66bb54a89c008e18ab2b31462beddb450","observation_id":"fb374256-0dd1-4b4d-a3ca-c07e0744ebe3","resolution":{"observed_at":"2026-08-07T04:36:58.290223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-07T04:36:56.303597Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.303597Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:7297f757342a3ccd9240555e54a9a8d6f742c3a2fd4eca34c46204ee8468a736","observation_id":"d4690e8f-a6ff-4b89-af78-e6dd86db56b8","resolution":{"observed_at":"2026-08-07T04:36:56.303597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.352974Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.352974Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:2ebe3c982bd6b7b5ec0640db9c2296e2ff2123b726288ebd7ccce7f1b3fea791","observation_id":"7166f125-6432-4892-9b2b-cf08503f23c5","resolution":{"observed_at":"2026-08-07T04:36:56.352974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T04:36:56.418189Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.418189Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:d774d8bfdf03cdc4449b81a70f2eedd10b0f9e7c39963e7c63c9a4af2e3d0b3a","observation_id":"3d591363-7b61-4c01-b648-91b2e7daa879","resolution":{"observed_at":"2026-08-07T04:36:56.418189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.271490Z","title":null,"venue":null,"work_id":"5eb89b22-7c95-46dc-a5e6-e937e1cdd255","year":2018},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.484181Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:ef5b7f3007095a401fca5ea6fcefea69fd8b85db5ea294d62bf3bc1bd03d1265","observation_id":"9a505477-76a1-41a3-bd06-4a82bd59794f","resolution":{"observed_at":"2026-08-07T04:36:58.274288Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.262595Z","title":null,"venue":null,"work_id":"947e074a-0b9d-417b-93fe-639c66ca4217","year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.552826Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:076202e958c5dae1858c08c9e9fd8737f1ac3dd10592cf678c406bae9152b4b9","observation_id":"f6ca50f9-4f86-4913-9064-40a506cc1344","resolution":{"observed_at":"2026-08-07T04:36:58.265367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.586973Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.586973Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:89d153b793e74b2f7adaabb720eaaaa55cab9c7d7f493e4cfdede0a318beb0aa","observation_id":"554cc7f2-cfbf-4f4f-a6e6-a6711c45b3ac","resolution":{"observed_at":"2026-08-07T04:36:56.586973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.247665Z","title":null,"venue":null,"work_id":"3d43fec3-3661-4d77-b876-308427805855","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.623691Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:52a645973b8f3a627a387dedb88e484505b2be07f77270ce2857e1c98c2aefa4","observation_id":"851cadbf-3692-4203-9ab4-74d172aada91","resolution":{"observed_at":"2026-08-07T04:36:58.251177Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.239075Z","title":"Ku, Qian Liu, and Wenhu Chen","venue":null,"work_id":"ba572085-d8ac-4817-9ca5-978201f42d79","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.689422Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:68059d35c8cbf6643e4d56cb4f2e39b4f312d36e3c069bd5de9a1d40d0750a20","observation_id":"6357a1b2-4a06-4e72-ae96-19caa511c722","resolution":{"observed_at":"2026-08-07T04:36:58.241963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.756183Z","title":null,"venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.756183Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:4e5511d6c7b0733530e8f4b30c93ce97feb2e4caa20f45a415857004b82c9ae1","observation_id":"61e8e627-bce3-4b03-b763-7090f19bff57","resolution":{"observed_at":"2026-08-07T04:36:56.756183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T04:36:56.800127Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.800127Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:689fb0bd93a16c5882ad3e2354cd645462c010d3e467f8e56d0c305c84cc400f","observation_id":"ee18bd61-5898-473d-b604-74072ed4d97b","resolution":{"observed_at":"2026-08-07T04:36:56.800127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:56.871215Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.871215Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:b6f5b1e698c450cdf6268582d7ea7a74ef83c8af7c18264243dba6f86e38facf","observation_id":"9cbdcc6f-eed7-49c7-b3ef-b58c46889f77","resolution":{"observed_at":"2026-08-07T04:36:56.871215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-07-06T18:44:24.873040Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-07T04:36:56.903250Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.903250Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:af331c2a26ac4f278ebbe959ef970721e1ea21d509199adf3684ed7391ef714b","observation_id":"aec1934d-55f9-4823-b709-84fa00b75b98","resolution":{"observed_at":"2026-08-07T04:36:56.903250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08632","last_updated":"2024-09-06T11:20:13Z","snapshot_observed_at":"2026-07-06T19:01:27.827878Z","submitted_at":"2024-08-16T09:52:02Z","title":"A Survey on Benchmarks of Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08632","snapshot_observed_at":"2026-08-07T04:36:56.960671Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:56.960671Z"},"links":{"cited_paper":"/paper/2408.08632","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:d81cbc0ee419a62220a72eca6e5b3affd0a1f6ba50d075085beda3741011b547","observation_id":"b3b66b49-a8e3-45ae-99c4-5c84ace87e7b","resolution":{"observed_at":"2026-08-07T04:36:56.960671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.218663Z","title":null,"venue":null,"work_id":"7c266a63-d5cc-41c0-88cf-eb7736827b1f","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.035431Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:04b73ff9a73823b97c34e0fa4072695b3085711f3d3a2f76f27b8d2234cf1c6d","observation_id":"38f2f181-a075-4453-b6d4-6c11922694ef","resolution":{"observed_at":"2026-08-07T04:36:58.221435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.209984Z","title":null,"venue":null,"work_id":"8218c432-d41c-49df-a0ef-36b5e491ac90","year":2019},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.083977Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:6a842b168bf0df3701ec93f5b666a1e67f539091e4bb50eb5befea5a5bacc531","observation_id":"84c2d7c2-8b62-4e08-8ebc-ea82b2ad1476","resolution":{"observed_at":"2026-08-07T04:36:58.212845Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.201017Z","title":null,"venue":null,"work_id":"1036077f-a63e-4663-b191-5347a4b21e61","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.178525Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:9e4e0ddb7cf809fc796de2a8efbed5f5a0bae09a553ad1992ae4b364921b37f6","observation_id":"b565f4d8-0151-4476-b5da-228d5d773e7e","resolution":{"observed_at":"2026-08-07T04:36:58.203854Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.191752Z","title":null,"venue":null,"work_id":"10e29586-939d-443c-a581-4c172af34498","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.223584Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:04cc0dddc04fb4e97fcd9c1fbade69cf5d7d9edebf93460758f10b4fbaefb91c","observation_id":"2382cdb4-0975-4350-b76c-b6060a36dc1b","resolution":{"observed_at":"2026-08-07T04:36:58.195026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.182038Z","title":null,"venue":null,"work_id":"dbc17cd1-66c2-4fbe-9e56-881e32562fc3","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.312487Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:5a5e32239d9bfa2629aa83dbaac730b26d5362d189e001e389e43c7aef1b40e6","observation_id":"a3a0c202-9922-420b-9427-584464a29986","resolution":{"observed_at":"2026-08-07T04:36:58.184983Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.172699Z","title":null,"venue":null,"work_id":"58f71529-047a-494e-9ea6-5d8dcf44cf9a","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.355871Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:3791f56e5b3bea19ba4f67720e1c63db21df9157b18e14d46e5ef7b3ba07530f","observation_id":"2a5ac443-47a1-4cc5-9b78-d33bc962200b","resolution":{"observed_at":"2026-08-07T04:36:58.175717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.162732Z","title":null,"venue":null,"work_id":"08816ccb-92b2-4056-b2e0-8501908b892b","year":2025},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.406025Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:2977d599adc1c1a35bc715b513e2565e1caadc520318aa756b01c2baa8dfdb22","observation_id":"9f40534c-5146-4bc6-bf49-8f471341bfa3","resolution":{"observed_at":"2026-08-07T04:36:58.165973Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.152979Z","title":null,"venue":null,"work_id":"09e6cf13-882d-4bad-aa22-2f3028863ef2","year":2022},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.493936Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:cc299ffd942969558c55492007773946e52385dc547c67504200f5e16f2b4f59","observation_id":"a779e404-8c5e-4802-935e-36120f0f9bea","resolution":{"observed_at":"2026-08-07T04:36:58.156334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.143842Z","title":null,"venue":null,"work_id":"0876c9fa-0d62-49f0-98ee-0de12010f5ea","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.529318Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:875106c7a21abade39a517b43ac8e415ef8ee27e1644857ad14e108049145a02","observation_id":"cfa1177c-7f38-4a46-a26e-1c46c67e3bdd","resolution":{"observed_at":"2026-08-07T04:36:58.146711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.614358Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.614358Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:8885b243affa235e237b07090669d2c97e5c379183a307314da745b02988d9e8","observation_id":"6f3ec60e-cef3-4ab6-ac1b-2abc939dcfe2","resolution":{"observed_at":"2026-08-07T04:36:57.614358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.127699Z","title":null,"venue":null,"work_id":"025b261b-82b8-4624-b8bb-6ab9af46b33a","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.660424Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:e7b476a2abee223a61897da61bf8577aa447b859d65651663113c65177eb4bb3","observation_id":"d5b9b921-0af2-411c-99ba-ff972055fb86","resolution":{"observed_at":"2026-08-07T04:36:58.130607Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.119049Z","title":null,"venue":null,"work_id":"0d4f8995-fe55-4140-8b4a-eab7c1f4d333","year":2003},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.724102Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:3d7da464ed092cb257239a91d55e60389d76bef4ecb8fc07d2b5b5a63e66bdef","observation_id":"fb57719b-1494-4abc-8166-e03811368756","resolution":{"observed_at":"2026-08-07T04:36:58.121927Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.109906Z","title":null,"venue":null,"work_id":"d9c42750-a230-47a7-8ad4-4a8bf8f9d77c","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.745924Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:ac7bc8ca111fcac3e83b61bfd8972d1d13b039dec8252d4af70b3b5d73dc1f96","observation_id":"315654a7-0260-4135-a85d-a0d4189a2a95","resolution":{"observed_at":"2026-08-07T04:36:58.113028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.101017Z","title":null,"venue":null,"work_id":"100c8863-065b-444f-91ef-9da10ba805df","year":2019},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.749772Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:2bc0dbaf26966b6aa178d096a88f4387d3d3cc549de88522684ea71fd29fcd41","observation_id":"75cecedd-f28b-458e-8c73-a1db0c65008d","resolution":{"observed_at":"2026-08-07T04:36:58.103796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T04:36:57.752458Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.752458Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:a55a236b72505295df039cd31ebfe4033253cb9b6cae2fe11736a9f6dfe85000","observation_id":"7e92028f-d1cf-455d-b143-4a5abba33883","resolution":{"observed_at":"2026-08-07T04:36:57.752458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.092137Z","title":null,"venue":null,"work_id":"8e92282c-cf2e-431a-b8fa-0072b38428ca","year":2025},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.755306Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:7927c28245d468ff775af90e04f6c3e8ed2427185924c9dcfc7e806043e1d83f","observation_id":"dca4467a-b6e6-4873-a438-5a406bf2eba0","resolution":{"observed_at":"2026-08-07T04:36:58.094986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T04:36:57.758726Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.758726Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:e958ac62acd062de94eded7cd2f42edff41891465f6aaaef66064a4a60db89f6","observation_id":"7a6459ba-220b-4ae5-9fed-9da86d444cbf","resolution":{"observed_at":"2026-08-07T04:36:57.758726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.761786Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.761786Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:9482bfa449433834f655143474e44bea108ca420640a0a9135f61d38a91fbd3a","observation_id":"1d00e8dc-26b0-4a19-b456-da1fac3709de","resolution":{"observed_at":"2026-08-07T04:36:57.761786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.764923Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.764923Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:f927d0105e34363f22d627b0567bc3bc99fef9d317c8421aa6afd5bcb08961df","observation_id":"a7b68da8-5e05-4361-96a0-b382231b5f3a","resolution":{"observed_at":"2026-08-07T04:36:57.764923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-07T04:36:57.768267Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.768267Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:f1f6d279041511fcf4acc28a1eeaca6c10de13f1b99d9cf854e9323491321a11","observation_id":"60289f6a-c095-4d0f-8598-7e7a8d5c3156","resolution":{"observed_at":"2026-08-07T04:36:57.768267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.075038Z","title":null,"venue":null,"work_id":"1fff6f26-b321-4be6-8026-167bf3b1c1a8","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.771470Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:748b77d76a25cd350e1a90e56b1d4115cff60536c74f2a001532d6364f526534","observation_id":"ea391491-2233-462b-99df-43c0d61d2dd6","resolution":{"observed_at":"2026-08-07T04:36:58.078067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.774458Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.774458Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:062fd243ba5613a3adb2c520bfa01a1c376fd58dc102f10ddc2f33ce306762b7","observation_id":"ae19ed72-386f-4706-9dd8-fc22b2680059","resolution":{"observed_at":"2026-08-07T04:36:57.774458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16852","last_updated":"2024-07-01T02:59:29Z","snapshot_observed_at":"2026-08-07T09:52:45.942315Z","submitted_at":"2024-06-24T17:58:06Z","title":"Long Context Transfer from Language to Vision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16852","snapshot_observed_at":"2026-08-07T04:36:57.778449Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.778449Z"},"links":{"cited_paper":"/paper/2406.16852","citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:e31750bf69c5ec2974e610fbbdec721d3c78680a236e2fac2aca4ea7df785b40","observation_id":"48c77cfe-290f-4270-adb6-2b1adcf3f0d6","resolution":{"observed_at":"2026-08-07T04:36:57.778449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.782456Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.782456Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:5c73af0db2a114f14b10ef33d9916d71fdceb8710027bf1d471c296d5881fcf2","observation_id":"6e1a7f37-a7c4-4c2d-9e09-8187eea79bce","resolution":{"observed_at":"2026-08-07T04:36:57.782456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.785475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.785475Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:75989f13985d996de0488f50ccbe96e4c760d3aae95612811fccd5b443739c78","observation_id":"ac596079-51f6-453a-9ae1-83a32905c794","resolution":{"observed_at":"2026-08-07T04:36:57.785475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:58.046838Z","title":null,"venue":null,"work_id":"96fef079-6103-4278-99e6-c5e5269af1af","year":2024},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.788190Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:266f37461fe7b6f1b596f47a48ae793dc94ff069a4a17502217f3a0e04f270cf","observation_id":"7632a9aa-e197-41da-a670-197147fc38e5","resolution":{"observed_at":"2026-08-07T04:36:58.050574Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"pubmed/9522683","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:36:57.948568Z","title":"Zwaan and Gabriel A","venue":null,"work_id":"80f0d504-e2f7-44ae-992e-fb027394ba75","year":1998},"citing_paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T04:36:57.791208Z"},"links":{"citing_paper":"/paper/2506.10415"},"observation_digest":"sha256:88ce5d30cb351ec1844890cd8221bdf3f7d71364a18dfe60fb36537c5f1bfec7","observation_id":"a3890a0f-9ccd-4788-a921-54571984658d","resolution":{"observed_at":"2026-08-07T04:36:57.954724Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.10415","last_updated":"2025-06-12T07:12:31Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T04:24:35.583795Z","submitted_at":"2025-06-12T07:12:31Z","title":"Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2506.10415."}