{"as_of":"2026-08-08T00:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:04961b98aba2a6dac415c3e392d37e02c76cb190dc9b95c938a6b56785bef1e8","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:22:35.417608Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04759/citation-record","integrity":"/paper/2608.04759/integrity","json":"/paper/2608.04759/citation-record.json","paper":"/paper/2608.04759"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.080406Z","title":"Aho and Jeffrey D","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.080406Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:b158bff27f59b04eb40093078dc483db966bad5df2d958040cc10e14ba31af16","observation_id":"5be2299a-f721-4ec1-8309-150a2b810c77","resolution":{"observed_at":"2026-08-06T17:22:31.080406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.139121Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.139121Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:6c9b6bbd6169f3d7c44cebdab7f8f9ef0b3684c2bb758133d9a250194d01bedc","observation_id":"8d7ec0fe-a125-422b-82f0-4120a930e7db","resolution":{"observed_at":"2026-08-06T17:22:31.139121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.199238Z","title":"Chandra and Dexter C","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.199238Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:09a0379bb1a3cf4674e6e27c19def077370c559e9d04787d0a3a82bda6000688","observation_id":"84136e11-a39b-45fe-951b-dc0a05ec5328","resolution":{"observed_at":"2026-08-06T17:22:31.199238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.255551Z","title":"Scalable training of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.255551Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:88be3d532d2d3d91d6aee98e2e3a64bc0c6986442f13b879e8632fe4ea3a58e9","observation_id":"cf6c0830-59e2-4108-9875-6db0f12dabd4","resolution":{"observed_at":"2026-08-06T17:22:31.255551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.294351Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.294351Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:96606ca8758fcfab8c2b442593aca05444909199d14f904545517dbba792759a","observation_id":"2b74ec59-d5d4-4d31-8d50-ff92a84d22e4","resolution":{"observed_at":"2026-08-06T17:22:31.294351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.369726Z","title":"Tetreault , title =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.369726Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:56cdd0ca051bcd553e680bf416aec19f04ef9c9e933f1f84f97c3fd303654582","observation_id":"a8e5cb42-981f-44bf-a48b-9bb896913c2f","resolution":{"observed_at":"2026-08-06T17:22:31.369726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.425996Z","title":"A Framework for Learning Predictive Structures from Multiple Tasks and Unlabeled Data , Volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.425996Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:2bbc517db8eb3354e081d3290de60ba11ca9eca63fa68d87d97310e65027cbb0","observation_id":"722fb0ff-3343-42dc-aea2-91bf5e1dee9d","resolution":{"observed_at":"2026-08-06T17:22:31.425996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.639586Z","title":"ACM Computing Surveys , volume=","venue":null,"work_id":"18c3c86c-ba21-49a2-bbbf-515a57bbc0d1","year":2025},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.489562Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:f2f163971c348d21edd68494b534efa950bfcc16c3bf7618c54de645c9afd183","observation_id":"6c538dbb-f1be-4725-a8b2-bf06baf624b1","resolution":{"observed_at":"2026-08-06T17:22:39.692827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.514361Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"98ec8646-5523-4294-ae8b-1afd1276931d","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.526543Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:689147139cc4ef34b37a569668008d14dc864624650ed713cb26f68ddbdfc7d1","observation_id":"8bad8126-4349-4e09-8cee-8c97f0d1c9d6","resolution":{"observed_at":"2026-08-06T17:22:39.569113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.08758","last_updated":"2026-06-29T18:48:00Z","snapshot_observed_at":"2026-08-06T02:33:07.002390Z","submitted_at":"2026-01-13T17:42:27Z","title":"M3CoTBench: Benchmark Chain-of-Thought of MLLMs in Medical Image Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.08758","snapshot_observed_at":"2026-08-06T17:22:31.612375Z","title":"arXiv preprint arXiv:2601.08758 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.612375Z"},"links":{"cited_paper":"/paper/2601.08758","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:00f610c31f4cf3ea40cff3fe8a3ea0397b2c4e17e1366da821cb26be24ab9f60","observation_id":"e0cf3826-eafb-48e3-947e-111aaeaaa301","resolution":{"observed_at":"2026-08-06T17:22:31.612375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.374981Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"2c82f157-c4f6-440a-9dd9-9a0002546267","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.647200Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:3e49bdf3d434bd34f15f3e07aadb30ffe13f50c5dc0bb026923beae174676ad3","observation_id":"f367b28e-03b8-4f75-b200-54eba89f48a0","resolution":{"observed_at":"2026-08-06T17:22:39.431434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.694970Z","title":"arXiv preprint arXiv:2602.04486 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.694970Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:6d5d2fc5e38491edad92dd0addc805e25e0102e31b4f034a07e565316e4c13f8","observation_id":"888ad18b-240e-444c-8c56-1e133ef24a0d","resolution":{"observed_at":"2026-08-06T17:22:31.694970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.243298Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"0190574a-7395-4b8f-969e-93faa599a56f","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.788965Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:60483e2739884a22a40a286d6c01f258535c6902617384c66f632d87ab117283","observation_id":"d044efa0-8084-41f7-a07b-ab5ec757a29b","resolution":{"observed_at":"2026-08-06T17:22:39.298602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:31.826864Z","title":"arXiv preprint arXiv:2601.11659 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.826864Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:0e0635753134b418eb6d87fa27a325a806bfdcdc97618d639550d73e697abb26","observation_id":"d85f94cc-f080-43e1-ac2b-8d3b495b2767","resolution":{"observed_at":"2026-08-06T17:22:31.826864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.25979","last_updated":"2026-05-25T15:54:04Z","snapshot_observed_at":"2026-07-06T23:35:50.787324Z","submitted_at":"2026-05-25T15:54:04Z","title":"LLaVA-OneVision-2: Towards Next-Generation Perceptual Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.25979","snapshot_observed_at":"2026-08-06T17:22:31.939898Z","title":"arXiv preprint arXiv:2605.25979 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:31.939898Z"},"links":{"cited_paper":"/paper/2605.25979","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:a8326a7758b3bc92a925ea4bf8dbfa35717917e26f2d69475160f746981b84d6","observation_id":"e5460fb8-f207-4ee5-bc9f-a1a267c7fb62","resolution":{"observed_at":"2026-08-06T17:22:31.939898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:32.003696Z","title":"arXiv preprint arXiv:2509.06266 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.003696Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:0a7c9f60174b66c1dfa5e6ff3195f2527819db4ffa4500f98bfb8fcb2b86aca3","observation_id":"7d9e88d4-7c8e-4ab7-bb62-357ac24e0047","resolution":{"observed_at":"2026-08-06T17:22:32.003696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:32.041786Z","title":"arXiv preprint arXiv:2512.16561 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.041786Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:b99f5d363c865fe51b945f512b525c8b88c0a584caedebf56c8a4de829323cf3","observation_id":"056a02c2-7874-4f77-91b8-221bd6bde87c","resolution":{"observed_at":"2026-08-06T17:22:32.041786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.130480Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"74addedb-a618-496d-bdbd-a3d9bcce998b","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.130080Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:7feb573c5183482f974b988400553ebd2d4bb3205ba40b5e5d9ea90bcceb8ad8","observation_id":"118d4e22-7421-4b0f-8aa6-427b552c60f8","resolution":{"observed_at":"2026-08-06T17:22:39.184414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:39.019710Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"8e189756-0a5c-4449-bbe5-4a912bf85e1e","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.188582Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:53298c80ebae7605ed553c9c5697685a1a5f8f2a9c0c9c6a776017030689b7fc","observation_id":"e99f9e4b-6cf3-402d-af7e-2b3c17c37488","resolution":{"observed_at":"2026-08-06T17:22:39.073644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.880787Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"02cee432-9287-46ac-8b22-3044d948d0b2","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.269406Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:2cd2e32e6a0bcac1aa8861817a945d9c1d1e3afd4d734de387be678530dad2ff","observation_id":"45dc518e-32ed-4bcc-ab70-47a8c16b3931","resolution":{"observed_at":"2026-08-06T17:22:38.933856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.692404Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"66ae2848-a2a9-412a-8c2d-7fe56195ea65","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.392307Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:62f504a2f94d70e2220887ff3157eccd60f93203c8e8e72ab493bc98e16754af","observation_id":"b1871c32-418a-4107-ad59-c7d66c9dde88","resolution":{"observed_at":"2026-08-06T17:22:38.784033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.540409Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"344f4984-eede-4e4d-a345-8bd5ace815a4","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.479508Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:107add015a24f21574d1c2571d872a5fac3d1693a1cf531cf9bfb03a7a1aac7f","observation_id":"247693e8-9b14-4530-b3b4-47c81516523a","resolution":{"observed_at":"2026-08-06T17:22:38.611525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.447949Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"198ca9d6-5871-431a-aeeb-963f840d47c4","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.535871Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:f0b34b4c266569f0cfd1411a7a475ce091414c04d594f84347ce7d29991555b4","observation_id":"5f224dbf-ef03-469e-8e2c-8b60aad3d86a","resolution":{"observed_at":"2026-08-06T17:22:38.478761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:32.607464Z","title":"arXiv preprint arXiv:2509.16087 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.607464Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:f4378114e5769347367312443c8dd10915e083637bc8632299d48d9a44c9ffd0","observation_id":"140df947-3c4d-4997-bcf3-3236940b954e","resolution":{"observed_at":"2026-08-06T17:22:32.607464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.367701Z","title":"Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"8bbe3ee4-a460-44cb-b7f2-33869ca21c96","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.676013Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:fa844a9a05b6375eb8e5da35fb1bc738965c92945c5a70ec13712e52d65e13f1","observation_id":"f27169ca-91aa-4429-bee9-d2b487b48779","resolution":{"observed_at":"2026-08-06T17:22:38.403166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:32.763559Z","title":"arXiv preprint arXiv:2602.07833 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.763559Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:7f6d90b43d3f414cac38602a53e82a095b5c2ac2be9e2d175c5f72f48961c0fb","observation_id":"ab4145a8-5cb9-459a-a510-d730161d377c","resolution":{"observed_at":"2026-08-06T17:22:32.763559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.271128Z","title":"Findings of the Association for Computational Linguistics: ACL 2026 , pages=","venue":null,"work_id":"10dcd688-8be2-44c9-a317-5e86709c7151","year":2026},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.878405Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:0d4732350e5e43d25f80f341bf6e9630fe86177edff471deaeb7110c24f9405b","observation_id":"dd9e4f0a-cee7-4657-a1e1-ff18bb8f8b23","resolution":{"observed_at":"2026-08-06T17:22:38.318990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:32.999630Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:32.999630Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:e462d8714b362a9a2d42050f9c57bf0ee1201271a79ce2476806bc6d9f51b131","observation_id":"0e5f81b5-4b01-499c-8048-448ded90800d","resolution":{"observed_at":"2026-08-06T17:22:32.999630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:33.109218Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.109218Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:25d8b5c250cc87cdbf89eee8fa7869893fc83eae371eaba9fa7402adfad39ad6","observation_id":"7e3b74ab-fbf6-48a0-8573-d6d58437ca25","resolution":{"observed_at":"2026-08-06T17:22:33.109218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:38.139304Z","title":"ICRA 2025 Workshop: Human-Centered Robot Learning in the Era of Big Data and Large Models , year=","venue":null,"work_id":"44803311-0e46-4945-b0ac-892d98497e6d","year":2025},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.187354Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:deb6c0eb67c6c70b635bb806a379157c671bb58d4f0690559e700c2b9f373f95","observation_id":"3dee3c6c-56db-4df7-8742-8bd5573df326","resolution":{"observed_at":"2026-08-06T17:22:38.184767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.990561Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"ece54fd5-a37b-407c-94a5-8dff6a364334","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.272945Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:b714f2605d75f5a95805442e6ce9afe902bddbdb6c145bf4cee29b2b692b154d","observation_id":"122ba67e-93a3-4206-be47-c217e2b8d109","resolution":{"observed_at":"2026-08-06T17:22:38.061972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-04T03:29:49.409446Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-06T17:22:33.391898Z","title":"arXiv preprint arXiv:2310.11441 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.391898Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:dd86bdcb253cca6fe1c9be16ddea9e270af594f2f25d0c462d70b450d7776246","observation_id":"bdd95ac7-d3f7-40ff-be9b-ab3dd3dc1e38","resolution":{"observed_at":"2026-08-06T17:22:33.391898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.06663","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:36.099697Z","title":"arXiv preprint arXiv:2603.06663 , year=","venue":null,"work_id":"461b5454-6cc2-46e0-b382-31e3ebf4fcb8","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.503601Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:ce7f2a00b887ec7ab2dd49cef1e2343afbcad97d876b8d7fc75cefcaad1da423","observation_id":"17303e19-1c60-4a2b-878d-085eeb5b87a5","resolution":{"observed_at":"2026-08-06T17:22:36.124898Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11779","last_updated":"2025-02-23T15:14:47Z","snapshot_observed_at":"2026-08-04T10:14:38.406056Z","submitted_at":"2024-10-15T16:57:44Z","title":"MLLM can see? Dynamic Correction Decoding for Hallucination Mitigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11779","snapshot_observed_at":"2026-08-06T17:22:33.626317Z","title":"arXiv preprint arXiv:2410.11779 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.626317Z"},"links":{"cited_paper":"/paper/2410.11779","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:615ccc66159422dd604088be1a136f792fc13bc8d2b0bf69ebbb1ee54fcbc2f5","observation_id":"92afc358-f664-430e-a548-9a712500d23c","resolution":{"observed_at":"2026-08-06T17:22:33.626317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.878885Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"11353afc-5201-4a7b-811c-95e091393aa5","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.695598Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:79712fb386fd174ffc5bdf39e84f10132dd7750d0cbae8be41b367bdaeed8cf4","observation_id":"c0695129-3bbe-4115-99fa-b240cccfe967","resolution":{"observed_at":"2026-08-06T17:22:37.925589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.788062Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"b48d1147-2e33-4233-a4e9-d326ca05c4c6","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.773296Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:23b296a253905b227ed35f2b98376c787a7a937b599001aa04c830bb31b8a14b","observation_id":"e1d3bf70-c276-475b-a3a1-9b24e42109b0","resolution":{"observed_at":"2026-08-06T17:22:37.834207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:33.835555Z","title":"arXiv preprint arXiv:2508.00378 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.835555Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:19fea357e86c0669bdd101b81326b81c9025c330d6dce6cd89338a04f4a21beb","observation_id":"de28aa3f-aa18-4cf5-a38e-9777b799c0a3","resolution":{"observed_at":"2026-08-06T17:22:33.835555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:33.912921Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.912921Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:72b2fd0fbf547fb65bd7080bfa460366cc75bee4e989fafa2c392cfb19cb4784","observation_id":"15adbcb8-b524-440e-a0ce-a324a0791e7f","resolution":{"observed_at":"2026-08-06T17:22:33.912921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.567909Z","title":null,"venue":null,"work_id":"3972af12-e935-4f2a-98c9-882cd0ca0f5d","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:33.971096Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:d575707f5d0b525e45bfd842824daa4bf7b1f89f58bc8cabf3be11ba00bcb915","observation_id":"b6c3fc76-1e7a-4dd2-9a0f-717aa9e795d9","resolution":{"observed_at":"2026-08-06T17:22:37.658623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.045096Z","title":"Proceedings of the 2023 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.045096Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:c478aa47ff5efbc41e50bd9bf2fced95b6dc2344aa58582722ad7fd07b7bbb67","observation_id":"78d72f53-3c8d-4094-8938-40cc9f624151","resolution":{"observed_at":"2026-08-06T17:22:34.045096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.126253Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.126253Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:1af140b1a41c56f8773aaab3d09fd70121e87e8f2bd42477d086849fe6c8d0a0","observation_id":"1ec12373-fb50-49b7-acc9-b8871e71bf2f","resolution":{"observed_at":"2026-08-06T17:22:34.126253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.191686Z","title":"Findings of the Association for Computational Linguistics: ACL 2024 , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.191686Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:c799b146151945a8aa51a3b624b5aa642c93089efd822211f4bf8abf313ac5b5","observation_id":"42f13357-1257-48f6-97f0-632f67ada602","resolution":{"observed_at":"2026-08-06T17:22:34.191686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-06T17:22:34.255093Z","title":"arXiv preprint arXiv:2511.21631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.255093Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:6d2319e368edbb9c748ba1b9cec88f96b922c82f45dc39032efd1aaf35dd2c6d","observation_id":"824d7f47-a638-4582-b8f7-e36c5e863960","resolution":{"observed_at":"2026-08-06T17:22:34.255093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-06T17:22:34.324511Z","title":"5: Advancing open-source multimodal models in versatility, reasoning, and efficiency , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.324511Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:38b5afb6eee2c90bc2d45cab3b8c31623d5a82038aca6ca67752cea1b5a8ed1c","observation_id":"c5b77986-8490-48ea-9ea6-7524e67ab46e","resolution":{"observed_at":"2026-08-06T17:22:34.324511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T17:22:34.408128Z","title":"arXiv preprint arXiv:2407.21783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.408128Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:76302c0ad5e828dcd4da96dfd81b936f98f2f0165c419f25fa71fca5c253cb25","observation_id":"97b3c6ec-0c76-4c96-bda0-a8e678b5d8fa","resolution":{"observed_at":"2026-08-06T17:22:34.408128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T17:22:34.525172Z","title":"arXiv preprint arXiv:2410.21276 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.525172Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:f33b1e8c5c23dde142a18c9711aa9c683137a09d55c1fe2fa0008ac60c96c0bc","observation_id":"33fe9acf-6578-4a94-9398-1c74ac8f74f7","resolution":{"observed_at":"2026-08-06T17:22:34.525172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.590402Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.590402Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:14c72be3df40aba7eca056ebb3de20dd171035009324def80069e7b8e8f7c6b9","observation_id":"e0087af7-1185-4712-b239-776bc215da04","resolution":{"observed_at":"2026-08-06T17:22:34.590402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.392907Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"b3cd6c75-5268-4095-8988-8a9988cfa6a2","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.706368Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:5cf734b55d8a29de4d33fe6fdb4b300f47f494c2ac31c09b5d0c8532db8ba511","observation_id":"f1a5998d-feaa-4693-9bed-bf1e045466c2","resolution":{"observed_at":"2026-08-06T17:22:37.463089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.801869Z","title":"European conference on computer vision , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.801869Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:11cd6af9af72f7ce2ee7e48893d8fefdb02a2cb07d2d1d9037c86337d83d28b9","observation_id":"a6efbf36-e90d-4981-a323-759b57798d42","resolution":{"observed_at":"2026-08-06T17:22:34.801869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.876379Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.876379Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:6363cb3981655c6ab64d59088bad4ede3f774563c3d59baf612ebe956a0374b2","observation_id":"855f16af-dedc-47d1-812c-6ffd5acb8d66","resolution":{"observed_at":"2026-08-06T17:22:34.876379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:34.967562Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:34.967562Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:821653af6135bb0910916a9d512a1d92d10eb62b463137679aa8666f91708289","observation_id":"7e8c5fda-7f06-487f-af06-cb856f2ab594","resolution":{"observed_at":"2026-08-06T17:22:34.967562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07809","last_updated":"2026-04-09T01:41:48Z","snapshot_observed_at":"2026-07-06T22:32:07.945004Z","submitted_at":"2025-10-09T05:34:57Z","title":"Invisible to Humans, Triggered by Agents: Stealthy Jailbreak Attacks on Mobile Vision-Language Agents","version":4},"cited_work":{"arxiv_id":"2510.07809","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.07809","snapshot_observed_at":"2026-08-06T17:22:35.654147Z","title":"Invisible to Humans, Triggered by Agents: Stealthy Jailbreak Attacks on Mobile Vision-Language Agents","venue":"cs.CR","work_id":"479eca1b-fa5f-413f-a567-d076cf572500","year":2025},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:35.066731Z"},"links":{"cited_paper":"/paper/2510.07809","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:ac5a277fc767a09402cad42a4d079b45ea03ffc42ad5730850c48831c2f271f4","observation_id":"1f57a89e-4166-480e-a1c7-3c80a0023ef9","resolution":{"observed_at":"2026-08-06T17:22:35.750550Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:37.137507Z","title":"Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"66ca41a2-d9a4-4fa0-98c8-080e1be1539f","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:35.188130Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:3a2d702af54a2f189dcffa5b9366da145dc28ac0aabba2b915a0bff19d8821b9","observation_id":"bd01ea6a-5749-4289-903b-9b4a7faf1c74","resolution":{"observed_at":"2026-08-06T17:22:37.220739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:35.281502Z","title":"arXiv preprint arXiv:2604.01618 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:35.281502Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:bcc0d7d4ace52d93cc0699b2dbb32bde03e46d76f413a21267816c009ee40bef","observation_id":"bb0c0a50-bff5-4b12-994a-3b2ac318e278","resolution":{"observed_at":"2026-08-06T17:22:35.281502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:22:36.851494Z","title":"Proceedings of the 32nd ACM international conference on multimedia , pages=","venue":null,"work_id":"21afb8c5-745b-4f0e-a48c-ba8e8d06a261","year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:35.359514Z"},"links":{"citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:47321117dc0944b42ae9020644928b4c08302e4d472071602d5e4a07fff234a7","observation_id":"a079389d-390d-4a95-bf0a-1f64cccdd653","resolution":{"observed_at":"2026-08-06T17:22:36.991699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.13026","last_updated":"2026-05-14T09:07:42Z","snapshot_observed_at":"2026-08-05T18:53:10.449994Z","submitted_at":"2025-11-17T06:25:12Z","title":"REVISOR: Beyond Textual Reflection, Towards Multimodal Introspective Reasoning in Long-Form Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.13026","snapshot_observed_at":"2026-08-06T17:22:35.417608Z","title":"arXiv preprint arXiv:2511.13026 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T17:22:35.417608Z"},"links":{"cited_paper":"/paper/2511.13026","citing_paper":"/paper/2608.04759"},"observation_digest":"sha256:81c98eb5170039f6d081dbc6629ed3782123eb7b57abd197131e4ba8869ef3b2","observation_id":"adea3195-b96a-4fb5-8423-b426ce956209","resolution":{"observed_at":"2026-08-06T17:22:35.417608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.04759","last_updated":"2026-08-05T12:26:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:11:45.835140Z","submitted_at":"2026-08-05T12:26:23Z","title":"Trace, Verify, and Correct: A Training-Free Framework for Spatial Reasoning in Multimodal LLMs"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":35,"verified_exact":1,"verified_fuzzy":19},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2608.04759."}