{"as_of":"2026-08-07T07:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:141cdea3f71a835cc00c8b67d65458d1bf0469ad1ed17290f96385daa91c8494","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:01:26.657907Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.11436/citation-record","integrity":"/paper/2607.11436/integrity","json":"/paper/2607.11436/citation-record.json","paper":"/paper/2607.11436"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:17.712350Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:17.712350Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:ac31f6b5a9c346ce5a1d28948c0b9923815654a8f76c4a44fdb3c4bd5eddf54f","observation_id":"18820816-da6b-4d3f-b4ea-1fe0f1ee6ae2","resolution":{"observed_at":"2026-08-02T07:01:17.712350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:17.881911Z","title":"Findings of the Association for Computational Linguistics: ACL 2025 , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:17.881911Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:2f1f9ba4c7afa30229edc400e2b05abf01b9b55afbed7f287171aedd74a190db","observation_id":"3cb49fb2-542b-4e76-9cf2-deda11c4018a","resolution":{"observed_at":"2026-08-02T07:01:17.881911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:18.028304Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:18.028304Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:836e867435a4415cb945732b1a90177c0f00901bf7fe80a204aece853c9aa33a","observation_id":"75018ad0-73b3-4d13-9040-c118bbca43cf","resolution":{"observed_at":"2026-08-02T07:01:18.028304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:18.206026Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:18.206026Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:4ac1f5a4f9cbd523557b5442abe8a95b48a363fdd7aeab142e1b7eb25b325629","observation_id":"b0384878-0299-42fa-a1cd-fc61e8e1ea86","resolution":{"observed_at":"2026-08-02T07:01:18.206026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18930","last_updated":"2025-04-01T18:36:08Z","snapshot_observed_at":"2026-08-06T19:08:14.800394Z","submitted_at":"2024-04-29T17:59:41Z","title":"Hallucination of Multimodal Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18930","snapshot_observed_at":"2026-08-02T07:01:18.306364Z","title":"arXiv preprint arXiv:2404.18930 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:18.306364Z"},"links":{"cited_paper":"/paper/2404.18930","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:48ae26a08725cbc0e0f35e868d2b3742fe9698b393f30049952db2624c895051","observation_id":"ee31ba24-fdcc-42be-8b11-2c031926e596","resolution":{"observed_at":"2026-08-02T07:01:18.306364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-02T07:01:18.380801Z","title":"arXiv preprint arXiv:2402.00253 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:18.380801Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:c0d9693f6e833b0fe28db53e71d2ef86af9330e5c9449c706476409b5d0c517d","observation_id":"3bb2a8a7-73c2-4344-bc2a-0c770d91c69b","resolution":{"observed_at":"2026-08-02T07:01:18.380801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:18.482164Z","title":"Journal of Computing and Information Science in Engineering , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:18.482164Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:320a9a4203e043d0a8358cbac067e7bcfa8787b15e9828af45345ab793435d0e","observation_id":"a048f8ca-9a5b-4a13-a5bf-fdf3a31c2cdf","resolution":{"observed_at":"2026-08-02T07:01:18.482164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:18.590846Z","title":"arXiv preprint arXiv:2509.11986 , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:18.590846Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:414e07a474114b637f96ac55d8565841fa2fa9c45dfcf2a09adb9b05fd85bc7b","observation_id":"00523a5c-d20a-4388-b407-056dd6039cd6","resolution":{"observed_at":"2026-08-02T07:01:18.590846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:18.761954Z","title":"Findings of the association for computational linguistics: emnlp 2024 , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:18.761954Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:20b407864de19902fdf2f29ce2e19aa28d6c07ff84e5d5cbf8192c398b9106d5","observation_id":"711256ba-3453-4f51-a596-3436f8131877","resolution":{"observed_at":"2026-08-02T07:01:18.761954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:18.916109Z","title":"Annual review of vision science , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:18.916109Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:c4aed3339474837545a48ef35eec18e899f6cba9c7a0acabbe5346551695694f","observation_id":"52da9965-9da2-471c-809d-96c66775bfe4","resolution":{"observed_at":"2026-08-02T07:01:18.916109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:19.059168Z","title":"Computational brain & behavior , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:19.059168Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:d6d09519b9f6828fcd7ffa58775ddce7b8a3424d04b6ca769c150ab9a3c23c4a","observation_id":"8f739e36-e7a2-4a25-a1d8-2f6aa829f916","resolution":{"observed_at":"2026-08-02T07:01:19.059168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:19.174108Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:19.174108Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:6954f3a2e402377ed23f7f614239d944bcb59e6e6c6c48823c2d539b87074dd5","observation_id":"a0ebf52e-ba26-4ba7-aa87-42e3fe3dd3b1","resolution":{"observed_at":"2026-08-02T07:01:19.174108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02189","last_updated":"2025-04-06T03:12:51Z","snapshot_observed_at":"2026-07-06T20:16:27.318761Z","submitted_at":"2025-01-04T04:59:33Z","title":"A Survey of State of the Art Large Vision Language Models: Alignment, Benchmark, Evaluations and Challenges","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02189","snapshot_observed_at":"2026-08-02T07:01:19.266720Z","title":"arXiv preprint arXiv:2501.02189 , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:19.266720Z"},"links":{"cited_paper":"/paper/2501.02189","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:ba1720572dbac01d170add94e504186c8390073f07f7959b3c5dd938797aef22","observation_id":"4c2502a7-557d-498a-a7dd-626d1a5ae361","resolution":{"observed_at":"2026-08-02T07:01:19.266720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:19.454822Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:19.454822Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:61473472a5f43982be00cd5197aee0bfa777559cc4345b332f69185ba2abfdba","observation_id":"cc5d28b4-11d1-4920-88c3-fa0d388f89ba","resolution":{"observed_at":"2026-08-02T07:01:19.454822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:19.567068Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:19.567068Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:fca4b068d8085ddaffe6d1fb6c095ba2321381184959e76e3efe43952bf801fe","observation_id":"3489c7ed-733b-4481-846e-07cf4bb625f0","resolution":{"observed_at":"2026-08-02T07:01:19.567068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.06521","last_updated":"2026-07-07T15:04:59Z","snapshot_observed_at":"2026-08-06T08:25:18.657667Z","submitted_at":"2026-01-10T10:42:44Z","title":"BabyVision: Visual Reasoning Beyond Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.06521","snapshot_observed_at":"2026-08-02T07:01:19.711542Z","title":"arXiv preprint arXiv:2601.06521 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:19.711542Z"},"links":{"cited_paper":"/paper/2601.06521","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:9492f0ec8627189d42d6f12646d12a6a271f7467d8978a88ca3c47b775237743","observation_id":"17b1b511-f44e-4f07-b535-a58fa7242f42","resolution":{"observed_at":"2026-08-02T07:01:19.711542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:19.861955Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:19.861955Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:ce6ad3178ff243f2fe262cb8b2d3745cf7a9be2327cae1604b6618d3b5283897","observation_id":"6ed312b3-1f1d-47fc-8c97-2477383a26c1","resolution":{"observed_at":"2026-08-02T07:01:19.861955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03321","last_updated":"2025-03-05T09:55:07Z","snapshot_observed_at":"2026-07-06T20:47:04.984599Z","submitted_at":"2025-03-05T09:55:07Z","title":"See What You Are Told: Visual Attention Sink in Large Multimodal Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.03321","snapshot_observed_at":"2026-08-02T07:01:19.935203Z","title":"arXiv preprint arXiv:2503.03321 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:19.935203Z"},"links":{"cited_paper":"/paper/2503.03321","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:5e969c6a6a831e4c9b45e1215b908a75f071ace4736db313ecbb1d0abac7fb3e","observation_id":"e2cba484-7271-45db-ada6-1c7465442908","resolution":{"observed_at":"2026-08-02T07:01:19.935203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:20.141445Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:20.141445Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:0f9b7bd4aaca336cbcbd88e59a1f36b7d8ee91b04bdde843c54fffeae739fa0f","observation_id":"3af679f3-0505-41e0-94d6-344b87a21ad0","resolution":{"observed_at":"2026-08-02T07:01:20.141445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:20.288676Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:20.288676Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:eb9a46a241f4f81d9247888cb2adf875177ee37e99ef73e66c4f9f21fcca7080","observation_id":"08a8f1e9-6336-4d9d-a1d6-aec2007f5ed7","resolution":{"observed_at":"2026-08-02T07:01:20.288676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:20.421690Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:20.421690Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:ae213194316e4ac27f6eda457663a8297e45eb7c0049cdc6185c283bf323bb77","observation_id":"7868280d-1dc3-4f10-953b-58bb31fd1d79","resolution":{"observed_at":"2026-08-02T07:01:20.421690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-02T07:01:20.606415Z","title":"arXiv preprint arXiv:2203.11171 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:20.606415Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:c9b8630e268ea0cbfb5548a68f0623bb1dd1fcdb55f3d677bb4709a14d4d7fbd","observation_id":"6d31f395-54bf-41d9-af9e-6fa273e5504e","resolution":{"observed_at":"2026-08-02T07:01:20.606415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:20.723446Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:20.723446Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:2f43049daf486dc3bdb2d9a000a9846d39491b884632a3e6f7f418d67f367f5e","observation_id":"96634147-0834-4780-a002-ed7239ab4762","resolution":{"observed_at":"2026-08-02T07:01:20.723446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:20.918346Z","title":"Proceedings of the Asian Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:20.918346Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:bcaf15edd7358ddfea9d77288f4d09a91bf9812022a4a8b8705a6b236f4f37a1","observation_id":"235fc2af-7cf3-4817-9b70-0c5e114b5c68","resolution":{"observed_at":"2026-08-02T07:01:20.918346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:20.992943Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:20.992943Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:0549b22271bc8b5a2c2737b5df7e953e21072a785d0b223f4651901872f9b350","observation_id":"d79b5ee4-9bf7-4d35-8f29-2ae54b3d2f91","resolution":{"observed_at":"2026-08-02T07:01:20.992943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:21.053781Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:21.053781Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:dd946d18fa3bc9461c9f0609590f8a48637a3bf365d034a82ef2ea0fda17e4bd","observation_id":"55a9c57b-1de2-49ff-99dd-3f631994174a","resolution":{"observed_at":"2026-08-02T07:01:21.053781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:21.244740Z","title":"Findings of the association for computational linguistics: ACL 2022 , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:21.244740Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:9504cb6b83d7e28063fe143a7cb98121734ed7359dbe31770346e82e5a539af8","observation_id":"2f19d960-38ec-4a0a-8b43-c862fc580819","resolution":{"observed_at":"2026-08-02T07:01:21.244740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:21.440848Z","title":"Proceedings of the IEEE/CVF winter conference on applications of computer vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:21.440848Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:744e6905c701623aa149fa41655637f08e87ebb22f61893203aff10c1f9817f8","observation_id":"14faa0e9-1e2b-4cc9-9cdd-12b8b640f5ce","resolution":{"observed_at":"2026-08-02T07:01:21.440848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:21.594540Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:21.594540Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:f36a3ec4868755e28a530544d6781dfd227f4c77e50f39d7f3721a4eb4692888","observation_id":"7b952e44-c6c1-49cc-a99a-d18ea8e6a823","resolution":{"observed_at":"2026-08-02T07:01:21.594540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-02T07:01:21.740483Z","title":"5: Advancing open-source multimodal models in versatility, reasoning, and efficiency , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:21.740483Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:cfde7d8024d85c871e93dd0c38e7da144600e1c25a10278581f63a1db70cbb74","observation_id":"88038c5f-4b77-41e8-8ecb-b18ea0bebfeb","resolution":{"observed_at":"2026-08-02T07:01:21.740483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:21.913384Z","title":"IEEE transactions on pattern analysis and machine intelligence , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:21.913384Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:30c6af78a7b80cebbce687df4a5df6264db79690b353c4792c89618a69d71a9b","observation_id":"a756fc9d-07bd-4fd6-b5c1-3dc441846760","resolution":{"observed_at":"2026-08-02T07:01:21.913384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:22.044734Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2025 , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:22.044734Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:e22faf0eae6c63e84ee4f68c7d39806d42d3d2e5b27b0dd5f6ab838ba36671d6","observation_id":"543396c8-3232-4f2a-bfb4-be152cd067a3","resolution":{"observed_at":"2026-08-02T07:01:22.044734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-02T07:01:22.238482Z","title":"arXiv preprint arXiv:2511.21631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:22.238482Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:6d4defd4b70a2f263c373d69aa4cc1b95e7eb8bee8465fa277ac93e0960942bd","observation_id":"c5f93339-5019-442d-8b91-c49c9c7c6881","resolution":{"observed_at":"2026-08-02T07:01:22.238482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:22.371601Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:22.371601Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:3845aa161537804e695f751108e1af2f58a4da15c66ee48aeda8bfb5a68803c1","observation_id":"65677d72-04ef-4bb8-b60d-7d670ba5304c","resolution":{"observed_at":"2026-08-02T07:01:22.371601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.05547","last_updated":"2026-04-17T05:02:11Z","snapshot_observed_at":"2026-07-06T22:41:15.345760Z","submitted_at":"2026-01-09T05:58:22Z","title":"VIB-Probe: Detecting and Mitigating Hallucinations in Vision-Language Models via Variational Information Bottleneck","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.05547","snapshot_observed_at":"2026-08-02T07:01:22.511512Z","title":"arXiv preprint arXiv:2601.05547 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:22.511512Z"},"links":{"cited_paper":"/paper/2601.05547","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:047c84993fa9b057737000fc95479f72fb2426ef91e513346e8559e263c052da","observation_id":"fb798401-0956-4a8d-9454-7e882bbc6778","resolution":{"observed_at":"2026-08-02T07:01:22.511512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:22.639679Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:22.639679Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:277b24a82e66eb77962be28ff9e90169cb3c851f48973e7e7675302037d3df3a","observation_id":"a91241de-baae-4cf5-a36f-432cfe4672bb","resolution":{"observed_at":"2026-08-02T07:01:22.639679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18359","last_updated":"2026-05-26T13:49:58Z","snapshot_observed_at":"2026-08-02T17:52:26.858372Z","submitted_at":"2026-05-18T13:12:50Z","title":"RAVE: Re-Allocating Visual Attention in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18359","snapshot_observed_at":"2026-08-02T07:01:22.764741Z","title":"arXiv preprint arXiv:2605.18359 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:22.764741Z"},"links":{"cited_paper":"/paper/2605.18359","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:e7724e797f68804411fd5bee191517a4c723691a46c890f8bc85befb98c123da","observation_id":"70e3971b-00bf-40c6-841e-ce3235821abd","resolution":{"observed_at":"2026-08-02T07:01:22.764741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:22.884745Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:22.884745Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:2e43d6b8a88f1ad78f96e03184f033752beb12586da658e0a06e52f70e653e10","observation_id":"83232645-7d0f-490c-9906-094bb1d7462e","resolution":{"observed_at":"2026-08-02T07:01:22.884745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:22.963914Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:22.963914Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:cf0a56d88686b2b4c464873490558f104f667ee27a31c8e5ecd2a7e0c5e18ab0","observation_id":"89c46f8c-8e83-403b-953e-73e3827f6af2","resolution":{"observed_at":"2026-08-02T07:01:22.963914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:23.093477Z","title":"International Journal on Digital Libraries , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:23.093477Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:e3f7243a13c6cc632f2523e1c8c2e867d5a4c0da8817cef0976f05ece0ce22be","observation_id":"cfdfe24b-41f6-4f4b-8c80-90e6e34339d6","resolution":{"observed_at":"2026-08-02T07:01:23.093477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:23.186203Z","title":"Language Resources and Evaluation , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:23.186203Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:16f5ff403e958315eef8a7bc30b486cb9d7a7e1ae60ba841dd3e0ed511300aaf","observation_id":"1d073004-f92d-4e85-956b-f2b7f3d25701","resolution":{"observed_at":"2026-08-02T07:01:23.186203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:23.324564Z","title":"Proceedings of the 33rd ACM International Conference on Multimedia , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:23.324564Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:3d80ddc3802f49702b344ae4b5f18114f51a378247791ed93ad94dc03eaf7853","observation_id":"05c74016-f35b-4415-9cfb-b000bcc82c58","resolution":{"observed_at":"2026-08-02T07:01:23.324564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:23.470025Z","title":"International journal of computer vision , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:23.470025Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:5702a706e91033b880bf7041c6bb429578bd5e1835cd4c71e72d4cce9b5faa38","observation_id":"85f5c9ff-abe9-4b1a-bf48-6f73970d7fbe","resolution":{"observed_at":"2026-08-02T07:01:23.470025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:23.631715Z","title":"Proceedings of the IEEE international conference on computer vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:23.631715Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:bac3b6a44608f40712f3ed4730d76f89370dcf4702caf34f44ad4ac64e16c3db","observation_id":"81115557-5b94-4e98-9d3b-78e6cd3a7b98","resolution":{"observed_at":"2026-08-02T07:01:23.631715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-02T07:01:23.812115Z","title":"5-coder technical report , author=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:23.812115Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:8749957a8c5437c3bf3bae31a8dd61f85a7b58c9b7d82293f810aaf103e08e46","observation_id":"287e7f1b-a0b2-4073-8730-cd5e10df6d2b","resolution":{"observed_at":"2026-08-02T07:01:23.812115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:24.009368Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:24.009368Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:f338646a2f77d1272020d07367a974ce55ff246cbd87dc0d0d8b58d7fe977fb1","observation_id":"b72523ee-9408-4366-a7fd-9063d719a67d","resolution":{"observed_at":"2026-08-02T07:01:24.009368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:24.088595Z","title":"The Fourteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:24.088595Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:02a9a7a264c283e00c64f1ac3d23405098ca1ba6bffda4a1764816988fa14cb0","observation_id":"ab126f39-1b18-4c4b-bcc9-7801b446d5bb","resolution":{"observed_at":"2026-08-02T07:01:24.088595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:24.171497Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:24.171497Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:6a6f6c19d39c4d0a14866e1337c193d0e533ed49b2ccd77a28ce610de103875f","observation_id":"1c15cad3-4255-44c1-a2a5-1c3aeafd456b","resolution":{"observed_at":"2026-08-02T07:01:24.171497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:24.274753Z","title":"Proceedings of the ACM on Web Conference 2025 , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:24.274753Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:4e421f1d9cf15240245631c826ebed925486497c5bc708dd66b72af967377b6d","observation_id":"6798896d-c3c2-49f4-bb70-3c4a8c876d1d","resolution":{"observed_at":"2026-08-02T07:01:24.274753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:24.444870Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:24.444870Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:ae20aecd95edb97c7f386908cfd499fc5035d0700ab300f1cd73aa42e0943184","observation_id":"9d370c7b-5ae3-4b26-9acb-8711a55fa363","resolution":{"observed_at":"2026-08-02T07:01:24.444870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:24.574749Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:24.574749Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:d5a4bb0ba9f4d56c8a907c4aab0224177a994205baf421e8aaffe68246a7bdeb","observation_id":"a882ac28-ed03-4506-9ee9-ea575fd398ab","resolution":{"observed_at":"2026-08-02T07:01:24.574749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:24.684749Z","title":"arXiv preprint arXiv:2602.04268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:24.684749Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:3588737963f5a9f97cb36ad6afe765c76e008d3aab6362d6852ed0940d044874","observation_id":"c9c86476-b1ce-44c8-a648-d77d5c5cf68e","resolution":{"observed_at":"2026-08-02T07:01:24.684749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:24.924740Z","title":"arXiv preprint arXiv:2506.08391 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:24.924740Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:a28234c5413488d566cfaa5e11948d493b590d3077244cee0786e1299011540a","observation_id":"338edb92-f9c2-4e46-8a9e-eed02bfcc381","resolution":{"observed_at":"2026-08-02T07:01:24.924740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:25.101246Z","title":"arXiv e-prints , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:25.101246Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:a6d045ad0b68e1ad31aef213b2a957e4b3a728f4903bf8f086a08545b9954238","observation_id":"83aeb06b-4c16-4cfd-8e67-af217746a198","resolution":{"observed_at":"2026-08-02T07:01:25.101246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:25.175875Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:25.175875Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:939c6597b124ebaec2a9ad647e714a1f3d19dc569eac6241b3837a0d587c4edd","observation_id":"d62b7489-8223-4022-a6c3-e09e05c6de67","resolution":{"observed_at":"2026-08-02T07:01:25.175875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:25.284591Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:25.284591Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:8e4699d1df6b68ee29bf149bfb7de9650117fd7fe8948ae3db1e0cec6e754440","observation_id":"11b988b4-c6ee-4714-92f1-9db6fa06edc6","resolution":{"observed_at":"2026-08-02T07:01:25.284591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-07-06T19:50:46.576709Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-02T07:01:25.384563Z","title":"arXiv preprint arXiv:2411.09968 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:25.384563Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:ef51ae729a738ff774b6459fabd16699a51d95d6ebc1135d2fb8b84476d32ce9","observation_id":"51b720e1-8e49-4199-8617-94ac48974886","resolution":{"observed_at":"2026-08-02T07:01:25.384563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:25.475521Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:25.475521Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:dc62a62e9d6b16604309cd8da76cddc9e56f14ff2ea8f48d96ea327f33a892f2","observation_id":"50f83bd4-e8de-43f2-8f4e-a916667556d5","resolution":{"observed_at":"2026-08-02T07:01:25.475521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:25.571839Z","title":"arXiv preprint arXiv:2601.09954 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:25.571839Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:040b1ff25bd886e3e6e84428c32bfc5591df5ed393db92dee77c24e322937219","observation_id":"98bf2ee8-2078-4ea0-9065-11736b61fef2","resolution":{"observed_at":"2026-08-02T07:01:25.571839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05668","last_updated":"2026-05-07T04:45:52Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T04:45:52Z","title":"Large Vision-Language Models Get Lost in Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.05668","snapshot_observed_at":"2026-08-02T07:01:25.702271Z","title":"arXiv preprint arXiv:2605.05668 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:25.702271Z"},"links":{"cited_paper":"/paper/2605.05668","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:699739205acd7cc16a7c49871a7305713a4efed9c0d42d0d65a752bf8354e64b","observation_id":"96c465d8-e87e-435d-b505-406ff384edd9","resolution":{"observed_at":"2026-08-02T07:01:25.702271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.07025","last_updated":"2026-06-04T18:10:49Z","snapshot_observed_at":"2026-08-03T05:34:31.195744Z","submitted_at":"2026-02-02T12:20:04Z","title":"The Geometry of Representational Failures in Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.07025","snapshot_observed_at":"2026-08-02T07:01:25.837070Z","title":"arXiv preprint arXiv:2602.07025 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:25.837070Z"},"links":{"cited_paper":"/paper/2602.07025","citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:e994e8450139e5a48546cc6319b36c6417ee21705e06d88cbbeb23767bd92515","observation_id":"aac427c9-ffec-4ee0-ba01-dd4fce326578","resolution":{"observed_at":"2026-08-02T07:01:25.837070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:25.966351Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:25.966351Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:78d30fe2e990fb156c71a6aea27ebb1cceed98548e945f76842fbf9a305708fa","observation_id":"8547c3af-4aa1-44c0-aafe-9bc3195688ee","resolution":{"observed_at":"2026-08-02T07:01:25.966351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:26.074874Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:26.074874Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:7afd10d564d7671352c29cfe75c56b037816d81634891d9bb1bb50ca8e70490c","observation_id":"f3253125-02f7-4318-a63c-f6c0602ef8eb","resolution":{"observed_at":"2026-08-02T07:01:26.074874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:26.183941Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:26.183941Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:28886b006e473e53447905fc563d0fe8c8bf8ba51f1d19f0b72db55996897d32","observation_id":"64877667-dbdc-485b-bd93-33cf502b6723","resolution":{"observed_at":"2026-08-02T07:01:26.183941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:26.263132Z","title":"Winter Conference on Applications of Computer Vision 2026 , year=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:26.263132Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:9a3ac9abcec4627a20a45b97c17744dd34dbe68f65b67d46c706582e7ef5d346","observation_id":"82ebad55-099f-4a96-b9f7-4b102bd12c04","resolution":{"observed_at":"2026-08-02T07:01:26.263132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:26.306369Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:26.306369Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:7dc4a8b4e4e72902d929faf51a15bc8634914e93269064ade5ee77119a420b87","observation_id":"1394a0f9-7164-4d7a-b2b4-66edd77fa2bc","resolution":{"observed_at":"2026-08-02T07:01:26.306369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:26.368804Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:26.368804Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:98831bfcaa537d47da7f5606b0a19aa4638d0781cc1970f715e15d73a76ad762","observation_id":"13c0cb0d-29e3-4e5b-8a90-d0c25ee04eb7","resolution":{"observed_at":"2026-08-02T07:01:26.368804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:26.430000Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:26.430000Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:1fc7ea8735c425f37c0aae99763083cfd24715a29cac72c419fac7bcb3d73d38","observation_id":"246c7a4c-eb76-4659-9a09-e6052ae1e3b0","resolution":{"observed_at":"2026-08-02T07:01:26.430000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:26.481927Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:26.481927Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:1f9047477769767f83fe0ac5ef314243624a5439fd02171143bff06147bb1e7b","observation_id":"13228548-5058-4028-acf5-b5f9fa8bd467","resolution":{"observed_at":"2026-08-02T07:01:26.481927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:26.569799Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:26.569799Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:971057f55fdfc57ec3a279f7803fffc81e428cbd480b3b06b0d0b0865734ad57","observation_id":"29b39640-a177-49ec-964f-cc185f32cc34","resolution":{"observed_at":"2026-08-02T07:01:26.569799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T07:01:26.657907Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-02T07:01:26.657907Z"},"links":{"citing_paper":"/paper/2607.11436"},"observation_digest":"sha256:a15cc68b8a6367fb0edae6564299cff61444f04db83fb1614f4994884f732ff1","observation_id":"edcc7bbb-4426-4d24-a021-d4c0b6fcb0d6","resolution":{"observed_at":"2026-08-02T07:01:26.657907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.11436","last_updated":"2026-07-17T15:34:16Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-02T07:01:12.417571Z","submitted_at":"2026-07-13T11:44:23Z","title":"The Ebb and Flow of Multimodal Focus: Scheduling Visual Relay Windows for Grounded VLM Reasoning"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":71,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 0 inbound Pith citation observations for arXiv:2607.11436."}