{"as_of":"2026-08-11T08:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e3f72937dec9fde6deb3b5938d74f0c4347a687a9eba59b63e0f36dcec5fa9cf","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:12:42.179988Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01827/citation-record","integrity":"/paper/2608.01827/integrity","json":"/paper/2608.01827/citation-record.json","paper":"/paper/2608.01827"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-04T20:12:41.962725Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:41.962725Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:a664a1bcbeaa0b55f75bb52745f3241482efe3848c42b494a5d867625adeb6a4","observation_id":"4d9423d4-4788-4748-bcd7-7a10b8702e81","resolution":{"observed_at":"2026-08-04T20:12:41.962725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:41.979882Z","title":"Zheng Chu, Xiao Wang, Jack Hong, Huiming Fan, Yuqi Huang, Yue Yang, Guohai Xu, Chenxiao Zhao, Cheng Xiang, Shengchao Hu, Dongdong Kuang, Ming Liu, Bing Qin, and Xing Yu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:41.979882Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:39dcfe80114f38df640e605b3243f9c890f10b63da560ecdab5186bda80b3c4d","observation_id":"e050e9b1-1088-4e5b-83d6-b833a455c029","resolution":{"observed_at":"2026-08-04T20:12:41.979882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:41.984234Z","title":"Gheorghe Comanici, Eric Bieber, Mike Schaekermann, Ice Pasupat, Noveen Sachdeva, Inderjit Dhillon, Marcel Blistein, Ori Ram, Dan Zhang, Evan Rosen, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:41.984234Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:85f7f3ab2683f67a892c8f289d934c21330450be680472519593c4967ad0586e","observation_id":"e5611415-cf2c-42f0-9d0d-4efdcea32deb","resolution":{"observed_at":"2026-08-04T20:12:41.984234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.31504","last_updated":"2026-06-30T11:22:24Z","snapshot_observed_at":"2026-08-08T20:17:46.874902Z","submitted_at":"2026-06-30T11:22:24Z","title":"SimpleSearch-VL: A Simple Recipe for Multimodal Agentic Deep Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.31504","snapshot_observed_at":"2026-08-04T20:12:41.988764Z","title":"Yifan Du, Zikang Liu, Jinbiao Peng, Jie Wu, Junyi Li, Jinyang Li, Wayne Xin Zhao, and Ji-Rong Wen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:41.988764Z"},"links":{"cited_paper":"/paper/2606.31504","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:61af0236a4e5a12ba08ae081a2ef0975e9bb880ba1e654a3f1d53db45742a0f0","observation_id":"404f64ff-41f8-4f5a-9261-8719fb7b2936","resolution":{"observed_at":"2026-08-04T20:12:41.988764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12890","last_updated":"2026-04-25T02:32:57Z","snapshot_observed_at":"2026-07-06T23:01:00.830207Z","submitted_at":"2026-04-14T15:40:28Z","title":"Towards Long-horizon Agentic Multimodal Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.12890","snapshot_observed_at":"2026-08-04T20:12:41.996482Z","title":"Mingyang Fu, Yuyang Peng, Dongping Chen, Zetong Zhou, Benlin Liu, Yao Wan, Zhou Zhao, Philip S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:41.996482Z"},"links":{"cited_paper":"/paper/2604.12890","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:156cdca075dff87fb9806123aa236d2d67160b73f2a80ecb06bbae656fc3bc14","observation_id":"5d3d2c9c-c33d-4993-a093-7327a153f263","resolution":{"observed_at":"2026-08-04T20:12:41.996482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05748","last_updated":"2025-09-01T03:21:53Z","snapshot_observed_at":"2026-08-03T10:59:41.466285Z","submitted_at":"2025-08-07T18:03:50Z","title":"WebWatcher: Breaking New Frontier of Vision-Language Deep Research Agent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.05748","snapshot_observed_at":"2026-08-04T20:12:42.009030Z","title":"10 Preprint Daya Guo, Dejian Yang, Haowei Zhang, Junxiao Song, Ruoyu Zhang, Runxin Xu, Qihao Zhu, Shirong Ma, Peiyi Wang, Xiao Bi, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.009030Z"},"links":{"cited_paper":"/paper/2508.05748","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:4aba637712f88f2da34fb6a876c54b059c500fef1cc001a3e9dbfe582d6b83fe","observation_id":"2d81ff00-6fa5-4cca-96d8-eb93c7f3c713","resolution":{"observed_at":"2026-08-04T20:12:42.009030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.05271","last_updated":"2026-03-11T08:46:41Z","snapshot_observed_at":"2026-07-06T22:35:13.699594Z","submitted_at":"2025-11-07T14:31:20Z","title":"DeepEyesV2: Toward Agentic Multimodal Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.05271","snapshot_observed_at":"2026-08-04T20:12:42.013532Z","title":"Bohan Hou, Jiuning Gu, Jiayan Guo, Ronghao Dang, Sicong Leng, Xin Li, Xuemeng Song, and Jianfei Yang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.013532Z"},"links":{"cited_paper":"/paper/2511.05271","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:26af20cf4a8d0d6d529f25272f5fddda4bf34ac2c1057f3e53fb6e5b03a61263","observation_id":"892b84f0-d8ab-4bc6-98c6-616c36a5c3f2","resolution":{"observed_at":"2026-08-04T20:12:42.013532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.018412Z","title":"Aaron Hurst, Adam Lerer, Adam P Goucher, Adam Perelman, Aditya Ramesh, Aidan Clark, AJ Os- trow, Akila Welihinda, Alan Hayes, Alec Radford, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.018412Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:bfff9c8273ff4eb5599a738397105d9b1ff00134b9f148a97ac235cdd067f446","observation_id":"bb88e0b0-1e4e-44b2-98c6-c2d4f191009a","resolution":{"observed_at":"2026-08-04T20:12:42.018412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-04T20:12:42.024196Z","title":"Search-r1: Training llms to reason and leverage search engines with reinforcement learning.arXiv preprint arXiv:2503.09516,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.024196Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:f72c30c72515268a3163afb8326272bbb32b165e8f6bc507740e846ad1188077","observation_id":"9d769d97-c830-4c32-9063-622e16ff2eb6","resolution":{"observed_at":"2026-08-04T20:12:42.024196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.029575Z","title":"Dense passage retrieval for open-domain question answering","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.029575Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:a46c12ee9f7fab421bd84d729c52dc96aa12e8b7042022ecb64101dce4aea49f","observation_id":"88633362-19b6-4208-a7c2-7f1537111056","resolution":{"observed_at":"2026-08-04T20:12:42.029575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-04T20:12:42.042253Z","title":"Llava-onevision: Easy visual task transfer.arXiv preprint arXiv:2408.03326,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.042253Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:b38aefd2baac4c42c50e7aba81e8a2d69f1770fd092a17a6677857d364fcd287","observation_id":"feac6c70-0f00-45e4-b784-912a931ab08c","resolution":{"observed_at":"2026-08-04T20:12:42.042253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14029","last_updated":"2026-07-29T13:04:29Z","snapshot_observed_at":"2026-08-02T16:18:18.484070Z","submitted_at":"2026-04-15T16:09:37Z","title":"POINTS-Seeker: An Open Recipe for Multimodal Search Agents with Visual Memory Management","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.14029","snapshot_observed_at":"2026-08-04T20:12:42.052599Z","title":"11 Preprint Kartik Narayan, Yang Xu, Tian Cao, Kavya Nerella, Vishal M Patel, Navid Shiee, Peter Grasch, Chao Jia, Yinfei Yang, and Zhe Gan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.052599Z"},"links":{"cited_paper":"/paper/2604.14029","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:a36fe7917729e14e91f972080f7a02cf387d2866946b1f86b0dd5b44cad431dc","observation_id":"217f99a1-192d-44ee-8159-68ca65c503c5","resolution":{"observed_at":"2026-08-04T20:12:42.052599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-04T20:12:42.060852Z","title":"Deepseekmath: Pushing the limits of mathemati- cal reasoning in open language models.arXiv preprint arXiv:2402.03300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.060852Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:7183336ca1b0d5fab6adf90cfef40674a625244ffd7e8fc1be711fd43fa24258","observation_id":"78506f83-5591-4135-b590-5f2c44410972","resolution":{"observed_at":"2026-08-04T20:12:42.060852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15966","last_updated":"2025-10-24T09:35:22Z","snapshot_observed_at":"2026-07-06T21:28:06.120576Z","submitted_at":"2025-05-21T19:35:08Z","title":"Pixel Reasoner: Incentivizing Pixel-Space Reasoning with Curiosity-Driven Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15966","snapshot_observed_at":"2026-08-04T20:12:42.068290Z","title":"Pixel reasoner: In- centivizing pixel-space reasoning with curiosity-driven reinforcement learning.arXiv preprint arXiv:2505.15966, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.068290Z"},"links":{"cited_paper":"/paper/2505.15966","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:3e099d68fa9b889cf2735d58d8bc6d792ba40b0cdb42e4ba31f697dc87ee0720","observation_id":"c6f67419-a36b-467b-932f-d306dfc57dd5","resolution":{"observed_at":"2026-08-04T20:12:42.068290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.076462Z","title":"Tongyi DeepResearch Team, Baixuan Li, Bo Zhang, Dingchu Zhang, Fei Huang, Guangyu Li, Guoxin Chen, Huifeng Yin, Jialong Wu, Jingren Zhou, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.076462Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:9bb260877c366711abd1f091a6921293004859c1ad9d21efe6f09baf8849eab8","observation_id":"60386b90-9290-4f6e-8d2c-e07f6bae7f20","resolution":{"observed_at":"2026-08-04T20:12:42.076462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-04T20:12:42.082147Z","title":"Jialong Wu, Baixuan Li, Runnan Fang, Wenbiao Yin, Liwen Zhang, Zhenglin Wang, Zhengwei Tao, Ding-Chu Zhang, Zekun Xi, Robert Tang, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.082147Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:78c8bbd3ec033be65cf7ec6b174fb780b8a7c3b50c115a3ac79d4855ce5df69c","observation_id":"26b77e54-b248-46cf-9d65-ccf3a1e0ae6b","resolution":{"observed_at":"2026-08-04T20:12:42.082147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20670","last_updated":"2025-06-25T17:59:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-25T17:59:42Z","title":"MMSearch-R1: Incentivizing LMMs to Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20670","snapshot_observed_at":"2026-08-04T20:12:42.088950Z","title":"Huanjin Yao, Qixiang Yin, Min Yang, Ziwang Zhao, Yibo Wang, Haotian Luo, Jingyi Zhang, and Jiaxing Huang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.088950Z"},"links":{"cited_paper":"/paper/2506.20670","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:b54b73b2d0b13bb13d362f3e04ffa2125fc3398466b0e2609b038a7b78c1ac17","observation_id":"496c2b04-519a-410b-9bee-1d53c9b93c69","resolution":{"observed_at":"2026-08-04T20:12:42.088950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.095785Z","title":"Shunyu Yao, Jeffrey Zhao, Dian Yu, Nan Du, Izhak Shafran, Karthik Narasimhan, and Yuan Cao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.095785Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:4fe0046d984da2e565a2f02145d81fac37ce79db1528215e480d055687286dab","observation_id":"fa6b4dde-14c5-4823-a456-ff72a02ffb29","resolution":{"observed_at":"2026-08-04T20:12:42.095785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02259","last_updated":"2026-07-29T12:55:39Z","snapshot_observed_at":"2026-08-06T20:31:23.587108Z","submitted_at":"2025-07-03T03:11:50Z","title":"MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02259","snapshot_observed_at":"2026-08-04T20:12:42.111366Z","title":"Memagent: Reshaping long-context llm with multi-conv rl-based memory agent.arXiv preprint arXiv:2507.02259,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.111366Z"},"links":{"cited_paper":"/paper/2507.02259","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:0233102b5a4f44cbdfb5feb3b4a7f4dd2c3fd08c8d14952032a9847295774c64","observation_id":"b97f5b84-3a10-4487-8d11-1ccfe8c83459","resolution":{"observed_at":"2026-08-04T20:12:42.111366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10594","last_updated":"2025-03-02T01:19:51Z","snapshot_observed_at":"2026-08-10T05:52:50.722724Z","submitted_at":"2024-10-14T15:04:18Z","title":"VisRAG: Vision-based Retrieval-augmented Generation on Multi-modality Documents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10594","snapshot_observed_at":"2026-08-04T20:12:42.116439Z","title":"Visrag: Vision-based retrieval-augmented generation on multi- modality documents.arXiv preprint arXiv:2410.10594,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.116439Z"},"links":{"cited_paper":"/paper/2410.10594","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:6c35ceb644647679d77fd08231c67826ccf696102fc377252571c9975df58487","observation_id":"953d8c11-78f8-452f-a89b-5affbb36be52","resolution":{"observed_at":"2026-08-04T20:12:42.116439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.125011Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.125011Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:70397e1b8b2bb83b9d4fff79879b280039f2288fbc603c5dfe236646e6eb2472","observation_id":"a559008a-7990-43ca-9ece-188a1c14b0eb","resolution":{"observed_at":"2026-08-04T20:12:42.125011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14362","last_updated":"2026-03-01T04:59:56Z","snapshot_observed_at":"2026-08-02T12:23:34.946873Z","submitted_at":"2025-05-20T13:48:11Z","title":"DeepEyes: Incentivizing \"Thinking with Images\" via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14362","snapshot_observed_at":"2026-08-04T20:12:42.129749Z","title":"thinking with images","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.129749Z"},"links":{"cited_paper":"/paper/2505.14362","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:3f0004406dd71ab8d06ad79d9835eda168775d7d523b7684b542401660db68b3","observation_id":"b1f9324f-97e0-4bb1-bd87-a96daf0d96a2","resolution":{"observed_at":"2026-08-04T20:12:42.129749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-10T18:37:57.419939Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-04T20:12:42.138153Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models.arXiv preprint arXiv:2504.10479,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.138153Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:1b7abfab29f00869fe1d65e5256f4f4343bc7d6b8b591e542628379eb50af586","observation_id":"0a86ef83-6427-40a2-ab72-ed33acf8bd9a","resolution":{"observed_at":"2026-08-04T20:12:42.138153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.144421Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.144421Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:fedf8a8baaac03a6cfc2967e1e8328910480d009df713ddbb4b47b0952f5e240","observation_id":"0f5b9001-aa67-4fb9-94f1-0b23653c353c","resolution":{"observed_at":"2026-08-04T20:12:42.144421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.150086Z","title":"In parallel, the available operations have expanded from fixed crops to code-synthesized image trans- formations (Zhao et al., 2025; Zhang et al., 2025a)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.150086Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:ce399c3e105e9bdd033259033bbf018949ea698264f396ba725f66652a39a7e1","observation_id":"e83234b5-0a63-4d5d-bdcb-f107f9dc3af2","resolution":{"observed_at":"2026-08-04T20:12:42.150086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.155917Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.155917Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:190a62d83b3fccfef283b7f02517e5cac7ff1699d75fad98e355f0b438aab747","observation_id":"44ec025f-dec5-470e-8227-262cfedc490b","resolution":{"observed_at":"2026-08-04T20:12:42.155917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.161611Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.161611Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:b67fe13c9f3f5d2aa7ccda1d1af40f0694c5661b6fa4c9f88827263554f0d35f","observation_id":"62850fa8-88c1-44b1-8bb6-2b94b4176514","resolution":{"observed_at":"2026-08-04T20:12:42.161611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.166791Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.166791Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:e6823313096e3f2dce41f3d63ccda0b8133e883fb293ee5dcbe01322768764d6","observation_id":"be2a69e2-1ee4-4758-81d8-900bf5393443","resolution":{"observed_at":"2026-08-04T20:12:42.166791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.174223Z","title":"This improves the placement of input-side visual grounding, but the image still substitutes for a node in a reasoning chain that was constructed in text","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.174223Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:d24a1a39a964bcae9f4b95213f33b5f829adfd98f2f8550478b3124aa8d576cf","observation_id":"f4ef8492-b1b0-4011-83e5-8241e1e754bd","resolution":{"observed_at":"2026-08-04T20:12:42.174223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.179988Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.179988Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:61a0c78fd283613731ff1b2d9663291722f42aab0ebdd5db6279b3a04ffc149b","observation_id":"928e62f2-d364-4e78-807d-505078971c75","resolution":{"observed_at":"2026-08-04T20:12:42.179988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07969","last_updated":"2025-09-09T17:54:21Z","snapshot_observed_at":"2026-07-30T05:21:39.737665Z","submitted_at":"2025-09-09T17:54:21Z","title":"Mini-o3: Scaling Up Reasoning Patterns and Interaction Turns for Visual Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.07969","snapshot_observed_at":"2026-08-04T20:12:42.036366Z","title":"Mini-o3: Scaling up reasoning patterns and interaction turns for visual search.arXiv preprint arXiv:2509.07969,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.036366Z"},"links":{"cited_paper":"/paper/2509.07969","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:478bd35afad7308938a379ba8bccce31cecced5a22dfbb2416b789ee3899c587","observation_id":"a80f6a26-000f-463e-8577-c0dcf86fb309","resolution":{"observed_at":"2026-08-04T20:12:42.036366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:41.975027Z","title":"Glyph: Scaling context windows via visual-text compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:41.975027Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:0cd2829e99729fa7c855eb3fed64cb2be6e46c6cba470fea4efc8e7a390e8495","observation_id":"062a7e2f-f049-4c64-a1ea-56af2d26a6a0","resolution":{"observed_at":"2026-08-04T20:12:41.975027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:12:42.105883Z","title":"Agentfold: Long-horizon web agents with proactive context management.arXiv preprint arXiv:2510.24699,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.105883Z"},"links":{"citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:ec454669a1f9f5756e33c52045e31958005508af300776493bc84034df790646","observation_id":"8f8d441d-ba36-4b04-b600-f5ff5f4fd9b4","resolution":{"observed_at":"2026-08-04T20:12:42.105883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02592","last_updated":"2025-07-03T12:59:07Z","snapshot_observed_at":"2026-08-09T01:03:55.193390Z","submitted_at":"2025-07-03T12:59:07Z","title":"WebSailor: Navigating Super-human Reasoning for Web Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02592","snapshot_observed_at":"2026-08-04T20:12:42.046835Z","title":"Websailor: Navigating super-human reasoning for web agent.arXiv preprint arXiv:2507.02592, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.046835Z"},"links":{"cited_paper":"/paper/2507.02592","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:e0fe86c4fff97e13204519382ecd0e92eb48f9bb5756f5d545ea423137652763","observation_id":"2483c9bf-2a8b-4e58-8a2f-887094768af8","resolution":{"observed_at":"2026-08-04T20:12:42.046835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05288","last_updated":"2025-07-01T02:17:31Z","snapshot_observed_at":"2026-08-10T13:24:26.889977Z","submitted_at":"2025-04-07T17:39:31Z","title":"Seeking and Updating with Live Visual Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05288","snapshot_observed_at":"2026-08-04T20:12:42.003038Z","title":"Xinyu Geng, Peng Xia, Zhen Zhang, Xinyu Wang, Qiuchen Wang, Ruixue Ding, Chenxi Wang, Jialong Wu, Yida Zhao, Kuan Li, Yong Jiang, Pengjun Xie, Fei Huang, and Jingren Zhou","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:42.003038Z"},"links":{"cited_paper":"/paper/2504.05288","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:0345df605dc1d5fdfe057055c4f5ff303f2ac1ca2d06f37d095435cdee6a4506","observation_id":"253414bc-4f8e-4eae-9edf-9ee0c0376758","resolution":{"observed_at":"2026-08-04T20:12:42.003038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05185","last_updated":"2026-05-06T17:50:38Z","snapshot_observed_at":"2026-08-02T12:07:09.741466Z","submitted_at":"2026-05-06T17:50:38Z","title":"OpenSearch-VL: An Open Recipe for Frontier Multimodal Search Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.05185","snapshot_observed_at":"2026-08-04T20:12:41.969149Z","title":"Wenhu Chen, Hexiang Hu, Xi Chen, Pat Verga, and William W Cohen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-04T20:12:41.969149Z"},"links":{"cited_paper":"/paper/2605.05185","citing_paper":"/paper/2608.01827"},"observation_digest":"sha256:eb3671840cd4e06f0992e9405019aae3015b1d6f842d80b48b5376ad07310b48","observation_id":"056490da-a8f0-40c0-8548-b938139922aa","resolution":{"observed_at":"2026-08-04T20:12:41.969149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01827","last_updated":"2026-08-03T07:36:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T01:05:04.453435Z","submitted_at":"2026-08-03T07:36:48Z","title":"DeepVoyager-VL: Incentivizing Vision-in-the-Loop Search for Long-Horizon Multimodal Agents"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2608.01827."}