{"as_of":"2026-08-07T15:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:412c5c04684e8714616ac398756cc71177984d25459ed8f9b44b073e8b87d191","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T14:08:11.249722Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28225/citation-record","integrity":"/paper/2607.28225/integrity","json":"/paper/2607.28225/citation-record.json","paper":"/paper/2607.28225"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.05452","last_updated":"2025-01-09T18:59:58Z","snapshot_observed_at":"2026-07-06T20:18:53.977126Z","submitted_at":"2025-01-09T18:59:58Z","title":"ReFocus: Visual Editing as a Chain of Thought for Structured Image Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05452","snapshot_observed_at":"2026-07-31T14:08:11.175717Z","title":"Refocus: Visual editing as a chain of thought for structured image understanding.arXiv preprint arXiv:2501.05452,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.175717Z"},"links":{"cited_paper":"/paper/2501.05452","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:05d417cc67ae323aaceb3b5723835091d6c8a98aa74c51d20d7b9485db9246ea","observation_id":"8fa4e668-6590-46fe-9b7c-0c84de0cd499","resolution":{"observed_at":"2026-07-31T14:08:11.175717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01619","last_updated":"2025-03-03T14:54:01Z","snapshot_observed_at":"2026-08-02T16:05:54.843255Z","submitted_at":"2025-03-03T14:54:01Z","title":"Advancing vision-language models in front-end development via data synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01619","snapshot_observed_at":"2026-07-31T14:08:11.179287Z","title":"Advancing vision-language models in front-end development via data synthesis.arXiv preprint arXiv:2503.01619,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.179287Z"},"links":{"cited_paper":"/paper/2503.01619","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:6bd54e9998ee6468d9b91994df8ea0e5c131b095de7be0ae997e955bb5036684","observation_id":"e6efdafa-ddac-4b0e-b7a3-619f8a91e288","resolution":{"observed_at":"2026-07-31T14:08:11.179287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01680","last_updated":"2024-04-19T01:15:16Z","snapshot_observed_at":"2026-08-06T19:10:15.466826Z","submitted_at":"2024-01-21T23:36:14Z","title":"Large Language Model based Multi-Agents: A Survey of Progress and Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01680","snapshot_observed_at":"2026-07-31T14:08:11.182691Z","title":"Large language model based multi-agents: A survey of progress and challenges.arXiv preprint arXiv:2402.01680,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.182691Z"},"links":{"cited_paper":"/paper/2402.01680","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:473ac5b993a22549f1e4b0b16017c5fea4473853879f8f03a4b57f284e35e525","observation_id":"f512032d-254b-47f2-87eb-d19703f09462","resolution":{"observed_at":"2026-07-31T14:08:11.182691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-07-31T14:08:11.189609Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.189609Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:714301b89c5a4573a1501379b0b468b3b02d2cd0deacb5559c1b75d98d2917a5","observation_id":"2056aca3-852b-44cd-bddd-5cdd8dd31922","resolution":{"observed_at":"2026-07-31T14:08:11.189609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-07-31T14:08:11.196715Z","title":"Llava-onevision: Easy visual task transfer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.196715Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:cab565e2f624febae1f52ab6b6901039de1e9da1c3b412cd38f7ba43ad77b641","observation_id":"f45ecf27-0a78-4eae-a085-aaecdbe7b6d1","resolution":{"observed_at":"2026-07-31T14:08:11.196715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19118","last_updated":"2024-10-09T02:41:21Z","snapshot_observed_at":"2026-08-01T16:20:31.337598Z","submitted_at":"2023-05-30T15:25:45Z","title":"Encouraging Divergent Thinking in Large Language Models through Multi-Agent Debate","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19118","snapshot_observed_at":"2026-07-31T14:08:11.200135Z","title":"Encouraging divergent thinking in large language models through multi-agent debate.arXiv preprint arXiv:2305.19118,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.200135Z"},"links":{"cited_paper":"/paper/2305.19118","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:c61dd4a682472a57a2a0b6fb23fd8ed819459e0157e896f839ac631ec313f38e","observation_id":"3e3fe7b7-6513-4933-82f0-3ab256eedac8","resolution":{"observed_at":"2026-07-31T14:08:11.200135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-07-31T14:08:11.203722Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.203722Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:fc752de37782cbb7d90230146d5d3d35b0b2250f760812fd332c0b0f16a01996","observation_id":"b1738387-2a5d-4b56-b4c0-2b4929d143e2","resolution":{"observed_at":"2026-07-31T14:08:11.203722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07924","last_updated":"2024-06-05T13:23:49Z","snapshot_observed_at":"2026-07-06T15:54:28.831510Z","submitted_at":"2023-07-16T02:11:34Z","title":"ChatDev: Communicative Agents for Software Development","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07924","snapshot_observed_at":"2026-07-31T14:08:11.210412Z","title":"Chatdev: Communicative agents for software development.arXiv preprint arXiv:2307.07924,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.210412Z"},"links":{"cited_paper":"/paper/2307.07924","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:6dac48f4fb182c1c9413c549fd2080302bf01f3394381495358b97c88593fefb","observation_id":"b2a609a9-7f5a-4cc5-9de1-c36ffd04a70e","resolution":{"observed_at":"2026-07-31T14:08:11.210412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-31T14:08:11.213839Z","title":"Deepseekmath: Pushing the limits of mathe- matical reasoning in open language models.arXiv preprint arXiv:2402.03300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.213839Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:9ceada0df7007e60fa720eb1ff0f77344288b70aa97eb3aba86875daad07b8ad","observation_id":"df46d5d9-fd55-48cd-a8dd-0fcf0baffebd","resolution":{"observed_at":"2026-07-31T14:08:11.213839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23918","last_updated":"2025-07-03T16:49:39Z","snapshot_observed_at":"2026-07-06T21:49:47.325553Z","submitted_at":"2025-06-30T14:48:35Z","title":"Thinking with Images for Multimodal Reasoning: Foundations, Methods, and Future Frontiers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23918","snapshot_observed_at":"2026-07-31T14:08:11.217082Z","title":"Thinking with images for multimodal reasoning: Foundations, methods, and future frontiers.arXiv preprint arXiv:2506.23918,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.217082Z"},"links":{"cited_paper":"/paper/2506.23918","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:a1837c14b03b9d28a1a4a68a8af1d9e0990a5a216ae0ad51951658c82f2c4fc4","observation_id":"05725049-4968-40be-ba2f-eb42ed40ef94","resolution":{"observed_at":"2026-07-31T14:08:11.217082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01949","last_updated":"2025-07-02T17:57:28Z","snapshot_observed_at":"2026-08-06T20:37:19.866170Z","submitted_at":"2025-07-02T17:57:28Z","title":"Kwai Keye-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01949","snapshot_observed_at":"2026-07-31T14:08:11.220405Z","title":"Kwai keye-vl technical report.arXiv preprint arXiv:2507.01949,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.220405Z"},"links":{"cited_paper":"/paper/2507.01949","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:c52233fe630d76a5564fb5f6878d43acded1a29048b3153139a402aca3d1539a","observation_id":"673afc8b-8945-4379-ab7e-8b4a898275e2","resolution":{"observed_at":"2026-07-31T14:08:11.220405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06322","last_updated":"2025-01-10T19:56:50Z","snapshot_observed_at":"2026-07-30T22:07:13.869232Z","submitted_at":"2025-01-10T19:56:50Z","title":"Multi-Agent Collaboration Mechanisms: A Survey of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06322","snapshot_observed_at":"2026-07-31T14:08:11.224025Z","title":"Multi-agent collaboration mechanisms: A survey of llms.arXiv preprint arXiv:2501.06322,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.224025Z"},"links":{"cited_paper":"/paper/2501.06322","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:51723b0e80b0efe896671d0b57495548a92eeb41a181f49903ed88a1bb444bf9","observation_id":"fb046770-e1ee-4425-9edf-2abf15cb33df","resolution":{"observed_at":"2026-07-31T14:08:11.224025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:08:11.227842Z","title":"From illusion to intention: Visual rationale learning for vision-language reasoning.arXiv preprint arXiv:2511.23031, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.227842Z"},"links":{"citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:36527c06572b1497006cf54061086f6f97c9e8c8d1d4598246b921dbc178efa5","observation_id":"362fce86-b7c8-4b40-9178-c9b669c08e65","resolution":{"observed_at":"2026-07-31T14:08:11.227842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:08:11.230720Z","title":"Divide, conquer and combine: A training-free framework for high- resolution image perception in multimodal large language models","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.230720Z"},"links":{"citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:f100d476d836228beff17a40e753c522ed92e101ae796ebe80b5293c089dac57","observation_id":"c655b6a0-a763-4853-bd6e-c897f7c6fd36","resolution":{"observed_at":"2026-07-31T14:08:11.230720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-07-31T19:03:03.494918Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-07-31T14:08:11.234071Z","title":"Autogen: Enabling next-gen LLM applications via multi-agent conversations.arXiv preprint arXiv:2308.08155,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.234071Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:415afb9b1a49212bf1b7d868bfc41769bd045bdae52a5f9e1c55804e6756eb76","observation_id":"d5b817ab-bd97-4676-bf30-c6b918c577db","resolution":{"observed_at":"2026-07-31T14:08:11.234071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:08:11.237373Z","title":"Visual planning: Let’s think only with images.arXiv preprint arXiv:2505.11409,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.237373Z"},"links":{"citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:8389eca0dd01a6c954eb3433a70c2f563c4865b1e4ed804c5644e95dfd699f1b","observation_id":"9a7208e3-3c70-4675-b4e5-961263fd1b7f","resolution":{"observed_at":"2026-07-31T14:08:11.237373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:08:11.240214Z","title":"Wenxi Yang, Yuzhong Zhao, Fang Wan, and Qixiang Ye","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.240214Z"},"links":{"citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:3a230f16efdfcb8b2c6b6f0fc6cc655160b0fb54be35bd9164f7fc938c921226","observation_id":"4920509b-3647-47ce-afd9-a40d336c0955","resolution":{"observed_at":"2026-07-31T14:08:11.240214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02835","last_updated":"2025-05-09T13:39:58Z","snapshot_observed_at":"2026-08-05T02:34:33.557081Z","submitted_at":"2025-05-05T17:59:50Z","title":"R1-Reward: Training Multimodal Reward Model Through Stable Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02835","snapshot_observed_at":"2026-07-31T14:08:11.243120Z","title":"thinking with images","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.243120Z"},"links":{"cited_paper":"/paper/2505.02835","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:07c2ed80131210d34dda42d9614e153b806f5bd302b153cb1e0e294dc3372da2","observation_id":"59f68406-5f9f-496c-b3a2-8f6e11c5da4b","resolution":{"observed_at":"2026-07-31T14:08:11.243120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:08:11.246530Z","title":"All scores are averaged over the rollouts within the batch","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.246530Z"},"links":{"citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:9863661f05e768a3adfc657f13d3e957d2b35598b6ca5257448f5b09eb7fcc9b","observation_id":"8c2eac63-23ca-4c73-be3a-eb43dd5ff5bf","resolution":{"observed_at":"2026-07-31T14:08:11.246530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:08:11.249722Z","title":"{file_path}","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.249722Z"},"links":{"citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:34155edbfce542aa954b7d36791550a491234ae5002ad547aae8a4c7168c9123","observation_id":"722c9621-d1da-4de2-81d5-71a440f109e2","resolution":{"observed_at":"2026-07-31T14:08:11.249722Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-07-31T14:08:11.206984Z","title":"Mathvista: Evaluating mathe- matical reasoning of foundation models in visual contexts.arXiv preprint arXiv:2310.02255,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.206984Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:f0d8d4ab78b4ad545e6978dd75194eead9a63307043624400f1dbf5ef2440a2d","observation_id":"19f4851a-0d9a-4daa-b587-2a7ef3bac2f6","resolution":{"observed_at":"2026-07-31T14:08:11.206984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-31T14:08:11.164039Z","title":"Qwen3-vl technical report.arXiv preprint arXiv:2511.21631, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.164039Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:4604553169f29f6d236717955a4acc260c165b81423d52436a742f1d60586c43","observation_id":"58b399bf-5783-4577-a337-846ff0a740fc","resolution":{"observed_at":"2026-07-31T14:08:11.164039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22525","last_updated":"2025-05-28T16:12:45Z","snapshot_observed_at":"2026-08-07T13:02:39.708613Z","submitted_at":"2025-05-28T16:12:45Z","title":"Thinking with Generated Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22525","snapshot_observed_at":"2026-07-31T14:08:11.168680Z","title":"Thinking with generated images.arXiv preprint arXiv:2505.22525,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.168680Z"},"links":{"cited_paper":"/paper/2505.22525","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:4a44220e9f493bbe38a3a0ad0e1244bd77dc976a3d72e8fee7a89ef6e61f0002","observation_id":"83c505a3-8516-404f-bb1d-243a002acfdb","resolution":{"observed_at":"2026-07-31T14:08:11.168680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:08:11.186512Z","title":"Controlthinker: Unveiling latent semantics for controllable image generation through visual reasoning.arXiv preprint arXiv:2506.03596,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.186512Z"},"links":{"citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:069d8ec04b01d136bdc9230440fb5e5afb67dfc60781f7d5bbabdd65f1f76597","observation_id":"d9c234a2-ad50-4ce5-a0b9-6321539621fa","resolution":{"observed_at":"2026-07-31T14:08:11.186512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T14:08:11.172286Z","title":"A survey on the optimization of large language model-based agents.arXiv preprint arXiv:2503.12434,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.172286Z"},"links":{"citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:13b93e924eb94d7c3afddae1acf1ac062ce4a1b170905ec39bc31f7f878b8a00","observation_id":"bc5c28dd-441f-4682-a515-5d5a635e3a87","resolution":{"observed_at":"2026-07-31T14:08:11.172286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07969","last_updated":"2025-09-09T17:54:21Z","snapshot_observed_at":"2026-07-30T05:21:39.737665Z","submitted_at":"2025-09-09T17:54:21Z","title":"Mini-o3: Scaling Up Reasoning Patterns and Interaction Turns for Visual Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.07969","snapshot_observed_at":"2026-07-31T14:08:11.193418Z","title":"Mini-o3: Scaling up reasoning patterns and interaction turns for visual search.arXiv preprint arXiv:2509.07969,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-07-31T14:08:11.193418Z"},"links":{"cited_paper":"/paper/2509.07969","citing_paper":"/paper/2607.28225"},"observation_digest":"sha256:e7eef2a90a103c8a11080348d36e28b290ff159e8e7b8a69642d1a54d6c41e78","observation_id":"25c1bf69-7aec-4a29-be85-5c4230954669","resolution":{"observed_at":"2026-07-31T14:08:11.193418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28225","last_updated":"2026-07-30T13:58:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T01:38:45.608115Z","submitted_at":"2026-07-30T13:58:08Z","title":"FaithEyes: Towards Faithful Tool Use via Multi-Agent Process-Image Verification"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2607.28225."}