{"as_of":"2026-08-07T21:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:327211ef40d4be1afdbbe6c2203e6f6466867a1c33b7c80ec83a2a7ee3a82328","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:49:09.474778Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T00:45:11.930288Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.17359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-07-01T00:45:11.930288Z","title":"Chain-of-action: Faithful and multimodal question answering through large language models","venue":null,"work_id":"bd71a502-6054-4ba6-8ad1-b8d5baadf7fc","year":2024},"citing_paper":{"arxiv_id":"2503.12605","last_updated":"2025-03-23T13:47:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-16T18:39:13Z","title":"Multimodal Chain-of-Thought Reasoning: A Comprehensive Survey","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-15T17:18:52.996467Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2503.12605"},"observation_digest":"sha256:f83aa17525f42a0b897588e08fb2b91bd3d92762476b737ae972155cb3ecb801","observation_id":"7fa6f7b4-fffa-48b6-93d4-b41adb273f06","resolution":{"observed_at":"2026-05-15T17:18:53.714234Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.17359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-07-01T00:45:11.930288Z","title":"Chain-of-action: Faithful and multimodal question answering through large language models","venue":null,"work_id":"bd71a502-6054-4ba6-8ad1-b8d5baadf7fc","year":2024},"citing_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"reference_index":139,"source":"pdf_text","source_observed_at":"2026-05-14T01:29:56.480020Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2503.16419"},"observation_digest":"sha256:b4e34d54c92b323664fb3040f7bec27dede241d4fc29d806d533079064387f24","observation_id":"42b7db67-9002-4c23-923f-9a2093d2f508","resolution":{"observed_at":"2026-05-14T01:29:56.671979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.17359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-07-01T00:45:11.930288Z","title":"Chain-of-action: Faithful and multimodal question answering through large language models","venue":null,"work_id":"bd71a502-6054-4ba6-8ad1-b8d5baadf7fc","year":2024},"citing_paper":{"arxiv_id":"2504.14239","last_updated":"2025-04-19T09:25:55Z","snapshot_observed_at":"2026-08-05T23:52:52.919433Z","submitted_at":"2025-04-19T09:25:55Z","title":"InfiGUI-R1: Advancing Multimodal GUI Agents from Reactive Actors to Deliberative Reasoners","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-18T13:54:44.011048Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2504.14239"},"observation_digest":"sha256:550ec96f3ad8a035e88396a0b254f36a5d7faf1b2644679eb6982168408d85fd","observation_id":"52ea15f1-07b2-490e-8b6f-765b0f316623","resolution":{"observed_at":"2026-05-18T13:54:44.109950Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-08-07T11:49:09.474778Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01423","last_updated":"2025-06-02T08:22:28Z","snapshot_observed_at":"2026-08-07T11:41:14.104078Z","submitted_at":"2025-06-02T08:22:28Z","title":"FinRobot: Generative Business Process AI Agents for Enterprise Resource Planning in Finance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:49:09.474778Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2506.01423"},"observation_digest":"sha256:ae6b1b3379ae2aabf43b59944b7f77156913fe39c60d08394a0f91dff67da3ea","observation_id":"efde18d9-958a-4841-81de-6941b9f7e3ba","resolution":{"observed_at":"2026-08-07T11:49:09.474778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.17359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-07-01T00:45:11.930288Z","title":"Chain-of-action: Faithful and multimodal question answering through large language models","venue":null,"work_id":"bd71a502-6054-4ba6-8ad1-b8d5baadf7fc","year":2024},"citing_paper":{"arxiv_id":"2506.18027","last_updated":"2026-04-07T08:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-22T13:14:19Z","title":"PDF Retrieval Augmented Question Answering","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T08:17:19.048914Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2506.18027"},"observation_digest":"sha256:72ee6289b687efc5d4afa7ddf7ebf6721dfa5dff3cda36f02e7bdea072f1f5ea","observation_id":"607e73f0-66c5-40cc-9132-20084c84d24e","resolution":{"observed_at":"2026-05-19T08:22:11.252220Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-08-06T11:09:04.776385Z","title":"Chain-of-action: Faithful and multimodal question an- swering through large language models.arXiv preprint arXiv:2403.17359, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23067","last_updated":"2025-09-06T03:03:04Z","snapshot_observed_at":"2026-08-06T21:10:43.960852Z","submitted_at":"2025-07-30T19:57:22Z","title":"FairReason: Balancing Reasoning and Social Bias in MLLMs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:09:04.776385Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2507.23067"},"observation_digest":"sha256:662037df1e7b617537a2537314a940ad6ac70a9976b135bad0a0d9e5fd8f142c","observation_id":"2ab1bd19-2540-4f77-a237-3f1ddff06c0a","resolution":{"observed_at":"2026-08-06T11:09:04.776385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-08-06T04:17:10.475488Z","title":"Chain-of-action: Faithful and multimodal question an- swering through large language models.arXiv preprint arXiv:2403.17359, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:10.475488Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:4737d586ae562bfb1708b8b0225e1bc3fcd85cecfd410bd02379392e4d203c22","observation_id":"a9cd9caf-e8d6-4c21-8bd6-cf11e8a8ad7b","resolution":{"observed_at":"2026-08-06T04:17:10.475488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.17359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-07-01T00:45:11.930288Z","title":"Chain-of-action: Faithful and multimodal question answering through large language models","venue":null,"work_id":"bd71a502-6054-4ba6-8ad1-b8d5baadf7fc","year":2024},"citing_paper":{"arxiv_id":"2605.01284","last_updated":"2026-05-23T16:17:37Z","snapshot_observed_at":"2026-08-02T07:59:54.107863Z","submitted_at":"2026-05-02T06:40:42Z","title":"Chain of Evidence: Pixel-Level Visual Attribution for Iterative Retrieval-Augmented Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-09T14:47:15.946199Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2605.01284"},"observation_digest":"sha256:63d7ef723d4ae5e818b6de21e193a97c593f3de62a9c769311bb7bf850da3753","observation_id":"155c77f2-48b6-4100-befb-3ec61136cb50","resolution":{"observed_at":"2026-05-11T16:51:07.373258Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.17359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-07-01T00:45:11.930288Z","title":"Chain-of-action: Faithful and multimodal question answering through large language models","venue":null,"work_id":"bd71a502-6054-4ba6-8ad1-b8d5baadf7fc","year":2024},"citing_paper":{"arxiv_id":"2605.01284","last_updated":"2026-05-23T16:17:37Z","snapshot_observed_at":"2026-08-02T07:59:54.107863Z","submitted_at":"2026-05-02T06:40:42Z","title":"Chain of Evidence: Pixel-Level Visual Attribution for Iterative Retrieval-Augmented Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-01T00:41:00.814875Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2605.01284"},"observation_digest":"sha256:a92fd3d73a40f924e8f39cea707205cbc12ea878c94fd5808b50515f14312368","observation_id":"f5abcb1f-674b-4706-b3b9-7d09b63f2c56","resolution":{"observed_at":"2026-07-01T00:45:11.931551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.17359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-07-01T00:45:11.930288Z","title":"Chain-of-action: Faithful and multimodal question answering through large language models","venue":null,"work_id":"bd71a502-6054-4ba6-8ad1-b8d5baadf7fc","year":2024},"citing_paper":{"arxiv_id":"2605.06165","last_updated":"2026-05-07T12:51:49Z","snapshot_observed_at":"2026-07-06T23:18:41.400741Z","submitted_at":"2026-05-07T12:51:49Z","title":"Post Reasoning: Improving the Performance of Non-Thinking Models at No Cost","version":1},"reference_index":186,"source":"arxiv_source","source_observed_at":"2026-05-08T10:19:08.451445Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2605.06165"},"observation_digest":"sha256:5b4fab84017437d2afd4e37c862673c3526bb5e3eef07493b13f0815744f2622","observation_id":"8e7accb4-7088-48a2-a805-1d0cec5bb319","resolution":{"observed_at":"2026-05-11T20:06:09.072023Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.17359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-07-01T00:45:11.930288Z","title":"Chain-of-action: Faithful and multimodal question answering through large language models","venue":null,"work_id":"bd71a502-6054-4ba6-8ad1-b8d5baadf7fc","year":2024},"citing_paper":{"arxiv_id":"2606.00959","last_updated":"2026-05-31T02:29:36Z","snapshot_observed_at":"2026-07-06T23:41:34.459700Z","submitted_at":"2026-05-31T02:29:36Z","title":"Towards Understanding Modality Interaction in Multimodal Language Models via Partial Information Decomposition","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-28T17:40:30.038337Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2606.00959"},"observation_digest":"sha256:0d5f3ade435e2db39d6c6879e037c465a3bf73ca392f64b0c644733b976303fd","observation_id":"f7028f75-d043-4ab8-9c9d-3c6644c1570d","resolution":{"observed_at":"2026-06-28T17:42:26.096972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2403.17359/citation-record","integrity":"/paper/2403.17359/integrity","json":"/paper/2403.17359/citation-record.json","paper":"/paper/2403.17359"},"outbound":[],"paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2403.17359."}