Pith. sign in

Paper Citation Record · LEDGER

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning

As of 9 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2508.00356.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2508.00356 v1

Coverage vector

measured 24 of 24 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T10:14:26.501485Z

measured 24 of 24 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

24 of 24 outbound references displayed

  • verified exact7
  • verified fuzzy1
  • unresolved15
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 57c4ef17-6644-495a-a376-98a2eb7fe313 · outbound

This paper cites an unresolved cited work.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-06T10:14:27.083225Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.383981Z digest=sha256:c1dc6c5a20e4c87a4911449a84e96db371c1b0ca7a975fa14908c71caef1c49b

Observation 7c949231-5f48-44ea-9a23-e4db810e6bbd · outbound

This paper cites an unresolved cited work.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-06T10:14:27.067450Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.395786Z digest=sha256:c4d1884febf79a58d2c808c25f9169b7408094f1a6b3c4b5c9f306b1d4703d81

Observation ec7a6b27-faeb-4549-9bc1-9262a518c81c · outbound

This paper cites iEdit: Localised Text-guided Image Editing with Weak Supervision.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning iEdit: Localised Text-guided Image Editing with Weak Supervision

Reference 3

Resolution
verified exact
local_arxiv, observed 2026-08-06T10:14:26.955157Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.400829Z digest=sha256:63189dc65983696a3fd03e91ee1448e02c6112e598939d2470e4d9d16c0b8050

Observation d3bdebc5-3888-494c-b572-a38bb4c572ba · outbound

This paper cites nuScenes: A multimodal dataset for autonomous driving.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning nuScenes: A multimodal dataset for autonomous driving

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-06T10:14:26.406143Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:14:26.406143Z digest=sha256:b22a6905366baec094bd157b49be720f1748084b2221e3586e3e7d25062261c5

Observation 8fc48e60-3e2c-482b-a6c0-e0198b28d2de · outbound

This paper cites WebQA: Multihop and Multimodal QA.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning WebQA: Multihop and Multimodal QA

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T10:14:26.411573Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:14:26.411573Z digest=sha256:d24ddb02b5c019d885ffec3e33057a67f92e5fdce064f6cfba8c4b24d9aa16c3

Observation 718fb223-8954-4c7c-a9ed-14aa57031b23 · outbound

This paper cites an unresolved cited work.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T10:14:27.051742Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.417685Z digest=sha256:d1ef3effc32754af1ed813acb54c51b6fa9a4496d2cb8bb4aecaf2f3b6d79cdd

Observation 6a4d9f21-e11b-46b3-b594-55fede6f18aa · outbound

This paper cites Neural Naturalist: Generating Fine-Grained Image Comparisons.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Neural Naturalist: Generating Fine-Grained Image Comparisons

Reference 7

Resolution
verified exact
local_arxiv, observed 2026-08-06T10:14:26.900213Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.422530Z digest=sha256:0f41b65c315054f6270f0f5f7b8162d742504ed8b94a2f61d0272625fc61fc5d

Observation bdc9d5da-fed6-44d1-9a24-02c2d089559a · outbound

This paper cites an unresolved cited work.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Unresolved cited work

Reference 8

Resolution
verified exact
doi, observed 2026-08-06T10:14:26.555105Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.428676Z digest=sha256:6cfd560de4134909f345f7cbf4c0dd9dc3d59eecc400a43c6a7ea7eb9193c668

Observation f8835270-7cc0-44f3-b1a0-514a488701e8 · outbound

This paper cites VizWiz Grand Challenge: Answering Visual Questions from Blind People.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning VizWiz Grand Challenge: Answering Visual Questions from Blind People

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T10:14:26.433842Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:14:26.433842Z digest=sha256:7113b5a39a890dcd0ff808d54917a8207da48f7dd3b619ae2a4cfb0ebe4b19c5

Observation 7afc94be-cd73-4ec8-bf06-3aedf9ce1de8 · outbound

This paper cites Automatic Spatially-aware Fashion Concept Discovery.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Automatic Spatially-aware Fashion Concept Discovery

Reference 10

Resolution
metadata mismatch
local_arxiv, observed 2026-08-06T10:14:26.859611Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.439127Z digest=sha256:1557665167731b2e4aef269daa7bdd6b87f3fc86f6f14f4b340898abb7ef7eb8

Observation 03f9712d-06cc-4790-b42b-3eb47d297715 · outbound

This paper cites an unresolved cited work.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-06T10:14:27.036541Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.443906Z digest=sha256:9723a5ec0077e97a71d9758582a160a0449b834b38c4de22a0476a58c21ce05f

Observation 61f18b4e-39f1-4953-8d1b-a49da1445d0f · outbound

This paper cites Lim, and Edward H.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Lim, and Edward H

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:14:27.020400Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.448708Z digest=sha256:ca168fa753cf0fa724182ebc8da7a5ff8b12e075792298664f1a30f7d522b162

Observation eec49654-8b85-42c3-8c4d-56a1da1665ee · outbound

This paper cites an unresolved cited work.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-06T10:14:27.004968Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.453408Z digest=sha256:ecee1a5926e107bbf0d5d51586380ee76855960e3d1ec86dc9e80f88bfe43fbe

Observation 8038a4a9-d55b-42fd-9584-5c218f8e5302 · outbound

This paper cites Textbook Question Answering with Multi-modal Context Graph Understanding and Self-supervised Open-set Comprehension.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Textbook Question Answering with Multi-modal Context Graph Understanding and Self-supervised Open-set Comprehension

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-06T10:14:26.457867Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:14:26.457867Z digest=sha256:a8e2c4280610686ce37281a0e354e9e54292b008e573448c3d09deff8d1fbb79

Observation 0e01d4e9-522d-4e50-a6b0-fba0710f9d9e · outbound

This paper cites an unresolved cited work.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Unresolved cited work

Reference 15

Resolution
verified exact
doi, observed 2026-08-06T10:14:26.539249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.462613Z digest=sha256:29a2abf16127beb85d7d17ccb18f34cd55f604bb134f4e9c70c50cfdf31e49f0

Observation 43534105-71b5-4352-9c37-10cd104a6e2f · outbound

This paper cites an unresolved cited work.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-08-06T10:14:26.988233Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.467296Z digest=sha256:4a20202705653342562a61e5416c3f7d8d5b2d0cf078ce4982c58f8a101bfb49

Observation b8386a33-20c2-4723-803b-f2ef52d0b13a · outbound

This paper cites DocVQA: A Dataset for VQA on Document Images.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning DocVQA: A Dataset for VQA on Document Images

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T10:14:26.472521Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:14:26.472521Z digest=sha256:ef93c13fe5e00fcf2eab7e5f17b7f551ae55b5c3cf3a5df037a1ffc70231cf53

Observation 4412677d-676f-48ff-98b2-2ff2f9f680b0 · outbound

This paper cites an unresolved cited work.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Unresolved cited work

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T10:14:26.478099Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:14:26.478099Z digest=sha256:c2634cedc6f4b535e6175d3466eeaaa79738c245eb1fd26ebe78a8da3ca0f018

Observation 22fbebb8-7b81-47b5-92da-e90b3b048edc · outbound

This paper cites Robust Change Captioning.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Robust Change Captioning

Reference 19

Resolution
verified exact
local_arxiv, observed 2026-08-06T10:14:26.721542Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.482824Z digest=sha256:89a8e8e0331cb3f6425854334ffff11ba628eaa445970076490474fded1499fe

Observation d74dbec7-1fe0-4d7c-a424-92774c0d32e7 · outbound

This paper cites an unresolved cited work.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T10:14:26.487693Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:14:26.487693Z digest=sha256:39954db8862884aeda76f841690ee7b181ac33f20daeaa9b8b9a0128f4de69aa

Observation f6f0a749-f489-4708-9d49-0fffae55ef97 · outbound

This paper cites Totally Looks Like - How Humans Compare, Compared to Machines.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning Totally Looks Like - How Humans Compare, Compared to Machines

Reference 21

Resolution
verified exact
local_arxiv, observed 2026-08-06T10:14:26.617394Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.492057Z digest=sha256:64fb1f41ace658a625a12c8ca26bdfb10e9ca7ee4862e0b50c9b9bfc48c30b05

Observation eca3f955-72b0-4d9c-875b-545a2c56042b · outbound

This paper cites ALFRED: A Benchmark for Interpreting Grounded Instructions for Everyday Tasks.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning ALFRED: A Benchmark for Interpreting Grounded Instructions for Everyday Tasks

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-06T10:14:26.496776Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:14:26.496776Z digest=sha256:16b06898c882e225d1cc99d08a4d3daea97fc42639acb1516f8be72118644d4f

Observation 64e5c2e6-8ee0-4e94-9298-2f298e1ed724 · outbound

This paper cites NLVR2 Visual Bias Analysis.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning NLVR2 Visual Bias Analysis

Reference 23

Resolution
verified exact
local_arxiv, observed 2026-08-06T10:14:26.577064Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T10:14:26.501485Z digest=sha256:4ac9b05455c7c3009c71687cc829d651b0a894e98638aa30866cdd7b42c4d9ba

Observation 2c619c72-0063-459e-a0b1-8cc98d7fccc2 · outbound

This paper cites VISION Datasets: A Benchmark for Vision-based InduStrial InspectiON.

Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning VISION Datasets: A Benchmark for Vision-based InduStrial InspectiON

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-06T10:14:26.389640Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:14:26.389640Z digest=sha256:b8d77a3880afc538d3e5d8683f314a320ca01da345311accf2c4ecfe8e368c2d

Pith citing papers

No inbound Pith citation observations are available.