{"as_of":"2026-08-09T22:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4926d706997d86d5ee4584fc5a31b380b7741cc499cdc315e455f1773e9a1905","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:57:20.180732Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T02:04:26.390365Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2103.14470","last_updated":"2021-03-26T13:46:00Z","snapshot_observed_at":"2026-07-06T10:53:40.529751Z","submitted_at":"2021-03-26T13:46:00Z","title":"Spatial Dual-Modality Graph Reasoning for Key Information Extraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14470","snapshot_observed_at":"2026-08-07T14:57:20.180732Z","title":"Spatial dual- modality graph reasoning for key information extraction.arXiv preprint arXiv:2103.14470, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17163","last_updated":"2026-05-26T01:50:12Z","snapshot_observed_at":"2026-08-07T14:52:59.748689Z","submitted_at":"2025-05-22T15:25:14Z","title":"OCR-Reasoning Benchmark: Unveiling the True Capabilities of MLLMs in Complex Text-Rich Image Reasoning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:20.180732Z"},"links":{"cited_paper":"/paper/2103.14470","citing_paper":"/paper/2505.17163"},"observation_digest":"sha256:7bfb6df9964c190eeb1d7dcc7adc551ad0d86358ee41bb61d04b3bd35e07905d","observation_id":"8073ba43-4ed4-47ee-81e1-5da74344ec25","resolution":{"observed_at":"2026-08-07T14:57:20.180732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14470","last_updated":"2021-03-26T13:46:00Z","snapshot_observed_at":"2026-07-06T10:53:40.529751Z","submitted_at":"2021-03-26T13:46:00Z","title":"Spatial Dual-Modality Graph Reasoning for Key Information Extraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14470","snapshot_observed_at":"2026-08-06T17:59:06.590430Z","title":"Spatial dual-modality graph rea- soning for key information extraction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09531","last_updated":"2025-07-13T08:15:11Z","snapshot_observed_at":"2026-08-09T19:00:02.677398Z","submitted_at":"2025-07-13T08:15:11Z","title":"VDInstruct: Zero-Shot Key Information Extraction via Content-Aware Vision Tokenization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:59:06.590430Z"},"links":{"cited_paper":"/paper/2103.14470","citing_paper":"/paper/2507.09531"},"observation_digest":"sha256:86f2474a7d1a5b235365d5300f6d1a68c5bcc625191c0e3b7c7af140ff0efebe","observation_id":"7927cf82-2d59-4f37-a184-cef2e104c169","resolution":{"observed_at":"2026-08-06T17:59:06.590430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14470","last_updated":"2021-03-26T13:46:00Z","snapshot_observed_at":"2026-07-06T10:53:40.529751Z","submitted_at":"2021-03-26T13:46:00Z","title":"Spatial Dual-Modality Graph Reasoning for Key Information Extraction","version":1},"cited_work":{"arxiv_id":"2103.14470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.14470","snapshot_observed_at":"2026-07-08T02:04:26.390365Z","title":"Spatial dual-modality graph reasoning for key information extraction","venue":"cs.CV","work_id":"2ac696a9-b432-467b-8aa4-f419a0d709ee","year":2021},"citing_paper":{"arxiv_id":"2604.25212","last_updated":"2026-06-25T01:51:11Z","snapshot_observed_at":"2026-08-04T03:34:24.488076Z","submitted_at":"2026-04-28T04:30:55Z","title":"Noncrossing Duality and the Geometry of Positive Tropical Linear Spaces","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-01T09:23:20.044291Z"},"links":{"cited_paper":"/paper/2103.14470","citing_paper":"/paper/2604.25212"},"observation_digest":"sha256:6a4a8c1cae2c687b17620d3ad9f6ba228e3adedce4ca1ee01f5abc72f65137e7","observation_id":"88fd108d-58f0-4c8a-8dc5-dbec2ca4b345","resolution":{"observed_at":"2026-07-01T09:25:39.933815Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14470","last_updated":"2021-03-26T13:46:00Z","snapshot_observed_at":"2026-07-06T10:53:40.529751Z","submitted_at":"2021-03-26T13:46:00Z","title":"Spatial Dual-Modality Graph Reasoning for Key Information Extraction","version":1},"cited_work":{"arxiv_id":"2103.14470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.14470","snapshot_observed_at":"2026-07-08T02:04:26.390365Z","title":"Spatial dual-modality graph reasoning for key information extraction","venue":"cs.CV","work_id":"2ac696a9-b432-467b-8aa4-f419a0d709ee","year":2021},"citing_paper":{"arxiv_id":"2604.25213","last_updated":"2026-04-28T04:33:26Z","snapshot_observed_at":"2026-07-06T23:11:07.254460Z","submitted_at":"2026-04-28T04:33:26Z","title":"When the Forger Is the Judge: GPT-Image-2 Cannot Recognize Its Own Faked Documents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T16:54:17.319933Z"},"links":{"cited_paper":"/paper/2103.14470","citing_paper":"/paper/2604.25213"},"observation_digest":"sha256:6201fc1b3038006054b082c5f14e60bf2f5383723fee62cf97c91794bae5c8d8","observation_id":"1d2d7d9c-673c-437d-94e3-9d0c2ebdcbf7","resolution":{"observed_at":"2026-05-11T23:31:15.041032Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14470","last_updated":"2021-03-26T13:46:00Z","snapshot_observed_at":"2026-07-06T10:53:40.529751Z","submitted_at":"2021-03-26T13:46:00Z","title":"Spatial Dual-Modality Graph Reasoning for Key Information Extraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14470","snapshot_observed_at":"2026-07-11T16:02:00.920066Z","title":"arXiv preprint arXiv:2103.14470 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04636","last_updated":"2026-07-06T03:39:08Z","snapshot_observed_at":"2026-08-06T12:41:38.313154Z","submitted_at":"2026-07-06T03:39:08Z","title":"Enhancing Large Multimodal Models in Key Information Extraction via Scene-Aware Document Synthesis","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-11T16:02:00.920066Z"},"links":{"cited_paper":"/paper/2103.14470","citing_paper":"/paper/2607.04636"},"observation_digest":"sha256:b7b6e5c3d6c4f1fd406c1cb391c151be0bd1cd178cd2f6a5e7c769eaa50f1984","observation_id":"f5ac9e35-cfa7-4522-98f5-dc6b98b0a828","resolution":{"observed_at":"2026-07-11T16:02:00.920066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14470","last_updated":"2021-03-26T13:46:00Z","snapshot_observed_at":"2026-07-06T10:53:40.529751Z","submitted_at":"2021-03-26T13:46:00Z","title":"Spatial Dual-Modality Graph Reasoning for Key Information Extraction","version":1},"cited_work":{"arxiv_id":"2103.14470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.14470","snapshot_observed_at":"2026-07-08T02:04:26.390365Z","title":"Spatial dual-modality graph reasoning for key information extraction","venue":"cs.CV","work_id":"2ac696a9-b432-467b-8aa4-f419a0d709ee","year":2021},"citing_paper":{"arxiv_id":"2607.06560","last_updated":"2026-07-07T17:58:33Z","snapshot_observed_at":"2026-07-10T23:18:28.655344Z","submitted_at":"2026-07-07T17:58:33Z","title":"Vision as Unified Multimodal Generation","version":1},"reference_index":160,"source":"pdf_text","source_observed_at":"2026-07-08T01:54:30.649092Z"},"links":{"cited_paper":"/paper/2103.14470","citing_paper":"/paper/2607.06560"},"observation_digest":"sha256:5fcf7af2186fd75b68a73f7435df402b668b08900cc2c3875d515e1ba6095da2","observation_id":"03cb6a75-c915-4770-96a9-9d6c9f69018e","resolution":{"observed_at":"2026-07-08T02:04:26.392042Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14470","last_updated":"2021-03-26T13:46:00Z","snapshot_observed_at":"2026-07-06T10:53:40.529751Z","submitted_at":"2021-03-26T13:46:00Z","title":"Spatial Dual-Modality Graph Reasoning for Key Information Extraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14470","snapshot_observed_at":"2026-08-01T16:31:11.264506Z","title":"Spatial Dual- Modality Graph Reasoning for Key Information Extraction (WildReceipt)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22708","last_updated":"2026-07-20T14:14:44Z","snapshot_observed_at":"2026-08-07T12:37:24.746296Z","submitted_at":"2026-07-20T14:14:44Z","title":"StepX-Edge: An On-Device UI Vision-Language Model via Architecture-Training-Deployment Co-Design","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T16:31:11.264506Z"},"links":{"cited_paper":"/paper/2103.14470","citing_paper":"/paper/2607.22708"},"observation_digest":"sha256:730f70669a5f8a85fb6c3953039cbc9a16fa8389580e23ba97369d0db6d605dd","observation_id":"327a0edc-4c53-434a-9e33-80f92e42df3c","resolution":{"observed_at":"2026-08-01T16:31:11.264506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14470","last_updated":"2021-03-26T13:46:00Z","snapshot_observed_at":"2026-07-06T10:53:40.529751Z","submitted_at":"2021-03-26T13:46:00Z","title":"Spatial Dual-Modality Graph Reasoning for Key Information Extraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.14470","snapshot_observed_at":"2026-08-01T08:52:44.665708Z","title":"arXiv preprint arXiv:2103.14470 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22745","last_updated":"2026-07-23T06:56:49Z","snapshot_observed_at":"2026-08-03T08:25:31.170674Z","submitted_at":"2026-07-23T06:56:49Z","title":"AI-generated Images Challenge Visual Trust in High-risk Scenarios","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T08:52:44.665708Z"},"links":{"cited_paper":"/paper/2103.14470","citing_paper":"/paper/2607.22745"},"observation_digest":"sha256:1456fc97075e98424a8266b7dfe26d680ae0a24a2af75e77547d1606ded5e6e6","observation_id":"72097a27-1519-433d-ade6-d4797b0fdc45","resolution":{"observed_at":"2026-08-01T08:52:44.665708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2103.14470/citation-record","integrity":"/paper/2103.14470/integrity","json":"/paper/2103.14470/citation-record.json","paper":"/paper/2103.14470"},"outbound":[],"paper":{"arxiv_id":"2103.14470","last_updated":"2021-03-26T13:46:00Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T10:53:40.529751Z","submitted_at":"2021-03-26T13:46:00Z","title":"Spatial Dual-Modality Graph Reasoning for Key Information Extraction"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2103.14470."}