{"as_of":"2026-08-05T13:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:89cda28ec459f78e905605565a66b190aba8d6606af020b5d721bb7c8a0b0b56","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T08:44:42.110094Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T00:37:30.128596Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.09927","last_updated":"2025-02-14T05:36:32Z","snapshot_observed_at":"2026-07-06T20:36:26.822412Z","submitted_at":"2025-02-14T05:36:32Z","title":"Granite Vision: a lightweight, open-source multimodal model for enterprise Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09927","snapshot_observed_at":"2026-08-04T08:44:42.110094Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19496","last_updated":"2026-05-31T09:39:34Z","snapshot_observed_at":"2026-08-05T03:14:18.623813Z","submitted_at":"2025-10-22T11:44:31Z","title":"CARES: Context-Aware Resolution Selector for VLMs","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T08:44:42.110094Z"},"links":{"cited_paper":"/paper/2502.09927","citing_paper":"/paper/2510.19496"},"observation_digest":"sha256:35682efc0fcf498c97e9dbd4c64661e9e6ffcebd21ce1c852a29d54d15f79c03","observation_id":"1a730b76-90ec-4497-8477-3213f1333f58","resolution":{"observed_at":"2026-08-04T08:44:42.110094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09927","last_updated":"2025-02-14T05:36:32Z","snapshot_observed_at":"2026-07-06T20:36:26.822412Z","submitted_at":"2025-02-14T05:36:32Z","title":"Granite Vision: a lightweight, open-source multimodal model for enterprise Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09927","snapshot_observed_at":"2026-08-03T17:02:36.520157Z","title":"Granite vision: a lightweight, open-source multimodal model for enterprise intelligence.arXiv preprint arXiv:2502.09927, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10888","last_updated":"2026-06-02T15:53:37Z","snapshot_observed_at":"2026-08-05T05:45:36.735946Z","submitted_at":"2025-12-11T18:19:00Z","title":"PubTables-v2: A new large-scale dataset for full-page and multi-page table extraction","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T17:02:36.520157Z"},"links":{"cited_paper":"/paper/2502.09927","citing_paper":"/paper/2512.10888"},"observation_digest":"sha256:900d8e69d96b631347c8c2d1251bd0b7225e0dc2de2723c7bda5f92bbeb9ce1f","observation_id":"9d6b9cc7-7d42-4f78-a505-89c1532632f4","resolution":{"observed_at":"2026-08-03T17:02:36.520157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09927","last_updated":"2025-02-14T05:36:32Z","snapshot_observed_at":"2026-07-06T20:36:26.822412Z","submitted_at":"2025-02-14T05:36:32Z","title":"Granite Vision: a lightweight, open-source multimodal model for enterprise Intelligence","version":1},"cited_work":{"arxiv_id":"2502.09927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09927","snapshot_observed_at":"2026-07-03T00:37:30.128596Z","title":"arXiv preprint arXiv:2502.09927 , year=","venue":null,"work_id":"91452475-e89a-4a74-911c-a0e4f03f3ca7","year":2025},"citing_paper":{"arxiv_id":"2603.27064","last_updated":"2026-04-14T20:08:27Z","snapshot_observed_at":"2026-07-06T22:50:50.593464Z","submitted_at":"2026-03-28T00:45:05Z","title":"ChartNet: A Million-Scale, High-Quality Multimodal Dataset for Robust Chart Understanding","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-14T22:39:06.113655Z"},"links":{"cited_paper":"/paper/2502.09927","citing_paper":"/paper/2603.27064"},"observation_digest":"sha256:21a2e9a55e4173802db1190ce5fb8fa73f57a716a734c04085dcad4cd88b9d74","observation_id":"c59e13ce-90bf-463f-80a0-9fe37b8f21d0","resolution":{"observed_at":"2026-05-14T22:39:32.875179Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09927","last_updated":"2025-02-14T05:36:32Z","snapshot_observed_at":"2026-07-06T20:36:26.822412Z","submitted_at":"2025-02-14T05:36:32Z","title":"Granite Vision: a lightweight, open-source multimodal model for enterprise Intelligence","version":1},"cited_work":{"arxiv_id":"2502.09927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09927","snapshot_observed_at":"2026-07-03T00:37:30.128596Z","title":"arXiv preprint arXiv:2502.09927 , year=","venue":null,"work_id":"91452475-e89a-4a74-911c-a0e4f03f3ca7","year":2025},"citing_paper":{"arxiv_id":"2604.08538","last_updated":"2026-04-13T17:37:21Z","snapshot_observed_at":"2026-08-02T07:55:28.320539Z","submitted_at":"2026-04-09T17:59:36Z","title":"ParseBench: A Document Parsing Benchmark for AI Agents","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T17:20:02.687230Z"},"links":{"cited_paper":"/paper/2502.09927","citing_paper":"/paper/2604.08538"},"observation_digest":"sha256:2c04b6596e6b88268d63b41bf2e330dd3ef34fa7ac194489b2629c7c3c9fb45d","observation_id":"4de26168-ddc2-403d-be2d-ca5db2e8724e","resolution":{"observed_at":"2026-05-11T07:01:07.662378Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09927","last_updated":"2025-02-14T05:36:32Z","snapshot_observed_at":"2026-07-06T20:36:26.822412Z","submitted_at":"2025-02-14T05:36:32Z","title":"Granite Vision: a lightweight, open-source multimodal model for enterprise Intelligence","version":1},"cited_work":{"arxiv_id":"2502.09927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09927","snapshot_observed_at":"2026-07-03T00:37:30.128596Z","title":"arXiv preprint arXiv:2502.09927 , year=","venue":null,"work_id":"91452475-e89a-4a74-911c-a0e4f03f3ca7","year":2025},"citing_paper":{"arxiv_id":"2604.21718","last_updated":"2026-04-26T23:28:29Z","snapshot_observed_at":"2026-08-03T21:12:35.258126Z","submitted_at":"2026-04-22T09:01:04Z","title":"Building a Precise Video Language with Human-AI Oversight","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T00:37:31.858728Z"},"links":{"cited_paper":"/paper/2502.09927","citing_paper":"/paper/2604.21718"},"observation_digest":"sha256:77de7e3faca93c5f5aafe3c8772a98c4b015fb56b241199c95c57301a849edd0","observation_id":"7c73f769-4a9d-49d2-aae9-80d07f013e11","resolution":{"observed_at":"2026-05-11T13:46:04.406418Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09927","last_updated":"2025-02-14T05:36:32Z","snapshot_observed_at":"2026-07-06T20:36:26.822412Z","submitted_at":"2025-02-14T05:36:32Z","title":"Granite Vision: a lightweight, open-source multimodal model for enterprise Intelligence","version":1},"cited_work":{"arxiv_id":"2502.09927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09927","snapshot_observed_at":"2026-07-03T00:37:30.128596Z","title":"arXiv preprint arXiv:2502.09927 , year=","venue":null,"work_id":"91452475-e89a-4a74-911c-a0e4f03f3ca7","year":2025},"citing_paper":{"arxiv_id":"2605.08421","last_updated":"2026-05-08T19:28:46Z","snapshot_observed_at":"2026-08-03T20:04:29.535256Z","submitted_at":"2026-05-08T19:28:46Z","title":"Beyond Bag-of-Patches: Learning Global Layout via Textual Supervision for Late-Interaction Visual Document Retrieval","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-12T01:16:05.097254Z"},"links":{"cited_paper":"/paper/2502.09927","citing_paper":"/paper/2605.08421"},"observation_digest":"sha256:15f82ad0ac91a4aca92ce8e05d58f7e01201cb2f669b3fd8c397de52f9be06dd","observation_id":"330f02df-8885-467b-9d24-7065f3ce2cd1","resolution":{"observed_at":"2026-05-12T08:06:36.700339Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09927","last_updated":"2025-02-14T05:36:32Z","snapshot_observed_at":"2026-07-06T20:36:26.822412Z","submitted_at":"2025-02-14T05:36:32Z","title":"Granite Vision: a lightweight, open-source multimodal model for enterprise Intelligence","version":1},"cited_work":{"arxiv_id":"2502.09927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09927","snapshot_observed_at":"2026-07-03T00:37:30.128596Z","title":"arXiv preprint arXiv:2502.09927 , year=","venue":null,"work_id":"91452475-e89a-4a74-911c-a0e4f03f3ca7","year":2025},"citing_paper":{"arxiv_id":"2605.21479","last_updated":"2026-05-20T17:58:24Z","snapshot_observed_at":"2026-08-02T21:43:57.509132Z","submitted_at":"2026-05-20T17:58:24Z","title":"WikiVQABench: A Knowledge-Grounded Visual Question Answering Benchmark from Wikipedia and Wikidata","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-05-21T04:41:06.779529Z"},"links":{"cited_paper":"/paper/2502.09927","citing_paper":"/paper/2605.21479"},"observation_digest":"sha256:a2ba31581094d941110505c6f396ce377c11e8ff9784924a5ad9832017195be3","observation_id":"4a3e3a4d-8a42-4031-b57a-0e55d1269980","resolution":{"observed_at":"2026-05-21T04:43:58.724725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09927","last_updated":"2025-02-14T05:36:32Z","snapshot_observed_at":"2026-07-06T20:36:26.822412Z","submitted_at":"2025-02-14T05:36:32Z","title":"Granite Vision: a lightweight, open-source multimodal model for enterprise Intelligence","version":1},"cited_work":{"arxiv_id":"2502.09927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09927","snapshot_observed_at":"2026-07-03T00:37:30.128596Z","title":"arXiv preprint arXiv:2502.09927 , year=","venue":null,"work_id":"91452475-e89a-4a74-911c-a0e4f03f3ca7","year":2025},"citing_paper":{"arxiv_id":"2606.09788","last_updated":"2026-06-08T17:43:44Z","snapshot_observed_at":"2026-08-02T09:55:19.118958Z","submitted_at":"2026-06-08T17:43:44Z","title":"POTATR: A Lightweight Image-to-Graph Model for Page-Level Table Extraction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T17:06:33.518620Z"},"links":{"cited_paper":"/paper/2502.09927","citing_paper":"/paper/2606.09788"},"observation_digest":"sha256:73759a63284d3fd7833f01c8e103e66dc1401ba18a6d5d04dd48d46e3e3cce1e","observation_id":"93f82dbf-82a7-4362-8e77-fc79acecee63","resolution":{"observed_at":"2026-07-03T00:37:30.130095Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09927","last_updated":"2025-02-14T05:36:32Z","snapshot_observed_at":"2026-07-06T20:36:26.822412Z","submitted_at":"2025-02-14T05:36:32Z","title":"Granite Vision: a lightweight, open-source multimodal model for enterprise Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09927","snapshot_observed_at":"2026-08-02T11:40:15.463160Z","title":"Granite vision: a lightweight, open-source multimodal model for enterprise intelligence,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.13811","last_updated":"2026-07-26T23:52:47Z","snapshot_observed_at":"2026-08-02T11:40:14.617545Z","submitted_at":"2026-06-11T18:27:27Z","title":"Aligning Quantum Operators with Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T11:40:15.463160Z"},"links":{"cited_paper":"/paper/2502.09927","citing_paper":"/paper/2606.13811"},"observation_digest":"sha256:9d7dbb0354a112041ba7c9430b2ec02787f7394b9cea4c5acba6b11378165553","observation_id":"029e6395-5a5c-4012-9407-038af2f9c0eb","resolution":{"observed_at":"2026-08-02T11:40:15.463160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.09927/citation-record","integrity":"/paper/2502.09927/integrity","json":"/paper/2502.09927/citation-record.json","paper":"/paper/2502.09927"},"outbound":[],"paper":{"arxiv_id":"2502.09927","last_updated":"2025-02-14T05:36:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T20:36:26.822412Z","submitted_at":"2025-02-14T05:36:32Z","title":"Granite Vision: a lightweight, open-source multimodal model for enterprise Intelligence"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2502.09927."}