{"as_of":"2026-08-08T17:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cfc07df69384a42f8821e1f8eed58102610f98ac0672bfba956d9266df0bfb0c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:16:20.208413Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T06:54:20.741710Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-07T14:16:20.208413Z","title":"Var-clip: Text-to- image generator with visual auto-regressive modeling.arXiv preprint arXiv:2408.01181, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19602","last_updated":"2025-05-26T07:11:42Z","snapshot_observed_at":"2026-08-07T20:37:37.513673Z","submitted_at":"2025-05-26T07:11:42Z","title":"Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:16:20.208413Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2505.19602"},"observation_digest":"sha256:6e87861eee43bf7702459856052af2f95b5077ecb807fea9cdd40f1c8410a802","observation_id":"91b9fa70-7ee9-4c17-b71a-2ec91cd63095","resolution":{"observed_at":"2026-08-07T14:16:20.208413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-07T12:48:56.108385Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23493","last_updated":"2025-05-29T14:43:46Z","snapshot_observed_at":"2026-08-07T20:36:09.670028Z","submitted_at":"2025-05-29T14:43:46Z","title":"R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T12:48:56.108385Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2505.23493"},"observation_digest":"sha256:3a65f35ea4a2a979f5695903eda2467b686ea8f087eb16ca77dad5befd1f0856","observation_id":"9f2adca5-024e-4b9b-bbc3-bf397071ab34","resolution":{"observed_at":"2026-08-07T12:48:56.108385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-07T10:47:52.448909Z","title":"V ar-clip: T ext-to-image generator with vi- sual auto-regressive modeling.arXiv preprint arXiv:2408.01181,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04421","last_updated":"2025-06-04T20:08:07Z","snapshot_observed_at":"2026-08-07T20:35:26.253139Z","submitted_at":"2025-06-04T20:08:07Z","title":"HMAR: Efficient Hierarchical Masked Auto-Regressive Image Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T10:47:52.448909Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2506.04421"},"observation_digest":"sha256:44e1618bd54388a57b1f5772d5d0f1a684a169d2b937a961fe57fbb2ccbd5ab3","observation_id":"9cf7b3a0-2484-49d2-a8a1-850297adb6d2","resolution":{"observed_at":"2026-08-07T10:47:52.448909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-07T04:52:55.129106Z","title":"Var-clip: Text-to-image generator with visual auto-regressive modeling.arXiv preprint arXiv:2408.01181, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09482","last_updated":"2025-08-20T06:57:17Z","snapshot_observed_at":"2026-08-07T04:44:47.714397Z","submitted_at":"2025-06-11T07:50:31Z","title":"Marrying Autoregressive Transformer and Diffusion with Multi-Reference Autoregression","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:55.129106Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2506.09482"},"observation_digest":"sha256:e7ec1e2b816a3235cf4044b63fbfeb858c28f0d5be86319bc47bc1e6b7177018","observation_id":"8df0b60b-f192-4be3-97d3-ae74e55aa94d","resolution":{"observed_at":"2026-08-07T04:52:55.129106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-07T04:17:52.283966Z","title":"Var-clip: Text-to-image gen- erator with visual auto-regressive modeling.arXiv preprint arXiv:2408.01181, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10962","last_updated":"2025-06-12T17:57:44Z","snapshot_observed_at":"2026-08-08T11:44:13.586975Z","submitted_at":"2025-06-12T17:57:44Z","title":"SpectralAR: Spectral Autoregressive Visual Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T04:17:52.283966Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2506.10962"},"observation_digest":"sha256:bbb9f5d537cd01300fc2e1ad51636144c205aeb2e603767b285695c16bebc52c","observation_id":"861f9994-7206-44ea-962e-ff45773dbcc8","resolution":{"observed_at":"2026-08-07T04:17:52.283966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-06T21:49:45.539495Z","title":"Var-clip: Text-to-image gen- erator with visual auto-regressive modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23347","last_updated":"2025-07-07T16:20:58Z","snapshot_observed_at":"2026-08-07T20:36:08.130659Z","submitted_at":"2025-06-29T17:43:04Z","title":"CycleVAR: Repurposing Autoregressive Model for Unsupervised One-Step Image Translation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T21:49:45.539495Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2506.23347"},"observation_digest":"sha256:ac5641224a9b50a42acb72cb4d02c5c3552abf311c13fdfd09ecf8eb146b3f99","observation_id":"403a70da-72c2-469a-8beb-860b8f66a223","resolution":{"observed_at":"2026-08-06T21:49:45.539495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-06T19:41:23.828655Z","title":"Var-clip: Text-to-image gen- erator with visual auto-regressive modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04947","last_updated":"2025-07-07T12:45:23Z","snapshot_observed_at":"2026-08-08T12:12:25.015685Z","submitted_at":"2025-07-07T12:45:23Z","title":"DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T19:41:23.828655Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2507.04947"},"observation_digest":"sha256:d619442ec98431afc35bf2b20b4db9c6e1869a307594cec270125f82e092e9ca","observation_id":"43ad1ff8-72f0-4a82-99e6-2f3e1f952c7e","resolution":{"observed_at":"2026-08-06T19:41:23.828655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-05T18:33:54.401363Z","title":"Var-clip: Text-to-image generator with visual auto-regressive modeling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14502","last_updated":"2025-08-20T07:45:08Z","snapshot_observed_at":"2026-08-05T18:33:49.561061Z","submitted_at":"2025-08-20T07:45:08Z","title":"SATURN: Autoregressive Image Generation Guided by Scene Graphs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T18:33:54.401363Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2508.14502"},"observation_digest":"sha256:6c9710cc3df194ad1eea7072caebb0221aee56d7ff9c07442dd196aeca36a18e","observation_id":"a9a41627-9ca0-4458-9807-b298eac50c2f","resolution":{"observed_at":"2026-08-05T18:33:54.401363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-08-04T14:43:17.464750Z","title":"VAR-CLIP : Text-to-Image Generator with Visual Auto-Regressive Modeling , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23876","last_updated":"2026-07-04T08:20:05Z","snapshot_observed_at":"2026-08-07T20:39:02.578525Z","submitted_at":"2025-09-28T13:33:49Z","title":"Rethinking Visual Autoregressive Sampling with Information-Grounding Guidance","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:17.464750Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2509.23876"},"observation_digest":"sha256:9753091a424baf495ef9f380933183818ca8280ed11f53ab8fff9b6fe50b61de","observation_id":"dcc8120e-260a-4b47-90cf-22cedb9e0b4d","resolution":{"observed_at":"2026-08-04T14:43:17.464750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling","version":1},"cited_work":{"arxiv_id":"2408.01181","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.01181","snapshot_observed_at":"2026-06-30T06:54:20.741710Z","title":"arXiv preprint arXiv:2408.01181 (2024)","venue":null,"work_id":"1eb7c329-d80a-4ee1-b3f3-495e30ad611f","year":2024},"citing_paper":{"arxiv_id":"2606.30124","last_updated":"2026-06-29T10:59:10Z","snapshot_observed_at":"2026-08-02T12:26:27.389877Z","submitted_at":"2026-06-29T10:59:10Z","title":"SciIR: A Large-scale Training Dataset and Benchmark for Scientific Image Reasoning Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T06:48:22.594002Z"},"links":{"cited_paper":"/paper/2408.01181","citing_paper":"/paper/2606.30124"},"observation_digest":"sha256:4732a8f1abc46cfce485edcd669cef3fb52177275e36ede311d37e5af6ee97d8","observation_id":"d81dd14f-c752-4f50-9122-2139059439b0","resolution":{"observed_at":"2026-06-30T06:54:20.743053Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2408.01181/citation-record","integrity":"/paper/2408.01181/integrity","json":"/paper/2408.01181/citation-record.json","paper":"/paper/2408.01181"},"outbound":[],"paper":{"arxiv_id":"2408.01181","last_updated":"2024-08-02T11:03:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T04:14:05.977486Z","submitted_at":"2024-08-02T11:03:22Z","title":"VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2408.01181."}