{"as_of":"2026-08-04T11:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:48921903aa38494be12cef1ce89d3ac4e363a343514a21e4fbf101b1cd164f57","coverage":[{"denominator":4,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T22:55:49.617588Z","state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T04:43:13.483262Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-01T06:16:24.888925Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.00829","last_updated":"2026-04-25T12:57:30Z","snapshot_observed_at":"2026-07-06T22:51:26.754746Z","submitted_at":"2026-04-01T12:38:27Z","title":"LinguDistill: Recovering Linguistic Ability in Vision-Language Models via Selective Cross-Modal Distillation","version":3},"cited_work":{"arxiv_id":"2604.00829","doi":"10.48550/arxiv.2604.00829","metadata_source":"pith","pith_arxiv_id":"2604.00829","snapshot_observed_at":"2026-08-01T06:16:24.888925Z","title":"LinguDistill: Recovering Linguistic Ability in Vision-Language Models via Selective Cross-Modal Distillation","venue":"cs.CV","work_id":"25c15c8e-74cb-4688-8132-2ebeae6a1c5a","year":2026},"citing_paper":{"arxiv_id":"2607.27614","last_updated":"2026-07-30T03:02:13Z","snapshot_observed_at":"2026-08-03T04:19:27.683162Z","submitted_at":"2026-07-30T03:02:13Z","title":"DualAnchor: Preserving Language Priors and Improving Lexical Fidelity in Gloss-Free Sign Language Translation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T04:43:13.483262Z"},"links":{"cited_paper":"/paper/2604.00829","citing_paper":"/paper/2607.27614"},"observation_digest":"sha256:8170dd9408d3ae1620709b64d81404446a1ea34a1effadb8b06f6bd8dd473f21","observation_id":"d2ace0ba-4c10-4949-b6aa-40f915558d98","resolution":{"observed_at":"2026-08-01T04:43:23.070987Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.00829/citation-record","integrity":"/paper/2604.00829/integrity","json":"/paper/2604.00829/citation-record.json","paper":"/paper/2604.00829"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-03T03:07:36.966845Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":"1504.00325","doi":"10.48550/arxiv.1504.00325","metadata_source":"pith","pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","venue":"cs.CV","work_id":"b3d6fb46-4169-4a28-8f7e-2ca6774211da","year":2015},"citing_paper":{"arxiv_id":"2604.00829","last_updated":"2026-04-25T12:57:30Z","snapshot_observed_at":"2026-07-06T22:51:26.754746Z","submitted_at":"2026-04-01T12:38:27Z","title":"LinguDistill: Recovering Linguistic Ability in Vision-Language Models via Selective Cross-Modal Distillation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T22:55:49.617588Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2604.00829"},"observation_digest":"sha256:caa4f0ff0c5ee2fb38e977ee47f9f97a2bef905e19629fa86b1357f10dc7e0d9","observation_id":"b3eeed85-7c5e-4003-bfbd-110ea924877e","resolution":{"observed_at":"2026-05-13T22:58:23.958105Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":"1503.02531","doi":"10.1109/cvpr52733.2024.01515","metadata_source":"pith","pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Distilling the Knowledge in a Neural Network","venue":"stat.ML","work_id":"d927ab1f-17b8-4002-9d09-c3d55764fbad","year":2015},"citing_paper":{"arxiv_id":"2604.00829","last_updated":"2026-04-25T12:57:30Z","snapshot_observed_at":"2026-07-06T22:51:26.754746Z","submitted_at":"2026-04-01T12:38:27Z","title":"LinguDistill: Recovering Linguistic Ability in Vision-Language Models via Selective Cross-Modal Distillation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T22:55:49.617588Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2604.00829"},"observation_digest":"sha256:c558200f2fdc996e6a47200e0d8c73746f8aa44bdf59a5ade73436b3927dcd79","observation_id":"cf091af8-a81a-466f-b44f-cf0aa1c56c12","resolution":{"observed_at":"2026-05-13T22:58:23.947686Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2733.2024","doi":"10.1109/cvpr52733.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Emogen: Emotional image content generation with text-to-image diffusion models","venue":null,"work_id":"7efbc2dd-b0f2-4f71-bb1c-d2fcf110d805","year":2024},"citing_paper":{"arxiv_id":"2604.00829","last_updated":"2026-04-25T12:57:30Z","snapshot_observed_at":"2026-07-06T22:51:26.754746Z","submitted_at":"2026-04-01T12:38:27Z","title":"LinguDistill: Recovering Linguistic Ability in Vision-Language Models via Selective Cross-Modal Distillation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T22:55:49.617588Z"},"links":{"citing_paper":"/paper/2604.00829"},"observation_digest":"sha256:6e38de47bbd3291c21fd93d41eadf6ea851d3fad2f40642b9938d6f87c2eca1f","observation_id":"45835309-ebfd-4dfe-9565-79435d0714c4","resolution":{"observed_at":"2026-05-13T22:58:23.817932Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:26.559218+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.14856","doi":"10.48550/arxiv.2512.14856","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"T5gemma 2: Seeing, reading, and understanding longer","venue":null,"work_id":"7f750e9c-70a8-4f8d-8c5b-e2d48902885d","year":2025},"citing_paper":{"arxiv_id":"2604.00829","last_updated":"2026-04-25T12:57:30Z","snapshot_observed_at":"2026-07-06T22:51:26.754746Z","submitted_at":"2026-04-01T12:38:27Z","title":"LinguDistill: Recovering Linguistic Ability in Vision-Language Models via Selective Cross-Modal Distillation","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T22:55:49.617588Z"},"links":{"citing_paper":"/paper/2604.00829"},"observation_digest":"sha256:6cdad0621163a9166ba6a5f00d08019ee787b6139c176eb592d27da1b5f0b561","observation_id":"db04093d-fba5-4cee-9c36-1ed3cf872138","resolution":{"observed_at":"2026-05-13T22:58:23.953214Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.00829","last_updated":"2026-04-25T12:57:30Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:51:26.754746Z","submitted_at":"2026-04-01T12:38:27Z","title":"LinguDistill: Recovering Linguistic Ability in Vision-Language Models via Selective Cross-Modal Distillation"},"reference_resolution":{"displayed":4,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":4},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 4 of 4 outbound references and 1 inbound Pith citation observation for arXiv:2604.00829."}