{"as_of":"2026-08-06T20:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cc026ad7d061ec1fc715411346f56e730c675a12232737e878875d831787f1d6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:55:28.167608Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T00:04:22.401157Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":"2412.04332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-07-08T00:04:22.401157Z","title":"arXiv preprint arXiv:2412.04332 (2024) 2, 9, 10","venue":"cs.CV","work_id":"a9ef7688-9d55-4c89-935a-8762165fc75f","year":2024},"citing_paper":{"arxiv_id":"2503.07265","last_updated":"2026-06-02T17:11:50Z","snapshot_observed_at":"2026-07-06T20:49:51.505079Z","submitted_at":"2025-03-10T12:47:53Z","title":"WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-15T16:24:27.407376Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2503.07265"},"observation_digest":"sha256:f90967f61d8bfdb2f02373fd2184f33ee3c0ba8b119b5d3bab8cf13ce205fd1a","observation_id":"9bbaf9aa-4ec2-4012-b95c-27c78871a41e","resolution":{"observed_at":"2026-05-15T16:24:27.491335Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":"2412.04332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-07-08T00:04:22.401157Z","title":"arXiv preprint arXiv:2412.04332 (2024) 2, 9, 10","venue":"cs.CV","work_id":"a9ef7688-9d55-4c89-935a-8762165fc75f","year":2024},"citing_paper":{"arxiv_id":"2505.05472","last_updated":"2025-05-11T18:47:18Z","snapshot_observed_at":"2026-08-04T22:02:38.792513Z","submitted_at":"2025-05-08T17:58:57Z","title":"Mogao: An Omni Foundation Model for Interleaved Multi-Modal Generation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-17T07:24:04.460276Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2505.05472"},"observation_digest":"sha256:e12ce9ce94a987c26e0529ce0dca7c8994847ccfa95534b2d17db0fe263c5da0","observation_id":"ce410087-09ce-4ded-974b-f0731aa4b796","resolution":{"observed_at":"2026-05-17T07:24:04.698301Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":"2412.04332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-07-08T00:04:22.401157Z","title":"arXiv preprint arXiv:2412.04332 (2024) 2, 9, 10","venue":"cs.CV","work_id":"a9ef7688-9d55-4c89-935a-8762165fc75f","year":2024},"citing_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-10T16:23:41.854132Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2505.14683"},"observation_digest":"sha256:f88d4f2916cf75e9b06f10c5dc921f83530d77a76ddd58e6ad6958abf671938c","observation_id":"67e2ff16-9551-4c35-a2cc-7fc008b4854b","resolution":{"observed_at":"2026-05-10T16:23:42.041939Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":"2412.04332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-07-08T00:04:22.401157Z","title":"arXiv preprint arXiv:2412.04332 (2024) 2, 9, 10","venue":"cs.CV","work_id":"a9ef7688-9d55-4c89-935a-8762165fc75f","year":2024},"citing_paper":{"arxiv_id":"2506.15564","last_updated":"2025-09-22T01:24:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-18T15:39:15Z","title":"Show-o2: Improved Native Unified Multimodal Models","version":3},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-05-12T18:51:15.428692Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2506.15564"},"observation_digest":"sha256:cb07cf898113f516f07bca399d467f56de74f5b9309ec924a2a474e28e22a3b0","observation_id":"09c1505d-c155-403f-a089-bbac8913b2f5","resolution":{"observed_at":"2026-05-12T18:51:15.779964Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-08-04T22:36:08.238282Z","title":"Liquid: Language models are scalable multi-modal generators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07295","last_updated":"2026-06-25T06:17:40Z","snapshot_observed_at":"2026-08-04T22:36:03.033298Z","submitted_at":"2025-09-08T23:59:32Z","title":"Reconstruction Alignment Improves Unified Multimodal Models","version":4},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-04T22:36:08.238282Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2509.07295"},"observation_digest":"sha256:63ed7954f31f30485a07d3be145c40582bb3172977b1ffe07ab88392acd8daad","observation_id":"5afcd07c-6d9f-464d-8890-d84d5122f57b","resolution":{"observed_at":"2026-08-04T22:36:08.238282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-08-03T18:57:00.890684Z","title":"Liquid: Language models are scalable and unified multi-modal generators.arXiv preprint arXiv:2412.04332, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.02924","last_updated":"2026-07-20T02:01:50Z","snapshot_observed_at":"2026-08-06T15:38:52.220151Z","submitted_at":"2025-12-02T16:45:25Z","title":"AutoNeural: Co-Designing Vision-Language Models for NPU Inference","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T18:57:00.890684Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2512.02924"},"observation_digest":"sha256:fb8acbef30d31bc7978a685753ed6b0aece491cfc2c91191f6e7275a5a0aff99","observation_id":"b540e1e8-a5c9-400e-a37f-a14975165cb7","resolution":{"observed_at":"2026-08-03T18:57:00.890684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":"2412.04332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-07-08T00:04:22.401157Z","title":"arXiv preprint arXiv:2412.04332 (2024) 2, 9, 10","venue":"cs.CV","work_id":"a9ef7688-9d55-4c89-935a-8762165fc75f","year":2024},"citing_paper":{"arxiv_id":"2604.10949","last_updated":"2026-04-13T03:46:45Z","snapshot_observed_at":"2026-08-02T17:46:44.490061Z","submitted_at":"2026-04-13T03:46:45Z","title":"Pseudo-Unification: Entropy Probing Reveals Divergent Information Patterns in Unified Multimodal Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T16:27:14.491492Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2604.10949"},"observation_digest":"sha256:168401a5e11460ad860ebe84d1dffad1dae7dfecb9c5b892bfbfc158308a9ffe","observation_id":"ed2cb239-2d97-4609-b8e9-b737b8539c91","resolution":{"observed_at":"2026-05-11T08:50:59.197308Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":"2412.04332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-07-08T00:04:22.401157Z","title":"arXiv preprint arXiv:2412.04332 (2024) 2, 9, 10","venue":"cs.CV","work_id":"a9ef7688-9d55-4c89-935a-8762165fc75f","year":2024},"citing_paper":{"arxiv_id":"2605.18115","last_updated":"2026-05-18T09:24:39Z","snapshot_observed_at":"2026-08-06T04:43:08.432770Z","submitted_at":"2026-05-18T09:24:39Z","title":"WinTok: A Win-Win Hybrid Tokenizer via Decomposing Visual Understanding and Generation with Transferable Tokens","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-20T12:04:19.761430Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2605.18115"},"observation_digest":"sha256:bb7d24a35f1e399a55be46cce86892e75595d9ce484ca4249bb85c5056bb271b","observation_id":"45accae2-06e0-437a-a0c2-3dc9140cdc29","resolution":{"observed_at":"2026-05-20T12:08:15.782804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":"2412.04332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-07-08T00:04:22.401157Z","title":"arXiv preprint arXiv:2412.04332 (2024) 2, 9, 10","venue":"cs.CV","work_id":"a9ef7688-9d55-4c89-935a-8762165fc75f","year":2024},"citing_paper":{"arxiv_id":"2606.01503","last_updated":"2026-05-31T23:59:12Z","snapshot_observed_at":"2026-08-02T12:17:24.216194Z","submitted_at":"2026-05-31T23:59:12Z","title":"On the Limits of Token Reduction for Efficient Unified Vision Language Training","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T16:57:56.333595Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2606.01503"},"observation_digest":"sha256:6d76db39410ebc001952a51fa2aa3b53b36adfb3bbbac2207238fbbcb9ba514d","observation_id":"510d55b9-c96c-44f8-8248-8422ac28ebf1","resolution":{"observed_at":"2026-06-28T17:02:24.295561Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":"2412.04332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-07-08T00:04:22.401157Z","title":"arXiv preprint arXiv:2412.04332 (2024) 2, 9, 10","venue":"cs.CV","work_id":"a9ef7688-9d55-4c89-935a-8762165fc75f","year":2024},"citing_paper":{"arxiv_id":"2606.13289","last_updated":"2026-06-11T12:46:07Z","snapshot_observed_at":"2026-08-02T10:42:01.559662Z","submitted_at":"2026-06-11T12:46:07Z","title":"HYDRA-X: Native Unified Multimodal Models with Holistic Visual Tokenizers","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-06-27T07:01:07.362430Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2606.13289"},"observation_digest":"sha256:cfd7fabb8ad57e512efb0f013145ad0c33dd61a1ec5f02826dbafd9cbd33a254","observation_id":"0c738ec6-7764-4a1d-a5fd-22cfe2530c27","resolution":{"observed_at":"2026-07-03T14:38:28.909508Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":"2412.04332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-07-08T00:04:22.401157Z","title":"arXiv preprint arXiv:2412.04332 (2024) 2, 9, 10","venue":"cs.CV","work_id":"a9ef7688-9d55-4c89-935a-8762165fc75f","year":2024},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-07-11T07:46:45.098798Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":1},"reference_index":137,"source":"arxiv_source","source_observed_at":"2026-07-07T23:59:38.702609Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:5dccf2bdd5829714eab3a081d44ce62cae0e971153a65609d24c5ae7babe1497","observation_id":"8f2c5e0c-af6d-4e79-b120-7b19fba7d402","resolution":{"observed_at":"2026-07-08T00:04:22.402454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-07-11T07:46:49.059192Z","title":"arXiv preprint arXiv:2412.04332 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-07-11T07:46:45.098798Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":2},"reference_index":137,"source":"arxiv_source","source_observed_at":"2026-07-11T07:46:49.059192Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:f18e0c8d6f879bb0c3f98d4e41d24f31980ee868da0106f2735a1570f781014c","observation_id":"4b2703cb-d4f9-48e6-a5af-b518d68a27a4","resolution":{"observed_at":"2026-07-11T07:46:49.059192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-08-01T04:29:51.029704Z","title":"arXiv preprint arXiv:2412.04332 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22531","last_updated":"2026-07-24T17:59:39Z","snapshot_observed_at":"2026-08-01T04:29:41.388158Z","submitted_at":"2026-07-24T17:59:39Z","title":"Twins: Learn to Predict Unified Representations with Focal Loss","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-01T04:29:51.029704Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2607.22531"},"observation_digest":"sha256:6ef862937e1c85bea204bb23dcb4cf5194474c39ac480f0913654bb70ed12fca","observation_id":"385d2136-e0a2-4319-94e1-3412150f6711","resolution":{"observed_at":"2026-08-01T04:29:51.029704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-08-01T02:14:09.687868Z","title":"arXiv preprint arXiv:2412.04332 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25527","last_updated":"2026-07-28T10:12:06Z","snapshot_observed_at":"2026-08-03T21:55:22.610961Z","submitted_at":"2026-07-28T10:12:06Z","title":"Argus-Unified: Towards A Compact and Economical Unified Model for Image Understanding and Generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T02:14:09.687868Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2607.25527"},"observation_digest":"sha256:cae6a7ed1178b3327daee398d44a9b28c62f49162ef987c8744b9f5ce2337e3f","observation_id":"2ef15d77-cc04-4d18-80d0-a35ec502ee27","resolution":{"observed_at":"2026-08-01T02:14:09.687868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04332","snapshot_observed_at":"2026-08-06T11:55:28.167608Z","title":"Liquid: Language models are scalable and unified multi-modal generators.arXiv preprint arXiv:2412.04332, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05000","last_updated":"2026-08-05T16:09:25Z","snapshot_observed_at":"2026-08-06T20:00:44.865852Z","submitted_at":"2026-08-05T16:09:25Z","title":"Towards Physics of Multimodal Pretraining: Knowledge Flow, Modality Synergy, Early Unification, and Recipes","version":1},"reference_index":138,"source":"pdf_text","source_observed_at":"2026-08-06T11:55:28.167608Z"},"links":{"cited_paper":"/paper/2412.04332","citing_paper":"/paper/2608.05000"},"observation_digest":"sha256:9eddcaf1e75b546ca502d23e557e3814e8309cd6afbfdef7e48c8c3777b4e4a8","observation_id":"06fe37aa-195e-4ebb-95c9-68e02a64175f","resolution":{"observed_at":"2026-08-06T11:55:28.167608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.04332/citation-record","integrity":"/paper/2412.04332/integrity","json":"/paper/2412.04332/citation-record.json","paper":"/paper/2412.04332"},"outbound":[],"paper":{"arxiv_id":"2412.04332","last_updated":"2025-04-10T18:28:11Z","latest_version":4,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T12:56:37.713692Z","submitted_at":"2024-12-05T16:48:16Z","title":"Liquid: Language Models are Scalable and Unified Multi-modal Generators"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2412.04332."}