{"as_of":"2026-08-06T13:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:239e73733b807c484ceaf98a0b5fca19de0cfa59c3810187af6c719d062b7ee4","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T20:38:06.225705Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T21:18:03.005508Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-19T21:22:48.470135Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2512.19433","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.19433","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","venue":"cs.CV","work_id":"e90563bf-c35c-4b68-81d8-35356c78d3aa","year":2025},"citing_paper":{"arxiv_id":"2505.23606","last_updated":"2026-04-13T07:14:16Z","snapshot_observed_at":"2026-07-06T21:33:02.686798Z","submitted_at":"2025-05-29T16:15:48Z","title":"Muddit: Liberating Generation Beyond Text-to-Image with a Unified Discrete Diffusion Model","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-19T12:59:31.454155Z"},"links":{"cited_paper":"/paper/2512.19433","citing_paper":"/paper/2505.23606"},"observation_digest":"sha256:8af64992255ea24c6349120d963d6b93ea79b66d1cbcad7ff74ef64a82766d73","observation_id":"cff2cb2e-f720-4f6e-9aaa-13989a23adab","resolution":{"observed_at":"2026-05-19T13:02:18.391456Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"cited_work":{"arxiv_id":"2512.19433","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.19433","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","venue":"cs.CV","work_id":"e90563bf-c35c-4b68-81d8-35356c78d3aa","year":2025},"citing_paper":{"arxiv_id":"2605.16842","last_updated":"2026-05-16T06:59:54Z","snapshot_observed_at":"2026-07-06T23:27:57.805018Z","submitted_at":"2026-05-16T06:59:54Z","title":"Sketch Then Paint: Hierarchical Reinforcement Learning for Diffusion Multi-Modal Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-19T21:18:03.005508Z"},"links":{"cited_paper":"/paper/2512.19433","citing_paper":"/paper/2605.16842"},"observation_digest":"sha256:e6ef6a6033ad28c1ff4ae38f73424a630991cc72b36132b040d7c84460f7e154","observation_id":"21d20a71-dd7b-4be5-8d7f-261f920d7e64","resolution":{"observed_at":"2026-05-19T21:22:48.472803Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2512.19433/citation-record","integrity":"/paper/2512.19433/integrity","json":"/paper/2512.19433/citation-record.json","paper":"/paper/2512.19433"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Johnson, Jonathan Ho, Daniel Tar- low, and Rianne van den Berg","venue":null,"work_id":"e19ec983-ae4a-42d5-8a70-ddb045d2e7cb","year":2021},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:7a87022f8e157e7aa7a364e721a616d0df5b6bdafc6d4b12422ac0a044e98fdb","observation_id":"65f5083a-8cc3-4619-98b1-07463d790aff","resolution":{"observed_at":"2026-05-16T20:38:25.218816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"54506754-1e9a-442f-b026-f7f6153ed145","year":2023},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:42fd7231bf84940468f40c4cd37ff88b3e33edfceea07472aab9ae6ffa06a8d6","observation_id":"f0d06e84-05ff-47fb-a5c1-77c3906aab20","resolution":{"observed_at":"2026-05-16T20:38:25.216527Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":"2501.17811","doi":"10.48550/arxiv.2501.17811","metadata_source":"pith","pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","venue":"cs.AI","work_id":"67d9e391-26d1-459e-ab56-07e60511c886","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:9e7d6579b89a439a845563dc5247e9f34f5235518606aeb54a6dd9444667dd07","observation_id":"dc78bb8e-a098-4d54-8d4e-29d4a1367c72","resolution":{"observed_at":"2026-05-16T20:38:24.560495Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.18537","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T21:37:25.450474Z","title":"Tts-var: A test- time scaling framework for visual auto-regressive genera- tion","venue":null,"work_id":"50ab1bf1-b43a-4080-8641-b3c8ee1c5fd8","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:53f89facddd0fc5c781710b23c857657c5f4bd011efb943b02047c4f2b7857da","observation_id":"d54d9ef1-a8d1-4b9d-b1e1-483c5b322e30","resolution":{"observed_at":"2026-05-16T20:38:24.564028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":"2505.14683","doi":"10.48550/arxiv.2505.14683","metadata_source":"pith","pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emerging Properties in Unified Multimodal Pretraining","venue":"cs.CV","work_id":"e0cfd82c-f5d4-44fd-b531-ec73ab0a805b","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:adbf947cd45ab33064cfc2475e0ca8126378001e407f1e490ebbd81cc50cafd1","observation_id":"e7f7812b-587e-4c5c-aa3e-2f662e470395","resolution":{"observed_at":"2026-05-16T20:38:24.557363Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lumina-t2x: Scalable flow-based large diffusion transformer for flexible resolution generation","venue":null,"work_id":"a50a3b3b-4a9a-48b6-ad0e-d594e8a4513e","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:21a68e4d869a9b62146beeeda0d0ccecb6b828e01162a610d10738213fc32af5","observation_id":"bef2c71e-1534-4a91-9094-ab99cce6dc01","resolution":{"observed_at":"2026-05-16T20:38:25.214301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Geneval: An object-focused framework for evaluating text- to-image alignment.Advances in Neural Information Pro- cessing Systems (NeurIPS), 36","venue":null,"work_id":"d099f009-706b-4e88-80c0-ad36e77e3baf","year":2024},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:f0eefbc8cc0e6dcc18f67362c615787f255ea825d785a1a969c46f0866891d22","observation_id":"5f206ea4-c32b-4670-82ee-095090eed136","resolution":{"observed_at":"2026-05-16T20:38:25.188186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling diffusion language models via adap- tation from autoregressive models","venue":null,"work_id":"43ff7647-3153-433a-8b04-7bde19faea82","year":null},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:fb85c2c06cdb93b74cb04c62942919e0a75605b3d13cfe60866223fe5743d777","observation_id":"0fa3ca06-6f35-4228-8010-5901375f39f0","resolution":{"observed_at":"2026-05-16T20:38:25.192653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clipscore: A reference-free evaluation met- ric for image captioning","venue":null,"work_id":"ba3a8bc1-98fe-4d78-8ce4-336b15e7ce70","year":2021},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:bb87bcf6bd7383d9e6d2f01e8f58df234af18260a83dcde5e1d16e8c516a8725","observation_id":"736b3d41-491a-4ba5-9cbc-87304f63e834","resolution":{"observed_at":"2026-05-16T20:38:25.179999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffu- sion probabilistic models.Advances in Neural Information Processing Systems (NeurIPS)","venue":null,"work_id":"bfa89f73-6ae1-4992-8608-ce1e737aab26","year":2020},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:a4ba4c712cb1ae2a8b77058c3697d0aa6d1f1e5e1e19f96be73b567fdbc36fbe","observation_id":"0ded1d3e-bfd9-4f7c-a529-6e05cc0f00a5","resolution":{"observed_at":"2026-05-16T20:38:25.182205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:a84e2512ab948efe3c24172170bab051388aa74e13c82cf4607989426b192ffe","observation_id":"ab0c33f7-4694-4547-87d2-b120fe682341","resolution":{"observed_at":"2026-05-16T20:38:24.500559Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":"2412.16720","doi":"10.48550/arxiv.2412.16720","metadata_source":"pith","pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI o1 System Card","venue":"cs.AI","work_id":"68d3c334-0fc9-49e3-b7b0-a69afae933e2","year":2024},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:ded15e30021890e1ab8e44ac3fbc3e8aab00a22b8d995be0a57e7e547294c06c","observation_id":"8677a576-4fde-4268-aacf-b4747b44ded0","resolution":{"observed_at":"2026-05-16T20:38:24.524386Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flux.https://github.com/ black-forest-labs/flux","venue":null,"work_id":"d47e0075-c1d0-499f-aba7-7028ac36b0ea","year":2024},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:c62e7dc4567226665e94cd7fdc37a11b65002b8ba72d365419913c1aa74747fe","observation_id":"e3bf41a0-b568-45ca-b818-ff27c18376d0","resolution":{"observed_at":"2026-05-16T20:38:25.200679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12271","last_updated":"2025-03-15T21:58:12Z","snapshot_observed_at":"2026-07-06T20:53:18.361404Z","submitted_at":"2025-03-15T21:58:12Z","title":"Reflect-DiT: Inference-Time Scaling for Text-to-Image Diffusion Transformers via In-Context Reflection","version":1},"cited_work":{"arxiv_id":"2503.12271","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.12271","snapshot_observed_at":"2026-07-03T14:38:29.281336Z","title":"Reflect-dit: Inference-time scaling for text-to-image diffu- sion transformers via in-context reflection","venue":null,"work_id":"50885f35-7f76-48ff-9306-47a256fef8ec","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2503.12271","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:7763c54b199d181a7bd721b0fa913d2abe3c6894a1912393b8a65de957956d74","observation_id":"e5c493a0-3d7d-4841-9d6b-733ff71b116d","resolution":{"observed_at":"2026-05-16T20:38:24.507584Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02657","last_updated":"2025-04-24T16:16:27Z","snapshot_observed_at":"2026-08-05T15:40:56.937227Z","submitted_at":"2024-08-05T17:46:53Z","title":"Lumina-mGPT: Illuminate Flexible Photorealistic Text-to-Image Generation with Multimodal Generative Pretraining","version":3},"cited_work":{"arxiv_id":"2408.02657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02657","snapshot_observed_at":"2026-07-04T03:49:30.628376Z","title":"Lumina-mgpt: Illuminate flexible photorealistic text-to-image generation with multimodal gener- ative pretraining, 2024a","venue":null,"work_id":"c0d2d00b-1774-4161-8f99-a6e142cfa281","year":2024},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2408.02657","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:9120d967b558d50942bdbe09799bd70e26887ce61295d71f0508378907095586","observation_id":"5d334b33-de6f-4a3d-a3ab-566b9c84a901","resolution":{"observed_at":"2026-05-16T20:38:24.554015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Discrete diffusion modeling by estimating the ratios of the data dis- tribution","venue":null,"work_id":"65eeb334-c147-4e74-8fd8-f5510ea0cd62","year":2024},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:2b9b8d0b630014193ce687f6a8cc789406c27647415ab6715dc2a7c0ac1d964d","observation_id":"c59834e0-a743-419d-a13a-721c106db13f","resolution":{"observed_at":"2026-05-16T20:38:25.177747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09732","last_updated":"2025-01-16T18:30:37Z","snapshot_observed_at":"2026-07-06T20:22:04.328179Z","submitted_at":"2025-01-16T18:30:37Z","title":"Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps","version":1},"cited_work":{"arxiv_id":"2501.09732","doi":"10.48550/arxiv.2501.09732","metadata_source":"pith","pith_arxiv_id":"2501.09732","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps","venue":"cs.CV","work_id":"e39bf306-0e1f-4ef8-a024-0401d40d08a0","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2501.09732","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:803fe3d6e0e6dd16a673e3d243c08e5e6dd0f5bc9cc178d44910c5a8a60acf6d","observation_id":"b45a99d3-1aee-4131-98e4-9024edb7b6bb","resolution":{"observed_at":"2026-05-20T11:45:17.785272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":"2502.09992","doi":"10.48550/arxiv.2502.09992","metadata_source":"pith","pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Diffusion Models","venue":"cs.CL","work_id":"cce0f4b3-ed4d-4375-b84d-3f01316016c1","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:56a737574c7fb10ed5bd5d61175828ff043782360e1d67154360a50a8c57c8c0","observation_id":"0bbee2b1-de59-4091-b187-3eb2c2dd58da","resolution":{"observed_at":"2026-05-16T20:38:24.510754Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01808","last_updated":"2024-01-03T16:10:07Z","snapshot_observed_at":"2026-08-05T08:58:21.854349Z","submitted_at":"2024-01-03T16:10:07Z","title":"aMUSEd: An Open MUSE Reproduction","version":1},"cited_work":{"arxiv_id":"2401.01808","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.01808","snapshot_observed_at":"2026-07-03T03:57:38.898214Z","title":"amused: An open muse reproduction","venue":null,"work_id":"af9bb68a-a0ea-4606-96a1-160e1dec8db0","year":2024},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2401.01808","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:9292d9d33951d715955d97625714f0ad8c6e6afa77af15452422f1a571d06058","observation_id":"18f50fff-142c-4059-b3e5-f8679a4d1435","resolution":{"observed_at":"2026-05-16T20:38:24.550578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis.Proceedings of the In- ternational Conference on Learning Representations (ICLR)","venue":null,"work_id":"ffef022b-66c1-418c-8724-3274afd52fe0","year":null},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:aced4661055cc3b264a792055f6a870c0c27a81228ce0144c4ac19bb956a690f","observation_id":"cf8dd3fc-8f7d-443f-badc-5e616039c7bd","resolution":{"observed_at":"2026-05-16T20:38:25.190325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lumina- image 2.0: A unified and efficient image generative frame- work.Proceedings of the IEEE International Conference on Computer Vision (ICCV)","venue":null,"work_id":"431d01b1-e3b9-4ec6-a78a-82473b6b065c","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:c2822aa68c63bc34361629b6c746fc0594d05db14be721d163a4685f0dae8afc","observation_id":"299defab-a04a-4204-8521-30bcfec9dc45","resolution":{"observed_at":"2026-05-16T20:38:25.184303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"59b79222-9a06-4db6-b731-b7be584eb900","year":2021},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:1600e5b0a9eb7dd3ca0dac70e5dd92b4de0ff4f939f527c41efa8c96381c4705","observation_id":"83f506e9-11ab-46b3-9a90-0ef89805506f","resolution":{"observed_at":"2026-05-16T20:38:25.186231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"e65f2c93-6bce-4e08-831c-1dee949192bd","year":2022},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:a4065bb2bbce6e9a32b31a186deaaaa1055055420df697cace7f53c2b2f5f61d","observation_id":"ed377402-831b-407a-b462-7f89a393c3f5","resolution":{"observed_at":"2026-05-16T20:38:25.207871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Muddit: Liber- ating generation beyond text-to-image with a unified discrete diffusion model","venue":null,"work_id":"f8770946-1bee-4202-a495-8e5e75d0c219","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:4e334944d648d7cef4878fddb286177041827eb39ff7b8c31d175a17799e7fd3","observation_id":"64a654cf-6ac5-45ed-bd58-20b7682bfd5f","resolution":{"observed_at":"2026-05-16T20:38:25.210148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06848","last_updated":"2025-07-18T17:52:45Z","snapshot_observed_at":"2026-07-06T20:19:55.486841Z","submitted_at":"2025-01-12T15:34:24Z","title":"A General Framework for Inference-time Scaling and Steering of Diffusion Models","version":5},"cited_work":{"arxiv_id":"2501.06848","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.06848","snapshot_observed_at":"2026-07-04T13:09:50.123415Z","title":"A general framework for inference-time scaling and steering of diffusion models","venue":null,"work_id":"9ff11c8a-d659-4c6c-9262-d48f515ace17","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2501.06848","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:1f2c48839048efe07db471f3ca10722c8dda14c49d3d162ba275182a6f20e672","observation_id":"00180444-fc9d-4874-bdad-d1a9920a0164","resolution":{"observed_at":"2026-05-16T20:38:24.514296Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":"2409.18869","doi":"10.48550/arxiv.2409.18869","metadata_source":"pith","pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Emu3: Next-Token Prediction is All You Need","venue":"cs.CV","work_id":"720d288e-fac0-464c-9929-19efd9a52afc","year":2024},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:11dc090be083ceff4be8bf6cb7172cee4cca8af63ba596eda3c6cc7411c12c19","observation_id":"ef16b56f-5f92-41a7-b955-41f8835061f5","resolution":{"observed_at":"2026-05-16T20:38:24.543869Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:e3ce4f2efb457e62f08918681d1a226d7257ddbec650e4543bd491d2790c4acb","observation_id":"d818f328-9552-44a1-8ae5-a5ff1c164246","resolution":{"observed_at":"2026-05-16T20:38:24.540825Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sana: Efficient high- resolution image synthesis with linear diffusion transform- ers.Proceedings of the International Conference on Learn- ing Representations (ICLR)","venue":null,"work_id":"6e534999-4b5c-4477-abf1-12e707098755","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:28e705ee55d482012fe8d6800d87ebd46fb8418ea8be472e9e52bc6fe5217215","observation_id":"37dbb905-08c6-4e00-8201-2cb9c723509f","resolution":{"observed_at":"2026-05-16T20:38:25.202875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sana 1.5: Efficient scaling of training-time and inference-time compute in linear diffusion transformer.Proceedings of the International Conference on Machine Learning (ICML)","venue":null,"work_id":"9fb0259b-de62-40ac-b30d-12e19873cba2","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:be475e6e059c4d5940db30c1225e6b184efa7e66c5028490b2ad1d35319061d8","observation_id":"1b870263-c76d-45d5-ac1f-9551aac673b3","resolution":{"observed_at":"2026-05-16T20:38:25.205472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":"2408.12528","doi":"10.48550/arxiv.2408.12528","metadata_source":"pith","pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","venue":"cs.CV","work_id":"1393dc24-a6b2-44e1-b5d7-7009d1fa4811","year":2024},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:dd069dd9dc5be62991a9ce29aae251bcc927316942798bfdfb9e549aa2713bdb","observation_id":"d3351bb1-0e6e-47a4-a585-4f62a17adb61","resolution":{"observed_at":"2026-05-16T20:38:24.547194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.06308","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:20:05.623462Z","title":"Lumina-dimoo: An omni diffusion large language model for multi-modal generation and understanding","venue":null,"work_id":"564fa918-f290-4779-8c2c-dcc4258252da","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:16f6604f8664469f7e7feb31c8f0fa49b6688ebeb84af7c0f334023f307a8ddb","observation_id":"512da9c3-4cf3-4f78-acf1-f91c881879b9","resolution":{"observed_at":"2026-05-16T20:38:24.537938Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17801","last_updated":"2025-07-23T17:42:13Z","snapshot_observed_at":"2026-07-06T22:01:54.769256Z","submitted_at":"2025-07-23T17:42:13Z","title":"Lumina-mGPT 2.0: Stand-Alone AutoRegressive Image Modeling","version":1},"cited_work":{"arxiv_id":"2507.17801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17801","snapshot_observed_at":"2026-07-02T12:26:57.121388Z","title":"Lumina-mgpt 2.0: Stand-alone autoregressive image modeling","venue":null,"work_id":"2896fd3e-8491-4e55-9d46-cb03727f853f","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2507.17801","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:eeb7e6cfbaf7f8f11e0477e3bbf1a49d9781fff2c6aa4f1d4478f7e74ee7d05e","observation_id":"feb673e6-274a-4997-8d09-7064a73bb1e4","resolution":{"observed_at":"2026-05-16T20:38:24.534551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13032","last_updated":"2025-07-17T12:02:38Z","snapshot_observed_at":"2026-07-06T21:58:38.340770Z","submitted_at":"2025-07-17T12:02:38Z","title":"Resurrect Mask AutoRegressive Modeling for Efficient and Scalable Image Generation","version":1},"cited_work":{"arxiv_id":"2507.13032","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.13032","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Resurrect mask autoregressive modeling for efficient and scalable image generation","venue":null,"work_id":"7e66ead9-cdbc-4c9d-88dc-a3050b45cfb0","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2507.13032","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:5a3a29d61f2f952d4b004e94288cd9e2e73c1fc7e73ee7c12658b5b132827cfd","observation_id":"1310161c-f795-4554-b47c-2c561285cc9a","resolution":{"observed_at":"2026-05-16T20:38:24.531104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation","venue":null,"work_id":"3e6d1eb1-4861-4a91-bc84-b33f6111f79f","year":2023},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:a6a387eab458c1b38dd3b85a106eb477eb8578b522c1c258a1e23e373ae7a050","observation_id":"ce9cb3b7-1c9e-45dd-a978-b8b10e7a0bd6","resolution":{"observed_at":"2026-05-16T20:38:25.198856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15809","last_updated":"2025-09-25T02:40:45Z","snapshot_observed_at":"2026-08-05T05:27:10.277230Z","submitted_at":"2025-05-21T17:59:05Z","title":"MMaDA: Multimodal Large Diffusion Language Models","version":2},"cited_work":{"arxiv_id":"2505.15809","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15809","snapshot_observed_at":"2026-07-11T03:07:51.413936Z","title":"MMaDA: Multimodal Large Diffusion Language Models","venue":"cs.CV","work_id":"9d626cf3-094e-4960-9e71-a00a47158639","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2505.15809","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:1095eed1720becfab85bdacc3687128628224615cba7203ec18b190a2f55c16c","observation_id":"df090975-d48e-4dbf-acf9-6cc62755331b","resolution":{"observed_at":"2026-05-16T20:38:24.504106Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards understanding the working mechanism of text-to-image dif- fusion model.Advances in Neural Information Processing Systems (NeurIPS)","venue":null,"work_id":"b4d5cdfc-9ba1-49e1-8c3d-34f29c112834","year":2024},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:af16b8d5f776aebb57607f6bd45f1ae4606e6ac2e0cbd8a9e5545e080a110fbf","observation_id":"41275aa0-15dd-4336-9322-7128ac8da6ef","resolution":{"observed_at":"2026-05-16T20:38:25.212202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16933","last_updated":"2025-06-04T05:52:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-22T17:23:26Z","title":"LLaDA-V: Large Language Diffusion Models with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2505.16933","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16933","snapshot_observed_at":"2026-07-11T03:07:52.266883Z","title":"LLaDA-V: Large Language Diffusion Models with Visual Instruction Tuning","venue":"cs.LG","work_id":"0cc20892-a1cb-4674-af31-8b884e2a3a79","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2505.16933","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:1f899e11ae34268d5fbb1c28495dbc37725df4cec302dc97b0298c05b63a6fb3","observation_id":"7312622e-1578-4eea-aaf4-5a9bc24a6733","resolution":{"observed_at":"2026-05-17T03:46:06.580274Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19223","last_updated":"2025-10-12T15:42:47Z","snapshot_observed_at":"2026-07-06T21:30:09.658226Z","submitted_at":"2025-05-25T16:36:20Z","title":"LLaDA 1.5: Variance-Reduced Preference Optimization for Large Language Diffusion Models","version":2},"cited_work":{"arxiv_id":"2505.19223","doi":"10.48550/arxiv.2505.19223","metadata_source":"pith","pith_arxiv_id":"2505.19223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaDA 1.5: Variance-Reduced Preference Optimization for Large Language Diffusion Models","venue":"cs.LG","work_id":"ebe72b3e-b18c-4784-8c3d-d7bfda67e098","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"cited_paper":"/paper/2505.19223","citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:e02b5c00bae9b29b386bdf805d0dd4161eb0ede4e154ec258a03b4e03e6575c1","observation_id":"c5e3fe73-6cd6-4814-a38f-2d829c046c5c","resolution":{"observed_at":"2026-05-16T20:38:24.527750Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lumina-next: Making lumina-t2x stronger and faster with next-dit","venue":null,"work_id":"e96c739a-367a-4791-bd2c-746c8842bfc3","year":2024},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:28b7f7b1ccb2fd08c205b7bf2c4363a2dccede9a9faba7d7d27992345c786713","observation_id":"6c8fcc9e-7f6b-4ad3-b5e4-e11522056893","resolution":{"observed_at":"2026-05-16T20:38:25.194741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5da54e26-b108-4b2e-bcfa-c64a9323baa3","year":2025},"citing_paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T20:38:06.225705Z"},"links":{"citing_paper":"/paper/2512.19433"},"observation_digest":"sha256:144915f4a59f0550f472b88a294c89af8f58f4653292bec5296484b874efff5c","observation_id":"9480c05b-fc94-4d75-ac0b-34f3e1e8a593","resolution":{"observed_at":"2026-05-16T20:38:25.196671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2512.19433","last_updated":"2026-04-08T06:02:03Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T08:21:20.873368Z","submitted_at":"2025-12-22T14:31:58Z","title":"dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":20,"verified_fuzzy":18},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 2 inbound Pith citation observations for arXiv:2512.19433."}