{"as_of":"2026-08-08T02:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cfae33b5b093f16475fd9ea1121a0c3d575c45e19660a1c40ca997205f61917c","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T10:59:54.011822Z","state":"measured"},{"denominator":123,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":123,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":45,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:08:32.723442Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2511.13720","last_updated":"2026-01-07T05:36:57Z","snapshot_observed_at":"2026-07-06T22:36:08.495952Z","submitted_at":"2025-11-17T18:59:57Z","title":"Back to Basics: Let Denoising Generative Models Denoise","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-11T22:16:26.996599Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2511.13720"},"observation_digest":"sha256:d725ce2812f9bb3be4603d5aed97608a27156da30edecc25021b58b533c9972e","observation_id":"9a4ba403-0c5a-42db-b951-4a9a467159c3","resolution":{"observed_at":"2026-05-11T22:16:27.646986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2511.19365","last_updated":"2026-04-08T04:08:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-24T17:59:06Z","title":"DeCo: Frequency-Decoupled Pixel Diffusion for End-to-End Image Generation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-17T05:47:24.669763Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2511.19365"},"observation_digest":"sha256:e00f0611c8ad0f67d223524dd589dd2aa5b362bab7369c697ae8170df8c00871","observation_id":"2636d442-e3a0-4bb5-9808-0db4b105cab7","resolution":{"observed_at":"2026-05-17T05:49:08.329370Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2511.20645","last_updated":"2026-04-16T17:04:25Z","snapshot_observed_at":"2026-08-07T01:34:34.936041Z","submitted_at":"2025-11-25T18:59:25Z","title":"PixelDiT: Pixel Diffusion Transformers for Image Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T04:30:07.417197Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2511.20645"},"observation_digest":"sha256:88188805e2a2a62d9682e95e7dd8c780aa9bc0a4fb143664086a00f32370f17f","observation_id":"b80c3618-e054-4934-b4c3-aa5c92c6f085","resolution":{"observed_at":"2026-05-17T04:31:31.147210Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-03T14:53:02.682342Z","title":"Pixnerd: Pixel neural field diffusion.arXiv preprint arXiv:2507.23268, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.19311","last_updated":"2026-07-12T14:26:35Z","snapshot_observed_at":"2026-08-07T18:54:26.140556Z","submitted_at":"2025-12-22T12:00:12Z","title":"MixFlow Training: Alleviating Exposure Bias with Slowed Interpolation Mixture","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T14:53:02.682342Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2512.19311"},"observation_digest":"sha256:7e4aa695854a0e9cb62a178529bacbf559481da633bfb6900ab8a966016f0494","observation_id":"fd0bc562-bfdb-460a-a208-93b8e7f8c989","resolution":{"observed_at":"2026-08-03T14:53:02.682342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2602.02493","last_updated":"2026-05-07T09:10:25Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T18:59:42Z","title":"PixelGen: Improving Pixel Diffusion with Perceptual Supervision","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T07:54:20.712620Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2602.02493"},"observation_digest":"sha256:caf5575398c815d6e1c49b5fc5b4baf74e37f419484eaff20b230674eb964c60","observation_id":"698a6b94-3a5a-4420-a54e-83bfca4a18fc","resolution":{"observed_at":"2026-05-16T07:57:33.233070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-03T01:25:19.705115Z","title":"Pixnerd: Pixel neural field diffusion.arXiv preprint arXiv:2507.23268, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10099","last_updated":"2026-07-03T15:19:24Z","snapshot_observed_at":"2026-08-06T13:27:43.962812Z","submitted_at":"2026-02-10T18:58:04Z","title":"Learning on the Manifold: Unlocking Standard Diffusion Transformers with Representation Encoders","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T01:25:19.705115Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2602.10099"},"observation_digest":"sha256:181f0c00842bdb0d595e718368053ccb5e4fb853dbf714f166b062362df00bcc","observation_id":"eda630be-4b6e-4800-ad88-7fa0895801be","resolution":{"observed_at":"2026-08-03T01:25:19.705115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.11521","last_updated":"2026-04-13T14:23:31Z","snapshot_observed_at":"2026-07-31T08:57:40.954187Z","submitted_at":"2026-04-13T14:23:31Z","title":"Continuous Adversarial Flow Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-10T15:25:53.420119Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.11521"},"observation_digest":"sha256:79a32aad458025abdb2697503782f2489621eb8d418ccf4bb2b1fb1830db8d1c","observation_id":"bca9935b-5b2c-4163-9645-3ef9e60f9319","resolution":{"observed_at":"2026-05-11T10:31:05.071376Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.12525","last_updated":"2026-04-15T01:25:27Z","snapshot_observed_at":"2026-08-07T07:03:02.391631Z","submitted_at":"2026-04-14T09:56:25Z","title":"CoD-Lite: Real-Time Diffusion-Based Generative Image Compression","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T15:07:36.152482Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.12525"},"observation_digest":"sha256:1c26fc3687e84db3d687811bcc6024428a6cfd06f32e5973c1db0b4ef8610b43","observation_id":"89976e47-ee42-4646-89c7-2abf47801283","resolution":{"observed_at":"2026-05-11T11:11:04.259104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.16558","last_updated":"2026-04-17T08:39:56Z","snapshot_observed_at":"2026-07-06T23:03:52.631613Z","submitted_at":"2026-04-17T08:39:56Z","title":"Cross-Modal Generation: From Commodity WiFi to High-Fidelity mmWave and RFID Sensing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T08:14:04.769153Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.16558"},"observation_digest":"sha256:4b25ee83a9fa9c3b5ac00b27d9df9bd7e0d4f7d74ba078048bb181d68df48c19","observation_id":"76dcac84-433e-40da-b914-8ddaaeb8522c","resolution":{"observed_at":"2026-05-10T08:17:37.552218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.17492","last_updated":"2026-04-19T15:29:15Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T15:29:15Z","title":"Coevolving Representations in Joint Image-Feature Diffusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T06:30:52.371482Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.17492"},"observation_digest":"sha256:553122e919bf3a22a1262d512716939fe42d236af51f24d6fc13952423a25203","observation_id":"1aa53b58-6b0e-4bd5-b4e6-b669e71760c3","resolution":{"observed_at":"2026-05-10T06:31:30.449718Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.20041","last_updated":"2026-04-21T22:52:26Z","snapshot_observed_at":"2026-07-06T23:06:35.507008Z","submitted_at":"2026-04-21T22:52:26Z","title":"Normalizing Flows with Iterative Denoising","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T02:11:31.246200Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.20041"},"observation_digest":"sha256:2f54ba77d34d775753bc039ac439735f289c8283575b08d05886105d8c5fe44f","observation_id":"b1b5c675-50cf-4b17-bf49-bb280cc3fe5a","resolution":{"observed_at":"2026-05-11T13:11:19.800237Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2604.21984","last_updated":"2026-04-27T04:48:56Z","snapshot_observed_at":"2026-07-06T23:08:28.444591Z","submitted_at":"2026-04-23T18:07:27Z","title":"Soft Anisotropic Diagrams for Differentiable Image Representation","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-09T21:45:13.698356Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2604.21984"},"observation_digest":"sha256:67c81fb4cae3c5bf91f87d9bc8ed795e375da96baa33b03dde73c26c8010821e","observation_id":"867a8d2c-0f9f-45f8-ae51-3dab21cac7d6","resolution":{"observed_at":"2026-05-09T21:48:36.648657Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.06421","last_updated":"2026-07-28T07:17:48Z","snapshot_observed_at":"2026-08-02T14:48:28.958067Z","submitted_at":"2026-05-07T15:27:46Z","title":"FREPix: Frequency-Heterogeneous Flow Matching for Pixel-Space Image Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T13:24:49.746981Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.06421"},"observation_digest":"sha256:4ced62a3ac327875b8759272b236cb834ead2554a605042fae14a0b58f3d478e","observation_id":"dd36c717-2c3f-43bf-908b-c86de742f2ee","resolution":{"observed_at":"2026-05-11T18:56:06.096986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-02T14:48:31.731548Z","title":"Pixnerd: Pixel neural field diffusion.arXiv preprint arXiv:2507.23268, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.06421","last_updated":"2026-07-28T07:17:48Z","snapshot_observed_at":"2026-08-02T14:48:28.958067Z","submitted_at":"2026-05-07T15:27:46Z","title":"FREPix: Frequency-Heterogeneous Flow Matching for Pixel-Space Image Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T14:48:31.731548Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.06421"},"observation_digest":"sha256:bf58c7abe765bfe0e36d76a7802845bb3fad58fd81e4426ce28fcf56228840ab","observation_id":"c4e3a370-0e2c-4bbb-ae91-15a5e3d5e418","resolution":{"observed_at":"2026-08-02T14:48:31.731548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.12013","last_updated":"2026-05-12T12:01:35Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T12:01:35Z","title":"L2P: Unlocking Latent Potential for Pixel Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T07:12:28.181595Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.12013"},"observation_digest":"sha256:42d9d5cfd1bf8003364a94d857fb20a65879e93b6f497dbe06c7defedeeda932","observation_id":"25814439-ceb4-4680-a6ab-8dcf75f16bbe","resolution":{"observed_at":"2026-05-13T07:17:29.781919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.15741","last_updated":"2026-06-03T01:59:39Z","snapshot_observed_at":"2026-07-06T23:27:01.213106Z","submitted_at":"2026-05-15T08:51:55Z","title":"HyperDiT: Hyper-Connected Transformers for High-Fidelity Pixel-Space Diffusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T19:08:26.689023Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.15741"},"observation_digest":"sha256:d9a672d91399a51f14181e78e45dd0a30826f862d6e6a6778b5bdec84b9eb6c5","observation_id":"b7d7446c-c897-4846-ba0b-992726044a3b","resolution":{"observed_at":"2026-05-20T19:08:54.005833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.15741","last_updated":"2026-06-03T01:59:39Z","snapshot_observed_at":"2026-07-06T23:27:01.213106Z","submitted_at":"2026-05-15T08:51:55Z","title":"HyperDiT: Hyper-Connected Transformers for High-Fidelity Pixel-Space Diffusion","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T19:33:53.876614Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.15741"},"observation_digest":"sha256:cb33cf54bef8cd5a0f6806bb62b04714035e47a0add0d1e95e377c7639e43161","observation_id":"8e6fdf2e-b99c-4e03-8693-69897a895eee","resolution":{"observed_at":"2026-06-30T19:35:00.961632Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.17759","last_updated":"2026-05-18T02:25:07Z","snapshot_observed_at":"2026-08-01T22:43:12.616139Z","submitted_at":"2026-05-18T02:25:07Z","title":"FrequencyBooster: Full-Frequency Modeling for High-Fidelity Pixel Diffusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T12:43:58.746650Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.17759"},"observation_digest":"sha256:0f970c279e7763084591743de03561708693aa1645054386587126f206756517","observation_id":"9a442605-5bd9-4070-9c1a-fe04addd3e7d","resolution":{"observed_at":"2026-05-20T12:48:17.641600Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T11:59:54.139888Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:e3d428477fdc5aa5c1738a3298998047e7a7bc21c0845d4531a3b3f7e24382e8","observation_id":"88d039c6-6602-45f8-8544-37539c525e6c","resolution":{"observed_at":"2026-05-20T12:03:15.355563Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T18:39:40.667006Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:0f6cb7ad8a7791aaacfdc3bf53f4622f51cd306949519456a69257d98b208bb1","observation_id":"e2b33ecc-ae3e-4fcb-a1e9-06e23bc9f129","resolution":{"observed_at":"2026-06-30T19:15:01.305909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-02T13:49:19.275389Z","title":"Pixnerd: Pixel neural field diffusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T13:49:19.275389Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:76ed40a203715d513cc3d7654dea997176a40149c268248ed1e2953503adb8c6","observation_id":"165f07d7-e767-4e66-b121-2203ed04eef2","resolution":{"observed_at":"2026-08-02T13:49:19.275389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.20147","last_updated":"2026-05-19T17:35:09Z","snapshot_observed_at":"2026-07-06T23:30:44.092395Z","submitted_at":"2026-05-19T17:35:09Z","title":"PixVerve: Advancing Native UHR Image Generation to 100MP with a Large-Scale High-Quality Dataset","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-20T05:19:30.372528Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.20147"},"observation_digest":"sha256:a7f9ef2a578479cd0956ebc0869352f3b15d2420d5073b811de58203d465232d","observation_id":"34c15862-92a3-4d0e-a9b9-bfc26773722b","resolution":{"observed_at":"2026-05-20T05:23:03.893326Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.21981","last_updated":"2026-05-21T04:21:43Z","snapshot_observed_at":"2026-07-06T23:32:20.708664Z","submitted_at":"2026-05-21T04:21:43Z","title":"RiT: Vanilla Diffusion Transformers Suffice in Representation Space","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T07:50:29.461854Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.21981"},"observation_digest":"sha256:de12fac58d5d1a857d98adf6e49f6d0f2d6fb63a339ca0bda23ae5772d8961ae","observation_id":"771fa597-21c5-4501-b5c5-6f2f1b84eb9d","resolution":{"observed_at":"2026-05-22T07:51:15.925358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2605.31604","last_updated":"2026-07-03T09:50:38Z","snapshot_observed_at":"2026-08-03T15:39:37.184662Z","submitted_at":"2026-05-29T17:59:55Z","title":"Representation Forcing for Bottleneck-Free Unified Multimodal Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T22:54:10.460872Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.31604"},"observation_digest":"sha256:4b27e2e4788a8bceef9654fd069684f2c239ba2acf6fdf01187f3cf07a2d4144","observation_id":"eb760fe6-10a6-43e0-88dd-318163137173","resolution":{"observed_at":"2026-07-01T19:16:00.947424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-07-12T15:31:57.426559Z","title":"PixNerd: Pixel neural field diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.31604","last_updated":"2026-07-03T09:50:38Z","snapshot_observed_at":"2026-08-03T15:39:37.184662Z","submitted_at":"2026-05-29T17:59:55Z","title":"Representation Forcing for Bottleneck-Free Unified Multimodal Models","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-12T15:31:57.426559Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2605.31604"},"observation_digest":"sha256:30ff5ff34b1ff974d0919d28d41f8446744b8d19beb1fd32b77ab64f61ef9ff3","observation_id":"3963e05a-db2e-43bd-9c65-33860daaead3","resolution":{"observed_at":"2026-07-12T15:31:57.426559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.03455","last_updated":"2026-06-02T10:33:20Z","snapshot_observed_at":"2026-08-05T18:48:21.902772Z","submitted_at":"2026-06-02T10:33:20Z","title":"WavTTS: Towards High-Quality Zero-Shot TTS via Direct Raw Waveform Modeling","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-28T08:18:42.002083Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.03455"},"observation_digest":"sha256:b2495bcf6ce8a38341ffd318a76781acf061cd14ba1ffbcc3afad423d82fc8ad","observation_id":"550fec21-15f1-4126-bb4e-0a2ef6a59556","resolution":{"observed_at":"2026-07-02T05:16:39.848770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.09048","last_updated":"2026-06-08T05:36:42Z","snapshot_observed_at":"2026-07-06T23:48:26.076260Z","submitted_at":"2026-06-08T05:36:42Z","title":"BareWave: Waveform-Native Flow-Matching Text-to-Speech","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T15:14:03.681833Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.09048"},"observation_digest":"sha256:e1f5edf3ed9306963efb3f8b9ffec9e786fef92045938993529c513f74f78de9","observation_id":"394dec80-c8cf-4a27-a695-71d650af5b02","resolution":{"observed_at":"2026-07-03T03:37:35.212704Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.24888","last_updated":"2026-06-23T17:59:55Z","snapshot_observed_at":"2026-07-06T23:59:23.407216Z","submitted_at":"2026-06-23T17:59:55Z","title":"DiffusionBench: On Holistic Evaluation of Diffusion Transformers","version":1},"reference_index":171,"source":"arxiv_source","source_observed_at":"2026-06-26T00:06:11.951205Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.24888"},"observation_digest":"sha256:051c1ca44c587cb7fd71b505300f8ab9ecf6a3eeb4a36673f64462e4524ffc59","observation_id":"ec1791d9-f5fc-46de-ae9a-3078e7eb8099","resolution":{"observed_at":"2026-07-04T16:59:57.884703Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.26016","last_updated":"2026-07-08T10:57:01Z","snapshot_observed_at":"2026-08-02T07:36:10.167129Z","submitted_at":"2026-06-24T16:37:10Z","title":"MIMFlow: Integrating Masked Image Modeling with Normalizing Flows for End-to-End Image Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-25T19:34:02.046104Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.26016"},"observation_digest":"sha256:dc117c13039cef3265bbf17e2c0d17a79c1575c8a0c3f8cfb1230510a5349bb2","observation_id":"e8c5502d-25ca-484a-8350-64ab7815a91b","resolution":{"observed_at":"2026-07-04T20:50:11.427651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.27760","last_updated":"2026-06-26T06:39:06Z","snapshot_observed_at":"2026-07-31T06:11:06.764017Z","submitted_at":"2026-06-26T06:39:06Z","title":"PixelU: A U-Shaped Transformer for Efficient End-to-End Pixel Diffusion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-29T04:31:57.169935Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.27760"},"observation_digest":"sha256:8a3db96e38eb1737a00735b9eca6906ba6bc014ced380751c3d77a19dfb6d255","observation_id":"0e5f91c9-dd49-4992-96cc-c28adce46b2b","resolution":{"observed_at":"2026-06-29T20:03:57.206271Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2606.27978","last_updated":"2026-06-26T11:27:39Z","snapshot_observed_at":"2026-08-03T23:56:14.294002Z","submitted_at":"2026-06-26T11:27:39Z","title":"Parallel Rollout Approximation for Pixel-Space Autoregressive Image Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T04:58:23.066578Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2606.27978"},"observation_digest":"sha256:0bd8d5d7843ae8de16a7b80f90b538d0f008b9d7fbd554118ca15ee6be4227a0","observation_id":"c598a02c-4799-443c-80ee-43fe9f1c2e98","resolution":{"observed_at":"2026-06-29T19:03:52.166667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":"2507.23268","doi":"10.48550/arxiv.2507.23268","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pixnerd: Pixel neural field diffusion","venue":"ArXiv.org","work_id":"74b9a257-28df-4dea-85a1-68d091aba6b8","year":2025},"citing_paper":{"arxiv_id":"2607.01803","last_updated":"2026-07-04T06:58:16Z","snapshot_observed_at":"2026-08-02T02:22:21.215897Z","submitted_at":"2026-07-02T07:18:37Z","title":"PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-03T16:13:41.928049Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.01803"},"observation_digest":"sha256:c3fe4d2321a6da53b20eb709265d3c47dbecdc6907f441a7656f924cd292d42b","observation_id":"02a70814-6b68-4e17-8ead-39a1b5b165d3","resolution":{"observed_at":"2026-07-03T16:18:37.485853Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-07-12T08:36:06.846852Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.01803","last_updated":"2026-07-04T06:58:16Z","snapshot_observed_at":"2026-08-02T02:22:21.215897Z","submitted_at":"2026-07-02T07:18:37Z","title":"PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-12T08:36:06.846852Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.01803"},"observation_digest":"sha256:86daeb6573bbf2e7803b593f7c3cc661c1d2599a480d74f6da79685484db299b","observation_id":"8e31eb1d-0c48-4c42-8638-5f496ee4c250","resolution":{"observed_at":"2026-07-12T08:36:06.846852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-01T22:56:39.912445Z","title":"Pixnerd: Pixel neural field diffusion.arXiv preprint arXiv:2507.23268, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15585","last_updated":"2026-07-17T03:07:18Z","snapshot_observed_at":"2026-08-07T05:26:15.284663Z","submitted_at":"2026-07-17T03:07:18Z","title":"SPEED: One-Step Pixel Diffusion for High-quality Video Frame Interpolation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T22:56:39.912445Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.15585"},"observation_digest":"sha256:bc209959e0302b142072bacd2ef55e58eaf3b80bf96df0e2f257c7f2bef2d934","observation_id":"a3fcabf2-b53c-4664-8dfa-812fda7d4e10","resolution":{"observed_at":"2026-08-01T22:56:39.912445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-01T17:35:33.745950Z","title":"Pixnerd: Pixel neural field diffusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17585","last_updated":"2026-07-22T07:24:13Z","snapshot_observed_at":"2026-08-06T07:20:20.809986Z","submitted_at":"2026-07-20T06:04:08Z","title":"Pixel-Space Diffusion Transformers","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T17:35:33.745950Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.17585"},"observation_digest":"sha256:ba7948e08d5322c5b5366fe2fad6209d0ca365d58e62c4df79a3a21278f82410","observation_id":"16085e59-096f-4278-b340-4a540fc17d9d","resolution":{"observed_at":"2026-08-01T17:35:33.745950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-01T15:16:51.997812Z","title":"Pixnerd: Pixel neural field diffusion.arXiv preprint arXiv:2507.23268, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18510","last_updated":"2026-07-20T21:08:56Z","snapshot_observed_at":"2026-08-06T08:17:30.075438Z","submitted_at":"2026-07-20T21:08:56Z","title":"DuSPiT: Dual-Branch Sub-Patch Pixel Diffusion Transformer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T15:16:51.997812Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.18510"},"observation_digest":"sha256:58315a01e8f1fd3978c24f19e897ce2d24847a950226c38e07a68fa677b4952f","observation_id":"6a30bd83-8347-42b0-a6a8-39209ce4b62c","resolution":{"observed_at":"2026-08-01T15:16:51.997812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-01T11:10:14.438729Z","title":"Pixnerd: Pixel neural field diffusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19986","last_updated":"2026-07-22T10:19:43Z","snapshot_observed_at":"2026-08-07T21:44:11.373202Z","submitted_at":"2026-07-22T10:19:43Z","title":"STEREOFLOW: Progressive Stereo Matching with StereoDiT and Transition Flow Matching","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-08-01T11:10:14.438729Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.19986"},"observation_digest":"sha256:516e20ed520527c60669cbfb4a516c26961fd493bf8cdacc92c62c7a293f6f2c","observation_id":"c8a4f1bc-aaf3-4e7e-8012-7e731602c8ad","resolution":{"observed_at":"2026-08-01T11:10:14.438729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-01T04:30:08.106487Z","title":"arXiv preprint arXiv:2507.23268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22531","last_updated":"2026-07-24T17:59:39Z","snapshot_observed_at":"2026-08-07T13:04:18.211748Z","submitted_at":"2026-07-24T17:59:39Z","title":"Twins: Learn to Predict Unified Representations with Focal Loss","version":1},"reference_index":236,"source":"arxiv_source","source_observed_at":"2026-08-01T04:30:08.106487Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.22531"},"observation_digest":"sha256:aa7368d4ed85c79c592afe8275b46dfa19ae7ec2b095cf90417a49e5904596ac","observation_id":"c5f51ebe-82d7-4230-bc8c-cd2ad0b6c7e0","resolution":{"observed_at":"2026-08-01T04:30:08.106487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-07-30T18:58:28.472063Z","title":"arXiv preprint arXiv:2507.23268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26860","last_updated":"2026-07-29T12:44:19Z","snapshot_observed_at":"2026-08-06T09:28:43.159690Z","submitted_at":"2026-07-29T12:44:19Z","title":"Amortized Moment Matching for Visual Generation","version":1},"reference_index":145,"source":"arxiv_source","source_observed_at":"2026-07-30T18:58:28.472063Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.26860"},"observation_digest":"sha256:cea67adf018b67965ec37593bfe3e68b451ac8107160d0f1992eb69ea75bf1e1","observation_id":"9bc2fdaa-3c9d-46d5-b490-527e801d9193","resolution":{"observed_at":"2026-07-30T18:58:28.472063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-03T00:34:35.546032Z","title":"PixNerd: Pixel neural field diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28760","last_updated":"2026-07-30T18:26:19Z","snapshot_observed_at":"2026-08-06T02:19:22.424309Z","submitted_at":"2026-07-30T18:26:19Z","title":"WaiT for the Signal: Simple Frequency-Aware Flow-Matching","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T00:34:35.546032Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.28760"},"observation_digest":"sha256:0df0c3d03aac6442141cd4dddcc6ab39c65abb659f8e4ff26751cf4bd3bbfc25","observation_id":"e2974533-4f18-42f0-afa4-b545b9d33fea","resolution":{"observed_at":"2026-08-03T00:34:35.546032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-03T13:23:49.050470Z","title":"arXiv preprint arXiv:2507.23268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29122","last_updated":"2026-07-31T07:52:08Z","snapshot_observed_at":"2026-08-08T01:44:11.895032Z","submitted_at":"2026-07-31T07:52:08Z","title":"A Frozen Pixel-Space Diffusion Model Can Guide Itself with Its Own Samples","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-03T13:23:49.050470Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.29122"},"observation_digest":"sha256:10e1dd066f36a644aa63cdb2f570e6bb66691e27cfe5566989a41a99bed7407b","observation_id":"6ac64400-5051-40bd-8e47-f9561f9d6f4b","resolution":{"observed_at":"2026-08-03T13:23:49.050470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-03T08:35:55.479259Z","title":"Pixnerd: Pixel neural field diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29363","last_updated":"2026-07-31T12:51:24Z","snapshot_observed_at":"2026-08-05T23:15:08.967026Z","submitted_at":"2026-07-31T12:51:24Z","title":"Stable Autoregressive Speech Generation with Low-Frame-Rate High-Dimensional Continuous Tokens","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-03T08:35:55.479259Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2607.29363"},"observation_digest":"sha256:c345ab7b38f2e32320e6802e5a984455388db58b8a2d140ab20d74f279a64d35","observation_id":"a84ee794-56e3-4c3b-8a00-67240b39af5e","resolution":{"observed_at":"2026-08-03T08:35:55.479259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-05T00:44:17.024044Z","title":"arXiv preprint arXiv:2507.23268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00562","last_updated":"2026-08-01T10:00:42Z","snapshot_observed_at":"2026-08-06T23:17:27.773498Z","submitted_at":"2026-08-01T10:00:42Z","title":"Beyond Token-Level Cross-Entropy: Fr\\'echet Distributional Post-Training for Autoregressive Image Generation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T00:44:17.024044Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2608.00562"},"observation_digest":"sha256:6019e6ca44e5e062ff8d6c27ebb5a984856ebbcfd8cf9077637bcd83adac774b","observation_id":"978693c8-3bce-4984-b593-5bfa0acc6e3c","resolution":{"observed_at":"2026-08-05T00:44:17.024044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-06T15:55:49.613668Z","title":"arXiv:2507.23268","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04818","last_updated":"2026-08-05T13:22:43Z","snapshot_observed_at":"2026-08-08T02:12:44.850423Z","submitted_at":"2026-08-05T13:22:43Z","title":"Rethinking Pixel Mean Flows via Interval Denoiser","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:55:49.613668Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2608.04818"},"observation_digest":"sha256:7d8352651487824548c3ea408cca6aa8d2e7134fc1da637260a7eabc4ca5c1d8","observation_id":"67765856-ebff-432b-a69c-397b97b87296","resolution":{"observed_at":"2026-08-06T15:55:49.613668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.23268","snapshot_observed_at":"2026-08-07T23:08:32.723442Z","title":"arXiv preprint arXiv:2507.23268 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05811","last_updated":"2026-08-06T09:44:00Z","snapshot_observed_at":"2026-08-08T02:17:02.703641Z","submitted_at":"2026-08-06T09:44:00Z","title":"Energy-Guided Flow Matching","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T23:08:32.723442Z"},"links":{"cited_paper":"/paper/2507.23268","citing_paper":"/paper/2608.05811"},"observation_digest":"sha256:f54240e51f4d7a221e69986b0bd85aa2c3af2ca7ac678f14f34308a819def2c2","observation_id":"8da19eea-a026-4635-bb5c-7d37417e1ee2","resolution":{"observed_at":"2026-08-07T23:08:32.723442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.23268/citation-record","integrity":"/paper/2507.23268/integrity","json":"/paper/2507.23268/citation-record.json","paper":"/paper/2507.23268"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.919084Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"b7987c4c-3983-4f42-821e-c20b3418d498","year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.466775Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:f8a3d4217ea03afdcb625980d492beeced0aa2059b69dfed0f9640b9ff10185e","observation_id":"96fd7a67-89cb-43ee-8770-41aa4815ab6a","resolution":{"observed_at":"2026-08-06T10:59:55.924849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01423","last_updated":"2025-03-10T11:43:42Z","snapshot_observed_at":"2026-08-06T01:13:01.484290Z","submitted_at":"2025-01-02T18:59:40Z","title":"Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01423","snapshot_observed_at":"2026-08-06T10:59:53.473492Z","title":"Reconstruction vs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.473492Z"},"links":{"cited_paper":"/paper/2501.01423","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:e235c219843866940d9bc39ebe039d7462948710a6c16263e482dff3594a8f8a","observation_id":"7dc8fd61-c9cd-4a30-b492-7dd3f91223b9","resolution":{"observed_at":"2026-08-06T10:59:53.473492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10733","last_updated":"2025-05-18T21:17:22Z","snapshot_observed_at":"2026-07-06T19:33:12.610676Z","submitted_at":"2024-10-14T17:15:07Z","title":"Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10733","snapshot_observed_at":"2026-08-06T10:59:53.479817Z","title":"Deep compression autoencoder for efficient high-resolution diffusion models.arXiv preprint arXiv:2410.10733, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.479817Z"},"links":{"cited_paper":"/paper/2410.10733","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:8e572af032ca3c91e8884a83a5fe274ed034eaecb271b89a17f4503a97f8ac42","observation_id":"f3dd9cc4-55f2-43c0-b42d-db7e68516358","resolution":{"observed_at":"2026-08-06T10:59:53.479817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-06T10:59:53.488694Z","title":"Large scale gan training for high fidelity natural image synthesis.arXiv preprint arXiv:1809.11096, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.488694Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:b63e11ad1e4568385c3d00e656153b979f5d708b405218322c77b338577cb7c6","observation_id":"7ff2ac42-a1d1-4a32-a7d2-5d17f6f1c768","resolution":{"observed_at":"2026-08-06T10:59:53.488694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.904281Z","title":"Stylegan-xl: Scaling stylegan to large diverse datasets","venue":null,"work_id":"2a96825c-5645-48e3-bc09-7030825b0ed2","year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.496310Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:db4453161d462d29fcae8449b0b2dd0907d06b1700f5c0b8824729fc144afc1f","observation_id":"9760d303-2cf2-4e6b-920b-6392f410a0ac","resolution":{"observed_at":"2026-08-06T10:59:55.909157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.887454Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"254da452-214e-4b6e-b6b8-5ca0dc91b362","year":2018},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.504783Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:54478262598a3abd5219b85c233184091dda2df68068626aaa6cef7ad365cd36","observation_id":"a31cd441-0277-48a0-907e-20b52a11fc94","resolution":{"observed_at":"2026-08-06T10:59:55.892714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:53.510997Z","title":"Repa-e: Unlocking vae for end-to-end tuning with latent diffusion transformers.arXiv preprint arXiv:2504.10483,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.510997Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:54b818c5198b77885e2c66d0937e3b9e81b62c4a52e3fd45d784a87cb95f7fe6","observation_id":"dbde549e-f075-44d2-9a2c-eeeb03a6afd8","resolution":{"observed_at":"2026-08-06T10:59:53.510997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.871346Z","title":"Diffusion models beat gans on image synthesis.Advances in neural information processing systems, 34:8780–8794, 2021","venue":null,"work_id":"892352bc-e02c-4e71-bc3a-9a779589473f","year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.516839Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:1a64384cadbb9840d6f91a6436f9bde3abe5e3389379a95d275547cabd85979f","observation_id":"d058c70a-7984-41fd-a228-f0920a6a73f4","resolution":{"observed_at":"2026-08-06T10:59:55.876750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07963","last_updated":"2025-04-10T17:59:56Z","snapshot_observed_at":"2026-08-07T16:06:44.998749Z","submitted_at":"2025-04-10T17:59:56Z","title":"PixelFlow: Pixel-Space Generative Models with Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07963","snapshot_observed_at":"2026-08-06T10:59:53.523420Z","title":"Pixelflow: Pixel-space generative models with flow.arXiv preprint arXiv:2504.07963, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.523420Z"},"links":{"cited_paper":"/paper/2504.07963","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:c0ca50d8031751bae9e42f2517231abd204e74a1cff06f6f28afc5366cbb8aaa","observation_id":"f7b969ef-c99a-417f-a9f5-f508966d6c65","resolution":{"observed_at":"2026-08-06T10:59:53.523420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03350","last_updated":"2023-09-04T15:00:33Z","snapshot_observed_at":"2026-07-06T16:15:27.717075Z","submitted_at":"2023-09-04T15:00:33Z","title":"Relay Diffusion: Unifying diffusion process across resolutions for image synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03350","snapshot_observed_at":"2026-08-06T10:59:53.530303Z","title":"Relay diffusion: Unifying diffusion process across resolutions for image synthesis.arXiv preprint arXiv:2309.03350, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.530303Z"},"links":{"cited_paper":"/paper/2309.03350","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:4830e4be16da9101082878d76538183b68720c4919691187a16af17eb105396f","observation_id":"9bf2a504-67d4-4324-a21b-9225eef9b16a","resolution":{"observed_at":"2026-08-06T10:59:53.530303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.855996Z","title":"Nerf: Representing scenes as neural radiance fields for view synthesis.Communications of the ACM, 65(1):99–106, 2021","venue":null,"work_id":"3f923d0f-c481-448d-887e-5d61da16b17a","year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.537881Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:52b93d01f082db27689ecb5ae2d80fb45c3b56c2ce1a82523d3c36708bf61214","observation_id":"bc48f103-38de-4e66-941c-b54f84062b06","resolution":{"observed_at":"2026-08-06T10:59:55.860949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.838927Z","title":"Implicit neural representations with periodic activation functions.Advances in neural information processing systems, 33:7462–7473, 2020","venue":null,"work_id":"82ba8d1e-d672-441d-9efd-38514df76510","year":2020},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.543906Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:710cfd7da79580c0c65edee57ec2c17692e64598bea9c940cbdd00a647af6bce","observation_id":"16e8c55f-ae56-44ec-905d-d2f226e2c9bf","resolution":{"observed_at":"2026-08-06T10:59:55.844676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.822786Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"fdf0c471-1613-4028-a5e1-801c05f5532f","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.551173Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:5b24b110af9edcedb53469563c1439f93d6e9f877729d20e164205bf45286f30","observation_id":"0dddf612-161e-41e7-9474-fac0aed4a6bc","resolution":{"observed_at":"2026-08-06T10:59:55.828157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08740","last_updated":"2024-09-23T15:59:41Z","snapshot_observed_at":"2026-08-07T23:50:09.060564Z","submitted_at":"2024-01-16T18:55:25Z","title":"SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08740","snapshot_observed_at":"2026-08-06T10:59:53.556391Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable interpolant transformers.arXiv preprint arXiv:2401.08740, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.556391Z"},"links":{"cited_paper":"/paper/2401.08740","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:425a43dab11e283bf1774d3fc75af482946fc22e2bc373880b71101bc95ad249","observation_id":"78920582-22b7-4b4f-b488-e3cb1af4ce87","resolution":{"observed_at":"2026-08-06T10:59:53.556391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05741","last_updated":"2025-04-09T04:23:38Z","snapshot_observed_at":"2026-08-07T16:07:39.384750Z","submitted_at":"2025-04-08T07:17:45Z","title":"DDT: Decoupled Diffusion Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05741","snapshot_observed_at":"2026-08-06T10:59:53.563286Z","title":"Decoupled diffusion transformer.arXiv preprint arXiv:2504.05741, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.563286Z"},"links":{"cited_paper":"/paper/2504.05741","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:3e1490871814cdff0931cfd1b677d3d118de490d84d2e9a92ed312babcd41c6c","observation_id":"3a0155e0-346b-4061-9868-78ff42a6fa32","resolution":{"observed_at":"2026-08-06T10:59:53.563286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.806998Z","title":"Analyzing and improving the training dynamics of diffusion models","venue":null,"work_id":"f0f3d477-bf04-4910-be81-5516a553bcc2","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.570113Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:00f851f5dbbeeb3f0a0b96ee9c84fe948dc568e32ca375f1cfa75afcc026769b","observation_id":"3cc340b2-0c41-4ca3-a7d0-779ff450e7da","resolution":{"observed_at":"2026-08-06T10:59:55.812096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08531","last_updated":"2024-10-11T05:03:56Z","snapshot_observed_at":"2026-07-06T19:31:36.072099Z","submitted_at":"2024-10-11T05:03:56Z","title":"Diffusion Models Need Visual Priors for Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08531","snapshot_observed_at":"2026-08-06T10:59:53.579486Z","title":"Diffusion models need visual priors for image generation.arXiv preprint arXiv:2410.08531, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.579486Z"},"links":{"cited_paper":"/paper/2410.08531","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:2d9e0246beb75d0ce5b9cf7e8d2d0a7582bff01d51f2dfbf94bd817a5c4e4707","observation_id":"bed14cd8-c1eb-486f-ab19-58ea8399a1fa","resolution":{"observed_at":"2026-08-06T10:59:53.579486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.790642Z","title":"Exploring dcn-like architecture for fast image generation with arbitrary resolution.Advances in Neural Information Processing Systems, 37:87959–87977, 2024","venue":null,"work_id":"42f55b2b-308b-45a0-9d2f-7e9758e2cef9","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.586165Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:509588678026799500d67b2176c1d82b4b111e57b86223bc36e303ec6f7f11b3","observation_id":"7204f52a-9f31-4d1c-a57b-66d84907a202","resolution":{"observed_at":"2026-08-06T10:59:55.795963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14224","last_updated":"2024-07-10T09:02:11Z","snapshot_observed_at":"2026-07-06T18:18:21.334080Z","submitted_at":"2024-05-23T06:53:18Z","title":"DiM: Diffusion Mamba for Efficient High-Resolution Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14224","snapshot_observed_at":"2026-08-06T10:59:53.591869Z","title":"Dim: Diffusion mamba for efficient high-resolution image synthesis.arXiv preprint arXiv:2405.14224, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.591869Z"},"links":{"cited_paper":"/paper/2405.14224","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:4df2fa5e7ffc817b229d50b1d4c30f2475973b535ef295a92b7ac9981d67b0b7","observation_id":"f7eeabed-1928-4fa1-96b8-7f5b164d961a","resolution":{"observed_at":"2026-08-06T10:59:53.591869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12364","last_updated":"2025-04-16T15:09:45Z","snapshot_observed_at":"2026-08-07T16:01:46.917051Z","submitted_at":"2025-04-16T15:09:45Z","title":"DMM: Building a Versatile Image Generation Model via Distillation-Based Model Merging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12364","snapshot_observed_at":"2026-08-06T10:59:53.598965Z","title":"Dmm: Building a versatile image generation model via distillation-based model merging.arXiv preprint arXiv:2504.12364, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.598965Z"},"links":{"cited_paper":"/paper/2504.12364","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:eeb6eba9ef29c0b2cc9aa3337cff755ce5f9b1b8d986766d71d7dd78edbbe4a1","observation_id":"9cc4a7ac-446b-46fb-9e61-40aeb9d7baab","resolution":{"observed_at":"2026-08-06T10:59:53.598965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.774719Z","title":"Score identity distillation: Exponentially fast distillation of pretrained diffusion models for one-step generation","venue":null,"work_id":"297db24e-a5b5-40f5-b8e0-6a5908dd1b26","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.605270Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:a05f799335d57daebefa85d7caa970640df31a419819f48bbfe2c7e14d843ace","observation_id":"a148daa2-43b8-47c6-96aa-e3c4b67c9408","resolution":{"observed_at":"2026-08-06T10:59:55.780084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.756619Z","title":"All are worth words: A vit backbone for diffusion models","venue":null,"work_id":"add50dd7-d90b-4f5f-b1c3-3cf74a0f35a2","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.612388Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:945663af1f0a995249dac01a8853c9275d18e448cab3011d20d3a64668cbe5c4","observation_id":"73ab942b-f3de-49e6-8936-c46d19814a69","resolution":{"observed_at":"2026-08-06T10:59:55.762231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.739016Z","title":"Understanding diffusion objectives as the elbo with simple data augmentation.Advances in Neural Information Processing Systems, 36:65484–65516, 2023","venue":null,"work_id":"c2a8888e-9fac-4f80-8ed5-940993b2d700","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.618113Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:00de65d34bf4e18c98c46981fbef7ef1e38385630d060db2afe036ad49f64395","observation_id":"1d210327-7806-4199-aea7-828af496cc3c","resolution":{"observed_at":"2026-08-06T10:59:55.744308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.719157Z","title":"simple diffusion: End-to-end diffusion for high resolution images","venue":null,"work_id":"14bbef32-86d4-43a6-892c-717ed8bec1d9","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.623216Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:01f86c00ac8b412b24bc8af840a8a6ceb269cfabf88b84c6a166c495a78e6f80","observation_id":"e1ffc047-36c7-45f7-b660-402153b24c00","resolution":{"observed_at":"2026-08-06T10:59:55.724406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17437","last_updated":"2025-02-25T14:28:34Z","snapshot_observed_at":"2026-08-07T17:52:18.036682Z","submitted_at":"2025-02-24T18:59:56Z","title":"Fractal Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17437","snapshot_observed_at":"2026-08-06T10:59:53.628822Z","title":"Fractal generative models.arXiv preprint arXiv:2502.17437, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.628822Z"},"links":{"cited_paper":"/paper/2502.17437","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:f5de90a5b7fa7101fbcfcf166a78a9e6d4bcfbf70038ab3531ba85150f2a69a4","observation_id":"5e721986-4f87-406b-ae79-b323ac106e91","resolution":{"observed_at":"2026-08-06T10:59:53.628822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06329","last_updated":"2025-06-06T17:45:35Z","snapshot_observed_at":"2026-07-06T20:03:47.277630Z","submitted_at":"2024-12-09T09:28:06Z","title":"Normalizing Flows are Capable Generative Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06329","snapshot_observed_at":"2026-08-06T10:59:53.635782Z","title":"Normalizing flows are capable generative models.arXiv preprint arXiv:2412.06329, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.635782Z"},"links":{"cited_paper":"/paper/2412.06329","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:7a49f2c35937d9911fe5ece7be120fa3b43acf3d445a611459975c697f4efb7d","observation_id":"a8763492-f806-483f-9796-7a542edcbd4b","resolution":{"observed_at":"2026-08-06T10:59:53.635782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.701354Z","title":"Reverse-time diffusion equation models.Stochastic Processes and their Applications, 12(3):313–326, 1982","venue":null,"work_id":"687b21a8-6fdd-411b-9f31-8d5818ca3953","year":1982},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.642499Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:b6b15f4d40e9e550264c9909034b0625c493aa198fbfeb34bd4ac072d1429fb4","observation_id":"1ec32c64-d933-4ad0-82f6-f4e4cadd68e8","resolution":{"observed_at":"2026-08-06T10:59:55.706424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-06T10:59:53.651829Z","title":"Score-based generative modeling through stochastic differential equations.arXiv preprint arXiv:2011.13456, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.651829Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:7323baa19bf413885f87680dabcff70dea8291ae902a55003e506396df9a8870","observation_id":"41532b06-a287-42ff-91fb-afecd4bafd2b","resolution":{"observed_at":"2026-08-06T10:59:53.651829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.683779Z","title":"Elucidating the design space of diffusion-based generative models.Advances in Neural Information Processing Systems, 35:26565–26577, 2022","venue":null,"work_id":"4947cf34-dac3-43fe-914a-811030d00b6f","year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.658998Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:9573b11c04bef5af43bf772e9ac9c2479df0e4afb66d287e42483b76778b35f3","observation_id":"fbf99e05-c698-4a56-bf6a-145c29a87251","resolution":{"observed_at":"2026-08-06T10:59:55.690754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.664833Z","title":"Denoising diffusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":"1ef52c47-7808-42bc-88a2-a0f0f11921c6","year":2020},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.664691Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:86c6c4955357dd5b050ce8a0a9e6e986a3301d817d5747f6671025e776049e67","observation_id":"df5b1330-0c3f-4fb3-8270-0f4a38e726a6","resolution":{"observed_at":"2026-08-06T10:59:55.671671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T10:59:53.673193Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.673193Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:d2b910b4f9339a76f22686842b0e89ee77a92a8ded098937a2469253a8afd397","observation_id":"e09922ea-00af-4fe4-9025-8293b73cf97d","resolution":{"observed_at":"2026-08-06T10:59:53.673193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T10:59:53.680104Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.680104Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:8a6ab4d263dd71bfd5dd51df65ca9525acb6137196b1b65c918bc034c8cf0a1d","observation_id":"ef99423f-6e1f-4ff8-8692-67b9ef6fdfc4","resolution":{"observed_at":"2026-08-06T10:59:53.680104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.643838Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063, 2024","venue":null,"work_id":"0707a629-5350-474d-87db-426044b427dc","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.686698Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:bec1a0cf50216506825a5f09e74579cbfb5e81a68b52e9d1bf07fdbeb8f426e7","observation_id":"54635678-97bf-429d-8d0d-fc95af2d2678","resolution":{"observed_at":"2026-08-06T10:59:55.650779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00522","last_updated":"2024-07-08T02:48:27Z","snapshot_observed_at":"2026-08-06T16:05:38.919884Z","submitted_at":"2024-03-01T13:30:51Z","title":"VisionLLaMA: A Unified LLaMA Backbone for Vision Tasks","version":2},"cited_work":{"arxiv_id":"2403.00522","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.00522","snapshot_observed_at":"2026-08-06T10:59:54.749546Z","title":"VisionLLaMA: A Unified LLaMA Backbone for Vision Tasks","venue":"cs.CV","work_id":"d48deb2f-40b9-4a7e-ad94-d3cf2cf2b4c8","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.695426Z"},"links":{"cited_paper":"/paper/2403.00522","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:c865ffccc3e41a44d7238f466fc937e317cd4d039d7de489d26636011294e051","observation_id":"1b636a14-23e1-4dd3-965e-2092e5b3d788","resolution":{"observed_at":"2026-08-06T10:59:54.761049Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12376","last_updated":"2024-10-15T02:51:00Z","snapshot_observed_at":"2026-08-07T22:42:07.478353Z","submitted_at":"2024-02-19T18:59:07Z","title":"FiT: Flexible Vision Transformer for Diffusion Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12376","snapshot_observed_at":"2026-08-06T10:59:53.705503Z","title":"Fit: Flexible vision transformer for diffusion model.arXiv preprint arXiv:2402.12376, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.705503Z"},"links":{"cited_paper":"/paper/2402.12376","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:37198bb127c755edcfba9efb9cbb2982bfdcf256ba437732ace9654198724733","observation_id":"6f6e9f36-37e8-4ab2-a1b2-6c1e369abac8","resolution":{"observed_at":"2026-08-06T10:59:53.705503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07703","last_updated":"2025-03-10T17:58:33Z","snapshot_observed_at":"2026-07-06T20:50:09.622181Z","submitted_at":"2025-03-10T17:58:33Z","title":"Seedream 2.0: A Native Chinese-English Bilingual Image Generation Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07703","snapshot_observed_at":"2026-08-06T10:59:53.712528Z","title":"Seedream 2.0: A native chinese-english bilingual image generation foundation model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.712528Z"},"links":{"cited_paper":"/paper/2503.07703","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:e7e0c35b633dc0bf16be8f88d143a99186a7f66cd42e92e1dabeccf710324895","observation_id":"f310bc9e-816f-4994-bd9c-d465baa1a0bf","resolution":{"observed_at":"2026-08-06T10:59:53.712528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11346","last_updated":"2025-06-28T11:46:35Z","snapshot_observed_at":"2026-07-06T21:09:50.780345Z","submitted_at":"2025-04-15T16:19:07Z","title":"Seedream 3.0 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11346","snapshot_observed_at":"2026-08-06T10:59:53.722116Z","title":"Seedream 3.0 technical report.arXiv preprint arXiv:2504.11346, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.722116Z"},"links":{"cited_paper":"/paper/2504.11346","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:b827f99e8a9c3e4e211985338c75b8a52058d6df86c59c4710f260acf0c2d216","observation_id":"bf1caafc-7334-4783-935b-22474b87b295","resolution":{"observed_at":"2026-08-06T10:59:53.722116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05472","last_updated":"2025-05-11T18:47:18Z","snapshot_observed_at":"2026-08-04T22:02:38.792513Z","submitted_at":"2025-05-08T17:58:57Z","title":"Mogao: An Omni Foundation Model for Interleaved Multi-Modal Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05472","snapshot_observed_at":"2026-08-06T10:59:53.729180Z","title":"Mogao: An omni foundation model for interleaved multi-modal generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.729180Z"},"links":{"cited_paper":"/paper/2505.05472","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:b58c977b35736648518ad1fa550c69355582215ae34f33686bd07c3e9fa709d8","observation_id":"aea3b6a8-289d-43ae-bdcf-b0ecb5354bc2","resolution":{"observed_at":"2026-08-06T10:59:53.729180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12517","last_updated":"2024-03-20T11:24:06Z","snapshot_observed_at":"2026-07-06T17:19:14.478786Z","submitted_at":"2024-01-23T06:21:34Z","title":"DDMI: Domain-Agnostic Latent Diffusion Models for Synthesizing High-Quality Implicit Neural Representations","version":2},"cited_work":{"arxiv_id":"2401.12517","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.12517","snapshot_observed_at":"2026-08-06T10:59:54.598485Z","title":"DDMI: Domain-Agnostic Latent Diffusion Models for Synthesizing High-Quality Implicit Neural Representations","venue":"cs.LG","work_id":"0da307d8-af51-4fdb-a540-e8b308f773e6","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.735550Z"},"links":{"cited_paper":"/paper/2401.12517","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:2f5563a84428a5a617ef8e143cf47afd5085953be2f4318f08bb9d24e09cb6ea","observation_id":"84171c69-50d3-4cbc-8cb3-b8314cbb4d9a","resolution":{"observed_at":"2026-08-06T10:59:54.606462Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.622650Z","title":"Coco-gan: Generation by parts via conditional coordinating","venue":null,"work_id":"c5ac64a0-abf7-44cb-930f-fde81d83ce32","year":2019},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.743182Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:f9f9e7b96a17f27364200dfdc4a4003e06ad24105790da7d94ff21e0a8330818","observation_id":"c05f2f03-7a0c-4e55-a5ff-d1d7eaef0f2a","resolution":{"observed_at":"2026-08-06T10:59:55.628393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.601807Z","title":"Image neural field diffusion models","venue":null,"work_id":"4a61bf8d-befd-4d16-9241-729bc2ec2311","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.753847Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:425f23e8f71e8853dfdf9a4fd5398e77407bc1315c0858cb488bbc782beda23d","observation_id":"e8e6c4f0-7626-41b4-9c34-2d6b20a2b594","resolution":{"observed_at":"2026-08-06T10:59:55.608058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.580953Z","title":"Mip-nerf: A multiscale representation for anti-aliasing neural radiance fields","venue":null,"work_id":"52b5072b-8b53-45d8-bd78-dcd4a891db74","year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.759705Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:32642f062d720c0fe7a24df713faf0cd740402615a820267cd249f3d27b71872","observation_id":"e9aa5f08-2655-4c83-a416-a078164d5875","resolution":{"observed_at":"2026-08-06T10:59:55.587809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07751","last_updated":"2019-06-18T18:21:46Z","snapshot_observed_at":"2026-08-07T12:44:33.152248Z","submitted_at":"2019-06-18T18:21:46Z","title":"Neural Volumes: Learning Dynamic Renderable Volumes from Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07751","snapshot_observed_at":"2026-08-06T10:59:53.768072Z","title":"Neural volumes: Learning dynamic renderable volumes from images.arXiv preprint arXiv:1906.07751,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.768072Z"},"links":{"cited_paper":"/paper/1906.07751","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:77088f4bb27dbcf9ff786c48c5d1eb9296648ab420c8f58dfca49ce96b4f39ce","observation_id":"bc1c6fa8-78cf-4aa8-bd85-d3930ccc915b","resolution":{"observed_at":"2026-08-06T10:59:53.768072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10689","last_updated":"2023-02-01T06:00:21Z","snapshot_observed_at":"2026-08-02T09:26:48.635481Z","submitted_at":"2021-06-20T12:59:42Z","title":"NeuS: Learning Neural Implicit Surfaces by Volume Rendering for Multi-view Reconstruction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10689","snapshot_observed_at":"2026-08-06T10:59:53.775528Z","title":"Neus: Learning neural implicit surfaces by volume rendering for multi-view reconstruction.arXiv preprint arXiv:2106.10689, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.775528Z"},"links":{"cited_paper":"/paper/2106.10689","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:95567316b4222d88c42dc9cbfa0aa50f977d36c9fec72af01086d2fbaf60fc17","observation_id":"05fd149f-0d49-4c03-a783-714a18503706","resolution":{"observed_at":"2026-08-06T10:59:53.775528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.556308Z","title":"Monosdf: Exploring monocular geometric cues for neural implicit surface reconstruction.Advances in neural information processing systems, 35:25018–25032, 2022","venue":null,"work_id":"4777d2a0-d9cd-4636-ad25-7ff96d327a9f","year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.782784Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:b355f63347f9a89219f4a5ca8fd2fa7082541353d225012d1993f7f7a0f6335b","observation_id":"f8988a38-361d-43db-84e4-80b5fafa8351","resolution":{"observed_at":"2026-08-06T10:59:55.563312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.531577Z","title":"Neus2: Fast learning of neural implicit surfaces for multi-view reconstruction","venue":null,"work_id":"c1953dd4-7cb9-442f-8566-ffb0f94a6c4b","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.790020Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:a41e80fa1945ff24f41d25e13d9aee506ba4d956a83204ce4b84f4afe160307d","observation_id":"efcd25da-d08b-47a1-a8ca-794b9d77807d","resolution":{"observed_at":"2026-08-06T10:59:55.540218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:53.796811Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.796811Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:1f72d17a02e4bdb3e00c815a01c973fdcd0938a713157c2d08210e21eecc5434","observation_id":"306cda42-dc7f-4b23-8114-2bec1fc08c4e","resolution":{"observed_at":"2026-08-06T10:59:53.796811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03841","last_updated":"2021-03-05T17:56:03Z","snapshot_observed_at":"2026-08-05T23:24:04.690967Z","submitted_at":"2021-03-05T17:56:03Z","title":"Generating Images with Sparse Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03841","snapshot_observed_at":"2026-08-06T10:59:53.805944Z","title":"Generating images with sparse representations.arXiv preprint arXiv:2103.03841, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.805944Z"},"links":{"cited_paper":"/paper/2103.03841","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:45ff52b772726033226d5aad60a1d3d4b2b970d0473ae00416675390ac6a682e","observation_id":"fb840580-43b4-4d38-8a66-d564d86f3fd4","resolution":{"observed_at":"2026-08-06T10:59:53.805944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:53.812267Z","title":"Improved techniques for training gans.Advances in neural information processing systems, 29, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.812267Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:90e582deb5ce0a0dabda52246ee1052cbdfab2ae6592af36393f91c6fd465f4f","observation_id":"06edbe77-c0d3-4768-9712-39a3182ab7c4","resolution":{"observed_at":"2026-08-06T10:59:53.812267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:53.821371Z","title":"Improved precision and recall metric for assessing generative models.Advances in neural information processing systems, 32,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.821371Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:d4e83ab571a015f946144933ad4c602df37c3608b9a2b906dd1d418e2ed37809","observation_id":"79de7b13-37b4-41af-96ff-7a46eb246639","resolution":{"observed_at":"2026-08-06T10:59:53.821371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.458770Z","title":"Geneval: An object-focused framework for evaluating text-to-image alignment.Advances in Neural Information Processing Systems, 36:52132–52152,","venue":null,"work_id":"d16e1ee9-e354-4653-b00d-0512cec0ea43","year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.828441Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:666ee7221276dcf24e34c09f996c2b0495271a6745cf8db601106d8919523d72","observation_id":"427b4358-710a-466c-a370-0c5d29fdafa6","resolution":{"observed_at":"2026-08-06T10:59:55.466992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-04T23:51:18.339338Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05135","snapshot_observed_at":"2026-08-06T10:59:53.834821Z","title":"Ella: Equip diffusion models with llm for enhanced semantic alignment.arXiv preprint arXiv:2403.05135, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.834821Z"},"links":{"cited_paper":"/paper/2403.05135","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:e92b4c78f1259f628e2e5b740db4d6f9713196ddb6dd7ff35b011387ac371d03","observation_id":"fab333f7-2fa0-46c1-824a-813dd7884057","resolution":{"observed_at":"2026-08-06T10:59:53.834821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03206","last_updated":"2024-03-05T18:45:39Z","snapshot_observed_at":"2026-07-06T17:40:01.975792Z","submitted_at":"2024-03-05T18:45:39Z","title":"Scaling Rectified Flow Transformers for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03206","snapshot_observed_at":"2026-08-06T10:59:53.841329Z","title":"Scaling rectified flow transformers for high-resolution image synthesis.arXiv preprint arXiv:2403.03206, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.841329Z"},"links":{"cited_paper":"/paper/2403.03206","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:d595ba4debd22f564f89c4c6e91e49d57b1c6b5afeacbf504f47ef148bd65fdc","observation_id":"f4e0b3b1-3c1e-4b26-bdea-a24b43d3d6db","resolution":{"observed_at":"2026-08-06T10:59:53.841329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-06T10:59:53.847537Z","title":"Representation alignment for generation: Training diffusion transformers is easier than you think","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.847537Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:a3f9e381b814435f41af157a167caecf426b8a6990bd8ee85c624532cc7a45c2","observation_id":"4155688a-cd30-4744-bf8c-cbba159915ad","resolution":{"observed_at":"2026-08-06T10:59:53.847537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T10:59:53.854680Z","title":"Dinov2: Learning robust visual features without supervision.arXiv preprint arXiv:2304.07193, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.854680Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:049ea059c6ab6c58e1f2e42465769957912bc45b8f84557f413d2faf30204eec","observation_id":"89d6eed4-214a-41d5-94b3-a7e16519685c","resolution":{"observed_at":"2026-08-06T10:59:53.854680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T10:59:53.860327Z","title":"Classifier-free diffusion guidance.arXiv preprint arXiv:2207.12598, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.860327Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:9f0deef6e94fee8fedda72e778a3769b039a0795ab52a6cecf8c254c05712980","observation_id":"864abfa3-9fe3-4fd6-b620-c27faa4809e6","resolution":{"observed_at":"2026-08-06T10:59:53.860327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07724","last_updated":"2024-11-06T14:29:36Z","snapshot_observed_at":"2026-07-06T17:58:47.786948Z","submitted_at":"2024-04-11T13:16:47Z","title":"Applying Guidance in a Limited Interval Improves Sample and Distribution Quality in Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07724","snapshot_observed_at":"2026-08-06T10:59:53.867895Z","title":"Applying guidance in a limited interval improves sample and distribution quality in diffusion models.arXiv preprint arXiv:2404.07724, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.867895Z"},"links":{"cited_paper":"/paper/2404.07724","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:7594a435d8d4869d9a0cc96bbde78355b55f9de470fe2fefa69ffc2ca8903649","observation_id":"7b08d106-7f5a-4093-930b-b6f129a137cd","resolution":{"observed_at":"2026-08-06T10:59:53.867895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.433546Z","title":"Autoregressive image generation without vector quantization.Advances in Neural Information Processing Systems, 37:56424–56445, 2025","venue":null,"work_id":"17cd8edc-f336-4a84-8267-c1b1ee8fd09f","year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.874335Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:1090e668ba4535179c496448c9d73839375e5a581d279f694bb76fb790860a5f","observation_id":"45115753-f8d9-43d9-bfe6-a77d3f825137","resolution":{"observed_at":"2026-08-06T10:59:55.440748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12095","last_updated":"2024-12-17T18:45:55Z","snapshot_observed_at":"2026-07-06T20:07:58.873037Z","submitted_at":"2024-12-16T18:59:29Z","title":"Causal Diffusion Transformers for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12095","snapshot_observed_at":"2026-08-06T10:59:53.881716Z","title":"Causal diffusion transformers for generative modeling.arXiv preprint arXiv:2412.12095, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.881716Z"},"links":{"cited_paper":"/paper/2412.12095","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:df97f8ff3a01e27cd8704141c15889cd0a8f97a63fd0462e57998709f99bff72","observation_id":"af11de0a-c6a3-49df-97ca-d7d0c46d971c","resolution":{"observed_at":"2026-08-06T10:59:53.881716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19722","last_updated":"2025-05-19T15:26:21Z","snapshot_observed_at":"2026-08-02T07:10:00.001810Z","submitted_at":"2024-11-29T14:14:59Z","title":"JetFormer: An Autoregressive Generative Model of Raw Images and Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19722","snapshot_observed_at":"2026-08-06T10:59:53.888044Z","title":"Jetformer: An autoregressive generative model of raw images and text.arXiv preprint arXiv:2411.19722, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.888044Z"},"links":{"cited_paper":"/paper/2411.19722","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:ac26414b9b1b6de4e3b902de1ee76408fd48bd4af7a156abbf7939eead331b62","observation_id":"585c0a9f-14b0-47e6-b323-1836cb68460b","resolution":{"observed_at":"2026-08-06T10:59:53.888044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.11972","last_updated":"2023-06-14T03:32:57Z","snapshot_observed_at":"2026-08-01T18:59:30.902802Z","submitted_at":"2022-12-22T18:55:45Z","title":"Scalable Adaptive Computation for Iterative Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.11972","snapshot_observed_at":"2026-08-06T10:59:53.896912Z","title":"Scalable adaptive computation for iterative generation.arXiv preprint arXiv:2212.11972, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.896912Z"},"links":{"cited_paper":"/paper/2212.11972","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:eca2e16dab4f98686f0ef53fc7bd42bce458f806cd5f1572ef241a6243568314","observation_id":"1baa3565-ea4d-4f45-8ac4-b275d4721aa4","resolution":{"observed_at":"2026-08-06T10:59:53.896912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-07-06T19:04:43.716629Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-06T10:59:53.905189Z","title":"Show-o: One single transformer to unify multimodal understanding and generation.arXiv preprint arXiv:2408.12528, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.905189Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:09286e975decec6d0d24eec8a9ccfd7a2e80bdccecf7a21b7caf065222db5415","observation_id":"024db1c7-9df8-44b5-a6a7-eaf134eedad3","resolution":{"observed_at":"2026-08-06T10:59:53.905189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13863","last_updated":"2024-10-17T17:59:59Z","snapshot_observed_at":"2026-08-07T22:15:46.490983Z","submitted_at":"2024-10-17T17:59:59Z","title":"Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13863","snapshot_observed_at":"2026-08-06T10:59:53.912933Z","title":"Fluid: Scaling autoregressive text-to-image generative models with continuous tokens.arXiv preprint arXiv:2410.13863, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.912933Z"},"links":{"cited_paper":"/paper/2410.13863","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:522c518f357a99875e1148757a6744eefa44e6686eafe832df63fb38c5606d1a","observation_id":"5c1fca8e-0408-4be2-ad98-1f1751b53db4","resolution":{"observed_at":"2026-08-06T10:59:53.912933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11455","last_updated":"2025-04-15T17:59:46Z","snapshot_observed_at":"2026-08-07T16:02:04.272189Z","submitted_at":"2025-04-15T17:59:46Z","title":"SimpleAR: Pushing the Frontier of Autoregressive Visual Generation through Pretraining, SFT, and RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11455","snapshot_observed_at":"2026-08-06T10:59:53.920557Z","title":"Simplear: Pushing the frontier of autoregressive visual generation through pretraining, sft, and rl.arXiv preprint arXiv:2504.11455, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.920557Z"},"links":{"cited_paper":"/paper/2504.11455","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:8de5e9546de388e145a615270b0764aba41844ddda59d0e7a56f5344cac37f6d","observation_id":"58a3e0a8-a21c-4cf7-bfe0-222a2597f7b7","resolution":{"observed_at":"2026-08-06T10:59:53.920557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-06T10:59:53.927900Z","title":"Transfusion: Predict the next token and diffuse images with one multi-modal model.arXiv preprint arXiv:2408.11039, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.927900Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:2702e707731b0bf3589f1f92b1e0afe8c1ad19f0a21f5ec5307d4b5b5ea359a4","observation_id":"7f82d161-f0d5-43b1-93b9-88f118c7d48e","resolution":{"observed_at":"2026-08-06T10:59:53.927900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.411974Z","title":"Segment anything","venue":null,"work_id":"2b9daed9-6b1e-4c55-a646-8633174c4698","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.934980Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:6a8ae14bed18b7aec78becfabae866beb21f634a95ff1f963ce47191a2e5efd0","observation_id":"b5bc82e8-483d-43c3-8e09-cf79cd233138","resolution":{"observed_at":"2026-08-06T10:59:55.419099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.384974Z","title":"Journeydb: A benchmark for generative image understanding.Advances in neural information processing systems, 36:49659–49678, 2023","venue":null,"work_id":"67262538-4443-4793-9131-c7052fd36e92","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.940269Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:b22945e0be4e3e647b3090f2eb9f38f080e41c4c34c984f63809ceb13aed7493","observation_id":"cfad6b7f-f91c-4648-94c3-11db06350d54","resolution":{"observed_at":"2026-08-06T10:59:55.392241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.364374Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":"d8dc5a5a-74b8-4847-8dfe-ee26aa673c70","year":2015},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.946681Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:52ef2130b5bd75382cf7a8c4edf92944818f51a344ed841e2a4e3b44938ce9ed","observation_id":"03f1b303-c11a-4a47-8315-7f56c145b768","resolution":{"observed_at":"2026-08-06T10:59:55.371617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T10:59:53.953428Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.953428Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:2a0f8fc983fa3b0a1456207eaa5bc34bb9ca742c0af609099e6fd88ac16c68c0","observation_id":"52943ce2-ea6f-4bbd-84f9-b35e9fcd62ba","resolution":{"observed_at":"2026-08-06T10:59:53.953428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03131","last_updated":"2025-06-03T17:57:33Z","snapshot_observed_at":"2026-08-07T23:51:36.891678Z","submitted_at":"2025-06-03T17:57:33Z","title":"Native-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03131","snapshot_observed_at":"2026-08-06T10:59:53.959732Z","title":"Native-resolution image synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.959732Z"},"links":{"cited_paper":"/paper/2506.03131","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:5fb473a0eedc956a9809926716a966ac5412de139952b2e211750e487bd8d43f","observation_id":"27e6125d-c332-49bb-83cc-97af61f0e6bc","resolution":{"observed_at":"2026-08-06T10:59:53.959732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09568","last_updated":"2025-05-14T17:11:07Z","snapshot_observed_at":"2026-07-06T21:23:57.084147Z","submitted_at":"2025-05-14T17:11:07Z","title":"BLIP3-o: A Family of Fully Open Unified Multimodal Models-Architecture, Training and Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09568","snapshot_observed_at":"2026-08-06T10:59:53.966506Z","title":"Blip3-o: A family of fully open unified multimodal models-architecture, training and dataset.arXiv preprint arXiv:2505.09568, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.966506Z"},"links":{"cited_paper":"/paper/2505.09568","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:283e83e5ac3c6039e2f6dd8cc945e517ae848e3e05d9fe196102a069dd619a2e","observation_id":"b7976e51-257a-48b5-b285-0e128d614f9c","resolution":{"observed_at":"2026-08-06T10:59:53.966506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13686","last_updated":"2024-11-04T13:24:18Z","snapshot_observed_at":"2026-08-04T05:24:37.569197Z","submitted_at":"2024-04-21T15:16:05Z","title":"Hyper-SD: Trajectory Segmented Consistency Model for Efficient Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13686","snapshot_observed_at":"2026-08-06T10:59:53.977618Z","title":"Hyper-sd: Trajectory segmented consistency model for efficient image synthesis.arXiv preprint arXiv:2404.13686,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.977618Z"},"links":{"cited_paper":"/paper/2404.13686","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:6e44182a27ce8cefc46de0f9736393e6e5f8b6f2682124b36ae111ef186b7031","observation_id":"a3f57fec-6af9-4afb-bf20-e96af035ff87","resolution":{"observed_at":"2026-08-06T10:59:53.977618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03791","last_updated":"2025-05-29T01:03:51Z","snapshot_observed_at":"2026-07-06T20:01:54.557848Z","submitted_at":"2024-12-05T01:00:07Z","title":"INRFlow: Flow Matching for INRs in Ambient Space","version":2},"cited_work":{"arxiv_id":"2412.03791","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03791","snapshot_observed_at":"2026-08-06T10:59:54.073903Z","title":"INRFlow: Flow Matching for INRs in Ambient Space","venue":"cs.LG","work_id":"4fbf32ea-4e68-452f-b8a3-f028cf9a75da","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.983165Z"},"links":{"cited_paper":"/paper/2412.03791","citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:f55ccdbdb8e8fa476b596cbabfaf3fd4b2887146695da9f3f92953f73bdff1d7","observation_id":"2f06e1f2-00cf-4bb1-a63b-af1cdc3f0e85","resolution":{"observed_at":"2026-08-06T10:59:54.083025Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.336624Z","title":"Efficient training with denoised neural weights","venue":null,"work_id":"07ae3c29-63cb-480c-b130-d4310f212e2a","year":2024},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.988535Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:7fba5fa40bb65fcf751a95f7e033a6d1e7bf7171c7f596ac39f60de419325ea8","observation_id":"ca782e5d-68e0-4032-a90c-b71062048f65","resolution":{"observed_at":"2026-08-06T10:59:55.348189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.317365Z","title":"Patch diffusion: Faster and more data-efficient training of diffusion models","venue":null,"work_id":"2781f413-83dc-4173-a03e-5d101dc82bfb","year":2023},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.994341Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:54f1f1c0e51905c876ec182832e75a88a2e88947aca7aff2cb48b5cd960f5d97","observation_id":"bb4ae31e-2d0e-4261-83ef-1a36ebe57ff4","resolution":{"observed_at":"2026-08-06T10:59:55.323690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.298804Z","title":"Arbitrary-scale image synthesis","venue":null,"work_id":"8ef5392a-010e-4aab-a5ab-71bc50a09093","year":2022},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:53.999221Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:6bd3c67da3662211e93daff09c800f42b6e1ea4dac00b32d894b08d85ca56ca4","observation_id":"2f99bd30-209b-4cab-b736-3d49ae2c8fbf","resolution":{"observed_at":"2026-08-06T10:59:55.304439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.275821Z","title":"Adversarial generation of continuous images","venue":null,"work_id":"216ced97-069e-4dab-9bed-4aa18cf5a6a4","year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:54.005740Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:929c9a4be46fcc4bf933b651d0bdd550ec56f3c3e14f33490ff4baf0ab3a2b82","observation_id":"0217a6a4-f964-43bc-91c4-a5553c8acb6a","resolution":{"observed_at":"2026-08-06T10:59:55.283080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:59:55.249380Z","title":"Alias-free generative adversarial networks.Advances in neural information processing systems, 34:852–863, 2021","venue":null,"work_id":"d611d9f7-0979-4fff-9061-98792f9c8696","year":2021},"citing_paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T10:59:54.011822Z"},"links":{"citing_paper":"/paper/2507.23268"},"observation_digest":"sha256:b3f117c69adbbff9247d5a1210ab6ffe3950a378d9f10f9b03fe0046fde8f0bc","observation_id":"1a7497d3-b635-4494-8a42-540373b1a498","resolution":{"observed_at":"2026-08-06T10:59:55.256522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.23268","last_updated":"2025-08-04T02:46:11Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T21:03:40.851564Z","submitted_at":"2025-07-31T06:07:20Z","title":"PixNerd: Pixel Neural Field Diffusion"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":3,"verified_fuzzy":32},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 45 inbound Pith citation observations for arXiv:2507.23268."}