{"as_of":"2026-08-23T03:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c117638ed0c04c7d168a827e4a6c78d609d487c0ba1f30e2782bed96cc897e7c","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-07T14:29:23.795094Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T17:35:40.465005Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05373","snapshot_observed_at":"2026-08-01T17:35:40.465005Z","title":"Pixworld: Unifying 3d scene generation and reconstruction in pixel space,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17585","last_updated":"2026-08-12T11:53:54Z","snapshot_observed_at":"2026-08-20T08:17:39.303195Z","submitted_at":"2026-07-20T06:04:08Z","title":"Pixel-Space Diffusion Transformers","version":2},"reference_index":125,"source":"pdf_text","source_observed_at":"2026-08-01T17:35:40.465005Z"},"links":{"cited_paper":"/paper/2607.05373","citing_paper":"/paper/2607.17585"},"observation_digest":"sha256:f4c088ee99a0652bb1af57ea953aed21d8c7c976214e81101bc97970d30cbac1","observation_id":"fbcae009-65c5-4629-afee-0531e4c2921e","resolution":{"observed_at":"2026-08-01T17:35:40.465005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.05373/citation-record","integrity":"/paper/2607.05373/integrity","json":"/paper/2607.05373/citation-record.json","paper":"/paper/2607.05373"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.18457","last_updated":"2026-04-23T08:02:03Z","snapshot_observed_at":"2026-08-15T03:31:43.799649Z","submitted_at":"2025-10-21T09:30:45Z","title":"VFM-VAE: Vision Foundation Models Can Be Good Tokenizers for Latent Diffusion Models","version":3},"cited_work":{"arxiv_id":"2510.18457","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.18457","snapshot_observed_at":"2026-07-07T15:43:53.837099Z","title":"VFM-VAE: Vision Foundation Models Can Be Good Tokenizers for Latent Diffusion Models","venue":"cs.CV","work_id":"ac74c8b6-a91c-4489-9fcd-ccb7356f4558","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2510.18457","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:af4a1ca6793a3bb0af0a388f3c397bac44663352658679080bad7ef952086c5a","observation_id":"0032a841-3a01-43aa-8cbb-0d834f77ddf9","resolution":{"observed_at":"2026-07-07T14:33:54.322004Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25162","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.307986Z","title":"arXiv preprint arXiv:2509.25162 (2025) 4","venue":null,"work_id":"28315f59-d5f2-4386-b527-c6735b88b398","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:6a3372c3a582fc551ae574d8342febdf1d2ac3d79e7045e265f537839b11cdd9","observation_id":"87c93f65-6cd8-4fb4-83cb-2e036f3afbea","resolution":{"observed_at":"2026-07-07T14:33:54.309748Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.21657","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.383019Z","title":"Fantasyworld: Geometry-consistent world modeling via unified video and 3d prediction","venue":null,"work_id":"96b4282a-775b-40f8-a4dc-a6ddb2d050fa","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:dc70ce8322de282b8ad80be72a7c66738c5064ef0f5628f10a3f2ba65123c436","observation_id":"f6bbf874-f35d-4493-b66b-f982327d2eab","resolution":{"observed_at":"2026-07-07T14:33:54.385013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.00983","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.342857Z","title":"Worldscore: A unified evaluation benchmark for world generation","venue":null,"work_id":"ad14fa35-72b1-4530-b01a-6d41cd35888d","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:9a08b9e47d88aac2bc9a5fc5b820904dcaa2bf58015a02b9997e6001248b9e14","observation_id":"93dda0ae-9caf-4bd5-8177-3de0cfde545e","resolution":{"observed_at":"2026-07-07T14:33:54.344444Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10314","last_updated":"2024-05-16T17:59:05Z","snapshot_observed_at":"2026-08-15T07:34:03.035482Z","submitted_at":"2024-05-16T17:59:05Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","version":1},"cited_work":{"arxiv_id":"2405.10314","doi":"10.48550/arxiv.2405.10314","metadata_source":"pith","pith_arxiv_id":"2405.10314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","venue":"cs.CV","work_id":"16da851d-11ab-482c-8a09-2978d97a967c","year":2024},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2405.10314","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:22983d9944f30b75b6c6253670888c96e0c7530bd29cfb8e9020b03fcc4fd476","observation_id":"fb3dfb91-b5e0-4b58-9494-385c5c804d66","resolution":{"observed_at":"2026-07-07T14:33:54.406416Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.16099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.356626Z","title":"Oneworld: Taming scene generation with 3d unified representation autoencoder.arXiv preprint arXiv:2603.16099,","venue":null,"work_id":"240a2247-c875-4744-a846-47507eae8827","year":null},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:4ab73260727b5027e70be11193c3237624058b01708076b304c36b59e1ea95aa","observation_id":"c780ca3f-a00b-49c1-b3e9-298bd9b06ab4","resolution":{"observed_at":"2026-07-07T14:33:54.358219Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.13454","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.299927Z","title":"Vist3a: Text-to-3d by stitching a multi-view reconstruction network to a video generator","venue":null,"work_id":"3b674acc-ac66-4203-959e-affc7f76a700","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:88c2c80496ec48e0606cf9ca8549eacdc5e8ebcb97a22b345c0daad928147af1","observation_id":"43514fb4-8446-495c-b9b0-90fe204f993e","resolution":{"observed_at":"2026-07-07T14:33:54.301877Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04400","last_updated":"2024-03-09T10:47:51Z","snapshot_observed_at":"2026-08-18T01:50:26.644460Z","submitted_at":"2023-11-08T00:03:52Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","version":2},"cited_work":{"arxiv_id":"2311.04400","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.04400","snapshot_observed_at":"2026-07-09T18:46:26.549595Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","venue":"cs.CV","work_id":"0662dc2c-cc1c-4358-99bd-2a5f34795738","year":2023},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2311.04400","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:31903b4127bc55ed1fdecf9f5e75aa6f24a71629f7acf12eafa04bb7e41aaf75","observation_id":"45b053be-2618-40e3-8a47-a2eca88a749d","resolution":{"observed_at":"2026-07-07T14:33:54.409053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.04090","doi":"10.48550/arxiv.2601.04090","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gen3r: 3d scene genera- tion meets feed-forward reconstruction","venue":"arXiv (Cornell University)","work_id":"c8ebe4bb-66ac-4eaa-9095-6e3909fa7954","year":2026},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:fbb160a97e640fc7409c21b58c7bda27b317c49620fac3bbc345ae8f3bb68fbb","observation_id":"a8f86c64-65ad-43b0-a490-b2c5ed6b8761","resolution":{"observed_at":"2026-07-07T14:33:54.298621Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.22275","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.353759Z","title":"Repurposing geometric foundation models for multi-view diffusion","venue":null,"work_id":"8ec64e2f-e37d-4dbc-91a5-0943f004a8c3","year":2026},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:96a79fc24a6315cc68e33304afd9bf239ac21b527f3487b10eec526194eb4449","observation_id":"70862774-342d-4f5a-955e-f5b921d114e6","resolution":{"observed_at":"2026-07-07T14:33:54.355447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":"1312.6114","doi":"10.2139/ssrn.4269703","metadata_source":"pith","pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auto-Encoding Variational Bayes","venue":"stat.ML","work_id":"97d95295-30e1-42b4-bbf6-85f0fa4edb44","year":2013},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:2a44be15d5699b453387e0ba20d26e544cc66c4885f1b5260034fc3ed58d885f","observation_id":"722ae6fb-77a7-40ec-bef0-304cef56f1ae","resolution":{"observed_at":"2026-07-07T14:33:54.379231Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.07996","last_updated":"2026-07-20T17:34:32Z","snapshot_observed_at":"2026-08-20T03:51:45.381776Z","submitted_at":"2025-09-04T17:59:58Z","title":"3D and 4D World Modeling: A Survey","version":4},"cited_work":{"arxiv_id":"2509.07996","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.07996","snapshot_observed_at":"2026-07-21T03:22:29.733321Z","title":"3d and 4d world modeling: A survey","venue":null,"work_id":"0197d8fe-e11f-40f4-9254-87e63d981bf9","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2509.07996","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:85685bd0988ae9d7871d38a6db3635a52b55a10ed2e50c2da0cfd6aa5dac7292","observation_id":"d15e4e71-808e-484b-b525-be1e8de1c1b3","resolution":{"observed_at":"2026-07-21T03:22:29.733321Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.13720","last_updated":"2026-01-07T05:36:57Z","snapshot_observed_at":"2026-08-21T07:43:41.799880Z","submitted_at":"2025-11-17T18:59:57Z","title":"Back to Basics: Let Denoising Generative Models Denoise","version":2},"cited_work":{"arxiv_id":"2511.13720","doi":"10.48550/arxiv.2511.13720","metadata_source":"pith","pith_arxiv_id":"2511.13720","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Back to Basics: Let Denoising Generative Models Denoise","venue":"cs.CV","work_id":"37973de8-a5e6-4d92-897b-a98fa9f7f2f3","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2511.13720","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:598d8c7fdb1d75be5370249f6d80a5de6d2990a342dcc5e77f50139081e9c0bb","observation_id":"c49345e5-767b-45f5-ac98-b0ed47c3dcfb","resolution":{"observed_at":"2026-07-07T14:33:54.317122Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:11.792909+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:11.792909+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.13678","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.350977Z","title":"Flashworld: High-quality3dscenegenerationwithinseconds","venue":null,"work_id":"bb59340a-8ec1-4716-a3f6-e1318acca365","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:5dbc54726a1b882a435e38b05f8a2b555961848d313e495cfa7fea76a2bca090","observation_id":"27fba33d-223d-4842-9858-39d78f2a690c","resolution":{"observed_at":"2026-07-07T14:33:54.352589Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-08-15T23:16:19.228206Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":"2511.10647","doi":"10.48550/arxiv.2511.10647","metadata_source":"pith","pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","venue":"cs.CV","work_id":"0a54b500-1e9d-46c2-85eb-8e16cbac8461","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:bb0986d24b93130e6d2cad836d9a2117c995d6b8b759bc3982d37422fe6c45c0","observation_id":"f55f4b38-8795-4bd0-a439-663659284421","resolution":{"observed_at":"2026-07-07T14:33:54.381795Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16767","last_updated":"2025-06-25T07:19:44Z","snapshot_observed_at":"2026-08-18T09:25:14.498467Z","submitted_at":"2024-08-29T17:59:40Z","title":"ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model","version":4},"cited_work":{"arxiv_id":"2408.16767","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.16767","snapshot_observed_at":"2026-07-07T14:33:54.364325Z","title":"Reconx: Reconstruct any scene from sparse views with video diffusion model","venue":"cs.CV","work_id":"0a07d24b-c2f2-4a48-8f62-a71df4e53f9e","year":2024},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2408.16767","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:e06d25aef34a0aa663650090a1840a894546a9e23826c0b5aa850dbdfd0e5e2e","observation_id":"e51c31cd-74e5-4487-b443-017cd9adbc15","resolution":{"observed_at":"2026-07-07T14:33:54.365614Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03453","last_updated":"2024-04-15T10:28:44Z","snapshot_observed_at":"2026-08-12T22:52:54.817720Z","submitted_at":"2023-09-07T02:28:04Z","title":"SyncDreamer: Generating Multiview-consistent Images from a Single-view Image","version":2},"cited_work":{"arxiv_id":"2309.03453","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.03453","snapshot_observed_at":"2026-07-08T01:44:26.219240Z","title":"SyncDreamer: Generating Multiview-consistent Images from a Single-view Image","venue":"cs.CV","work_id":"b0c47120-5c87-4e79-8fe8-1be8e49f855f","year":2023},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2309.03453","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:698102fefe9bdc01a0325653372ea780219016dfe3d17ff4d7fac2afab2271b2","observation_id":"68ce6242-cb2f-4d61-aae2-b8f1ef54a8b5","resolution":{"observed_at":"2026-07-07T14:33:54.363070Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:cb2541e3b26773f00ee4cb6c6c9c3d8eee4db5e941bf8b7a2f1406d406664453","observation_id":"56e13937-be4e-42f4-9895-fb25c44cce7b","resolution":{"observed_at":"2026-07-07T14:33:54.336673Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19365","last_updated":"2026-04-08T04:08:23Z","snapshot_observed_at":"2026-08-11T04:23:34.279866Z","submitted_at":"2025-11-24T17:59:06Z","title":"DeCo: Frequency-Decoupled Pixel Diffusion for End-to-End Image Generation","version":2},"cited_work":{"arxiv_id":"2511.19365","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.19365","snapshot_observed_at":"2026-07-08T07:34:43.075395Z","title":"DeCo: Frequency-Decoupled Pixel Diffusion for End-to-End Image Generation","venue":"cs.CV","work_id":"7e4eb349-4cb7-4a73-92eb-800ed71ce9ab","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2511.19365","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:4baa07e756453f59e979e73688fd5a724f127c7991d40c076ce554c78efa3043","observation_id":"e81fe178-9365-4c09-98ed-8acc0f403ae4","resolution":{"observed_at":"2026-07-07T14:33:54.360641Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2307.01952","doi":"10.48500/arxiv.2307.01952","metadata_source":"pith","pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"8034c587-fba6-4941-87ba-c98f2ac962cb","year":2023},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:19e1daf4f5212fcfa7625a4b00ebb730fb336f3f084e853b01b4696d88f57ab6","observation_id":"8c8b1d3d-5ec4-4c45-b9f5-419ba669fedb","resolution":{"observed_at":"2026-07-07T14:33:54.370982Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":"2209.14988","doi":"10.48550/arxiv.2209.14988","metadata_source":"pith","pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","venue":"cs.CV","work_id":"7529df29-9980-4a8a-b55e-307e3c2f357b","year":2022},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:72bc90700cc9d6bfea64baec031607c1ef68a33fb56352d79a2b3cd1a6bcdde3","observation_id":"236468cd-07bd-46f4-9573-4e196d889372","resolution":{"observed_at":"2026-07-07T14:33:54.368069Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:01.924447+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:01.924447+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17994","last_updated":"2024-04-24T01:08:12Z","snapshot_observed_at":"2026-08-16T14:48:20.855879Z","submitted_at":"2023-10-27T09:06:43Z","title":"ZeroNVS: Zero-Shot 360-Degree View Synthesis from a Single Image","version":2},"cited_work":{"arxiv_id":"2310.17994","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.17994","snapshot_observed_at":"2026-07-07T14:33:54.329709Z","title":"Zeronvs: Zero-shot 360-degree view synthesis from a single image","venue":"cs.CV","work_id":"4c0f03b7-61fc-44a6-a4bb-a36c2d4518d2","year":2023},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2310.17994","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:732a15d52a6ac5c988b0e25b6d2358fceceabe9745e813bfaa930f8244e63b05","observation_id":"e023ffd8-1c42-436a-a48c-be906669aa11","resolution":{"observed_at":"2026-07-07T14:33:54.331004Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.475133Z","title":"Post-training quantization on diffusion models","venue":null,"work_id":"a1ab86c3-efe4-4869-8a91-3f5c82e514e6","year":1972},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:b774de364b37ac2d0f8e4831968ebbc9e5f0f25cdfaf628cb592386a834d638a","observation_id":"3c40d51a-2791-43d0-a2cb-8353ccf58d7b","resolution":{"observed_at":"2026-07-07T14:33:54.476589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":"2002.05202","doi":"10.48550/arxiv.2002.05202","metadata_source":"pith","pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLU Variants Improve Transformer","venue":"cs.LG","work_id":"17d0763c-1016-41ab-a478-478e890765eb","year":2020},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:fe3bea84fecf320d4522313171b660ba4fd5a48c6cc68bc3117be29c35ed9325","observation_id":"0500766c-edfe-4d4e-a053-3c74759c80d8","resolution":{"observed_at":"2026-07-07T14:33:54.403843Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.15301","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.398527Z","title":"Latent diffusion model without variational autoencoder","venue":null,"work_id":"ab5fd0eb-3300-410d-a690-19e04b2a7770","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:5a6cf3b9fb68cea586c860ff18b6995c0939218712c5c14e9e43d03e810a33aa","observation_id":"d4f02c8a-3065-4026-bb22-663970f693d3","resolution":{"observed_at":"2026-07-07T14:33:54.400245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-08-17T23:11:03.362702Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":"2308.16512","doi":"10.48550/arxiv.2308.16512","metadata_source":"pith","pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MVDream: Multi-view Diffusion for 3D Generation","venue":"cs.CV","work_id":"269d1cf4-9ad9-4b6b-8f5f-da1567956dd6","year":2023},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:c0ff84716065bd7f2cc1996a566433b0faeae8b262fae2aee771fb66b757c26c","observation_id":"09ee3e4e-1ca8-4f11-90ef-300a6c00731d","resolution":{"observed_at":"2026-07-07T14:33:54.373632Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:38:17.236325+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:38:17.236325+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04928","last_updated":"2024-11-07T18:07:31Z","snapshot_observed_at":"2026-08-16T13:02:01.454341Z","submitted_at":"2024-11-07T18:07:31Z","title":"DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion","version":1},"cited_work":{"arxiv_id":"2411.04928","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.04928","snapshot_observed_at":"2026-07-07T14:33:54.345685Z","title":"Dimen- sionx: Create any 3d and 4d scenes from a single image with controllable video diffusion","venue":"cs.CV","work_id":"c0c2b97f-2c4b-4f39-b154-6ced939a883d","year":2024},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2411.04928","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:ea55a7c5525ccde310a9a49fdf1b369d92e20a53b3e49dd17b5dbd3cd9ee3edd","observation_id":"688c0fc0-c6b2-4958-b029-533559ceb455","resolution":{"observed_at":"2026-07-07T14:33:54.347002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.12655","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.326479Z","title":"Vggt-world: Transforming vggt into an autoregressive geometry world model.arXiv preprint arXiv:2603.12655","venue":null,"work_id":"b7b59e3d-ce2c-4885-a9df-55344cc848bc","year":2026},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:665619ad3bf643149c632297fca2e70ecfb6284ae0cad5614e783f30f403cb48","observation_id":"066c8814-aa2d-4034-a15f-5a2472ed4149","resolution":{"observed_at":"2026-07-07T14:33:54.328505Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16653","last_updated":"2024-03-29T08:39:23Z","snapshot_observed_at":"2026-07-06T16:25:05.493379Z","submitted_at":"2023-09-28T17:55:05Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","version":2},"cited_work":{"arxiv_id":"2309.16653","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.16653","snapshot_observed_at":"2026-07-08T01:44:26.267895Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","venue":"cs.CV","work_id":"790b039f-2f31-4657-93ac-f802a85cd72a","year":2023},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2309.16653","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:2b4e036906c9950872dcb344dc3c22e4d2ae87cb3d8b51666b09b0bc01999667","observation_id":"4895085a-c693-444c-96ce-37c0ebccc1a1","resolution":{"observed_at":"2026-07-07T14:33:54.387760Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:24fb85de99ae4ad051861aac99a2264b1b0ccebb0c0bf1b3257676c17d60afdf","observation_id":"0728fc9c-d0bc-44a5-9c14-1727d2e39852","resolution":{"observed_at":"2026-07-07T14:33:54.319468Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20644","last_updated":"2025-03-26T15:37:17Z","snapshot_observed_at":"2026-08-16T12:46:35.767910Z","submitted_at":"2025-03-26T15:37:17Z","title":"MMGen: Unified Multi-modal Image Generation and Understanding in One Go","version":1},"cited_work":{"arxiv_id":"2503.20644","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.20644","snapshot_observed_at":"2026-07-07T14:33:54.337921Z","title":"Mmgen: Unified multi-modal image generation and understanding in one go","venue":"cs.CV","work_id":"4962fa2a-d989-4c59-ae4d-bca36e88dc53","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2503.20644","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:fa20e1500adae4606d83a6842980618271fe3c36b3bd37b6bb9d8a359d74f698","observation_id":"80b00ac2-d3b6-4271-9e71-96f9dd102d15","resolution":{"observed_at":"2026-07-07T14:33:54.339211Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.13347","last_updated":"2026-03-07T07:01:59Z","snapshot_observed_at":"2026-08-18T07:52:03.034005Z","submitted_at":"2025-07-17T17:59:53Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","version":3},"cited_work":{"arxiv_id":"2507.13347","doi":"10.48550/arxiv.2507.13347","metadata_source":"pith","pith_arxiv_id":"2507.13347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi^3$: Permutation-Equivariant Visual Geometry Learning","venue":"cs.CV","work_id":"8ab9cfd6-a60d-45e6-a572-9b4db82b8527","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2507.13347","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:47db282620771c97c313b3580afae6def63880d8a13709aed74f95833f35b973","observation_id":"db4a1bc3-f636-4c2e-a9c7-c5f463b1f86d","resolution":{"observed_at":"2026-07-07T14:33:54.397136Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07982","last_updated":"2026-05-05T14:55:01Z","snapshot_observed_at":"2026-08-14T21:13:23.101760Z","submitted_at":"2025-07-10T17:55:08Z","title":"Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling","version":2},"cited_work":{"arxiv_id":"2507.07982","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.07982","snapshot_observed_at":"2026-07-07T14:33:54.305490Z","title":"Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling","venue":"cs.CV","work_id":"7c214f4a-d3ff-48e7-bd13-043eb9c139cb","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2507.07982","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:6f873517ea86e07cc0ce1d324688a8d2d328b31b3ed7817adc1288dc798ea037","observation_id":"65973d3c-872f-4dba-a589-05a1d143c19a","resolution":{"observed_at":"2026-07-07T14:33:54.306847Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15922","last_updated":"2026-02-17T15:04:02Z","snapshot_observed_at":"2026-08-09T12:54:21.149243Z","submitted_at":"2026-02-17T15:04:02Z","title":"World Action Models are Zero-shot Policies","version":1},"cited_work":{"arxiv_id":"2602.15922","doi":"10.48550/arxiv.2602.15922","metadata_source":"pith","pith_arxiv_id":"2602.15922","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"World Action Models are Zero-shot Policies","venue":"cs.RO","work_id":"9a85fc69-74df-450e-94cd-69d186e9e830","year":2026},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2602.15922","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:8a27dd1855ac2d6072e474d0ec064aa499ee494e74580187bca5e1392c2f3669","observation_id":"e32cb9e2-4e14-49d4-8899-ea477b308bb8","resolution":{"observed_at":"2026-07-07T14:33:54.314710Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.958796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.958796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.20645","last_updated":"2026-04-16T17:04:25Z","snapshot_observed_at":"2026-08-16T01:24:03.000139Z","submitted_at":"2025-11-25T18:59:25Z","title":"PixelDiT: Pixel Diffusion Transformers for Image Generation","version":2},"cited_work":{"arxiv_id":"2511.20645","doi":"10.48550/arxiv.2511.20645","metadata_source":"pith","pith_arxiv_id":"2511.20645","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"PixelDiT: Pixel Diffusion Transformers for Image Generation","venue":"cs.CV","work_id":"7d675dc1-dc0d-4f02-81fc-aba652d0753a","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2511.20645","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:05e7e9f75a484b274df50cc740ae9facdee90d201a495c140ae1f36204428c2e","observation_id":"e7590d49-54e6-4657-8c8f-6288df648c23","resolution":{"observed_at":"2026-07-07T14:33:54.341669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02319","last_updated":"2024-11-05T06:08:43Z","snapshot_observed_at":"2026-08-16T13:03:04.838761Z","submitted_at":"2024-11-04T17:45:44Z","title":"GenXD: Generating Any 3D and 4D Scenes","version":2},"cited_work":{"arxiv_id":"2411.02319","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.02319","snapshot_observed_at":"2026-07-07T14:33:54.303149Z","title":"Genxd: Generating any 3d and 4d scenes","venue":"cs.CV","work_id":"e8253c41-3568-4ea6-bfb9-0d8e589c07ce","year":2024},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2411.02319","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:5a3b32c04838ea767c5aa63767f0f8043295939dcd8bd707636122f9d0429f05","observation_id":"7dd93b66-eb7b-4256-b918-536614260a3f","resolution":{"observed_at":"2026-07-07T14:33:54.304306Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.11690","last_updated":"2025-10-13T17:51:39Z","snapshot_observed_at":"2026-08-13T23:51:28.874833Z","submitted_at":"2025-10-13T17:51:39Z","title":"Diffusion Transformers with Representation Autoencoders","version":1},"cited_work":{"arxiv_id":"2510.11690","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.11690","snapshot_observed_at":"2026-07-10T18:47:31.703880Z","title":"Diffusion Transformers with Representation Autoencoders","venue":"cs.CV","work_id":"c1a2d4de-4439-4005-8c56-e0124e4ed5fa","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"cited_paper":"/paper/2510.11690","citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:c6d914142b240faa9b7ef7e94d8a3afe4dbc4bfc9dd53f91aabc93b2233f2e99","observation_id":"17cac515-4159-4588-85a1-92017f29704f","resolution":{"observed_at":"2026-07-07T14:33:54.312302Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.01528","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:25.568577Z","title":"Drivinggen: A comprehensive benchmark for generative video world models in autonomous driving.arXiv preprint arXiv:2601.01528","venue":null,"work_id":"e93fd55e-0610-4b4d-8497-671654903083","year":2026},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:f28d56336397053080f98a324b93e374e86d1272d9b16e8f1e33c1adabe0a12b","observation_id":"6180c39a-5042-473b-8dd6-cd7489680476","resolution":{"observed_at":"2026-07-07T14:33:54.325376Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9540.6170","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.348293Z","title":null,"venue":null,"work_id":"ad775d95-6e69-4ab8-b4cf-60116a7663ea","year":null},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:5c93956a0087addaa433bd234136e1f489b52b52ded0227df3b63d888c19c20a","observation_id":"bd27d1c9-39f0-4f43-b7cd-28adf82412ff","resolution":{"observed_at":"2026-07-07T14:33:54.349857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.479068Z","title":"Finally, Fig","venue":null,"work_id":"df33c98b-50ca-4ba5-9f7d-a4109e4195e9","year":2023},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:1129dd523c4c64ac8d0bb773e592c4126d259daeac6dd1d88c965f62136adced","observation_id":"8e10e4a9-62cd-47f8-9772-417a19bf93b4","resolution":{"observed_at":"2026-07-07T14:33:54.480169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.477205Z","title":"Best inbold; second best underlined","venue":null,"work_id":"df8a61fe-b2de-4d86-930f-1321dc748866","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:a2fd46ab85408c61b0e592ad1faa93a61a5444dfa40d6c709b942fd9b4f36d1c","observation_id":"1fd023a4-228c-4d35-bf02-cfaa7fbefec4","resolution":{"observed_at":"2026-07-07T14:33:54.478534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.482732Z","title":null,"venue":null,"work_id":"55769baa-f9da-4264-85a1-7df214162ae3","year":2025},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:bc9ea76455efcf38b678ab592426eccd3600033b260abaa0899577bf5eb450ef","observation_id":"3e9df017-a86f-4257-b9a5-2b6904b4e275","resolution":{"observed_at":"2026-07-07T14:33:54.483813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:33:54.480760Z","title":"PixWorld takes a step toward unifying 3D scene reconstruction and generation in pixel space, but several directions remain open","venue":null,"work_id":"8e8b1e40-2714-4182-85b2-fbad624c6e40","year":2023},"citing_paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-07T14:29:23.795094Z"},"links":{"citing_paper":"/paper/2607.05373"},"observation_digest":"sha256:be5c8bf66da13d3ad6f5680407d03517b3fcaeb5b07c0a687e50cf71b6a32686","observation_id":"90d60479-ec39-430e-8691-86f97af849ad","resolution":{"observed_at":"2026-07-07T14:33:54.482172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.05373","last_updated":"2026-07-06T17:51:00Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T17:03:48.645903Z","submitted_at":"2026-07-06T17:51:00Z","title":"PixWorld: Unifying 3D Scene Generation and Reconstruction in Pixel Space"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":1,"verified_exact":35,"verified_fuzzy":4},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2607.05373."}