{"as_of":"2026-08-06T02:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d1f0ed422a6cdb87d09907e67808ddc9157849268db0beda9ff661ede6ee3214","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T22:28:54.031663Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T22:17:54.684366Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-01T22:46:19.626989Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2604.21592","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.21592","snapshot_observed_at":"2026-07-01T22:46:19.626989Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","venue":"cs.CV","work_id":"ce2b1ced-f783-40c6-a8fe-db60b791a7e9","year":2026},"citing_paper":{"arxiv_id":"2605.26109","last_updated":"2026-05-25T17:59:22Z","snapshot_observed_at":"2026-07-30T09:25:16.493692Z","submitted_at":"2026-05-25T17:59:22Z","title":"Helix4D: Complex 4D Mesh Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T22:17:54.684366Z"},"links":{"cited_paper":"/paper/2604.21592","citing_paper":"/paper/2605.26109"},"observation_digest":"sha256:8dea66d086c9559dbba718692ce3d356d5bef685610cfc57b94703138b3f6014","observation_id":"d7c6f7cb-c77f-4bd7-b019-60444535996e","resolution":{"observed_at":"2026-06-29T22:24:00.581508Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2604.21592","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.21592","snapshot_observed_at":"2026-07-01T22:46:19.626989Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","venue":"cs.CV","work_id":"ce2b1ced-f783-40c6-a8fe-db60b791a7e9","year":2026},"citing_paper":{"arxiv_id":"2606.02491","last_updated":"2026-06-01T17:01:21Z","snapshot_observed_at":"2026-08-03T04:26:51.126265Z","submitted_at":"2026-06-01T17:01:21Z","title":"MORPHOS: Autoregressive 4D Generation with Temporal Structured Latents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T15:03:22.366584Z"},"links":{"cited_paper":"/paper/2604.21592","citing_paper":"/paper/2606.02491"},"observation_digest":"sha256:f2b52fc77e62b4000415c9559824c78b1b85088f90ec9ea0416b8fc74fb3a3b9","observation_id":"6d1d35bd-a4c8-4e7b-8588-c1a836131277","resolution":{"observed_at":"2026-07-01T22:46:19.628676Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.21592/citation-record","integrity":"/paper/2604.21592/integrity","json":"/paper/2604.21592/citation-record.json","paper":"/paper/2604.21592"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"4d-fy: Text-to-4d generation using hybrid score distillation sampling","venue":null,"work_id":"d571a60d-6bc9-4a7a-a4c8-7431aed0a377","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:5cc34496186ec8587b4a3c96400a019bc974a06d74745934a306790e69d61e93","observation_id":"1a9c03a9-de32-4704-9ae7-8a5024099a72","resolution":{"observed_at":"2026-05-23T14:33:09.010571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":"2004.05150","doi":"10.48550/arxiv.2004.05150","metadata_source":"pith","pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Longformer: The Long-Document Transformer","venue":"cs.CL","work_id":"abea7a44-6668-4de7-aab6-f53a6e5aa088","year":2020},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:b143b8c688a10ffc7591a1efe2daf4b40d157dccc8210d9de095f47fca22181f","observation_id":"05be9940-dd7a-4ade-8f99-657f0f99313d","resolution":{"observed_at":"2026-05-10T13:29:59.004618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large-vocabulary 3d diffusion model with transformer","venue":null,"work_id":"5b026338-2bf9-44b6-a563-e490d8c66660","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:8c9e6165395ab1a33191888395579fdf6036e6bf398c1e8fbc5b084e9a56f43d","observation_id":"b88ee785-532f-4a11-858c-a8b55072d6a3","resolution":{"observed_at":"2026-05-23T14:33:09.022084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient geometry-aware 3d generative adversarial networks","venue":null,"work_id":"ecad0fc1-be01-4a0b-875e-01c398c0dbe6","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:bbc46cccb2345b6bbdd8dddbdebefc6f857db5eaf3b13826922bcfb40dfb4103","observation_id":"6a79c2a1-a5e2-464b-b450-82bec7e2a3e6","resolution":{"observed_at":"2026-05-23T14:33:09.038497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09631","last_updated":"2025-07-29T10:07:37Z","snapshot_observed_at":"2026-08-04T04:38:42.907063Z","submitted_at":"2025-03-11T19:22:14Z","title":"V2M4: 4D Mesh Animation Reconstruction from a Single Monocular Video","version":2},"cited_work":{"arxiv_id":"2503.09631","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.09631","snapshot_observed_at":"2026-07-04T19:40:06.068998Z","title":"V2m4: 4d mesh animation reconstruction from a single monocular video","venue":null,"work_id":"c1c705c1-8daf-49c3-b522-8adddc4789ab","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2503.09631","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:7eab1d24d01ed3660cefa22b4edfaef8654c252a30b90219a8cd80b6e6cffdc0","observation_id":"0e7d51c5-6f0a-4eed-bbd3-3f22bc763dd5","resolution":{"observed_at":"2026-05-09T22:29:06.498923Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Primdiffusion: V olumetric prim- itives diffusion for 3d human generation.NeurIPS","venue":null,"work_id":"3dfa0046-3058-4005-98e2-eb2a98a97854","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:c8d909159faa7be1d4fa6f16e5c83d970f47459f03fa7a467b3d5417c8ac8d6a","observation_id":"0a0275ae-e822-4c3f-ad3c-380618518794","resolution":{"observed_at":"2026-05-23T14:33:09.003139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Objaverse-xl: A universe of 10m+ 3d objects","venue":null,"work_id":"7e29984f-86c4-4f26-a15c-95f717b78d4a","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:5ba39133cbb8da11796362a80f110adf5ae7b3303a186542136cd6529fbbb05e","observation_id":"e1616b55-7ee5-4b26-83de-d34d267ee380","resolution":{"observed_at":"2026-05-23T14:33:09.006676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":"5eeae9cc-d819-4784-98ee-7cc4a59dfc2e","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:b0e8648ef95e05b484a84a5f76d6ff584780fb34ef7838cf2959d590f29e7a31","observation_id":"2a1bcfe0-7686-4e0a-a9f8-6c9d58fa1848","resolution":{"observed_at":"2026-05-23T14:33:08.986501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gram: Generative radiance manifolds for 3d-aware image generation","venue":null,"work_id":"41a534d9-a41f-4290-81a4-3d759c746b56","year":2022},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:1056a4bf0e4a61d68045f34082a81caf813b889d5b99824e599c2058127c9759","observation_id":"c37bcf65-c4a8-4359-bfac-c11e8ef3fbfe","resolution":{"observed_at":"2026-05-23T14:33:08.990582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Get3d: A generative model of high quality 3d textured shapes learned from images.NeurIPS","venue":null,"work_id":"5ceadae7-7a61-4c9f-8900-d3883ef72a53","year":2022},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:67fdbb94b2a3c869de9896593687325069d22aa7395f7f9e2bbb071b7b542d6e","observation_id":"fd28acea-d279-41a7-98df-cbfb3fc68088","resolution":{"observed_at":"2026-05-23T14:33:08.982227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Block Sparse Attention","venue":null,"work_id":"4922e619-e9fe-447d-b119-c3f05e8da620","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:3c0dc4bda302aaff69c4f6a9d89b0e22277546925c0ce4aaa1dda63d5e65597a","observation_id":"caa4f823-3112-4b02-bd3a-b53799fb11a0","resolution":{"observed_at":"2026-05-23T14:33:08.978232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gvgen: Text-to-3d generation with volumetric representation","venue":null,"work_id":"1c3def9e-f1b5-49ba-b67a-e5d8e8927188","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:0e1e3e4312c78107e8851ccb54a6bc91ae5cac87e05dea4c234fc5f8be759d4b","observation_id":"8a16e237-410a-4840-b38b-5bc39943fe92","resolution":{"observed_at":"2026-05-23T14:33:08.998972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15442","last_updated":"2025-06-18T13:14:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-18T13:14:46Z","title":"Hunyuan3D 2.1: From Images to High-Fidelity 3D Assets with Production-Ready PBR Material","version":1},"cited_work":{"arxiv_id":"2506.15442","doi":"10.48550/arxiv.2506.15442","metadata_source":"pith","pith_arxiv_id":"2506.15442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuan3D 2.1: From Images to High-Fidelity 3D Assets with Production-Ready PBR Material","venue":"cs.CV","work_id":"ee52f4d7-462f-4491-9549-4160820ae563","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2506.15442","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:b77e850441159e1ee7fad4f6365c758022571000f5679a61d924caa9e04e3e81","observation_id":"fd289ebf-7eb5-4d63-977c-b65226a33878","resolution":{"observed_at":"2026-05-17T23:10:17.882063Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Consistent4d: Consistent 360° dynamic object generation from monocular video","venue":null,"work_id":"212ab119-2347-47e8-b809-700aa47cb3ee","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:8a90f79488978a685b868c552919b3c64c27b464981f5dbd4bdb649811d22b47","observation_id":"ac388096-8795-4646-ae4c-d69529ef01d2","resolution":{"observed_at":"2026-05-23T14:33:09.026457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Animate3d: Animating any 3d model with multi-view video diffusion.NeurIPS","venue":null,"work_id":"abd90475-eec2-4406-98cd-62f531e1886f","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:14165efce0266584ad3651b9bc6255b38a13fe0350e49fc67beae5be9e8f0828","observation_id":"2eaaa75f-c3db-42b5-841e-21f28f286334","resolution":{"observed_at":"2026-05-23T14:33:08.958581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02463","last_updated":"2023-05-03T23:59:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-03T23:59:13Z","title":"Shap-E: Generating Conditional 3D Implicit Functions","version":1},"cited_work":{"arxiv_id":"2305.02463","doi":"10.48550/arxiv.2305.02463","metadata_source":"pith","pith_arxiv_id":"2305.02463","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Shap-E: Generating Conditional 3D Implicit Functions","venue":"cs.CV","work_id":"d292f6b0-b538-459b-b332-ee3b7a0e4fbe","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2305.02463","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:209a2ffd7707911b6412951b10ee228551918c448c413c8869712f3a14c01a27","observation_id":"36e82a81-54c6-4ca8-99fe-8cd5df8ca430","resolution":{"observed_at":"2026-05-16T15:32:06.918889Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:47.59901+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:47.59901+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vivid-zoo: Multi-view video generation with diffusion model.NeurIPS","venue":null,"work_id":"198df7cb-af9a-44f6-8757-ec9ea99db1ef","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:11156d3691fd334da0ecf54667502e863ac5c82f67d94d686e8271712d74ad13","observation_id":"1e741e5f-d4f9-4b51-a0c1-0dde0c191040","resolution":{"observed_at":"2026-05-23T14:33:08.950761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07747","last_updated":"2025-05-12T16:56:30Z","snapshot_observed_at":"2026-07-06T21:22:40.740091Z","submitted_at":"2025-05-12T16:56:30Z","title":"Step1X-3D: Towards High-Fidelity and Controllable Generation of Textured 3D Assets","version":1},"cited_work":{"arxiv_id":"2505.07747","doi":"10.48550/arxiv.2505.07747","metadata_source":"pith","pith_arxiv_id":"2505.07747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Step1x-3d: Towards high-fidelity and con- trollable generation of textured 3d assets","venue":"cs.CV","work_id":"1cdeb279-0284-49b7-be5b-2cc26e262cb3","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2505.07747","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:86f758cf2011113bac72d98627e9d1e1ca2a4318e2f2dbebee31055668a9d01e","observation_id":"ece02cc2-948d-44cc-a5b3-23210f8593dc","resolution":{"observed_at":"2026-05-09T22:29:06.491384Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.19852","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:49:41.548735Z","title":"Radial attention:O(nlogn)sparse attention with energy decay for long video generation","venue":null,"work_id":"f37b4eb0-dbad-4cee-a31f-d0b68241edc3","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:4c3e1fd44cd7e48180711b6b3799a0286a14582a0c55afb463c28228dbc03af5","observation_id":"36829506-e601-472a-842f-7cdbe41e23cf","resolution":{"observed_at":"2026-05-09T22:29:06.493915Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreammesh4d: Video-to-4d generation with sparse-controlled gaussian-mesh hybrid representation.NeurIPS","venue":null,"work_id":"a7f45072-521c-4100-b166-4c458c1a82ed","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:8b068c74214db3ec0ccb5b3f928d7e2e8ffec7f3d18cc3e6c9ac442d352e44f1","observation_id":"79843fc1-edfb-4a74-9ab9-272344480baf","resolution":{"observed_at":"2026-05-23T14:33:08.954804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion4d: fast spatial-temporal consistent 4d generation via video diffusion models","venue":null,"work_id":"4d5023b8-1600-4c07-98b3-01f6fc6c51f1","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:3b0e07d2416484efb22dc7d6f78e02179759260dd5ec66599a38421460bfab66","observation_id":"f1950b08-db26-4f8f-b977-c9276fe69685","resolution":{"observed_at":"2026-05-23T14:33:08.962564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Align your gaussians: Text-to-4d with dynamic 3d gaussians and composed diffusion models","venue":null,"work_id":"33e56bfc-11d3-46ca-a70a-a68039f04f60","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:38df08c3279aa011ed9d307f95ebf5022ece2c903f6af6e773d41b3ff261e875","observation_id":"795769c6-8a6e-4378-82d4-0829d7d27038","resolution":{"observed_at":"2026-05-23T14:33:08.966422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffrf: Rendering-guided 3d radiance field diffusion","venue":null,"work_id":"757452ac-7505-4922-8367-a8a8d2acb331","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:9c08b14d9bcb6f1d508aca0ad3a33535b22a2f7341bef9c89319bfffc14e3512","observation_id":"02e31aae-1dd3-4430-b181-98acd9423fed","resolution":{"observed_at":"2026-05-23T14:33:08.994775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":"2304.07193","doi":"10.48550/arxiv.2304.07193","metadata_source":"pith","pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv2: Learning Robust Visual Features without Supervision","venue":"cs.CV","work_id":"26b304e5-b54a-4f26-be7e-83299eca52e4","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:12686affba05c75ff9e2c42978fd967d5ea43cea0c314a64f9407ef841047d72","observation_id":"83637fd5-d1b6-457f-ad18-5b48116419c8","resolution":{"observed_at":"2026-05-09T22:29:06.474421Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"2655524e-ed03-409a-b33e-f578ae43591f","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:735f0d53ee94dc7417fba949decb1a612874f4ca8113fa6a2489a7f56f23bb66","observation_id":"0b18cbdf-0f9d-4fce-a132-7f703d7b454c","resolution":{"observed_at":"2026-05-23T14:33:09.046814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A benchmark dataset and evaluation methodology for video object segmentation","venue":null,"work_id":"791aea15-6666-4043-aed2-9cb1d61ada4c","year":2016},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:06ddadcb993fff4aca104f63a197774250e976fff6a4a6bd9976eef47572cb9d","observation_id":"3bee3593-73f6-4b50-b422-255dbb448e5d","resolution":{"observed_at":"2026-05-23T14:33:09.014139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":"00dbae04-8903-450a-8dac-b97d52823d02","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:5ba2eb3b36223e2fd88c47b2a04f030215e450bff4221a04b9d2dfe869aeb14b","observation_id":"95a986c3-fcd3-4b5c-93dc-2173c94e0d8f","resolution":{"observed_at":"2026-05-23T14:33:09.182805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17142","last_updated":"2024-06-10T14:07:53Z","snapshot_observed_at":"2026-08-01T13:37:17.913862Z","submitted_at":"2023-12-28T17:16:44Z","title":"DreamGaussian4D: Generative 4D Gaussian Splatting","version":3},"cited_work":{"arxiv_id":"2312.17142","doi":"10.48550/arxiv.2312.17142","metadata_source":"pith","pith_arxiv_id":"2312.17142","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DreamGaussian4D: Generative 4D gaussian splatting.arXiv preprint arXiv:2312.17142","venue":"cs.CV","work_id":"a77db059-69dd-4a1e-929f-a8b1d4acdd28","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2312.17142","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:46fde32ad67c632b6c047e94490f0b62b045a3234221f20098ddf4f45979a442","observation_id":"4db74d71-688e-4a47-adee-27d712d6fc90","resolution":{"observed_at":"2026-05-09T22:29:06.479482Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"L4gm: large 4d gaussian reconstruction model","venue":null,"work_id":"2b8570bd-6959-4252-a2a0-379b0c931268","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:5774490eeda191c0c2df4be643553a7e3b5598048e0c0fd1b5fba15ef84ce6f0","observation_id":"7b364857-1387-4bdb-b485-9f7b300f1b35","resolution":{"observed_at":"2026-05-23T14:33:09.186877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Outra- 9 geously large neural networks: The sparsely-gated mixture- of-experts layer","venue":null,"work_id":"c97a6523-99e3-4fd1-b031-18aab4ccc490","year":2017},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:03b68ab7e481d60cc1d65286bacc77331a8c17db24bb0da2dc54cb524d2a7c08","observation_id":"ad067149-2860-47dd-bf5d-e8bbd9ea9027","resolution":{"observed_at":"2026-05-23T14:33:09.165872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d neural field generation using triplane diffusion","venue":null,"work_id":"6051fdd0-00eb-4e92-8427-2cc483d6b0bd","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:4f7b564fa43a6d6d6c891e0377f9e68aecfd21c34b83830347c7cb3557d67a2e","observation_id":"7d56ff4a-f6d2-41ee-829a-aacc13c928dd","resolution":{"observed_at":"2026-05-23T14:33:09.170299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Text-to-4d dy- namic scene generation","venue":null,"work_id":"093e0117-3aa5-4fbf-811b-f1add6818cba","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:3dd1ce738e76fd18677fa45253cf45ab6955d6a50112a5879a922a0083b643c7","observation_id":"d51a0441-1988-4ba3-a8e1-2233914b122b","resolution":{"observed_at":"2026-05-23T14:33:09.178825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d generation on imagenet","venue":null,"work_id":"ba5b839a-5d52-49e8-bb5e-cc9d3178625f","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:c6ad8775b287c3a25f767e1b1f15275594b1414a6120f2a47fdfa7b9d6bfca71","observation_id":"5554cbb1-d606-4db9-8a90-42807cf0f414","resolution":{"observed_at":"2026-05-23T14:33:09.174462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"As-rigid-as-possible surface modeling","venue":null,"work_id":"0f2adb02-f5ee-4647-a0b5-3d7f6b637cfa","year":2007},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:1184ac9b6b2655a0cc82a624f73269e530e185550b06a07704a98dd2acf4cb3b","observation_id":"de5c5410-adcb-410c-9753-da0a4fd50d32","resolution":{"observed_at":"2026-05-23T14:33:09.195224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063","venue":null,"work_id":"d1af47bd-dd90-4dff-826b-302fd98831d3","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:f173804db1ec5cd0f0537536364b69d51be29fd57afbda697b41798a0fbcb7be","observation_id":"24d77e9f-cf85-474b-b1e4-cf3df2adc18f","resolution":{"observed_at":"2026-05-23T14:33:09.149278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eg4d: Explicit generation of 4d object without score distillation","venue":null,"work_id":"5180f65c-2738-4766-984f-3c5eea8dfb5c","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:512be43e6ff6e6895d297b9f4aa1fde82f9da8a41aba5b2d0c27c69c802ca0b7","observation_id":"ec3c2ff7-5dec-4103-8a9e-85b1f0d05c0b","resolution":{"observed_at":"2026-05-23T14:33:09.153594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04928","last_updated":"2024-11-07T18:07:31Z","snapshot_observed_at":"2026-07-06T19:46:50.403301Z","submitted_at":"2024-11-07T18:07:31Z","title":"DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion","version":1},"cited_work":{"arxiv_id":"2411.04928","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.04928","snapshot_observed_at":"2026-07-07T14:33:54.345685Z","title":"Dimen- sionx: Create any 3d and 4d scenes from a single image with controllable video diffusion","venue":"cs.CV","work_id":"c0c2b97f-2c4b-4f39-b154-6ced939a883d","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2411.04928","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:df69b9eb0edf8d7952dc7fff9789bc0e341dababe025afe7ae5b5830cff8edf0","observation_id":"2f834d82-383e-451b-bdc8-b69a3a4d597a","resolution":{"observed_at":"2026-05-09T22:29:06.506297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11459","last_updated":"2024-08-13T04:35:02Z","snapshot_observed_at":"2026-07-06T17:04:46.288600Z","submitted_at":"2023-12-18T18:59:05Z","title":"VolumeDiffusion: Flexible Text-to-3D Generation with Efficient Volumetric Encoder","version":3},"cited_work":{"arxiv_id":"2312.11459","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.11459","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"V olumediffu- sion: Flexible text-to-3d generation with efficient volumetric encoder","venue":null,"work_id":"3d94ad17-4bb6-4d70-897d-766e4f359c3f","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2312.11459","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:37ab189501ce2503bad416cef0a87cc8df8c7b5439ff2ad5fe84b1688ddf9d83","observation_id":"b62cf4f9-aad8-40e9-b4ee-60e3d20b8e5b","resolution":{"observed_at":"2026-05-09T22:29:06.508952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"4real-video: Learning generalizable photo-realistic 4d video diffusion","venue":null,"work_id":"5e8c901b-f49b-4363-bdcf-b4fdce1a2fd9","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:edba52ecbedf76395c79feca52311b95f5b772614fa80c46282e649dd899166b","observation_id":"32edf1e1-ac8a-4cf4-9b66-86bb2e0dad39","resolution":{"observed_at":"2026-05-23T14:33:09.091770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rodin: A generative model for sculpting 3d digital avatars using diffusion","venue":null,"work_id":"15e5506e-2241-4cc6-9a77-336d6c347c14","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:e95127fc746c0103c5b2efdd49ed2c209da11af856ac46a9203a733a090a77eb","observation_id":"b83176b9-5928-4787-9524-81381c965af5","resolution":{"observed_at":"2026-05-23T14:33:09.078958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning a probabilistic latent space of ob- ject shapes via 3d generative-adversarial modeling.NeurIPS","venue":null,"work_id":"6fcb649a-aaa3-4e58-aa33-983564da8aba","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:d328be3dee0ef94a77320f975091ad56510b2049b2057e0f8b368aa95eaf3ef6","observation_id":"7417113e-3784-4f1a-b514-9d7cf36ef60a","resolution":{"observed_at":"2026-05-23T14:33:09.087778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cat4d: Create anything in 4d with multi-view video diffusion models","venue":null,"work_id":"52e1b40b-80d5-4a45-9651-230f2038438a","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:e05e98febfaa96c561d763d695ebb9f44250d0e1761af687c67f7e20f12a03ce","observation_id":"eef797d8-da00-498e-8059-19b0bcd3425a","resolution":{"observed_at":"2026-05-23T14:33:09.103627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17412","last_updated":"2025-05-26T17:47:04Z","snapshot_observed_at":"2026-08-04T22:55:20.413619Z","submitted_at":"2025-05-23T02:58:01Z","title":"Direct3D-S2: Gigascale 3D Generation Made Easy with Spatial Sparse Attention","version":2},"cited_work":{"arxiv_id":"2505.17412","doi":"10.48550/arxiv.2505.17412","metadata_source":"pith","pith_arxiv_id":"2505.17412","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Direct3d-s2: Gigascale 3d generation made easy with spatial sparse attention","venue":"cs.CV","work_id":"a2a1ea9e-9ac0-45a0-9600-468e27e83389","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2505.17412","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:4f2ca94118496824ee2c0df4fa353d9e6d351795c857baf047665860468a0815","observation_id":"b0351189-abaa-4efe-9733-2366447ac99d","resolution":{"observed_at":"2026-05-09T22:29:06.503766Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gram-hd: 3d-consistent image generation at high resolution with generative radiance manifolds","venue":null,"work_id":"afa164ab-6e5f-4f02-8456-1338eed90a55","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:782e81fe327da44765f53a599bb7163ef5806c3f75450c88aa986ebfb67dc99c","observation_id":"9818e501-0566-4821-9793-fa32c062831d","resolution":{"observed_at":"2026-05-23T14:33:09.061892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Structured 3d latents for scalable and versatile 3d generation","venue":null,"work_id":"b36b067d-7556-4dd6-a793-f65602b2e884","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:aa1489d305e87e6bdc86bb52e470b37f6aba00d0ef59ce657aa647458eb10ee3","observation_id":"d411ee83-f623-47ee-a2c8-b06f5be24032","resolution":{"observed_at":"2026-05-23T14:33:09.083376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"c4d0bdaa-9302-4f56-9aef-6c2b5c63ec21","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:ad87e89363f242fe0ccce9b9924d3b8469c56260422bc75b8c58cd2744b1b12f","observation_id":"24341886-2f3f-4f95-98b5-b44d713904bd","resolution":{"observed_at":"2026-05-23T14:33:09.140271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sv4d: Dynamic 3d content generation with multi-frame and multi-view consistency","venue":null,"work_id":"487d6ca7-05a2-4f8d-97f2-36ccdc764508","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:ac37cbf723a6fd9ab9ef3f042317c70bb0a8933e360453e3fcf92cc3c60aff0f","observation_id":"2b4f1fe3-02a8-41a1-941b-efd8448c2758","resolution":{"observed_at":"2026-05-23T14:33:09.034227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion2: Dynamic 3d content generation via score composition of video and multi-view diffusion models","venue":null,"work_id":"538b7e53-54cf-45c9-916f-e20d089098ca","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:80c359425985473aba708f5b20b4d4f2751ca24942eae507e2ed51256bea7ec4","observation_id":"97092edd-fe69-4c11-997c-fd61fa0bedc9","resolution":{"observed_at":"2026-05-23T14:33:09.053072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mosaic-sdf for 3d generative models","venue":null,"work_id":"039efdac-6235-4d3a-908e-e4cae0fc3975","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:aa27b69abd720689372bcaa5430251199d1a5f74586c1a1d8735e3293726487d","observation_id":"c6683a90-e4f3-44f0-b502-fe576366d7dc","resolution":{"observed_at":"2026-05-23T14:33:09.042560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.06208","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T08:06:48.089452Z","title":"Yenphraphai, A","venue":null,"work_id":"4e745101-7ea4-4f49-8b0a-5c3c4507d1c8","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:9a714693c4da9ec6ad31c459ed03c6c765b3c9dc0c5456ad32d86a582800488d","observation_id":"7d4c439b-a01d-41fd-920f-9dcb4e5d1d8c","resolution":{"observed_at":"2026-05-09T22:29:06.501306Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Splat4d: Diffusion-enhanced 4d gaussian splatting for tempo- rally and spatially consistent content creation","venue":null,"work_id":"458a6a13-a5dd-4b57-aaf3-8b7a7b3a9545","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:9b877bd51c0dffd490295991bef0b9f8f6dd08c3ca4a40cba9c2a4cda87ae382","observation_id":"d61acb43-0581-435f-adc6-c5844815a1ed","resolution":{"observed_at":"2026-05-23T14:33:09.070649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"4real: Towards photorealistic 4d scene generation via video diffusion models.NeurIPS","venue":null,"work_id":"a18ac53b-263f-4fc7-8575-3a920c3930da","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:02c000ad06e26e7b658006787b026ffbfa532bc0613c79972d285856455c8922","observation_id":"c570b505-5558-4ab7-a0e7-5f301ddfdbf9","resolution":{"observed_at":"2026-05-23T14:33:09.057517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Native sparse attention: Hardware- aligned and natively trainable sparse attention","venue":null,"work_id":"332691a0-2309-4111-91e0-931c692cee8a","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:286496e973c82154da82f1e384f5c66999fdbac02da24089ece2d4405a76dcf3","observation_id":"99391918-d9d0-4cda-9836-3925d4a6ddee","resolution":{"observed_at":"2026-05-23T14:33:09.066217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gavatar: Animatable 3d gaussian avatars with implicit mesh learning","venue":null,"work_id":"172943ee-af16-4248-b93d-6810a8677ad1","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:dbac3a4397ea426b4d7400f792d09c5aec259f3935a8211c28a3f06f97d2f8fa","observation_id":"6e5a1d47-24b1-4661-a570-7b0e398c6a1f","resolution":{"observed_at":"2026-05-23T14:33:09.095629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Big bird: Trans- formers for longer sequences.NeurIPS","venue":null,"work_id":"44fb3f45-febc-425d-ab84-789af75eb6ff","year":2020},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:8995015da9b22b2ee6b0ca82bdea0190dc1c6ee7c48275194f5959064edc3cf9","observation_id":"b90169dc-89cf-4027-8ee0-e5be788c2086","resolution":{"observed_at":"2026-05-23T14:33:09.144246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stag4d: Spatial-temporal anchored generative 4d gaussians","venue":null,"work_id":"0a79a786-6e27-432b-a9f7-2385dbcb350f","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:04cce7947ef7096c12f495224eac99403b74c5e2b5d61c2af521d08d1ec63a9c","observation_id":"052a9e22-8ffa-4c79-956e-ea4ee5005484","resolution":{"observed_at":"2026-05-23T14:33:09.018149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Root mean square layer normalization.NeurIPS","venue":null,"work_id":"3740a733-5dcc-4dec-97fc-9603072a1181","year":2019},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:8e103dad6b03ded31d521bb1c07d330c39e9532ce0ed97a5562144682f4bc914","observation_id":"b19cafb0-9a9d-483a-a55a-01dce1924f04","resolution":{"observed_at":"2026-05-23T14:33:09.157447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3dshape2vecset: A 3d shape representation for neural fields and generative diffusion models.TOG","venue":null,"work_id":"288c6f9c-9cf0-4b1b-8e82-5a5a9d4d814b","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:df2e2a8196345eb2cd8f5745d236496760410d9e3dfb907d97ebc7bffdf9e3a9","observation_id":"87f3dac5-f5eb-434a-a8ce-17a9a0c36572","resolution":{"observed_at":"2026-05-23T14:33:09.119354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rodinhd: High-fidelity 3d avatar generation with diffusion models","venue":null,"work_id":"1ba31485-998e-4782-b59e-49e7eedcd902","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:c2aea0b0f38e5d193b943f9e7a32c6fd83ae6904e216f1a00fb51fffa5bf312d","observation_id":"98e39c65-d0e0-460d-82f4-4ab8a834d49d","resolution":{"observed_at":"2026-05-23T14:33:09.115098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaussiancube: a structured and explicit radiance representa- tion for 3d generative modeling","venue":null,"work_id":"646493a6-a0c6-4593-b3ae-2956ab5f4f30","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:beb180086736e562259f13cbb68ef1ea5a4d6e2c00250c7da92c243b5f8bb979","observation_id":"2c333455-f124-4d9a-a0cd-84d929d261b3","resolution":{"observed_at":"2026-05-23T14:33:09.123336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaussian variation field diffusion for high-fidelity video-to-4d synthesis","venue":null,"work_id":"16bd4a6f-ab48-4a90-b36f-04cf034e882c","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:81e9e4d642d15b5471b837c03f84e28bf6927d7f755ab8a7816f31a194087203","observation_id":"30f85311-31cf-49b2-9e00-944f9f3cd137","resolution":{"observed_at":"2026-05-23T14:33:09.128194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"4diffusion: Multi-view video diffusion model for 4d generation","venue":null,"work_id":"7ae1f957-b91e-49e8-844a-68239167fe1d","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:63cc3cbb7bd9d8d70482b3bc478fd88077c1bc755bbd895f132cfcb464cfe7ea","observation_id":"d4389269-b0e4-4940-af16-4047ccc618bf","resolution":{"observed_at":"2026-05-23T14:33:09.111352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.12626","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:41.170375Z","title":"Lvmin Zhang, Shengqu Cai, Muyang Li, Chong Zeng, Beijia Lu, Anyi Rao, Song Han, Gordon Wetzstein, and Maneesh Agrawala","venue":null,"work_id":"346b7c9e-ca8e-406d-8770-be430b5f63eb","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:b2e3c4843ef30ade32c869d3e2541b74f1394a178235273de9283e1e6ae66f94","observation_id":"3a9af39c-0e45-4eb9-ab95-13557355d6ac","resolution":{"observed_at":"2026-05-09T22:29:06.476812Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14603","last_updated":"2024-02-19T02:30:14Z","snapshot_observed_at":"2026-07-06T16:52:00.070739Z","submitted_at":"2023-11-24T16:47:05Z","title":"Animate124: Animating One Image to 4D Dynamic Scene","version":2},"cited_work":{"arxiv_id":"2311.14603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.14603","snapshot_observed_at":"2026-07-04T07:59:40.212192Z","title":"Animate124: Animating one im- age to 4d dynamic scene.arXiv preprint arXiv:2311.14603","venue":null,"work_id":"888c749a-c63a-409e-9491-3de9c88f48cd","year":2023},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2311.14603","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:477e1f1f5890a0b03af7a2db4dbf9ddf5ae7213fc97f8632fa059d8e0cbc0176","observation_id":"a1bb5402-1bc1-4ef1-a76f-5eb03491bcbf","resolution":{"observed_at":"2026-05-09T22:29:06.482881Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12202","last_updated":"2026-05-14T15:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-21T15:16:54Z","title":"Hunyuan3D 2.0: Scaling Diffusion Models for High Resolution Textured 3D Assets Generation","version":5},"cited_work":{"arxiv_id":"2501.12202","doi":"10.48550/arxiv.2501.12202","metadata_source":"pith","pith_arxiv_id":"2501.12202","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hunyuan3D 2.0: Scaling Diffusion Models for High Resolution Textured 3D Assets Generation","venue":"cs.CV","work_id":"c2c8fc56-8c16-45fa-a5d6-23c9c3d0720b","year":2025},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"cited_paper":"/paper/2501.12202","citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:c2b2760f8166b1b1caa600d776e651234d7e45cd264308129cea832756ba5760","observation_id":"3530b4b9-2938-410f-bf29-734dc01f29ed","resolution":{"observed_at":"2026-05-09T22:29:06.486150Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sdf-stylegan: implicit sdf-based stylegan for 3d shape gener- ation","venue":null,"work_id":"51533683-a4c8-441a-84d9-bb0ee0994b32","year":2022},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:1f6c52f2d2d2e6275dfead5d8577f711b39851a4d34d6ef980767bf797800618","observation_id":"5ea43394-890a-4f88-be0a-5bbf6929538f","resolution":{"observed_at":"2026-05-23T14:33:09.132478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A unified approach for text- and image-guided 4d scene generation","venue":null,"work_id":"ae4d4614-f400-4300-9dd1-e44850df9f70","year":2024},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:ab02fbd4a7fd86afa28b4cca67fc96f3dab71ca38fe5778c26d7e4d56ad83fa0","observation_id":"e0a6fa10-324a-466b-8786-6ff38717a6ac","resolution":{"observed_at":"2026-05-23T14:33:09.161437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vi- sual object networks: Image generation with disentangled 3d representations.NeurIPS","venue":null,"work_id":"83f39703-a2eb-44e5-b118-62a563a29751","year":2018},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:c75d5ff320e8d5b222a9b4211657f0975482797d510a7126dd88f5996b0deaff","observation_id":"9d956599-9a23-4f79-a4aa-c9378603abea","resolution":{"observed_at":"2026-05-23T14:33:09.190920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ad9f5ca7-6e67-4c5a-9e37-5931710bea11","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:87c5a1ef9f64cab9e54e067fc9fa78baa88683bc24297432a03f9c051dd48ed7","observation_id":"bb4207af-d1a6-45cf-9420-3ed3877a5684","resolution":{"observed_at":"2026-05-23T14:33:09.136424Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conditioning is provided via cross-attention to visual context embeddings with a dimensionality of 1,370","venue":null,"work_id":"615ec062-ff24-4e80-a560-8944c72fbf0d","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:a54170e091cf898a4e659fce92bc5fc0611f88ec9aaf75c775fe88e6a6527fde","observation_id":"207412f6-1015-4b39-ab9c-a89239884a3e","resolution":{"observed_at":"2026-05-23T14:33:09.074832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"First-Frame Anchor","venue":null,"work_id":"6941c581-7899-4bcb-8dcf-7f7ef9b21199","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:b116a2ba1d426eeaaa9fb2dcb413be9b9e062c3ffdb7196e33ced0c9ec3b0f82","observation_id":"155fd645-c9de-4196-bf63-cd0dcbfe6ce8","resolution":{"observed_at":"2026-05-23T14:33:09.099608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6bd54e38-f1da-41f4-9da3-ae85aab895e2","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:31ba3be63d0bba233f4f611e95a4c705d7214ec3023a23d06a1e6ee6e1512095","observation_id":"20119851-1cdc-45ef-959f-738fa720e691","resolution":{"observed_at":"2026-05-23T14:33:09.107295Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c61859e0-0aa7-4b71-af06-a21d60b6346b","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:682a09bf6db71b2fa69d6fbe2fb23a6ced7294cda616c563fe56b87a94a23d8f","observation_id":"cf7bd39b-4875-4231-9277-8b8c9de87f19","resolution":{"observed_at":"2026-05-23T14:33:09.030160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5d177ec6-80d8-4ac4-98fc-b11f1ab265a3","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:cd875b979617dacf5ea439c3ea6f377c070fc76f8feea4aded7dcc75cd46266f","observation_id":"bff01b7a-8a6a-4dce-bc59-f766171293cb","resolution":{"observed_at":"2026-05-23T14:33:08.970507Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A2 and Fig","venue":null,"work_id":"739c2e31-5067-41d4-810b-2bad5ffacb4e","year":null},"citing_paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-09T22:28:54.031663Z"},"links":{"citing_paper":"/paper/2604.21592"},"observation_digest":"sha256:0a0b67b2c11a2513db0662cf394371684865c85c5dfd449b29990dbc3461b440","observation_id":"8a756494-483f-4b81-93ad-79d95f3d02bc","resolution":{"observed_at":"2026-05-23T14:33:08.974398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.21592","last_updated":"2026-04-23T12:18:55Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:18:55Z","title":"Sculpt4D: Generating 4D Shapes via Sparse-Attention Diffusion Transformers"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":4,"verified_exact":13,"verified_fuzzy":56},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 2 inbound Pith citation observations for arXiv:2604.21592."}