{"as_of":"2026-08-08T10:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:97bf617feba1d747d9bcbf489009de628f2a0698415fb5082e334a4cd9c4bffe","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:33:38.368887Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24245/citation-record","integrity":"/paper/2505.24245/integrity","json":"/paper/2505.24245/citation-record.json","paper":"/paper/2505.24245"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:33:34.854572Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:34.854572Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:582b15482774cc0134a35e3662d8ff480c3e6331059431b92cd7584c72867f51","observation_id":"ac94f1d8-26b4-4e5b-bd0e-27378c5e0056","resolution":{"observed_at":"2026-08-07T12:33:34.854572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:34.991095Z","title":"Flamingo: a visual language model for few-shot learning.Advances in neural information processing systems, 35:23716–23736,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:34.991095Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:e628bb009f67084fb2b2c900cd569e07d29bfc6a018bb0f51942fa800abdb803","observation_id":"fc9c0cdf-baa6-4b43-bfe7-bbb6c0b7abd8","resolution":{"observed_at":"2026-08-07T12:33:34.991095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-08-07T11:28:03.211074Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-08-07T12:33:35.147821Z","title":"Shapenet: An information-rich 3d model repository.arXiv preprint arXiv:1512.03012, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:35.147821Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:9a78a6e3710bda7158e781e9bdcd0911293f237ad5a4c9a6166f10c03d3ca0c8","observation_id":"9c445e6c-2b1a-4abc-a2a4-1333cf76f69c","resolution":{"observed_at":"2026-08-07T12:33:35.147821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20853","last_updated":"2024-06-18T16:03:10Z","snapshot_observed_at":"2026-08-07T10:11:04.248576Z","submitted_at":"2024-05-31T14:35:35Z","title":"MeshXL: Neural Coordinate Field for Generative 3D Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20853","snapshot_observed_at":"2026-08-07T12:33:35.284816Z","title":"Meshxl: Neural coordinate field for generative 3d foundation models.arXiv preprint arXiv:2405.20853,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:35.284816Z"},"links":{"cited_paper":"/paper/2405.20853","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:27fbee39581172183910c93b5f7930810dccc53d0a08050fc7d9751166b744aa","observation_id":"17e07eeb-047b-4a72-be1a-3b9a93e0a164","resolution":{"observed_at":"2026-08-07T12:33:35.284816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:41.330488Z","title":"Text-to-3d using gaussian splatting","venue":null,"work_id":"2384615b-2757-4a5c-be0d-1a04fda340dd","year":2024},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:35.426270Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:150409b95708d305acf6a8ff6e964713b59af3077dd97e1a3cfdad86ab7996bd","observation_id":"57d24baa-757d-4ad8-8621-23b055defbc0","resolution":{"observed_at":"2026-08-07T12:33:41.406199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:41.200210Z","title":"Sdfusion: Multimodal 3d shape completion, reconstruction, and generation","venue":null,"work_id":"7d83adc3-82f5-4dad-a85f-ce4db0522533","year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:35.595436Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:06761e2f0245e738018753500139b506fcc52ef80bb3eae11ab658b9e918d3e1","observation_id":"2237ab6c-7e09-45de-bd10-25c8fa0cd992","resolution":{"observed_at":"2026-08-07T12:33:41.248123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:35.693755Z","title":"Objaverse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:35.693755Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:f4cba7b17452ed22c2ab6bff444db3b0434873e5598ed75066a66b856d039836","observation_id":"acfb5287-8caa-4076-a3e6-0645244eeb67","resolution":{"observed_at":"2026-08-07T12:33:35.693755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:41.079230Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"352ab005-1970-44b4-bf31-720225dcedce","year":2022},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:35.758894Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:ed3a653a1e0fa3640f001c115f7e0c308a404c21092b243c0d1fb4ee16b21347","observation_id":"5bb6ce1c-8734-409c-8ecf-c6632d8ccc7a","resolution":{"observed_at":"2026-08-07T12:33:41.118050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12422","last_updated":"2024-05-06T14:23:25Z","snapshot_observed_at":"2026-07-06T15:45:13.905037Z","submitted_at":"2023-06-21T17:59:45Z","title":"DreamTime: An Improved Optimization Strategy for Diffusion-Guided 3D Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12422","snapshot_observed_at":"2026-08-07T12:33:35.822212Z","title":"Dreamtime: An improved optimiza- tion strategy for text-to-3d content creation.arXiv preprint arXiv:2306.12422, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:35.822212Z"},"links":{"cited_paper":"/paper/2306.12422","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:a270ec17d4e46d41b047117cd35328f60db400ee43a73888b46ac260a4e5cb10","observation_id":"e04075b3-eaa6-4af1-8705-ce0c097dd671","resolution":{"observed_at":"2026-08-07T12:33:35.822212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02463","last_updated":"2023-05-03T23:59:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-03T23:59:13Z","title":"Shap-E: Generating Conditional 3D Implicit Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02463","snapshot_observed_at":"2026-08-07T12:33:35.918512Z","title":"Shap-e: Generat- ing conditional 3d implicit functions.arXiv preprint arXiv:2305.02463, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:35.918512Z"},"links":{"cited_paper":"/paper/2305.02463","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:ae4f6f0dd4571740961c5f22e3014b915645aeb23bb1377671e2222ca1972052","observation_id":"3bbe6e99-3960-4208-9d45-eb4b158e0da3","resolution":{"observed_at":"2026-08-07T12:33:35.918512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:36.005351Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Trans","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.005351Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:d830bb6607b074757b02a5cb1cf472e9f90d5a05e1d68dffe4ebff153bb44c8d","observation_id":"00f3cf73-ba51-4161-a09e-941db918af30","resolution":{"observed_at":"2026-08-07T12:33:36.005351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:36.053994Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.053994Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:cf48cfb982b84a889eb5a890ffd9b95efe9fa9b4d8ff310bb7990ca686f3a141","observation_id":"208ce92a-4569-4530-b08b-bd7a29cb40a2","resolution":{"observed_at":"2026-08-07T12:33:36.053994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:40.864159Z","title":"Diffusion- sdf: Text-to-shape via voxelized diffusion","venue":null,"work_id":"98fe5f12-ec00-408f-bd8d-698e5e03b7f9","year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.146461Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:183f1770faec329acf982e80b9a340c02687d6d8095f734f436843e635b47def","observation_id":"d9d2e18f-7b04-48a7-bd52-de60e38c468e","resolution":{"observed_at":"2026-08-07T12:33:40.983218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11838","last_updated":"2024-11-01T14:45:36Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:58Z","title":"Autoregressive Image Generation without Vector Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11838","snapshot_observed_at":"2026-08-07T12:33:36.235172Z","title":"Autoregressive image generation without vec- tor quantization.arXiv preprint arXiv:2406.11838, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.235172Z"},"links":{"cited_paper":"/paper/2406.11838","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:bc14a841df1dbec8e4b1e01486ce2451f482b0eebee4a098adffe88504d037e7","observation_id":"dedbf24c-5b3a-47e3-9845-6dfd5df62e22","resolution":{"observed_at":"2026-08-07T12:33:36.235172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:40.692571Z","title":"Magic3d: High-resolution text-to-3d content creation","venue":null,"work_id":"d900f60d-7500-4768-b92d-afbca08ff4e8","year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.300200Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:8959e2f0b54f09dbeec23e8582ea8cc217d1949bff33fb6ec9ae78d74c23e34e","observation_id":"aa8df983-4bf5-4b52-a281-ffdf2d6e18b1","resolution":{"observed_at":"2026-08-07T12:33:40.763173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02480","last_updated":"2019-10-09T05:37:40Z","snapshot_observed_at":"2026-08-06T09:26:42.610215Z","submitted_at":"2019-09-05T15:32:34Z","title":"FlowSeq: Non-Autoregressive Conditional Sequence Generation with Generative Flow","version":3},"cited_work":{"arxiv_id":"1909.02480","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.02480","snapshot_observed_at":"2026-08-07T12:33:38.549905Z","title":"FlowSeq: Non-Autoregressive Conditional Sequence Generation with Generative Flow","venue":"cs.CL","work_id":"26eff153-4d5e-4208-b0e3-9e95d635171f","year":2019},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.378809Z"},"links":{"cited_paper":"/paper/1909.02480","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:da5c973ff32a035830502b169cdda6a37a5a09f9045f8aba7cdabefe287cdeaa","observation_id":"327095cf-11d8-467d-ac96-8cc0118edb4e","resolution":{"observed_at":"2026-08-07T12:33:38.610708Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:36.480926Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis.Communications of the ACM, 65(1):99–106, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.480926Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:ada697d3b3612252d1420566ab762b20f137e3e5f4bb575dae667492811f75f3","observation_id":"57568344-f8a1-4cee-9aa8-c9327e5b38bb","resolution":{"observed_at":"2026-08-07T12:33:36.480926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:40.537076Z","title":"Autosdf: Shape priors for 3d comple- tion, reconstruction and generation","venue":null,"work_id":"81e3912b-5297-430e-b4a0-4501f15e10b0","year":2022},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.542130Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:900e184f1c9c3b3d1818275ce316e24d95188f41070a092a95103e8d28b6c974","observation_id":"da0c2d04-8ac2-43d8-bc44-4443fb563095","resolution":{"observed_at":"2026-08-07T12:33:40.605354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:40.357805Z","title":"Polygen: An autoregressive generative model of 3d meshes","venue":null,"work_id":"e4321e1e-c99c-4dd0-86a2-78a27e5f5df3","year":2020},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.616195Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:f723fe8b76f103c3e46ee71f3ddd868741199917155fe54be67082d0c387fec0","observation_id":"c5168fa8-201e-43a0-944d-880c5587a814","resolution":{"observed_at":"2026-08-07T12:33:40.424862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08751","last_updated":"2022-12-16T23:22:59Z","snapshot_observed_at":"2026-07-06T14:31:54.932806Z","submitted_at":"2022-12-16T23:22:59Z","title":"Point-E: A System for Generating 3D Point Clouds from Complex Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08751","snapshot_observed_at":"2026-08-07T12:33:36.695604Z","title":"Point-e: A system for generat- ing 3d point clouds from complex prompts.arXiv preprint arXiv:2212.08751, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.695604Z"},"links":{"cited_paper":"/paper/2212.08751","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:e4520fb58abd113a450ba2e12422e6c0aa7d1dc88ee0b898b0e12abecfca26ca","observation_id":"73d07521-8dda-4498-903a-0acc8c80afdd","resolution":{"observed_at":"2026-08-07T12:33:36.695604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T12:33:36.756072Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.756072Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:36d5dca71d680cf832b4cf4691ac888ff97286c896461aecb42ac815dad4034e","observation_id":"226b3bd2-9914-4aa1-9846-a04f79dd6aba","resolution":{"observed_at":"2026-08-07T12:33:36.756072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-07T12:33:36.841766Z","title":"Dreamfusion: Text-to-3d using 2d diffusion.arXiv preprint arXiv:2209.14988, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.841766Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:d4703a898a946b0cbe3268318170f6a42704b5c33b30b03d568404ba6d82bc99","observation_id":"72b2db93-28b6-46cd-b06a-f444cc5ef701","resolution":{"observed_at":"2026-08-07T12:33:36.841766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:36.932320Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:36.932320Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:dba20347ca86dc267727b08af30748a62e0e38ea5e48c303c5365eccb2c8f10e","observation_id":"bad6702b-8dc9-4f54-b718-8a6db91abeb2","resolution":{"observed_at":"2026-08-07T12:33:36.932320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:40.253950Z","title":"Zero-shot text-to-image generation","venue":null,"work_id":"a210fa3e-0b0d-4da1-a76d-cb1c3fec2871","year":2021},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.036565Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:962dfb690e8a947ff0172a3c1ae03c45a1b8e0f5430045503eb36deece409133","observation_id":"687f1646-a635-4c6c-86ff-ec7cf0861352","resolution":{"observed_at":"2026-08-07T12:33:40.289153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:37.110644Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.110644Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:1391e97c27f7d129e7daa314624edcae63df41de1ada4c74e5d466cff965a14c","observation_id":"9f5cc8b7-3b0e-4c0e-8f98-321995e2d3c9","resolution":{"observed_at":"2026-08-07T12:33:37.110644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:37.190675Z","title":"Photorealistic text-to-image diffusion models with deep language understanding.Advances in neural information processing systems, 35:36479–36494, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.190675Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:8890023af2d50d6a7295aca5629a551dce5db13fe39cb6bc79f9926b1ef77a23","observation_id":"63366473-daa8-4f29-b3cd-bffc1a179e68","resolution":{"observed_at":"2026-08-07T12:33:37.190675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:40.051147Z","title":"Meshgpt: Generating triangle meshes with decoder-only transformers","venue":null,"work_id":"b30fb016-1ba0-4900-b42a-4f6303f1ed13","year":2024},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.271378Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:40d401206189693da92fbd0a16656234f4f97a58a7faa76ed91badc69cf7d0a2","observation_id":"d29d2450-72a9-4999-b891-6bc0eff2eee2","resolution":{"observed_at":"2026-08-07T12:33:40.115863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:37.342613Z","title":"Make-it-3d: High-fidelity 3d creation from a single image with diffusion prior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.342613Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:8604152fba20f2187834e8cbaa19fe352b92595dea823f3c660d2fb4e67bad6f","observation_id":"41822879-05f7-4508-a8d7-6c198db6fc75","resolution":{"observed_at":"2026-08-07T12:33:37.342613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T12:33:37.442699Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.442699Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:125fb77702588831a060830fd8d9a2743a3a2f8f44d16e0ef264710b857814a2","observation_id":"2d4d5483-f788-49f6-9f6d-be072f4c38d8","resolution":{"observed_at":"2026-08-07T12:33:37.442699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:37.523208Z","title":"Attention is all you need.Advances in Neural Information Processing Systems, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.523208Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:c22a65b5b546b57c4d0353c9aaeb7f61659f6e03eafa46a35952710a0f492bc6","observation_id":"98fdb654-897f-4ac9-9291-d08f21299333","resolution":{"observed_at":"2026-08-07T12:33:37.523208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:39.868653Z","title":"Hd- fusion: Detailed text-to-3d generation leveraging multiple noise estimation","venue":null,"work_id":"21337981-eccf-4296-bc01-9b7952120283","year":2024},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.613870Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:5021bda9fc93f46b467872a602faf1e22bdbddf0b333ffae6db6fb3500cbff74","observation_id":"85e0ad5c-177f-4b2e-ba1d-068861af7717","resolution":{"observed_at":"2026-08-07T12:33:39.964739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:39.709530Z","title":"Disn: Deep implicit surface network for high-quality single-view 3d reconstruction.Ad- vances in neural information processing systems, 32, 2019","venue":null,"work_id":"093580db-4fd3-452b-912e-0a4b254da615","year":2019},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.693451Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:be2f6daf1b23038314a950e957ce72925e8aa3a72755b15cd1aa9c797caf68c2","observation_id":"e1c5edcd-23a3-49ae-8406-8b8553df24be","resolution":{"observed_at":"2026-08-07T12:33:39.778378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:37.768481Z","title":"Ulip: Learning a unified representation of language, images, and point clouds for 3d understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.768481Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:ce8413dc8a50e34f0651fc132be375baa35e0673a9527ce731c9ac58d1560b59","observation_id":"eee02389-cf48-41fb-8fe0-c7a476b4611e","resolution":{"observed_at":"2026-08-07T12:33:37.768481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:39.484722Z","title":"Points-to-3d: Bridging the gap be- tween sparse points and shape-controllable text-to-3d gener- ation","venue":null,"work_id":"94470a46-8b52-4536-b53a-0c334caae3c3","year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.856553Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:2b0da1193bf7f69be3620c9aa52830289a94f80891800b60625854a840577350","observation_id":"af029760-1e12-476b-8a70-9e9892f3da45","resolution":{"observed_at":"2026-08-07T12:33:39.579199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:39.338754Z","title":"3dilg: Ir- regular latent grids for 3d generative modeling.Advances in Neural Information Processing Systems, 35:21871–21885,","venue":null,"work_id":"8270e591-ca71-40d7-b476-38d1bf5efc12","year":null},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:37.943418Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:633e538aa8d1f1adf3f0be1ef46029e99fb52c99d12955ae49888f696d0b2bd9","observation_id":"4be91d63-555f-43a0-afc8-64631d1e3a10","resolution":{"observed_at":"2026-08-07T12:33:39.406195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:39.194369Z","title":"3dshape2vecset: A 3d shape representation for neu- ral fields and generative diffusion models.ACM Transactions on Graphics (TOG), 42(4):1–16, 2023","venue":null,"work_id":"b692c92b-1b20-4c1b-a769-dd3a6c258b55","year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:38.016442Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:4b45e732fd4157ed4c5a2ac5a648e964d7e824bb68364a8a787c96930f8a02cf","observation_id":"765be0fa-94b9-4959-a1ab-aa2adb10b946","resolution":{"observed_at":"2026-08-07T12:33:39.264135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19655","last_updated":"2024-10-31T03:33:30Z","snapshot_observed_at":"2026-08-07T01:29:57.643382Z","submitted_at":"2024-03-28T17:59:50Z","title":"GaussianCube: A Structured and Explicit Radiance Representation for 3D Generative Modeling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19655","snapshot_observed_at":"2026-08-07T12:33:38.104585Z","title":"Gaussiancube: Structuring gaussian splatting using opti- mal transport for 3d generative modeling.arXiv preprint arXiv:2403.19655, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:38.104585Z"},"links":{"cited_paper":"/paper/2403.19655","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:fd867580f83a41055b087967cdca10054da66808623d7171365bcd181a23a651","observation_id":"1adbf657-3076-4a16-bed6-286a73275ddb","resolution":{"observed_at":"2026-08-07T12:33:38.104585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:38.157033Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:38.157033Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:41c0f17a1671e7f0850d1b35cd369ecf2e6256ebb8c8703df4c2ed86adf8a203","observation_id":"d26a4439-31d4-496f-bb74-dd5e7854e083","resolution":{"observed_at":"2026-08-07T12:33:38.157033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:39.012764Z","title":"Clay: A controllable large-scale generative model for creat- ing high-quality 3d assets.ACM Transactions on Graphics (TOG), 43(4):1–20, 2024","venue":null,"work_id":"e30d0a5f-eeb1-46fb-82a9-618e17281fc4","year":2024},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:38.230413Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:1959fe82b50422f0e9753d6f97000106e5d8e36b409aea236d028608f4772fc0","observation_id":"09731d65-093a-4de5-b92f-484bbfbb6a53","resolution":{"observed_at":"2026-08-07T12:33:39.091365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:33:38.833573Z","title":"Michelangelo: Conditional 3d shape generation based on shape-image-text aligned latent representation.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"4b251ba7-9ef7-47d4-91a1-0b2932637aac","year":2024},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:38.302030Z"},"links":{"citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:e94f1f5f67325535671f8984b139d3b40df2548646aebfba80eb862061bae2db","observation_id":"f8ab4ab2-90ac-4046-96ae-78b2e6bd8874","resolution":{"observed_at":"2026-08-07T12:33:38.937115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18766","last_updated":"2024-03-11T06:14:31Z","snapshot_observed_at":"2026-07-06T15:35:15.564727Z","submitted_at":"2023-05-30T05:56:58Z","title":"HiFA: High-fidelity Text-to-3D Generation with Advanced Diffusion Guidance","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18766","snapshot_observed_at":"2026-08-07T12:33:38.368887Z","title":"Hifa: High- fidelity text-to-3d generation with advanced diffusion guid- ance.arXiv preprint arXiv:2305.18766, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:33:38.368887Z"},"links":{"cited_paper":"/paper/2305.18766","citing_paper":"/paper/2505.24245"},"observation_digest":"sha256:29bb48110b798741ffb6c4eb8b9f6e91ef70c384884cfc404fb4a4c9856798b4","observation_id":"861e2db1-8939-48a8-9724-d2f3b863eea2","resolution":{"observed_at":"2026-08-07T12:33:38.368887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24245","last_updated":"2025-05-30T06:08:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T12:25:39.597570Z","submitted_at":"2025-05-30T06:08:45Z","title":"LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2505.24245."}