{"as_of":"2026-08-06T16:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bfa9fd6602d73da4f87fdbf0bd3a3bc7e17b2aa2c7af52360c8cdd7d13dcb97","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T19:08:58.213637Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.00781/citation-record","integrity":"/paper/2605.00781/integrity","json":"/paper/2605.00781/citation-record.json","paper":"/paper/2605.00781"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.19985","last_updated":"2026-06-30T23:03:31Z","snapshot_observed_at":"2026-08-03T20:25:41.826820Z","submitted_at":"2025-11-25T06:53:48Z","title":"SONIC: Spectral Optimization of Noise for Inpainting with Consistency","version":3},"cited_work":{"arxiv_id":"2511.19985","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2511.19985","snapshot_observed_at":"2026-07-02T01:17:25.856157Z","title":"arXiv preprint arXiv:2511.19985 (2025)","venue":null,"work_id":"1630c213-7238-4748-8b6f-36e1a65fc9f1","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"cited_paper":"/paper/2511.19985","citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:de55c2f4c726b67af61319500dfb7e1c500b5bde70d14c65726fd82bc000f455","observation_id":"b2d47c11-4292-463b-805f-fa4a87cb70e5","resolution":{"observed_at":"2026-07-02T01:17:25.856157Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Conference on Machine Learning (2023)","venue":null,"work_id":"1e2648d9-7d7d-48ed-bdb0-c61eda49f110","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:6c44e59d27fd0fdf4a7747c4e3c80c03be8d7d50ed4f44a113530559cf4b7994","observation_id":"1b8ef100-cbc1-4a1b-8ccb-d6bf05ec020b","resolution":{"observed_at":"2026-05-25T22:06:16.879623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01055","last_updated":"2024-09-02T08:28:57Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:28:57Z","title":"Follow-Your-Canvas: Higher-Resolution Video Outpainting with Extensive Content Generation","version":1},"cited_work":{"arxiv_id":"2409.01055","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.01055","snapshot_observed_at":"2026-07-02T02:36:26.428928Z","title":"Follow-your-canvas: Higher-resolution video outpainting with extensive content generation","venue":null,"work_id":"15e9dc54-68f3-4bc7-ae5e-83d7170f6d50","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"cited_paper":"/paper/2409.01055","citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:402867a782c49524e9f993890a3fff76b2965b0d7da365de62787b33f2a3f8be","observation_id":"4af096dd-8777-4291-bd48-895ad7648100","resolution":{"observed_at":"2026-05-11T15:51:42.819565Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV)","venue":null,"work_id":"a297d5b4-16f0-4125-9624-3de0294ede67","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:585430601890572628288c44a4230f2721dd4b8ae9ada4b570a2d37dd46a5553","observation_id":"cdfc3d1c-e7b3-43f1-bf61-7b46e7ab41f0","resolution":{"observed_at":"2026-05-25T22:06:16.867519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13384","last_updated":"2023-11-23T11:40:16Z","snapshot_observed_at":"2026-07-06T16:51:06.781541Z","submitted_at":"2023-11-22T13:27:34Z","title":"LucidDreamer: Domain-free Generation of 3D Gaussian Splatting Scenes","version":2},"cited_work":{"arxiv_id":"2311.13384","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.13384","snapshot_observed_at":"2026-07-04T13:49:51.650606Z","title":"Luciddreamer: Domain-free gen- eration of 3d gaussian splatting scenes","venue":null,"work_id":"24a684d2-afbc-461d-9ff8-92fa3c51ff4c","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"cited_paper":"/paper/2311.13384","citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:973ae9729bcb80ef7851d0709b6c7e2f42dc70ed6706e59628a3cf4a5c0fe414","observation_id":"7f4fe6d3-9f27-4172-8b9f-b4e70eb5d154","resolution":{"observed_at":"2026-05-11T15:51:42.890637Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:12:55.660082Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"9c1a386a-6c49-4d75-a2ca-b88f9aa71112","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:57207d6d8c79091cd871b4c2650a955b70462bdf1a051783662319e22c51242d","observation_id":"8051f393-87e6-4d2a-aa82-887cb6ad2805","resolution":{"observed_at":"2026-05-25T22:06:16.858607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: The twelfth international conference on learning representations (2023)","venue":null,"work_id":"44a4f700-4188-4643-8799-affae330d5ce","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:b77c5e10906176ab25f4dfad9a39dbb888eadad6987a6d528596b90ab5602bdf","observation_id":"07e50e67-dd16-427b-a4b5-0d39ccac629a","resolution":{"observed_at":"2026-05-25T22:06:16.807372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition (2024)","venue":null,"work_id":"4ef3a60e-a467-43df-985d-d691af1d808f","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:fa1b6d35bd86d3ca3a978ab2ebf53df17cb975611784d432fd78c4dff251e63a","observation_id":"dce22543-71d6-4248-979f-9fa6c995e8b2","resolution":{"observed_at":"2026-05-25T22:06:16.871635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16420","last_updated":"2025-03-20T17:59:40Z","snapshot_observed_at":"2026-07-06T20:56:14.017923Z","submitted_at":"2025-03-20T17:59:40Z","title":"SynCity: Training-Free Generation of 3D Worlds","version":1},"cited_work":{"arxiv_id":"2503.16420","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.16420","snapshot_observed_at":"2026-07-04T15:19:56.410609Z","title":"arXiv preprint arXiv:2503.16420 (2025) Map2World: Segment Map Conditioned Text to 3D World Generation 17","venue":null,"work_id":"8119191b-4fcb-42ed-a38d-46ade2d3f734","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"cited_paper":"/paper/2503.16420","citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:b2514975efd65e19f822f880aa6081ef28b648f1e2f8ea2922ddc26859b186d7","observation_id":"e14e136f-7388-4bc6-85da-ad36f588d08d","resolution":{"observed_at":"2026-05-11T15:51:42.850634Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 2024 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies (Volume 1: Long Papers)","venue":null,"work_id":"55099f47-5eb6-40d4-96a5-1ae00d986853","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:7ce9a06524546963e67b907f47fa7458fc5efb6ac7e6e145c8aada17a17b4b05","observation_id":"0a91bf13-01e8-40b9-9dda-8329042fbb17","resolution":{"observed_at":"2026-05-25T22:06:16.875691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":"87275d51-618c-468a-9c0e-9f6484c7dcbb","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:420291d3758953e37302eb511adcf72c3100da93386f2eef371f27e0346c0490","observation_id":"07943bd3-565e-4626-ad03-c2cd0ace3e08","resolution":{"observed_at":"2026-05-25T22:06:16.831651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T18:11:22.522013Z","title":"In: NeurIPS 2021 Workshop on Deep Generative Models and Downstream Applications (2021)","venue":null,"work_id":"eb9fd69a-e826-4a79-8ba0-88928972346b","year":2021},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:d17fc768374e2e4008fbf6a0b35062cae1b449c2b570bc3c81bdd8fbf14f67a1","observation_id":"a56a5934-2079-4cc1-8643-f8ef1cf28b57","resolution":{"observed_at":"2026-05-25T22:06:16.896458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV)","venue":null,"work_id":"1c65c7b9-e60a-428b-aede-c84882e26435","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:d01bdef69921c93a1452ca8ea17e0d809218f9773d37be34187eeaee126f8558","observation_id":"ba1a5a91-8b4e-4406-a88f-b83a05b65c59","resolution":{"observed_at":"2026-05-25T22:06:16.835280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference (2025)","venue":null,"work_id":"3d25318e-0792-4a76-953c-be4f13f696fe","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:47301cfd1fb2b01dda9034b06f9d48456e8e991b45826a70fcfe3e01312c697e","observation_id":"7d0273b2-2b8f-4aa1-b514-705a75cb8b70","resolution":{"observed_at":"2026-05-25T22:06:16.839040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02412","last_updated":"2023-02-05T15:49:26Z","snapshot_observed_at":"2026-08-04T23:32:54.020738Z","submitted_at":"2023-02-05T15:49:26Z","title":"Mixture of Diffusers for scene composition and high resolution image generation","version":1},"cited_work":{"arxiv_id":"2302.02412","doi":"10.48550/arxiv.2302.02412","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.02412","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2302.02412 (2023) 3, 5","venue":"arXiv (Cornell University)","work_id":"c79655e3-aa99-4e88-b9a0-e6bf1a98c9d0","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"cited_paper":"/paper/2302.02412","citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:917948ff4b46dca2f7a7c0357fc6b3bcc8597635546f1e94cfc9255e1c775b50","observation_id":"b09a97e6-a0b4-4a31-9e52-67f3f49a3474","resolution":{"observed_at":"2026-05-11T15:51:42.898867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:02:45.845059Z","title":"ACM Trans","venue":null,"work_id":"18adf1b6-eb50-461d-88e5-8f6081c5266f","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:54df749f708fbe5e56537e3bbb5989d3136822ba0b4a0483d12ad2411c816f17","observation_id":"6fadf28a-517f-461c-8975-90df3876d317","resolution":{"observed_at":"2026-05-25T22:06:16.774525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF winter conference on applications of computer vision (2021)","venue":null,"work_id":"4361db86-c789-4206-b487-7d17f3392bed","year":2021},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:d52c8eedcc2fc30f2d8117ab4f25c933082e9aa547d63a06907bbc81d28371f4","observation_id":"33ebdfc0-b97b-4f0d-bc5e-8aea70e77924","resolution":{"observed_at":"2026-05-25T22:06:16.761951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16375","last_updated":"2025-09-01T15:09:50Z","snapshot_observed_at":"2026-08-05T00:18:35.209191Z","submitted_at":"2025-03-20T17:37:43Z","title":"NuiScene: Exploring Efficient Generation of Unbounded Outdoor Scenes","version":2},"cited_work":{"arxiv_id":"2503.16375","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.16375","snapshot_observed_at":"2026-07-04T15:19:56.407761Z","title":"arXiv preprint arXiv:2503.16375 (2025)","venue":null,"work_id":"066bd685-ec91-4994-a660-e0c8d27164c4","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"cited_paper":"/paper/2503.16375","citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:aff456f910fce6ca96ed7b1a59333a54f3898d6306259118cbb5decc2c1840e4","observation_id":"96e409b2-fc95-40da-a32a-1f4a1e46f7a7","resolution":{"observed_at":"2026-05-11T15:51:42.869648Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition (2025)","venue":null,"work_id":"edd8af3c-d677-4a06-87a4-37ce8209100d","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:1c5ee6f4b673505cc4884118024bb0fa920d2e72fa933c007e1213143a866bae","observation_id":"e2c3812c-670b-439d-9073-42b888c707ac","resolution":{"observed_at":"2026-05-25T22:06:16.850448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems (2023)","venue":null,"work_id":"d1b0948d-dca2-476d-a9cc-2d0a8b14d374","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:a3b54eb543211de6969b283f98400ce6162d49a6aa71428ca118f0ed2a8545e1","observation_id":"2e064718-38e2-4a4f-ab65-fe8adb216c52","resolution":{"observed_at":"2026-05-25T22:06:16.891992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"7530a2d4-a6da-45f8-9a46-c8aaa6b09ca2","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:858eb5d0010cdca177aa3b8a8117f4e705ff4ce980137c4caa6651ef8e56a031","observation_id":"4b06633c-b6b2-47d3-aed6-daaf106ed21c","resolution":{"observed_at":"2026-05-25T22:06:16.842627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.21682","doi":"10.48550/arxiv.2510.21682","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2510.21682 (2025)","venue":"ArXiv.org","work_id":"0af66b1b-914a-4022-8eba-5e72f4ea17d8","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:0061994dc29a186cb8eb35329279a75453ac5509847e0053d83a73c969563097","observation_id":"aeef4fef-584b-410a-adee-c4b82e53ca60","resolution":{"observed_at":"2026-05-11T15:51:42.860346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (2023)","venue":null,"work_id":"5a6017df-f33e-4eb3-8419-627cdd3550a2","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:59d0fe74d51a52e170e922f8143a0df8fc6b409059c336aaaf323c0e4ffe7dc5","observation_id":"d4162d30-a6e6-4689-ac64-c95e3c43a252","resolution":{"observed_at":"2026-05-25T22:06:16.811181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: International Conference on Learning Representations (2023)","venue":null,"work_id":"9018b81d-1f52-444d-9ede-cfadc159a663","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:a366bedebca6efa71513226711eb986f8999aa66cbdb8c709d50933789acc880","observation_id":"ed146e55-9662-41d1-a123-c26bb40912f5","resolution":{"observed_at":"2026-05-25T22:06:16.823805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems37, 133305–133327 (2024)","venue":null,"work_id":"e424a384-58f4-42ee-945f-e3f6c89ea331","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:f34f4b6d8280b5e71f8e097670e642de27915c8473ced52c84aa21be62b8e140","observation_id":"680a55c8-b91c-4da9-939c-968880b69d45","resolution":{"observed_at":"2026-05-25T22:06:16.827910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03934","last_updated":"2025-06-26T03:10:09Z","snapshot_observed_at":"2026-07-06T20:01:59.108032Z","submitted_at":"2024-12-05T07:32:20Z","title":"InfiniCube: Unbounded and Controllable Dynamic 3D Driving Scene Generation with World-Guided Video Models","version":2},"cited_work":{"arxiv_id":"2412.03934","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03934","snapshot_observed_at":"2026-07-04T15:19:56.464733Z","title":"Infinicube: Unbounded and controllable dynamic 3d driving scene generation with world-guided video models","venue":null,"work_id":"e9dc93b7-8e48-4f74-9686-a7457d46e994","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"cited_paper":"/paper/2412.03934","citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:eed4f56947a7fe3759ebe8dd71fa749cd30f0e7d7ea96f3f549ee19b10dd957c","observation_id":"546880cc-0c7a-4a4f-a9a9-2d3a56e2cd3f","resolution":{"observed_at":"2026-05-11T15:51:42.812738Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:53:50.669760Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"d4c0b90d-8912-45e6-bd97-0c30429aea01","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:53a4604001138253f39220ad62a7e7474cd18e2587803390791f61200f67a659","observation_id":"3335bb8f-5289-4174-bf1f-36611c27ef2c","resolution":{"observed_at":"2026-05-25T22:06:16.888013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08453","last_updated":"2023-03-20T10:52:26Z","snapshot_observed_at":"2026-07-31T21:11:02.534986Z","submitted_at":"2023-02-16T17:56:08Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":"2302.08453","doi":"10.48550/arxiv.2302.08453","metadata_source":"pith","pith_arxiv_id":"2302.08453","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"2337b26e-9ca1-4157-be2a-438971c5fef3","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"cited_paper":"/paper/2302.08453","citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:7fe788407d61ff06da2313ae7996c66c19562f7fa22bc3ddbbe3675b17c02717","observation_id":"641f9d36-55e2-4972-a9e5-df6d4a7dbed1","resolution":{"observed_at":"2026-05-16T22:47:50.630300Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:32:52.533462Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2024)","venue":null,"work_id":"8c041b53-a3f9-4b8e-a473-f60918de02c9","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:992521eb5f6704f0a8bba73b93967b4207e9096a4ad61d8a9898788290d13253","observation_id":"ef78b45c-5985-4164-8f60-6c16dc48cde7","resolution":{"observed_at":"2026-05-25T22:06:16.785780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: The Thirty-eighth Annual Conference on Neural Information Processing Systems (2024)","venue":null,"work_id":"f9c58b3b-f6a2-402e-907a-3170c135e621","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:5fa8c8d40e135c2af59668f730d81c0b561c47db627877767da863e1efae1404","observation_id":"5236aa42-9a35-4fbe-b41f-a2c3bbc25bf5","resolution":{"observed_at":"2026-05-25T22:06:16.853961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition (2022)","venue":null,"work_id":"69957eb0-8a72-4165-8fa3-f7fc0aafc772","year":2022},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:4be9eaab92f7fbc0296989c40aaf3d1ab5b29b279c5e3c323f2548e079cadb90","observation_id":"5995b391-cd4d-4504-8d77-513862ab828f","resolution":{"observed_at":"2026-05-25T22:06:16.789610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems35(2022)","venue":null,"work_id":"ec93886d-c748-4e90-ab0a-8575f0c8f1c9","year":2022},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:97b4da18b9272ac348ad0595bbb0d07b39b8e75d106273541bfb9971300021d1","observation_id":"fca2fc02-bd6d-4d29-9dfe-8d0897e2cd0e","resolution":{"observed_at":"2026-05-25T22:06:16.800057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ACM Transactions on Graphics (TOG)42(4), 1–16 (2023)","venue":null,"work_id":"1c83afbe-1c4f-42d2-a97e-acae47f65ab2","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:8dd30f733bbd92132a2b78c08d847ff75e45a4be36e5b5274d465cd493336c0c","observation_id":"b8c2d49d-c0c6-4028-9673-034d7366e93d","resolution":{"observed_at":"2026-05-25T22:06:16.796155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: International Conference on 3D Vision (3DV) (2025)","venue":null,"work_id":"8e7d8df3-3d7c-4929-b346-083a3227ee34","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:4f031a66fd26ca0ba54d422423515e0f54085d173021ddc841af961b58d4f4ed","observation_id":"9c34a711-3422-4925-86dc-2b1b22e758f5","resolution":{"observed_at":"2026-05-25T22:06:16.883707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (2025)","venue":null,"work_id":"a8276a00-0e01-4175-83ec-b5e7e6673fea","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:ad748cfd33ab00afcacecee212f09e9c27d662e6da3490c040b46898bcd009d5","observation_id":"a99b8e27-232c-4193-89d1-34762f2de18c","resolution":{"observed_at":"2026-05-25T22:06:16.778487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: 2025 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":"df635251-7821-4bc4-b890-5ae715997746","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:5669a906e18a3a170dcbe44e0aa9e9c23426f133dedd1f96fd57de9b248ccf25","observation_id":"f798bf05-deb9-4c5d-98a4-5c930f6c5758","resolution":{"observed_at":"2026-05-25T22:06:16.803987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2307.03177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:53:50.438249Z","title":"Pan- odiffusion: 360-degree panorama outpainting via diffusion","venue":null,"work_id":"5b1669f9-5b75-4f82-9e07-deb4e4c9fc0e","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:bd42c59b428c504406f921cfcce2ec4792f2dd0414ff922cfb0551fe21958f99","observation_id":"96a8c00a-87eb-4658-9e29-86345f44fa04","resolution":{"observed_at":"2026-05-11T15:51:42.829800Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ACM TOG (2024)","venue":null,"work_id":"90d84286-8dc1-48cc-949b-be3c38d1e1e0","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:a68b5d894d96c3b254b7c05ba70012a54d11eeedbce27fc1d8195deec83be632","observation_id":"4a2db40f-b2b2-4fb4-94f0-09ff7686ff79","resolution":{"observed_at":"2026-05-25T22:06:16.792656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: CVPR","venue":null,"work_id":"b3e66242-d1c6-4ce3-beb4-e6c86b353bcc","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:de7b496b62a633888224434be4a801e4dd6eb74bfa612f90b7e19b45da22a716","observation_id":"614e8b68-7e77-49b4-a074-bb5661e3097f","resolution":{"observed_at":"2026-05-25T22:06:16.819800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"f2cbbc20-028b-43b1-b591-df38fa8dab6a","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:2d3549f666626788ee0c432cd9fedea82b9f7046acd80d3fa962629675d1958d","observation_id":"f237df21-ed69-45cf-8a75-3e38d9edfb2e","resolution":{"observed_at":"2026-05-25T22:06:16.770403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":"2308.06721","doi":"10.48550/arxiv.2308.06721","metadata_source":"pith","pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"98e51b10-54bd-4251-8a2d-f79bd6215c19","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:ef44eb55ca812b8ead6e23bb52acdcd85d168382383f0d0359da91b0aaf70f8e","observation_id":"a492f918-c26a-4969-98ea-d06056c7e85a","resolution":{"observed_at":"2026-05-11T15:51:42.881091Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:20:08.139662+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"eef5d167-9fd6-4482-801e-ebdf1320eeea","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:3d9bc55c1ea4585a47273efe754d66b8c972383ffae217a2a7ea5d8b5d25953b","observation_id":"5efaa31b-e624-4ac1-8806-e41ac4dfa31c","resolution":{"observed_at":"2026-05-25T22:06:16.757964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T22:47:44.287663Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"8f80e441-b1c7-4d53-9403-fb56d52b8c38","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:4cdf4b699953fd932bb11540fbe9eb20317a63babb5f4661c653ea0bb86bb5c4","observation_id":"96e62eb6-7408-40b8-ac09-3c834d5cf7bb","resolution":{"observed_at":"2026-05-25T22:06:16.766514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"NeurIPS (2024)","venue":null,"work_id":"e145e742-168e-4247-bb61-60538af7f656","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:e2019d0c331b0d5c6a54e965815925d8841c5a1b9fc445541a7a9f34319e99b5","observation_id":"0a73c794-3b85-4f66-9d1b-1e93ee122fdd","resolution":{"observed_at":"2026-05-25T22:06:16.782342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:12:55.722169Z","title":"ACM Transactions on Graphics (TOG)43(4), 1–20 (2024)","venue":null,"work_id":"ea8e29df-8c1a-4f8b-8113-cd1371829c0d","year":2024},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:57e9bab0d57dd607bf6c5dbb7d89fca9366a8a68660ab2ee814b51b2f7af7656","observation_id":"2a171013-5047-4c71-9ed6-62b8d6893b61","resolution":{"observed_at":"2026-05-25T22:06:16.815734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision (2023)","venue":null,"work_id":"ab745e04-8e05-4a9a-a6e0-1bc93ffbd038","year":2023},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:b0d79f5722f78df42a5f21e12a4bf2eb2ea2bfe725517790ffd795b6b5f91236","observation_id":"1702c4c9-69ab-4eef-9902-3093f38c14e4","resolution":{"observed_at":"2026-05-25T22:06:16.846453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T05:30:44.310033Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference","venue":null,"work_id":"e79955b4-ab57-4744-9441-688476405291","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:d97fcf13ad657198ae7c6bd7e652bba873feb8ecd0b7fc3176e403864cfc9fe7","observation_id":"aba097ab-77b1-4c56-9e9b-5f845b68ea65","resolution":{"observed_at":"2026-05-25T22:06:16.863573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.15765","doi":"10.48550/arxiv.2505.15765","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Spring village with wildflower meadows, cherry blossoms, clear sky","venue":"ArXiv.org","work_id":"383dab42-514c-4c65-94eb-dcfc2ee8992c","year":2025},"citing_paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-09T19:08:58.213637Z"},"links":{"citing_paper":"/paper/2605.00781"},"observation_digest":"sha256:3b0218a54cad1433594b34f640ddd77005c65992631f1eadb4211dec53b1a0a4","observation_id":"a892cc04-5a14-4bc5-8c4c-bd97a7f8007f","resolution":{"observed_at":"2026-05-11T15:51:42.843087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.00781","last_updated":"2026-05-01T16:56:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:14:06.327027Z","submitted_at":"2026-05-01T16:56:49Z","title":"Map2World: Segment Map Conditioned Text to 3D World Generation"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":0,"verified_exact":7,"verified_fuzzy":36},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2605.00781."}