{"as_of":"2026-08-07T09:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d8f6ef9a333d35d4f41734df41fb644b60051b4d54b41e130b9d314635a4586","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:21:43.104278Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T06:09:37.256195Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-08-07T05:21:43.104278Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation.arXiv preprint arXiv:2505.02836,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08174","last_updated":"2025-06-11T17:04:39Z","snapshot_observed_at":"2026-08-07T05:14:59.899648Z","submitted_at":"2025-06-09T19:39:09Z","title":"LLM-BT-Terms: Back-Translation as a Framework for Terminology Standardization and Dynamic Semantic Embedding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:43.104278Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2506.08174"},"observation_digest":"sha256:3893b67a3f5e5beaa0915a63569d33dbea7c305bb493bbb4fbcaa84bec18f93c","observation_id":"5b32ae89-6483-435b-9982-647d8edc2a7b","resolution":{"observed_at":"2026-08-07T05:21:43.104278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-08-07T00:13:32.850883Z","title":"Ling, C.-H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14763","last_updated":"2025-06-17T17:57:37Z","snapshot_observed_at":"2026-08-07T04:22:17.875129Z","submitted_at":"2025-06-17T17:57:37Z","title":"RobotSmith: Generative Robotic Tool Design for Acquisition of Complex Manipulation Skills","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:13:32.850883Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2506.14763"},"observation_digest":"sha256:1373f82770d3f483b35ffec79d6e470629153bf6ce4725eb7b466da0df59c6ab","observation_id":"a31b2567-2df7-46dd-ab93-3d480503aff5","resolution":{"observed_at":"2026-08-07T00:13:32.850883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-08-06T22:48:59.729438Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation.arXiv preprint arXiv:2505.02836, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20601","last_updated":"2025-06-25T16:40:17Z","snapshot_observed_at":"2026-08-06T22:42:20.651601Z","submitted_at":"2025-06-25T16:40:17Z","title":"Video Perception Models for 3D Scene Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:48:59.729438Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2506.20601"},"observation_digest":"sha256:39e8c417754d51be17c3963123413fb0687ed3ada6d1532f2228ccf72e6dc971","observation_id":"f97302bc-978c-48e6-a955-c770b23c387b","resolution":{"observed_at":"2026-08-06T22:48:59.729438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-08-06T05:15:42.305835Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02094","last_updated":"2025-08-04T06:05:36Z","snapshot_observed_at":"2026-08-06T05:14:34.110582Z","submitted_at":"2025-08-04T06:05:36Z","title":"\"Harmless to You, Hurtful to Me!\": Investigating the Detection of Toxic Languages Grounded in the Perspective of Youth","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T05:15:42.305835Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2508.02094"},"observation_digest":"sha256:f2ac0a15001a19a5cab33daf43454562820a4c3bc002c14d7f66d23b6ad8bb1a","observation_id":"a4081951-88c8-47fd-88d2-e67f97dafcec","resolution":{"observed_at":"2026-08-06T05:15:42.305835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-08-06T05:12:36.368585Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02095","last_updated":"2025-08-06T19:21:50Z","snapshot_observed_at":"2026-08-06T05:12:28.147197Z","submitted_at":"2025-08-04T06:06:06Z","title":"VLM4D: Towards Spatiotemporal Awareness in Vision Language Models","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T05:12:36.368585Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2508.02095"},"observation_digest":"sha256:11b1ce216db8be311d84c794f2819758d388f77087ff82c55b82538c244d6c55","observation_id":"c0daa79a-4e47-481e-a554-80e5d332ed29","resolution":{"observed_at":"2026-08-06T05:12:36.368585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-08-03T19:19:20.992326Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation.arXiv preprint arXiv:2505.02836, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.01204","last_updated":"2026-07-02T09:41:54Z","snapshot_observed_at":"2026-08-04T03:53:47.805311Z","submitted_at":"2025-12-01T02:38:52Z","title":"TabletopGen: Tabletop Scene Generation and Interactive Simulation for Robotic Manipulation","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T19:19:20.992326Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2512.01204"},"observation_digest":"sha256:6c9ec3c7186526664da467cc6d1e8c1eb6f8062429a1204f212b7a2ec859b700","observation_id":"85383ed5-aad4-4b7c-b011-5beca377713b","resolution":{"observed_at":"2026-08-03T19:19:20.992326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2601.08454","last_updated":"2026-05-17T09:37:30Z","snapshot_observed_at":"2026-07-06T22:41:33.987055Z","submitted_at":"2026-01-13T11:28:46Z","title":"Real2Sim via Active Perception with Behavior Trees Automatically Generated by VLMs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T15:07:54.930273Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2601.08454"},"observation_digest":"sha256:614ddfd35863f4535e50661850ecacaaa678cad09a91a6de9151e921a884acbe","observation_id":"36e4d326-5360-4fd9-9be8-22eb11c93a07","resolution":{"observed_at":"2026-05-21T15:10:16.648939Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2601.11109","last_updated":"2026-04-06T13:27:26Z","snapshot_observed_at":"2026-07-06T22:41:53.823272Z","submitted_at":"2026-01-16T09:11:55Z","title":"Vision-as-Inverse-Graphics Agent via Interleaved Multimodal Reasoning","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T13:50:19.988813Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2601.11109"},"observation_digest":"sha256:8ce2b358d24e6cd5ba43f6c40d0fbb207dbecd361614d8802b525ad2673415a0","observation_id":"26543a02-6378-46d7-9a85-33f1673708c1","resolution":{"observed_at":"2026-05-16T13:51:00.560832Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2604.10578","last_updated":"2026-04-14T11:24:24Z","snapshot_observed_at":"2026-08-02T13:49:44.275069Z","submitted_at":"2026-04-12T10:55:14Z","title":"Rein3D: Reinforced 3D Indoor Scene Generation with Panoramic Video Diffusion Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T15:34:15.916685Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2604.10578"},"observation_digest":"sha256:5012c61ad43b7ff9597d30038c9406c30055df188faef752fd2df2af39568533","observation_id":"e1a06504-1b43-4f3b-9a11-30a8982adfca","resolution":{"observed_at":"2026-05-11T10:16:05.932363Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2604.13035","last_updated":"2026-04-14T17:59:26Z","snapshot_observed_at":"2026-08-02T20:49:07.621096Z","submitted_at":"2026-04-14T17:59:26Z","title":"SceneCritic: A Symbolic Evaluator for 3D Indoor Scene Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T15:36:33.149921Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2604.13035"},"observation_digest":"sha256:704f83120e7030e4aef762a6dd91b745217a6b2d759397f2b43d5a52a55fab60","observation_id":"e693439b-16c8-4d60-83b0-4fc46678f9d3","resolution":{"observed_at":"2026-05-11T10:11:03.657154Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2604.13800","last_updated":"2026-04-15T12:36:59Z","snapshot_observed_at":"2026-08-02T10:48:28.074347Z","submitted_at":"2026-04-15T12:36:59Z","title":"EmbodiedClaw: Conversational Workflow Execution for Embodied AI Development","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T13:34:58.288245Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2604.13800"},"observation_digest":"sha256:834575b34adab6544937d54f3ef32e142c6017f44b9a2a2739dd4b451098e3f7","observation_id":"3d6782b4-b96a-4ba2-bdf7-ad05b5150363","resolution":{"observed_at":"2026-05-10T13:35:26.232494Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2604.16299","last_updated":"2026-04-17T17:59:50Z","snapshot_observed_at":"2026-08-03T01:59:43.264555Z","submitted_at":"2026-04-17T17:59:50Z","title":"Repurposing 3D Generative Model for Autoregressive Layout Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T08:09:00.779456Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2604.16299"},"observation_digest":"sha256:47bab2db03ae1c7113fe07088e74089ad6dfda5b779d253630a5cfc9f8e26852","observation_id":"057d08e1-e449-482e-bb80-fe41c9e25c24","resolution":{"observed_at":"2026-05-10T08:12:26.732757Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2604.16552","last_updated":"2026-04-29T14:25:32Z","snapshot_observed_at":"2026-07-06T23:03:52.631613Z","submitted_at":"2026-04-17T07:28:04Z","title":"Co-generation of Layout and Shape from Text via Autoregressive 3D Diffusion","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T09:22:10.651922Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2604.16552"},"observation_digest":"sha256:2285e125707875c28df2758b039d568b383542d84d9e2050aad6d65074b39841","observation_id":"f5417681-3361-451a-9452-ae11b24206a1","resolution":{"observed_at":"2026-05-10T09:23:36.978937Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2604.19907","last_updated":"2026-04-21T18:33:15Z","snapshot_observed_at":"2026-07-06T23:06:26.596990Z","submitted_at":"2026-04-21T18:33:15Z","title":"SceneOrchestra: Efficient Agentic 3D Scene Synthesis via Full Tool-Call Trajectory Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T03:22:30.012610Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2604.19907"},"observation_digest":"sha256:f0d23cca904e4d0216df390804a1c76dff4529b911ef36d0c2b344b5b3c88a9e","observation_id":"05f27cc3-095e-4f35-800e-ad8400f5a2e8","resolution":{"observed_at":"2026-05-11T12:31:06.580065Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2605.20837","last_updated":"2026-05-20T07:27:08Z","snapshot_observed_at":"2026-08-02T14:27:18.575129Z","submitted_at":"2026-05-20T07:27:08Z","title":"ArchSIBench: Benchmarking the Architectural Spatial Intelligence of Vision-Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T04:55:40.370796Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2605.20837"},"observation_digest":"sha256:a4defd9ff0db10fed88f7dd66be78a291a90b398bc56daf07b9e7629da2c17f2","observation_id":"4112b671-dff6-4520-b981-7c75a03eb637","resolution":{"observed_at":"2026-05-21T04:59:36.508177Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2605.25326","last_updated":"2026-05-25T01:16:19Z","snapshot_observed_at":"2026-08-06T19:41:54.483891Z","submitted_at":"2026-05-25T01:16:19Z","title":"Perceive-then-Plan: Layout-as-Policy for Monocular 3D Scene Layout Estimation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T23:11:59.282627Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2605.25326"},"observation_digest":"sha256:849a3b7feec18739e9d1c07a57561bf7b57a27632788e930b1d236c6f052212e","observation_id":"d46764da-2d11-4041-85f1-8298ebb0421b","resolution":{"observed_at":"2026-06-29T23:14:01.323641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2606.03994","last_updated":"2026-06-02T17:59:59Z","snapshot_observed_at":"2026-07-06T23:44:09.692359Z","submitted_at":"2026-06-02T17:59:59Z","title":"SimuScene: Simulation-Ready Compositional 3D Scene Reconstruction from a Single Image","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T10:59:17.553098Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2606.03994"},"observation_digest":"sha256:e19ea6937dd822e0221d33634fa2037be9baac45a97ab835e16c745ced0ad074","observation_id":"975ec25c-94f1-4a7a-a71b-d301f9dc1282","resolution":{"observed_at":"2026-07-02T02:26:26.366072Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2606.08402","last_updated":"2026-06-16T06:24:38Z","snapshot_observed_at":"2026-08-03T11:49:18.264925Z","submitted_at":"2026-06-07T01:38:39Z","title":"SceneConductor: 3D Scene Generation from a Single Image with Multi-Agent Orchestration","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-27T19:08:08.329817Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2606.08402"},"observation_digest":"sha256:e951c755fb721542af127cb26bb39b9d4c02895f0e6b5e29003f76d2e2be03c5","observation_id":"8ffe7006-363f-4c1e-ba7a-92183b4b77d6","resolution":{"observed_at":"2026-07-02T22:07:26.723110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2606.21596","last_updated":"2026-06-19T16:50:48Z","snapshot_observed_at":"2026-08-03T18:54:47.903762Z","submitted_at":"2026-06-19T16:50:48Z","title":"$\\phi$-Scene: Physically Grounded Image-to-3D Scene Reconstruction","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-26T14:50:16.317301Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2606.21596"},"observation_digest":"sha256:2b0a92717bce25d36685836604d1ba4f4674dbe6e8a57959146577ad92fc1c13","observation_id":"ee327f72-b816-4837-b399-d85f8f7a3d3a","resolution":{"observed_at":"2026-07-04T06:09:37.258248Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2606.29395","last_updated":"2026-06-28T13:33:44Z","snapshot_observed_at":"2026-08-03T10:57:36.190748Z","submitted_at":"2026-06-28T13:33:44Z","title":"NaLA: A 3D Native LLM Layout Agent for High-quality 3D Scene Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T08:12:30.693936Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2606.29395"},"observation_digest":"sha256:755b38800a8f41281384ec9a8824e87a78f679265ee0c7d21ff7b08813ecc937","observation_id":"d0407fcf-3f38-47fc-a0ff-d6f490c6f095","resolution":{"observed_at":"2026-06-30T08:14:25.460428Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":"2505.02836","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-04T06:09:37.256195Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation","venue":null,"work_id":"30f1cb71-9f42-4e54-bf65-ab62eef4c221","year":2025},"citing_paper":{"arxiv_id":"2606.31388","last_updated":"2026-06-30T09:16:21Z","snapshot_observed_at":"2026-08-02T07:18:38.830324Z","submitted_at":"2026-06-30T09:16:21Z","title":"One Video, One World: Turning Monocular Video into Physical 4D Scenes","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-01T05:38:19.541391Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2606.31388"},"observation_digest":"sha256:667eba97046cdf1fbf6be5d6d74ecc124ef4efbeeba0012097d3f577dcac66e9","observation_id":"117dbc72-dd2b-4e11-9aad-123f302ebc8f","resolution":{"observed_at":"2026-07-01T10:15:45.028897Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-07-11T22:29:10.666143Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03990","last_updated":"2026-07-04T19:16:29Z","snapshot_observed_at":"2026-08-07T04:37:33.315212Z","submitted_at":"2026-07-04T19:16:29Z","title":"InSpace: Structure-Aware 3D Indoor Scene Generation from a Single 360{\\deg} Image","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-11T22:29:10.666143Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2607.03990"},"observation_digest":"sha256:de2b50d6724345b45255d57b113ca9c9daac8cda081042f26931f6ed6e34a397","observation_id":"9b69de31-9219-4245-be32-20415ad32f18","resolution":{"observed_at":"2026-07-11T22:29:10.666143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02836","snapshot_observed_at":"2026-08-01T18:57:31.940710Z","title":"Scenethesis: A language and vision agentic framework for 3d scene generation.arXiv preprint arXiv:2505.02836, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17145","last_updated":"2026-07-19T09:01:20Z","snapshot_observed_at":"2026-08-01T18:57:29.178507Z","submitted_at":"2026-07-19T09:01:20Z","title":"Text2Villa: Hierarchical Generation of 3D Indoor Environments with Physics-Aware Analysis-by-Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T18:57:31.940710Z"},"links":{"cited_paper":"/paper/2505.02836","citing_paper":"/paper/2607.17145"},"observation_digest":"sha256:de73d1047b131e09b3951843aad24e37a7f7bfc76096950d2dbbf65d60884cc6","observation_id":"0973aaf3-5216-40b5-b911-1f59fe8edfde","resolution":{"observed_at":"2026-08-01T18:57:31.940710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.02836/citation-record","integrity":"/paper/2505.02836/integrity","json":"/paper/2505.02836/citation-record.json","paper":"/paper/2505.02836"},"outbound":[],"paper":{"arxiv_id":"2505.02836","last_updated":"2025-05-05T17:59:58Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T21:19:14.621187Z","submitted_at":"2025-05-05T17:59:58Z","title":"Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 23 inbound Pith citation observations for arXiv:2505.02836."}