{"as_of":"2026-08-15T18:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4c48993b7bfdd992d0fdc7de4fe78253b68f2be33a701a6739e1bf11905565d5","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:39:39.094935Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:23:00.474963Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T13:20:26.035267Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12906","snapshot_observed_at":"2026-08-06T15:23:00.474963Z","title":"Catsplat: Context-aware transformer with spatial guidance for generalizable 3d gaus- sian splatting from a single-view image.arXiv preprint arXiv:2412.12906, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16144","last_updated":"2025-07-22T01:43:51Z","snapshot_observed_at":"2026-08-14T09:38:24.716514Z","submitted_at":"2025-07-22T01:43:51Z","title":"LongSplat: Online Generalizable 3D Gaussian Splatting from Long Sequence Images","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:23:00.474963Z"},"links":{"cited_paper":"/paper/2412.12906","citing_paper":"/paper/2507.16144"},"observation_digest":"sha256:89780207bb5d90d0a9678be1515d9a011bf72cdabbabe8866e3e4cfe5b4e1454","observation_id":"453592e5-1da4-48f1-942a-d4abe5ccb37a","resolution":{"observed_at":"2026-08-06T15:23:00.474963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12906","snapshot_observed_at":"2026-08-05T18:37:01.726566Z","title":"W.; Lee, S.; Yoo, I.; Lugmayr, A.; Chi, S.; Ramani, K.; and Kim, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14443","last_updated":"2025-08-20T05:58:07Z","snapshot_observed_at":"2026-08-13T12:25:40.354322Z","submitted_at":"2025-08-20T05:58:07Z","title":"Reconstruction Using the Invisible: Intuition from NIR and Metadata for Enhanced 3D Gaussian Splatting","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T18:37:01.726566Z"},"links":{"cited_paper":"/paper/2412.12906","citing_paper":"/paper/2508.14443"},"observation_digest":"sha256:3fa483d0d065a7a406cb5d1377b848545c5c079d10bf28b9fb69c62ccc076d9a","observation_id":"ef291725-01dd-4152-839b-1b9b5f9b695f","resolution":{"observed_at":"2026-08-05T18:37:01.726566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"cited_work":{"arxiv_id":"2412.12906","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.12906","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Catsplat: Context-aware transformer with spatial guidance for generalizable 3d gaussian splatting from a single-view image","venue":null,"work_id":"a6ff0d81-5d60-4566-aa96-d4b906f264e0","year":2024},"citing_paper":{"arxiv_id":"2604.14025","last_updated":"2026-04-15T16:07:18Z","snapshot_observed_at":"2026-07-06T23:01:55.698452Z","submitted_at":"2026-04-15T16:07:18Z","title":"Feed-Forward 3D Scene Modeling: A Problem-Driven Perspective","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-10T13:13:42.052386Z"},"links":{"cited_paper":"/paper/2412.12906","citing_paper":"/paper/2604.14025"},"observation_digest":"sha256:354b5abfd984385343897497b9762ee031d55a4cc8983606fe4da66cc92ed1ec","observation_id":"96487200-cd14-4d77-9884-f0d5ed94ddc6","resolution":{"observed_at":"2026-05-10T13:20:26.038681Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.12906/citation-record","integrity":"/paper/2412.12906/integrity","json":"/paper/2412.12906/citation-record.json","paper":"/paper/2412.12906"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T13:39:38.819023Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.819023Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:0004dee0b6e1de9128622cee8e2a4c2c7cd83f022ed41a317f991823094abb84","observation_id":"908e4164-d7e6-477e-931a-69ad7da2b18e","resolution":{"observed_at":"2026-08-11T13:39:38.819023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.815297Z","title":"Vision-only robot navigation in a neural ra- diance world","venue":null,"work_id":"5902bed0-2c6b-4b17-9c43-6b3ff89e0f52","year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.823745Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:ba14ba432d023931835284cdc01d930c2e7d5a270a00388ec849c7d75cad271e","observation_id":"6984006e-011b-4fae-a9d7-6d1818cf4fb3","resolution":{"observed_at":"2026-08-11T13:39:39.819093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.827720Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.827720Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:1cdb080145d95749cfd5dbbf91596d07d7b0735f78f5665d128eb622eec9ee11","observation_id":"4a620873-b70f-4a12-85f5-84be5fd18e69","resolution":{"observed_at":"2026-08-11T13:39:38.827720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-11T13:39:38.831904Z","title":"Palm 2 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.831904Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:489bd44090255931ed54f8381aeac883e1409ecec024bc2b8ff57c97acbdb65a","observation_id":"5360e644-0c70-428e-85b7-e521044474c4","resolution":{"observed_at":"2026-08-11T13:39:38.831904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01390","last_updated":"2023-08-07T17:53:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-02T19:10:23Z","title":"OpenFlamingo: An Open-Source Framework for Training Large Autoregressive Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01390","snapshot_observed_at":"2026-08-11T13:39:38.836191Z","title":"Openflamingo: An open- source framework for training large autoregressive vision- language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.836191Z"},"links":{"cited_paper":"/paper/2308.01390","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:c9b13e8cb1e4ee0a4773ebde3bb41f197070022948946b879bb6024e9c66f674","observation_id":"0ec392dc-6398-405b-b18b-4bf97d243667","resolution":{"observed_at":"2026-08-11T13:39:38.836191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.841291Z","title":"Mip-nerf: A multiscale representation for anti-aliasing neu- ral radiance fields","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.841291Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:8ddc01bf71e57fc281cfe4f9fe9185ba677d8dfa73b33cda3e56cd196eb63e2f","observation_id":"c47b1e46-40b3-41b5-88b2-7cd3650ade03","resolution":{"observed_at":"2026-08-11T13:39:38.841291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T13:39:38.845053Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.845053Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:9859277c6a6593e14785a4380815a20952608b46237e8731ec9cf1797ab0910e","observation_id":"784fea98-0bd9-4999-9298-4541114f8153","resolution":{"observed_at":"2026-08-11T13:39:38.845053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.791238Z","title":"pixelsplat: 3d gaussian splats from image pairs for scalable generalizable 3d reconstruction","venue":null,"work_id":"1fb6cf9c-045e-4461-ae10-e2c11c4c6606","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.849426Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:bfd5cbffd840f1f4a3c8506d54aac849e7a122f946ed93fade2f919067d230e0","observation_id":"1e87f656-f50a-47d2-8320-4284dbed6bb6","resolution":{"observed_at":"2026-08-11T13:39:39.795315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.853283Z","title":"Tensorf: Tensorial radiance fields","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.853283Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:92cb1e016d6bdffa601a491cecd2e3d4055c58ad5b2f5d35dfc9138d1c226b62","observation_id":"da38b39c-1019-4138-9976-621b6587e501","resolution":{"observed_at":"2026-08-11T13:39:38.853283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14627","last_updated":"2024-07-18T13:10:22Z","snapshot_observed_at":"2026-08-13T00:48:25.742699Z","submitted_at":"2024-03-21T17:59:58Z","title":"MVSplat: Efficient 3D Gaussian Splatting from Sparse Multi-View Images","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14627","snapshot_observed_at":"2026-08-11T13:39:38.857481Z","title":"Mvsplat: Efficient 3d gaussian splatting from sparse multi-view images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.857481Z"},"links":{"cited_paper":"/paper/2403.14627","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:9a3aca9b9a35c81db9efd17c17bfb89e8b74431ae8f7641d4e8f79c8de73240a","observation_id":"00e1703b-2b86-484b-b528-e63d823758c3","resolution":{"observed_at":"2026-08-11T13:39:38.857481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.862332Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.862332Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:be1df9f501a6bd0111b156964aa975fca0158f1236506c46bcfa5676d8ba1974","observation_id":"12aa9588-47df-4ad3-ad01-e8f92ff26f30","resolution":{"observed_at":"2026-08-11T13:39:38.862332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.768788Z","title":"Scaling instruction- finetuned language models","venue":null,"work_id":"6a7dd475-0b21-47dc-9e00-4b2940edd2a7","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.866105Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:8a98d4492b62d7d1eb3d53b31f6c1959552c923de71d97788d55d9df330ecd6e","observation_id":"d4bc92a4-9cd6-4b38-8ec5-29d871661eab","resolution":{"observed_at":"2026-08-11T13:39:39.772590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.870007Z","title":"Gaussian splatting: 3d reconstruction and novel view synthesis, a review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.870007Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:40072c9c802f17b005a4ca02f5c626bba5b74096cd71ba156f62aa4a8efc3777","observation_id":"1a13ef0d-b8f8-47aa-bca5-e95dcf82308c","resolution":{"observed_at":"2026-08-11T13:39:38.870007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.752003Z","title":"Learning to render novel views from wide-baseline stereo pairs","venue":null,"work_id":"388c7480-5f5a-4304-acd0-b97a59464819","year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.873866Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:40ebfbf80550503ce8ec08270d43acf3c556c65aa99da1e4e8e8a81291e9b8f5","observation_id":"78e48487-1ac2-49b4-b411-f2c0af137b31","resolution":{"observed_at":"2026-08-11T13:39:39.755824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.741249Z","title":"The farthest point strategy for progres- sive image sampling","venue":null,"work_id":"dc01acbd-0fb4-4020-8167-0a669b39b053","year":1997},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.878017Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:17c460bf8af44041c94470f6756192ef14ebcbe0f0882490daa0e23a45c9b6e1","observation_id":"e5037ab3-0dee-439f-807b-54c5f0a2f807","resolution":{"observed_at":"2026-08-11T13:39:39.745254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.729170Z","title":"Vision-language pre-training: Basics, re- cent advances, and future trends","venue":null,"work_id":"ba2869c4-c289-4cd8-ac03-29f7230623f4","year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.882504Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:e2505e04345a4d1c6bb37e4b2d96a7a16846ad53eeb2ac0e03ae3c8f81911fe6","observation_id":"1d5ca7d3-a313-4699-90bf-d4a7ea96b858","resolution":{"observed_at":"2026-08-11T13:39:39.733471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.718228Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":"17f4380f-64cf-442f-9389-214950922ca7","year":2012},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.887339Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:386b316f97afbfe40afd2d5fe0fb4b3fcb4415c41c81918464e564bdb7580ebf","observation_id":"a9a069b0-e871-4fbf-8461-9ddf11542d8f","resolution":{"observed_at":"2026-08-11T13:39:39.722259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.702586Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"24dab005-249d-47c9-8aef-aa429cb41509","year":2016},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.892610Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:a268bbae7a569113d2139eeaff78262a9a2d417f97b9a9694615a374bee0d1a9","observation_id":"2bb959e9-fe8f-41e6-8315-7c8505b732e9","resolution":{"observed_at":"2026-08-11T13:39:39.707829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.690437Z","title":"Promptcap: Prompt-guided im- age captioning for vqa with gpt-3","venue":null,"work_id":"76feb3a3-b347-40e8-8841-7178e25e3960","year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.897812Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:63c372dd9269895a35531dcbad8724ca3ff246f542706e01afb39613f4dee01a","observation_id":"c69172dd-f696-4767-ae3a-d3f3851d7c56","resolution":{"observed_at":"2026-08-11T13:39:39.694807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.677703Z","title":"Language is not all you need: Aligning perception with language mod- els","venue":null,"work_id":"33d8b930-511e-4a8f-acf2-55f0f525a7d0","year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.901700Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:829c04196b5e1caa92bfb543c22d53896c7789d06f011bf0697f3c32b8224a40","observation_id":"1e7e39a6-bc99-48da-951d-308b7b4ae41b","resolution":{"observed_at":"2026-08-11T13:39:39.681903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.905386Z","title":"Scaling up visual and vision-language representa- tion learning with noisy text supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.905386Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:ab509bbfd154290eeb90dc58823f9666701f9113e2393f0322bca37bc20b4b55","observation_id":"01d0d8ce-7c77-4806-b89d-aabfa74a9464","resolution":{"observed_at":"2026-08-11T13:39:38.905386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.909543Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.909543Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:c64b69403f759901f45339002f1a0be007702149219e010074d506bf41525c7a","observation_id":"e3d67b9f-da93-42be-a7e0-ee8bd805e851","resolution":{"observed_at":"2026-08-11T13:39:38.909543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.913568Z","title":"Gen- erating images with multimodal language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.913568Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:f93cf76ca4c681e2d52c544cc2376b71645483cd11853f5cb05cf8d840689df7","observation_id":"acf8ee5d-133e-4880-9523-e0b49c84b8d1","resolution":{"observed_at":"2026-08-11T13:39:38.913568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.916975Z","title":"Lisa: Reasoning segmentation via large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.916975Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:77b6385f82e67b190eecb8cb9cbe615beb0e28f0995509c979a59f016c948631","observation_id":"1018ffe2-2860-4b47-b99b-6618497fa324","resolution":{"observed_at":"2026-08-11T13:39:38.916975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.640325Z","title":"Mine: Towards continuous depth mpi with nerf for novel view synthesis","venue":null,"work_id":"e25bd7e9-847e-4431-8579-9a5308b81a00","year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.921055Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:f2a5eeb91e1024b4b24d0c0d6b1c5f75dd9ec638bdb7fc0380c736655ebf9494","observation_id":"5c74d4ed-d4d7-44df-9d78-96779b053164","resolution":{"observed_at":"2026-08-11T13:39:39.643920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.924530Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.924530Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:826c7fd860461619a16c5d5e31bacf89c861561cfde80304a11642ddc9e6b4b7","observation_id":"ca88e672-2ed5-4a17-ae35-f20b81d362aa","resolution":{"observed_at":"2026-08-11T13:39:38.924530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.622645Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":"ce4cf53c-fe09-498d-8f8a-35c4752ae5d0","year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.928747Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:0a008b9b3235b5ba5cf74ab6ac699aeeeac1951d7741d9dd2bc3e550ad4053e9","observation_id":"de219c11-abb8-45c9-b838-103f3c447947","resolution":{"observed_at":"2026-08-11T13:39:39.626517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.611987Z","title":"Infinite na- ture: Perpetual view generation of natural scenes from a sin- gle image","venue":null,"work_id":"d0d766d5-85f7-4ff5-8a31-dfa7bff84453","year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.932441Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:247ffb044d8cbcc42fba44cabf8b6406be2d2c67564f7abe1ae6428010b0adeb","observation_id":"a49e2c53-e90b-4c4c-bdd3-fe9f6815e7e4","resolution":{"observed_at":"2026-08-11T13:39:39.615850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09625","last_updated":"2024-03-14T17:57:04Z","snapshot_observed_at":"2026-08-13T00:54:03.177981Z","submitted_at":"2024-03-14T17:57:04Z","title":"Make-Your-3D: Fast and Consistent Subject-Driven 3D Content Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09625","snapshot_observed_at":"2026-08-11T13:39:38.936371Z","title":"Make-your-3d: Fast and consis- tent subject-driven 3d content generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.936371Z"},"links":{"cited_paper":"/paper/2403.09625","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:208cc230b9e24eeb035af05e8fabd8cf846f3678035dc99764a0f9de13f105b8","observation_id":"b3f36c8d-075c-40da-b4c1-f4c731aeb5b9","resolution":{"observed_at":"2026-08-11T13:39:38.936371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.600429Z","title":"Visual instruction tuning","venue":null,"work_id":"98fbf71c-9550-41bc-b7ab-b81b7a5132cf","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.940640Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:81d7f6c1be66ac5c81981d5857d840e301b4300cf07be5dd58caafddf4ad58b9","observation_id":"4ef8705c-dfe9-41fc-8cd3-7134fb8d607f","resolution":{"observed_at":"2026-08-11T13:39:39.604369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07751","last_updated":"2019-06-18T18:21:46Z","snapshot_observed_at":"2026-08-14T16:13:43.526790Z","submitted_at":"2019-06-18T18:21:46Z","title":"Neural Volumes: Learning Dynamic Renderable Volumes from Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07751","snapshot_observed_at":"2026-08-11T13:39:38.944421Z","title":"Neural vol- umes: Learning dynamic renderable volumes from images","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.944421Z"},"links":{"cited_paper":"/paper/1906.07751","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:439cbb09a342055b4d331149a0bae2f38378cb6f64f59cd44172a576b1274ffe","observation_id":"ea9b7f52-77bc-44b2-9c39-7df4ec57220d","resolution":{"observed_at":"2026-08-11T13:39:38.944421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.07356","last_updated":"2022-05-03T21:31:58Z","snapshot_observed_at":"2026-08-13T16:01:58.621049Z","submitted_at":"2022-04-15T07:33:06Z","title":"Vision-and-Language Pretrained Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.07356","snapshot_observed_at":"2026-08-11T13:39:38.948299Z","title":"Vision-and-language pretrained models: A survey","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.948299Z"},"links":{"cited_paper":"/paper/2204.07356","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:f787f4ca92fde5df469e723023cea0bcecfc5e12310be0589dd878ebac98f3db","observation_id":"79f379a9-7f8b-4a4e-ba82-20d597e5b7f4","resolution":{"observed_at":"2026-08-11T13:39:38.948299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.588476Z","title":"Cots: Collaborative two-stream vision- language pre-training model for cross-modal retrieval","venue":null,"work_id":"a623edaf-c44e-4e1f-b9ac-669994a21516","year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.952375Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:445d538c4d08a787d19c8845da44353ff63c7d5a30df23ff89d9633e89fabcd1","observation_id":"31e4748b-d10c-4f61-8834-a842a73ad383","resolution":{"observed_at":"2026-08-11T13:39:39.593069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.576268Z","title":"Nerf in the wild: Neural radiance fields for uncon- strained photo collections","venue":null,"work_id":"273883ca-d3cf-4839-a8f7-01e264f29688","year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.955368Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:2c253e7c696cb3ed5182e65892becca6d851cd045c2351b2e6f08f738f79bee1","observation_id":"38a3b9ab-1f99-4800-8e8b-ad4adf19676e","resolution":{"observed_at":"2026-08-11T13:39:39.580892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.959168Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.959168Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:deadfcaa479f269a3be0458a2427ce21ccef784f7ed7209df47d2c98f1fe7739","observation_id":"1b9c4201-17d0-499a-be1c-ec445ddac3dc","resolution":{"observed_at":"2026-08-11T13:39:38.959168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.962215Z","title":"Ocr-vqa: Visual question answering by reading text in images","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.962215Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:6592c268826ccac282bbbbc74fdb109aadf37e4dcac5f0dc6a8ce3c5c85ed4ce","observation_id":"e6420b45-0cc6-4f1d-8e5b-b09aca9f5c88","resolution":{"observed_at":"2026-08-11T13:39:38.962215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.552595Z","title":"Improving multimodal datasets with image captioning","venue":null,"work_id":"a999fa10-05e0-45b1-bc9f-6a47d32d0368","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.965227Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:43c1cda77249ffeb63ec3a45b714d56edfdd437ea26866d2a8443fd50408eda0","observation_id":"41be9556-44a9-46cc-9a22-64ecdfca567a","resolution":{"observed_at":"2026-08-11T13:39:39.556628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.541752Z","title":"Nerfies: Deformable neural radiance fields","venue":null,"work_id":"83d2bba7-ce19-4b88-842a-eab2c959d7dc","year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.968096Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:7d1111d9de96550977ac03f6c9eb6d06c56b641e6d358ed37791634a81d8cf33","observation_id":"aea87d3d-cf3a-4263-8493-03ba52afef8e","resolution":{"observed_at":"2026-08-11T13:39:39.545516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.531014Z","title":"Unidepth: Universal monocular metric depth estimation","venue":null,"work_id":"f4baa963-e1c8-4869-a6ea-1c3d77028d9b","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.971173Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:c2f789f74bbdab4d60ee61e6c36d2912a632ba3721e4d1051aa4d5727172d0c9","observation_id":"bfbfd61e-5caf-4fed-b58f-1f7caf512a82","resolution":{"observed_at":"2026-08-11T13:39:39.534789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.973955Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.973955Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:0e90f6d8793dd1265be813c1a3bfa732b73247dd623dc017cd6d9cf1ebd8f044","observation_id":"9474adf2-c525-4cfe-ba7c-4a1387a33c53","resolution":{"observed_at":"2026-08-11T13:39:38.973955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.977213Z","title":"Nuscenes-qa: A multi-modal visual ques- tion answering benchmark for autonomous driving scenario","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.977213Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:95e54ab4c9730058b67d18c9a9e1c77e5e670cf55eaf68bffff1e536dd426b94","observation_id":"a6e771d4-749f-40be-8079-0038eded3ab5","resolution":{"observed_at":"2026-08-11T13:39:38.977213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:38.980260Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.980260Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:62336c4f06f94b0c9b77d3185b30064b16dc6dbb5f9da1a283e4dd82f25442df","observation_id":"d0aaaedc-e740-434c-a811-466bc2c37a24","resolution":{"observed_at":"2026-08-11T13:39:38.980260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.498460Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"82d71456-3c64-41c0-b930-7e3a83a3e695","year":2012},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.984141Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:2ccd856c2c2028542b48a0d71f58367ca938530130fdc05d1a9d2314ea0c2e90","observation_id":"37f695aa-2a91-4c6e-ac17-88999e5891f5","resolution":{"observed_at":"2026-08-11T13:39:39.502565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.487131Z","title":"Implicit neural representa- tions with periodic activation functions","venue":null,"work_id":"3e35f013-54be-4c3f-8180-8799c3237347","year":2020},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.987568Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:7aee8593ca1f108e555173d5bd10ab51635a1ee4749398db25abcc1e73cbf5b4","observation_id":"feadb00c-089b-4d48-a632-b865b2633744","resolution":{"observed_at":"2026-08-11T13:39:39.491541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04343","last_updated":"2025-06-01T06:23:12Z","snapshot_observed_at":"2026-08-13T12:23:48.495875Z","submitted_at":"2024-06-06T17:59:56Z","title":"Flash3D: Feed-Forward Generalisable 3D Scene Reconstruction from a Single Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04343","snapshot_observed_at":"2026-08-11T13:39:38.990916Z","title":"Flash3d: Feed-forward gener- alisable 3d scene reconstruction from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.990916Z"},"links":{"cited_paper":"/paper/2406.04343","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:4de8f11298464c7e3847b9ffd3c2bef25beafc86ad7e13eb1ee8df483f5e6b1d","observation_id":"64df25a9-32f5-4a3b-8369-0a3ca7f25d83","resolution":{"observed_at":"2026-08-11T13:39:38.990916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.471847Z","title":"Splatter image: Ultra-fast single-view 3d recon- struction","venue":null,"work_id":"8ac7e751-c172-45cc-a119-7b9e75a021aa","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.994752Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:c9381e15e217e8906ecf69428fcce8f83ec4152f0541d06971b9c94ac5466c03","observation_id":"aac36db2-a900-48e8-8feb-538f21a1199e","resolution":{"observed_at":"2026-08-11T13:39:39.476978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.02417","last_updated":"2022-08-29T15:46:14Z","snapshot_observed_at":"2026-08-13T14:37:17.253817Z","submitted_at":"2022-08-29T15:46:14Z","title":"Volume Rendering Digest (for NeRF)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.02417","snapshot_observed_at":"2026-08-11T13:39:38.998184Z","title":"V olume rendering digest (for nerf)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:38.998184Z"},"links":{"cited_paper":"/paper/2209.02417","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:849e3c3318145cae8b3e3fd5a02f5653a338ad79ba0ba60b09a102ed186f331b","observation_id":"31947d4d-4376-4a64-9531-929858f70efc","resolution":{"observed_at":"2026-08-11T13:39:38.998184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T13:39:39.001898Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.001898Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:0036203d329dff4f1c31e0336180579b347fc9173eb8c75d1bf1c24551c73c40","observation_id":"63a58f62-cf5e-44e6-8fa8-674571b047ff","resolution":{"observed_at":"2026-08-11T13:39:39.001898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.460350Z","title":"Single-view view synthe- sis with multiplane images","venue":null,"work_id":"0500734b-69dd-47dc-85e4-869bb4e1ae59","year":2020},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.005460Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:35277901763444e7a22c91ac8cfd6023986d6d6aab9cf902c2a091ae4ed81beb","observation_id":"3af008f9-a64b-4ba3-a92a-269b425c830c","resolution":{"observed_at":"2026-08-11T13:39:39.464440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.448181Z","title":"Layer-structured 3d scene inference via view synthesis","venue":null,"work_id":"2eb35fa1-f8ab-4bf3-8fc3-d5bee95c1f4f","year":2018},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.009048Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:d2a379f4e456c6345ba4503e68a2509d9eaa3e4a06388252efb16864473d7f77","observation_id":"1235899f-aef5-470d-b13e-0938d6a42d60","resolution":{"observed_at":"2026-08-11T13:39:39.452868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.013045Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.013045Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:ca131ee3c4f9affe1d6b004057fcced2d00c6331a521276f5d4364d3eb640f66","observation_id":"041f44e0-52a4-40b9-a65f-a3cf7e12e373","resolution":{"observed_at":"2026-08-11T13:39:39.013045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16292","last_updated":"2024-07-30T12:12:00Z","snapshot_observed_at":"2026-08-13T00:46:49.755783Z","submitted_at":"2024-03-24T20:48:36Z","title":"latentSplat: Autoencoding Variational Gaussians for Fast Generalizable 3D Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16292","snapshot_observed_at":"2026-08-11T13:39:39.016371Z","title":"latentsplat: Autoencoding variational gaussians for fast generalizable 3d reconstruction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.016371Z"},"links":{"cited_paper":"/paper/2403.16292","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:69fbfbdcd0edf8f26cfdd8ca18d5cd3b45e65245e92077bdaf367832561c96f8","observation_id":"32022cd0-0d7d-4246-b5b1-4502c6508fe5","resolution":{"observed_at":"2026-08-11T13:39:39.016371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.019963Z","title":"Synsin: End-to-end view synthesis from a sin- gle image","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.019963Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:a028bbf59a1ed3e50d6ecf0ef868c06b2079ca46f81bfad32e0793bb73f6c847","observation_id":"bba07e37-95dd-4cd8-aeb7-2b7158bba642","resolution":{"observed_at":"2026-08-11T13:39:39.019963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.419455Z","title":"Behind the scenes: Density fields for single view reconstruction","venue":null,"work_id":"ee9c4ff8-b577-4283-872b-a175b603a1a1","year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.024248Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:533d2724de33a180ba8d9a45cbc600c7f85c6f358edce83da248ad80ff745b83","observation_id":"36053200-60ff-4474-b5fc-89a0d232e2ec","resolution":{"observed_at":"2026-08-11T13:39:39.424683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.028194Z","title":"Neural fields in visual computing and beyond","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.028194Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:eb04a3e82ad43addc10b0e5bff3130c8a7f398e7a69934e82c00f6c0a39a139d","observation_id":"cc74f264-9ca2-443c-bc44-4ee4bc8fc976","resolution":{"observed_at":"2026-08-11T13:39:39.028194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.031724Z","title":"Freenerf: Im- proving few-shot neural rendering with free frequency reg- ularization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.031724Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:8ea2382eb7b63d57df1ce4d3324e1e848e3d1e465bea9b1fef4f5384cb76b892","observation_id":"d3eff62e-473d-46e7-b34e-cbc08d8dffa8","resolution":{"observed_at":"2026-08-11T13:39:39.031724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.396572Z","title":"Deformable 3d gaussians for high- fidelity monocular dynamic scene reconstruction","venue":null,"work_id":"1a9feaca-179a-4339-b1d5-776b40a90b3c","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.035991Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:f5f5a80ad05e8de7160965206bd25499cb58c2d53aeb33a35c23017525fdde59","observation_id":"83cfffc1-f225-4ea3-9a50-e7b75c8210e9","resolution":{"observed_at":"2026-08-11T13:39:39.400283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.385907Z","title":"pixelnerf: Neural radiance fields from one or few images","venue":null,"work_id":"bfcc5ac2-7b41-406a-93f7-7f1f5519ebf6","year":2021},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.039082Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:f8b4efbdcb8787f65a13c26ac6a95b6c058d53b9e588248df9e59f8a03697517","observation_id":"ab8c75c9-5a8f-43e4-8c37-0c2a2f6a68dd","resolution":{"observed_at":"2026-08-11T13:39:39.389665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-08-13T15:12:42.567441Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01917","snapshot_observed_at":"2026-08-11T13:39:39.042630Z","title":"Coca: Contrastive captioners are image-text foundation models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.042630Z"},"links":{"cited_paper":"/paper/2205.01917","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:4f9a6760f412d3d722264923b19d60d1ec2ff4510c7593802c792518eeeaad5d","observation_id":"68958d69-dc04-4de4-9179-3794dde4978a","resolution":{"observed_at":"2026-08-11T13:39:39.042630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.046122Z","title":"Mip-splatting: Alias-free 3d gaussian splat- ting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.046122Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:3c58cf49a1bfe93b450d19bfd32ceeb8560be2bfa7829b7da811c5a20d52336a","observation_id":"a3527777-bd63-423b-bb90-5cb9d0af4620","resolution":{"observed_at":"2026-08-11T13:39:39.046122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13770","last_updated":"2024-08-25T08:37:57Z","snapshot_observed_at":"2026-08-14T17:34:51.044751Z","submitted_at":"2024-08-25T08:37:57Z","title":"TranSplat: Generalizable 3D Gaussian Splatting from Sparse Multi-View Images with Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13770","snapshot_observed_at":"2026-08-11T13:39:39.048884Z","title":"Transplat: Generalizable 3d gaussian splatting from sparse multi-view images with transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.048884Z"},"links":{"cited_paper":"/paper/2408.13770","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:63a2d698af775c1906cf7729372ea736fd0f44994792606a4550f9e32beba183","observation_id":"5399fbc6-fd5e-421e-b653-624566fb1629","resolution":{"observed_at":"2026-08-11T13:39:39.048884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.052522Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.052522Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:e957f15ce272983264e41218b6cb5a3ef5d39b4ba8d6a01720205d05580310e7","observation_id":"70ccf237-83e3-42c6-8f5b-3831aed01842","resolution":{"observed_at":"2026-08-11T13:39:39.052522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-11T13:39:39.055848Z","title":"Opt: Open pre-trained trans- former language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.055848Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:0f500bb53c835d54b84ebf24ba1a57e0d9859112a03c2f1e7c9532027c384989","observation_id":"9dff31ac-6b09-4d84-9ac9-e2e3dd8f43ae","resolution":{"observed_at":"2026-08-11T13:39:39.055848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.360774Z","title":"User: Unified semantic enhancement with momentum contrast for image-text retrieval","venue":null,"work_id":"9f21b308-0a07-4684-8216-510dc5591c14","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.060243Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:73eefb09635b1e832f1715420182001c911cd834f1c80ee0833f714327491a60","observation_id":"33088fb0-1234-48bc-af78-205923204f50","resolution":{"observed_at":"2026-08-11T13:39:39.364492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09817","last_updated":"2018-05-24T17:58:02Z","snapshot_observed_at":"2026-07-06T06:41:05.545426Z","submitted_at":"2018-05-24T17:58:02Z","title":"Stereo Magnification: Learning View Synthesis using Multiplane Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09817","snapshot_observed_at":"2026-08-11T13:39:39.064477Z","title":"Stereo magnification: Learning view synthesis using multiplane images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.064477Z"},"links":{"cited_paper":"/paper/1805.09817","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:ad3f8f3cd173bc8aadb27a858d92d079e9b5f5557b1a1e5aff04c055d8ba20c8","observation_id":"e586970a-15f2-475f-9f97-e082891168b8","resolution":{"observed_at":"2026-08-11T13:39:39.064477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-11T13:39:39.068664Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.068664Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:0c7cb4f97884b1506f6ffd4e7e9a3afce9a041ae3102016334c518fbc28cbe9a","observation_id":"219ce9ae-465c-446e-a782-1b9b12ddf79f","resolution":{"observed_at":"2026-08-11T13:39:39.068664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.349533Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Gen- eralizable 3D Gaussian Splatting from A Single-View Im- age","venue":null,"work_id":"4e4440e6-a632-4a1a-8b06-1e5fc030313e","year":2024},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.073112Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:292559b95595230b391dc563948bd9e7a79d30b312b540c7f3863a27fa2a22ce","observation_id":"a516c8dc-6e83-49ce-a3e0-ea6bc82fa643","resolution":{"observed_at":"2026-08-11T13:39:39.353457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.334859Z","title":"Which of the two images predicts the target image better in terms of visual quality, such as object appearance, shapes, colors, and textures?","venue":null,"work_id":"b5320a6e-87d1-489d-bed0-2f97828c9f4b","year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.078751Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:2ad59d7bfe243de75aa8ed6b9c4212d1295238b3ad355ceb21ba263a4d897727","observation_id":"08da7982-e48c-438d-9539-9615d557cca0","resolution":{"observed_at":"2026-08-11T13:39:39.340809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.323293Z","title":null,"venue":null,"work_id":"99194bc7-a8ce-4132-b76f-50d2dab91d93","year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.083485Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:7e9bd2166025f7ddc3178efd8cff100ffd595ccb2e1e9746d91b5809c5553c42","observation_id":"761b3030-0030-4452-8ffc-9118baa1fce6","resolution":{"observed_at":"2026-08-11T13:39:39.327361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.311077Z","title":"Datasets RealEstate10K","venue":null,"work_id":"70c13aae-a8fe-4f22-b44d-686d007f7bb3","year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.087260Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:fdc3dc13df6acc47207bed9a0bf570f171e76e5e61210ccdd269f2428fcb62af","observation_id":"9a45f0dd-9de5-4305-8d2a-bf0ff4705541","resolution":{"observed_at":"2026-08-11T13:39:39.314965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.298969Z","title":"Baseline","venue":null,"work_id":"656abd92-c087-4861-a6f8-cee59b1f8356","year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.091411Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:a133d7282336f7b14852de5af37778a1710bbe42b400abd5523b19fd183ca561","observation_id":"7a68ef83-e07b-495a-af9a-152b6d525a7e","resolution":{"observed_at":"2026-08-11T13:39:39.302881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:39:39.286566Z","title":"Failure cases of CATSplat","venue":null,"work_id":"c585cbb5-5276-4b6f-b6d8-053c1748c2c6","year":null},"citing_paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T13:39:39.094935Z"},"links":{"citing_paper":"/paper/2412.12906"},"observation_digest":"sha256:d66890425d0483fbd7e680bc9586efecc75fd52d53b41f9ba0f962ce1ac7fb50","observation_id":"3d3b335e-dd81-47f0-9d54-b13d2e3ec33a","resolution":{"observed_at":"2026-08-11T13:39:39.291214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.12906","last_updated":"2025-02-03T08:06:36Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T07:09:00.621204Z","submitted_at":"2024-12-17T13:32:04Z","title":"CATSplat: Context-Aware Transformer with Spatial Guidance for Generalizable 3D Gaussian Splatting from A Single-View Image"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":33},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 3 inbound Pith citation observations for arXiv:2412.12906."}