{"as_of":"2026-08-09T01:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:adc75084566f33dc23d5c6be5e38ffcdb5de63518e6a2468a625dbe543bb533e","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T16:17:22.812496Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T07:08:45.182462Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T07:12:28.594370Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"cited_work":{"arxiv_id":"2512.14236","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.14236","snapshot_observed_at":"2026-07-10T02:19:33.992432Z","title":"arXiv preprint arXiv:2512.14236 (2025)","venue":null,"work_id":"2b343793-7784-4659-bdcb-d402a5e7da4a","year":2025},"citing_paper":{"arxiv_id":"2605.12169","last_updated":"2026-05-12T14:16:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T14:16:47Z","title":"UniFixer: A Universal Reference-Guided Fixer for Diffusion-Based View Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T07:08:45.182462Z"},"links":{"cited_paper":"/paper/2512.14236","citing_paper":"/paper/2605.12169"},"observation_digest":"sha256:873368661c3134b31253601ad462e3d5209522bab1f6cb7d0fb8deb7d1f282a9","observation_id":"c7595fbe-6a83-4dab-a7a5-762414a21190","resolution":{"observed_at":"2026-07-10T02:19:33.992432Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2512.14236/citation-record","integrity":"/paper/2512.14236/integrity","json":"/paper/2512.14236/citation-record.json","paper":"/paper/2512.14236"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:16.439371Z","title":"Lumiere: A space-time diffu- sion model for video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:16.439371Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:d0ddbabaf73aab72fc9d0f85bbd21cf804132fd070accc61fd79f474d9f5a46d","observation_id":"fb105b47-2eab-4bef-bcf0-301e32303068","resolution":{"observed_at":"2026-08-03T16:17:16.439371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:16.615720Z","title":"Visual competi- tion.Nature Reviews Neuroscience, 3(1):13–21, 2002","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:16.615720Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:332c8547c1be1b7f98c0577f2aa0769e38a8776032d951bf61fe8350f9cf01fe","observation_id":"9de5960b-d6f4-4772-a4af-7d6788364b39","resolution":{"observed_at":"2026-08-03T16:17:16.615720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-03T16:17:16.732660Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:16.732660Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:515c36f0c48c4f3991e599a1fbfbc6778255899406f61a6a7b613fba1a997032","observation_id":"64d7bba1-95eb-463a-8790-69038fee8925","resolution":{"observed_at":"2026-08-03T16:17:16.732660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02073","last_updated":"2025-04-21T12:09:08Z","snapshot_observed_at":"2026-08-02T06:32:26.688405Z","submitted_at":"2024-10-02T22:42:20Z","title":"Depth Pro: Sharp Monocular Metric Depth in Less Than a Second","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02073","snapshot_observed_at":"2026-08-03T16:17:16.862067Z","title":"Depth Pro: Sharp monocular metric depth in less than a second.preprint arXiv:2410.02073, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:16.862067Z"},"links":{"cited_paper":"/paper/2410.02073","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:c396055f3e84b1f7bf0b0cc5a81d754390c6ffd960ac4368f3a4b6c04a56a4ac","observation_id":"bb7827fe-7617-415d-880e-304b32eb99a1","resolution":{"observed_at":"2026-08-03T16:17:16.862067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:16.977305Z","title":"B Breese","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:16.977305Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:f3b359afdaa427e90d70077f1bfdd5636a9b61590da43212e182d5ed7b1ac9b3","observation_id":"27c2547d-01a7-452c-b269-1d020cbcf58d","resolution":{"observed_at":"2026-08-03T16:17:16.977305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.039606Z","title":"Com- parison of three different methods to merge multiresolution and multispectral data- landsat TM and SPOT panchromatic","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.039606Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:1a4c1f5ae84a7d223942bacb7dd4109baa7acee1ed60f8f3badc2e0c05890db9","observation_id":"22578f75-77a6-4466-84fe-37e8fef5ab7e","resolution":{"observed_at":"2026-08-03T16:17:17.039606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.096210Z","title":"SVG: 3d stereoscopic video generation via denoising frame matrix","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.096210Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:3371760fcead36898525bf43e85b135691626959d2474d64cb658f62dfe5db4e","observation_id":"63a01113-d59d-4fdb-a851-754f0ca52196","resolution":{"observed_at":"2026-08-03T16:17:17.096210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.156838Z","title":"Guided super-resolution as pixel-to-pixel transformation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.156838Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:f3db114cd399d5446a55f0c1c050495d11b769c59188598e7a325749dd36b5da","observation_id":"715c9acb-3416-4023-9865-25f81d48c93d","resolution":{"observed_at":"2026-08-03T16:17:17.156838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.235419Z","title":"DeDoDe v2: Analyzing and improving the DeDoDe keypoint detec- tor","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.235419Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:0e27eb261040574fc3494accdd1945adc1145ced4639aba7bc8a5ccc9d5894ff","observation_id":"5c0521e4-5000-4451-9731-87e617e9fe6d","resolution":{"observed_at":"2026-08-03T16:17:17.235419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.289927Z","title":"Depth-image-based rendering (DIBR), compression, and transmission for a new approach on 3D- TV","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.289927Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:4e3650fc7b68f4d9de3c45b49b2f9d5cf03625441259bdc2cab16e07cb8075a3","observation_id":"fd377fc3-9c68-4e9d-8646-453a9479a3c6","resolution":{"observed_at":"2026-08-03T16:17:17.289927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-03T16:17:17.352134Z","title":"An image is worth one word: Personalizing text-to-image gen- eration using textual inversion.preprint arXiv:2208.01618,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.352134Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:955b6156e3f45f662f65b89ad4fc02c0883d30b91c754e7ef5def5ecf8ecf12b","observation_id":"76716a05-873f-44a2-8474-2b31d118f3a3","resolution":{"observed_at":"2026-08-03T16:17:17.352134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.434590Z","title":"Fine-tuning image-conditional diffusion models is easier than you think","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.434590Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:777e494a2c4025a5c4d981c220b6840f2c9f221976293a4b1190c66fb08b9f04","observation_id":"ed9bf1f9-293f-4996-be1e-df878d5cf4ce","resolution":{"observed_at":"2026-08-03T16:17:17.434590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00135","last_updated":"2025-04-30T19:06:09Z","snapshot_observed_at":"2026-08-07T23:31:53.516680Z","submitted_at":"2025-04-30T19:06:09Z","title":"Eye2Eye: A Simple Approach for Monocular-to-Stereo Video Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00135","snapshot_observed_at":"2026-08-03T16:17:17.483150Z","title":"Eye2Eye: A simple approach for monocular-to-stereo video synthesis.preprint arXiv:2505.00135, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.483150Z"},"links":{"cited_paper":"/paper/2505.00135","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:8dd0bfa485d084e4eefcd4b41d75c51752ba8f7acff2168d3f4d1732467b639a","observation_id":"85292eb6-2fc4-4899-9a7c-ad44c0e93fd5","resolution":{"observed_at":"2026-08-03T16:17:17.483150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.544576Z","title":"Ego4D: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.544576Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:b3e9ada9a67152de573790e3ce6b2a907656e6c59e0e78110fac428383d94e6f","observation_id":"80a7ded6-5235-4fc6-ab7a-5d05d461ff80","resolution":{"observed_at":"2026-08-03T16:17:17.544576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.613919Z","title":"Epipolar transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.613919Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:de512599d9a1027f665fa15ada1187aa95938cf88275ec13457163972448a92e","observation_id":"5265fad0-b443-4101-9736-d07a23fae3fc","resolution":{"observed_at":"2026-08-03T16:17:17.613919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.729321Z","title":"Denoising diffu- sion probabilistic models.Advances in Neural Information Processing Systems (NeurIPS), 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.729321Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:dcd81fd32bd318ff8820fd0cb5158aa878e7af225b7862895bff5e1d81949212","observation_id":"1aeb6f08-af3b-4119-b3b6-6016806a7f20","resolution":{"observed_at":"2026-08-03T16:17:17.729321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.855561Z","title":"Video dif- fusion models.Advances in Neural Information Processing Systems (NeurIPS), 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.855561Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:f2cc8b1e18e4b837df86ff620fbd94e8fdbc8643770d1cf9ab9b2f6357d3687c","observation_id":"8516e5fc-1ae8-4654-bc43-43c6a328df9f","resolution":{"observed_at":"2026-08-03T16:17:17.855561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:17.980816Z","title":"DepthCrafter: Generating consistent long depth sequences for open-world videos","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:17.980816Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:df332cc00c1567e8c1dcb64a65b8a2c6417d68b24e09139bf375a6be417a44c7","observation_id":"fe651e3e-49e6-4778-9bbf-9d7d41c194ec","resolution":{"observed_at":"2026-08-03T16:17:17.980816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06023","last_updated":"2025-06-06T12:14:24Z","snapshot_observed_at":"2026-08-08T15:12:16.165491Z","submitted_at":"2025-06-06T12:14:24Z","title":"Restereo: Diffusion stereo video generation and restoration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06023","snapshot_observed_at":"2026-08-03T16:17:18.025399Z","title":"Restereo: Diffusion stereo video generation and restoration.preprint arXiv:2506.06023, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.025399Z"},"links":{"cited_paper":"/paper/2506.06023","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:02fcd113de8a8b29bf0966a8ab26934ddbfdbd994ecaea258bb4a2f08519be7d","observation_id":"545aadc6-9c74-4981-a4ba-32fbf5e2eeeb","resolution":{"observed_at":"2026-08-03T16:17:18.025399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.082930Z","title":"EpiDiff: Enhancing multi-view synthesis via localized epipolar-constrained diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.082930Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:b6f00dafe31d9ef3360554b396564265404b3384f5dd61919e8e9daa6b05e8a3","observation_id":"97e97984-bf2c-41a1-a342-fdefa4dddaf5","resolution":{"observed_at":"2026-08-03T16:17:18.082930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.145435Z","title":"Depth map super-resolution by deep multi-scale guidance","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.145435Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:46024ab0df54e4ae95dcc98a07e238cd9998cb6b5b13caa6671d34ad52c0fc99","observation_id":"83bcd1a3-ccc8-490e-8e1e-483cb0dec240","resolution":{"observed_at":"2026-08-03T16:17:18.145435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.195255Z","title":"Izadimehr, Milad Ghanbari, Guodong Chen, Wei Zhou, Xiaoshuai Hao, Mallesham Dasari, Christian Tim- merer, and Hadi Amirpour","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.195255Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:79fef4c7171994f332bfe14420f87a3a83e409e205cd9695990f3ef715296e11","observation_id":"ac264673-e5df-4f7a-8967-585be8ff6478","resolution":{"observed_at":"2026-08-03T16:17:18.195255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.280775Z","title":"Stereo4D: Learning how things move in 3d from internet stereo videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.280775Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:42788762abdc23bec767a1a5f7f13c19a089b82e878e6a9d1a9d8736619247d5","observation_id":"c272b1aa-d3e3-416f-8056-dd25c687a6f4","resolution":{"observed_at":"2026-08-03T16:17:18.280775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.385089Z","title":"Repurpos- ing diffusion-based image generators for monocular depth estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.385089Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:c69088834ebc9ce4e77670cd9bbf8edd7caeb9601fe363e730df8a622db3773d","observation_id":"264e5009-a95f-4701-b00e-e0b41567d49d","resolution":{"observed_at":"2026-08-03T16:17:18.385089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.520057Z","title":"Marigold: Affordable adaptation of diffusion- based image generators for image analysis.IEEE Transac- tions on Pattern Analysis and Machine Intelligence (TPAMI),","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.520057Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:972dc46ba10e8ffc2fb68022c89c2839ce94d3df835136ec5e81e1d46c72fc01","observation_id":"98b6a010-1dc2-4e80-a420-644273ac2e73","resolution":{"observed_at":"2026-08-03T16:17:18.520057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.618519Z","title":"Auto-encoding varia- tional bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.618519Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:7f819217d096209354c023b0b28dd25af670944973f99adfea58740aa31b6d6b","observation_id":"5decf424-6de9-4acb-b711-95204ee03c07","resolution":{"observed_at":"2026-08-03T16:17:18.618519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.680289Z","title":"2d-to- 3d image conversion by learning depth from examples","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.680289Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:6d6337f162691f3aae33c2d9ea99f7fa3d78700a00f25ac7285e9bba4b052e5c","observation_id":"e2d4b83c-68e5-43dc-a691-7cb95470fa90","resolution":{"observed_at":"2026-08-03T16:17:18.680289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.721481Z","title":"Visual discomfort of 3D TV: Assessment methods and modeling.Displays, 32(4):209–218, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.721481Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:172eba76916329ca6a96c4e0d925237d5601da78bfc128883ee151d20b89409a","observation_id":"ff646d38-18f3-49b9-8ce8-f758d6ac9721","resolution":{"observed_at":"2026-08-03T16:17:18.721481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.777527Z","title":"Stereo conversion with disparity-aware warping, compositing and inpainting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.777527Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:773993c25abd6b1f1c97661dd0b8750cf25e5b7574e64ece10d830dd46d1b397","observation_id":"21293917-b73e-4148-816d-29f345a35777","resolution":{"observed_at":"2026-08-03T16:17:18.777527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.875791Z","title":"Guided depth super-resolution by deep anisotropic diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.875791Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:f1ea35000a57851d8fad20aee326c14af1155c31fdf9f73f4ea1a159bf915417","observation_id":"eea3cf55-b37b-4b1d-8ed1-f348cc15d61b","resolution":{"observed_at":"2026-08-03T16:17:18.875791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:18.921447Z","title":"T2I-Adapter: Learn- ing adapters to dig out more controllable ability for text-to- image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.921447Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:a88a192e8688ed5ce5564d8c8c91049da1af81ff1f4473d1f297abb7eab0716e","observation_id":"5bb9b3bc-9ee4-4e82-aa5f-6d625a5ecd45","resolution":{"observed_at":"2026-08-03T16:17:18.921447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12036","last_updated":"2024-03-18T17:59:40Z","snapshot_observed_at":"2026-07-06T17:46:29.153377Z","submitted_at":"2024-03-18T17:59:40Z","title":"One-Step Image Translation with Text-to-Image Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12036","snapshot_observed_at":"2026-08-03T16:17:18.981689Z","title":"One-step image translation with text-to-image models.preprint arXiv:2403.12036, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:18.981689Z"},"links":{"cited_paper":"/paper/2403.12036","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:b90579a7fa751976b2bff4447857dbd51866a7c4b55d2db3a5cf877a71af5bbb","observation_id":"cf6e3b79-a451-4ed3-ac7a-2d3678a067df","resolution":{"observed_at":"2026-08-03T16:17:18.981689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.102838Z","title":"UniDepth: Universal monocular metric depth estimation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.102838Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:b0405de8b55c11a3bb3a8e58bed4c50c1b7a4801489ce90993b6cbb99d039924","observation_id":"ffb52d61-afd4-48aa-ade2-37ea4284daa8","resolution":{"observed_at":"2026-08-03T16:17:19.102838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.203167Z","title":"UniDepthV2: Universal monocular metric depth estimation made simpler.IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.203167Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:258bcd040de0513fd575b30cb4fbd780e6ef6bd5b4da98f3c27c0e1552bc0d3a","observation_id":"369c62d2-d942-4359-9f13-a40b07600a1a","resolution":{"observed_at":"2026-08-03T16:17:19.203167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.370533Z","title":"SDXL: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.370533Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:316f2511d5ac97cfc56b1a9eb7f4e0da5b5cdfeffd3da86f1a80cb0d7c050fc3","observation_id":"a56806fa-c9be-4e29-9863-6117697a4fd2","resolution":{"observed_at":"2026-08-03T16:17:19.370533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.489226Z","title":"Towards open-world generation of stereo images and unsu- pervised matching","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.489226Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:f76b62d4ee138a00623cf7482f3ae5ac5f89a4cceeab639ebe22b0a20ccd606b","observation_id":"fba05a65-315a-4acd-abe7-7bd3f8c59566","resolution":{"observed_at":"2026-08-03T16:17:19.489226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.638176Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.638176Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:9b879c407e4eb06dc017a2729472b4ee302ab71d0d17a235cfa799dd9ebeb1ea","observation_id":"e3f4e072-d9f0-48a1-af8a-1d233016c091","resolution":{"observed_at":"2026-08-03T16:17:19.638176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.781189Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.781189Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:3235ae31ff20aff54fc9318e44a84acbc6b7139258d957b89086d445d57993d8","observation_id":"d0158fe6-44e4-4348-87aa-7a6d722d5dc0","resolution":{"observed_at":"2026-08-03T16:17:19.781189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:19.882926Z","title":"Deepspeed: System optimizations enable train- ing deep learning models with over 100 billion parameters","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:19.882926Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:c62f2b7099561efea07c64c5d2aedfc2339d123f493facb96dd5ec4467d8a72c","observation_id":"bfc62aef-377d-4782-b387-c18234d3d472","resolution":{"observed_at":"2026-08-03T16:17:19.882926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.040636Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.040636Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:1c3444eb7ae7834e9fe896d154d8ed45a43e407b299f3610436391f5fd8908b4","observation_id":"58764ac7-68fa-40f4-8a3c-a41cf18534bf","resolution":{"observed_at":"2026-08-03T16:17:20.040636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.156400Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.156400Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:323632c50513442707475e266508151f481c98f692087f3048a8f3cdbf54ed56","observation_id":"df18b10d-d3c3-46cc-8b22-b4029653fb87","resolution":{"observed_at":"2026-08-03T16:17:20.156400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.288634Z","title":"DreamBooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.288634Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:d3bab54d08a1074b295674780d10512d2f00f4dda85da8ef8649c073ca0a94df","observation_id":"8f3e2434-1158-41bc-a092-8668ccff5363","resolution":{"observed_at":"2026-08-03T16:17:20.288634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.402035Z","title":"Photorealistic text-to-image diffusion models with deep language understanding.Advances in Neural Information Processing Systems (NeurIPS), 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.402035Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:487fc0229223e247bc2ffa700bc00205f4a5582b9437b74e095ad26c22ce9b23","observation_id":"4872ced9-7dda-4f3d-b5a1-5f37293b0f10","resolution":{"observed_at":"2026-08-03T16:17:20.402035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00512","last_updated":"2022-06-07T09:17:35Z","snapshot_observed_at":"2026-07-06T12:33:23.843893Z","submitted_at":"2022-02-01T16:07:25Z","title":"Progressive Distillation for Fast Sampling of Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00512","snapshot_observed_at":"2026-08-03T16:17:20.492533Z","title":"Progressive distillation for fast sampling of diffusion models.arXiv preprint arXiv:2202.00512, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.492533Z"},"links":{"cited_paper":"/paper/2202.00512","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:d3ba19b28af1c374b68ba4cd53e3c0063102a891b0d2aab755a5f6fb3e59dddc","observation_id":"9616e8af-bb73-4241-9021-096b29e1b7fc","resolution":{"observed_at":"2026-08-03T16:17:20.492533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.625594Z","title":null,"venue":null,"work_id":null,"year":1940},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.625594Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:30732671aa182c98f9d1015a6bbb5b3547b3f4921e75940f14cff4aa6762284d","observation_id":"f43af82c-1fab-4566-9ce7-8279eb05e667","resolution":{"observed_at":"2026-08-03T16:17:20.625594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00262","last_updated":"2024-09-30T22:19:32Z","snapshot_observed_at":"2026-08-05T08:12:40.313243Z","submitted_at":"2024-09-30T22:19:32Z","title":"ImmersePro: End-to-End Stereo Video Synthesis Via Implicit Disparity Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00262","snapshot_observed_at":"2026-08-03T16:17:20.743644Z","title":"ImmersePro: End- to-end stereo video synthesis via implicit disparity learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.743644Z"},"links":{"cited_paper":"/paper/2410.00262","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:f9944bec122c63ecf14005cb091737d6f254f1d00611e78b1bcea03a4ce686da","observation_id":"e9b3406e-e981-4957-a9ad-e031c62c3ee4","resolution":{"observed_at":"2026-08-03T16:17:20.743644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:20.899955Z","title":"The zone of comfort: Predicting visual discom- fort with stereo displays.Journal of Vision, 11(8):11–11,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:20.899955Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:ef73b4cc1c04cc733226145752be9aa1ace0d108ea2b7ae83823967b48951d21","observation_id":"49522e4b-68b9-4045-a981-6ff3d7f24ff0","resolution":{"observed_at":"2026-08-03T16:17:20.899955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.022301Z","title":"3d photography using context-aware layered depth inpainting","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.022301Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:a95f86820816b217b8250f3b676ca33514a83dcfb176331a66091c58b0f7867e","observation_id":"daf509b1-6855-4c01-84ff-2a1096f0e98e","resolution":{"observed_at":"2026-08-03T16:17:21.022301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.104389Z","title":"3d scene reconstruction with multi-layer depth and epipolar transformers","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.104389Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:173e3eb99a7e6e384be335a06cf4b9b5d1e429cb3ecf1ab0a3b2a2ac12178d7e","observation_id":"eb478846-6220-4e52-bd89-b8578c580c4b","resolution":{"observed_at":"2026-08-03T16:17:21.104389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.187915Z","title":"M2SVid: End-to-end inpainting and refinement for monocular-to-stereo video conversion","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.187915Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:cae222b4fddfdfac1c31fed802851b128f5b1c2b9d735b56f8e20aed966c55a2","observation_id":"6c4a5eef-d5bf-43a2-9bbd-9b7372358f29","resolution":{"observed_at":"2026-08-03T16:17:21.187915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.254224Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.254224Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:d8a6e1d6d793d0994ef809dbe65d171a64c42b576b307075319ad565fae5cb76","observation_id":"3a42ac71-0164-4924-982d-d7cc0729996d","resolution":{"observed_at":"2026-08-03T16:17:21.254224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.302662Z","title":"What makes for a good stereoscopic image? InIEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.302662Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:2c79354bbc7dddc419f5e2b3590c52961ae6886586b08d18d7dc8c3f3a0e6db3","observation_id":"e6758838-c576-4e0c-9194-8c194c0a9a17","resolution":{"observed_at":"2026-08-03T16:17:21.302662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.345149Z","title":"RAFT: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.345149Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:fa60e7702cd72bd1ca70dd594666d2e91d8188cbcc5bd63a4652242cc4544333","observation_id":"d23272c3-8560-4092-8f13-ef968167f78e","resolution":{"observed_at":"2026-08-03T16:17:21.345149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.401631Z","title":"Methods for reducing vi- sual discomfort in stereoscopic 3d: A review.Signal Pro- cessing: Image Communication, 47:402–416, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.401631Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:e41892d59b06e06c84b0f94513360d6e9e55aa2854a111311e037adc4c27359c","observation_id":"c3dba04f-9d6b-40fc-9559-92b81080a2f5","resolution":{"observed_at":"2026-08-03T16:17:21.401631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.445233Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.445233Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:d546f3760c560707c5942f58a828d191a59a4f69eb9fd976fa9d5b6855f573a4","observation_id":"decd62c9-c304-4325-b7cf-9b6450e3dc74","resolution":{"observed_at":"2026-08-03T16:17:21.445233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.505770Z","title":"A critical comparison of pansharpening algorithms","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.505770Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:7aa39c21113fd67e8a602d8e7e3040653e87089953651cea356468ca4cc13028","observation_id":"777e4ccb-0d96-49ce-8897-09262e2155de","resolution":{"observed_at":"2026-08-03T16:17:21.505770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.557573Z","title":"StereoDiffusion: Training- free stereo image generation using latent diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.557573Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:9d7306cc1edae527af9b20a7b53f04f7cc355ca804b4c00a340677c9fc27c2ab","observation_id":"164fe27f-0991-4b3b-817a-c3ed841f13a7","resolution":{"observed_at":"2026-08-03T16:17:21.557573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.600336Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE Transactions on Image Process- ing (TIP), 13(4):600–612, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.600336Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:d5266d28a48cfb066ba0b8722b2bd998ae1d6c0978ffe28e744067c788b0c05e","observation_id":"f7bafa51-59a2-4781-8760-37d90236e552","resolution":{"observed_at":"2026-08-03T16:17:21.600336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.674503Z","title":"Learning stereo from single images","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.674503Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:31b5d54680a4fe5d2110ba88b42ec52ecd54ddbb4675cc300548d0f074928341","observation_id":"bcc1a5e3-8649-47a1-9e44-4f174577b856","resolution":{"observed_at":"2026-08-03T16:17:21.674503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.753953Z","title":"FoundationStereo: Zero- shot stereo matching.IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.753953Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:45098b6e3b5dd85afb42ae4dc558c866cc75d1f321632faaafdbdf1c4483020b","observation_id":"0351be57-a972-49ab-95be-82fe8f46ff48","resolution":{"observed_at":"2026-08-03T16:17:21.753953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.812226Z","title":"Direct and explicit 3d generation from a single image","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.812226Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:9c982fc2d431be33542d445fb002390fbd6b6049fbac5110ab41f76699c15a96","observation_id":"ad412d91-5ae7-4c32-a02b-dc277ff305bc","resolution":{"observed_at":"2026-08-03T16:17:21.812226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.877808Z","title":"Deep3d: Fully automatic 2d-to-3d video conversion with deep convo- lutional neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.877808Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:5b189ad4ba5dcbf639c56f4e541560224bf330e689a91fb88e7b9eb0942c11a9","observation_id":"1f07206d-c6ca-412e-bb65-05986118f0d0","resolution":{"observed_at":"2026-08-03T16:17:21.877808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:21.944668Z","title":"Depth Anything: Unleash- ing the power of large-scale unlabeled data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:21.944668Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:4209ee64fc09e09c3c903f2415ad61c75d8ce776a6835f2f82bfd32c998e9b4c","observation_id":"e1991907-c162-4e55-9325-0d9c3bd89d4d","resolution":{"observed_at":"2026-08-03T16:17:21.944668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.010226Z","title":"Any-to-Bokeh: One-step video bokeh via multi-plane image guided diffu- sion.preprint arXiv:2505.21593, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.010226Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:00a801f81665b7c461a4dde24f8a86a8688606a14a12e4e5e7d18c8268793c10","observation_id":"774a2661-b88d-44fe-b279-aa5d2f36989c","resolution":{"observed_at":"2026-08-03T16:17:22.010226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-03T16:17:22.040754Z","title":"IP- Adapter: Text compatible image prompt adapter for text-to- image diffusion models.preprint arXiv:2308.06721, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.040754Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:5f630dae7b7d8077ccb1f036e592bfe3cbf78085151e587ccbcd6f7492331104","observation_id":"f9d5c04b-9409-4e68-be88-1565d8ede969","resolution":{"observed_at":"2026-08-03T16:17:22.040754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.223310Z","title":"Tra- jectoryCrafter: Redirecting camera trajectory for monocu- lar videos via diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.223310Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:980828187b4afcd84035a752af90f543ee34abbeb64a8362b02c2fa33df156bf","observation_id":"748e6041-8091-48f9-a1f8-2a4b63cb187e","resolution":{"observed_at":"2026-08-03T16:17:22.223310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.396310Z","title":"3D- TV content creation: automatic 2D-to-3D video conversion","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.396310Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:070a40f179b07dbf285c2c2a513441d37a307346f8eb01e3680a2fd0a64c4c33","observation_id":"d691b288-f894-431c-ade5-7e1a256d8bb7","resolution":{"observed_at":"2026-08-03T16:17:22.396310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.498369Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.498369Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:755f79b01d895f653cdea521bf0c39833f8db77d08768c84c400cc38cd2ba084","observation_id":"f2746c32-1449-4214-a65e-56a88f20c262","resolution":{"observed_at":"2026-08-03T16:17:22.498369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.563931Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.563931Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:a20821752411c6340f9dd6fcae769dfbf77b32e3cb9d2fd7e33f9dd89dbbc2c3","observation_id":"9a13271e-0101-40d7-9b84-99a452177b30","resolution":{"observed_at":"2026-08-03T16:17:22.563931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:17:22.696121Z","title":"High-fidelity novel view synthesis via splatting-guided diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.696121Z"},"links":{"citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:94bae4fa6eff1feec2fb76a524ceb247667b67352f5dd385cd3ab67050a4977f","observation_id":"8cf45379-e625-4702-b1aa-0c22bd6a7c12","resolution":{"observed_at":"2026-08-03T16:17:22.696121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07447","last_updated":"2024-09-11T17:52:07Z","snapshot_observed_at":"2026-08-07T23:33:01.135787Z","submitted_at":"2024-09-11T17:52:07Z","title":"StereoCrafter: Diffusion-based Generation of Long and High-fidelity Stereoscopic 3D from Monocular Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07447","snapshot_observed_at":"2026-08-03T16:17:22.757515Z","title":"StereoCrafter: Diffusion-based generation of long and high- fidelity stereoscopic 3d from monocular videos.preprint arXiv:2409.07447, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.757515Z"},"links":{"cited_paper":"/paper/2409.07447","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:4a523b40d088cb3df219fc39de17d23084108315db137984eaf80726bc8eb546","observation_id":"a4294b81-58e9-4cdd-901f-ed47092f0ea4","resolution":{"observed_at":"2026-08-03T16:17:22.757515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00625","last_updated":"2025-03-01T21:28:12Z","snapshot_observed_at":"2026-08-07T17:36:50.142935Z","submitted_at":"2025-03-01T21:28:12Z","title":"Perceptual Visual Quality Assessment: Principles, Methods, and Future Directions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00625","snapshot_observed_at":"2026-08-03T16:17:22.812496Z","title":"structurally","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T16:17:22.812496Z"},"links":{"cited_paper":"/paper/2503.00625","citing_paper":"/paper/2512.14236"},"observation_digest":"sha256:c21a11a003709595699c99091ef9d0aeaf2628669b3f5877ed9cdcc6569a9408","observation_id":"854498bb-c204-4bb2-8fd3-b266eb11a273","resolution":{"observed_at":"2026-08-03T16:17:22.812496Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.14236","last_updated":"2026-07-09T10:04:23Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:04:54.535970Z","submitted_at":"2025-12-16T09:46:23Z","title":"Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":71,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 1 inbound Pith citation observation for arXiv:2512.14236."}