{"as_of":"2026-08-11T21:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9e26e75e60cdceef5c30d7018481a1b86881ed15be79d1aad8d0d541ed6aa7ad","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T18:59:24.341963Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.01666/citation-record","integrity":"/paper/2502.01666/integrity","json":"/paper/2502.01666/citation-record.json","paper":"/paper/2502.01666"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.871234Z","title":"Enhanced Computer Vision With Microsoft Kinect Sensor: A Review,","venue":null,"work_id":"c9821dbb-96b5-43a8-83cc-e7b8c3a7ab63","year":2013},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.188767Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:56a925da23beab35f3d19d7a1728fa2eaa9da4ee9fd16f8dc4e9a6bb5aa6bacf","observation_id":"3ac27d3a-799d-4951-835f-77b9db0ec76a","resolution":{"observed_at":"2026-08-09T18:59:24.875914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.856879Z","title":"Deep Learning for Monocular Depth Estimation: A Review,","venue":null,"work_id":"b52b79e0-ba0d-4c20-8b92-5ee237e8ec82","year":2021},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.194061Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:579110b57e9ed6132d7c25ebccb6ef34e6661926b4232dffe32557899178da9f","observation_id":"cf4012a6-f231-4b83-928f-6abc6cbfbd9a","resolution":{"observed_at":"2026-08-09T18:59:24.861748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.842587Z","title":"Monocular depth prediction using generative adversarial networks","venue":null,"work_id":"4df82c85-948a-4333-ae67-5211f458b022","year":2018},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.199022Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:9cc5dd4f44ed21ed8997f0da6643c33f76517faa3528ccee2ba1e9ac2f7d3900","observation_id":"77674d05-17fc-4f65-af1a-b6e9c7b3a3dd","resolution":{"observed_at":"2026-08-09T18:59:24.847209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.828208Z","title":"Depth Map Prediction from a Single Image Using a Multi-Scale Deep Network,","venue":null,"work_id":"a61bfd59-a8df-4fc6-8f37-25dc059fbc3d","year":2014},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.204040Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:f7cdae17a27c25f58e76b280866b92a3eb622b2e946bb777e64707aa6ea92c58","observation_id":"5d533828-ef4a-44de-98c4-1fac3219ad17","resolution":{"observed_at":"2026-08-09T18:59:24.832931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.812662Z","title":"Depth Prediction from a Single Image with Conditional Adversarial Networks,","venue":null,"work_id":"93d943af-3beb-42cd-b6e7-540e51eea08d","year":2017},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.208993Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:6989c9b0371f8979cc2c51158b0ecb13aa18954a626a5f553620e30f3dd362e8","observation_id":"9174461a-3d48-4ccc-84ba-f74607d329a6","resolution":{"observed_at":"2026-08-09T18:59:24.818250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.797818Z","title":"Improved Techniques for Training GANs,","venue":null,"work_id":"bc831a45-0ff5-466d-bd7b-baea1980f9fe","year":2016},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.213776Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:a662ed076fc228d916da10b916312eed1e14a9cde26e269506a872a4efb96db1","observation_id":"82a5dd4e-1bbd-4a79-99b0-edd96c702867","resolution":{"observed_at":"2026-08-09T18:59:24.802789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.783956Z","title":"Diffusion Models Beat GANs on Image Synthesis,","venue":null,"work_id":"74c21a38-ecad-43c2-b41b-77e95f3d0d2f","year":2024},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.218872Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:48dfeb45c4ba0ef60542d0fd63e5da6929b569df41707463d8459ee594ad2993","observation_id":"bfde2bfe-b855-428e-8161-ea7b02bc471d","resolution":{"observed_at":"2026-08-09T18:59:24.788812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14816","last_updated":"2023-02-28T18:08:21Z","snapshot_observed_at":"2026-08-11T09:37:19.107237Z","submitted_at":"2023-02-28T18:08:21Z","title":"Monocular Depth Estimation using Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.14816","snapshot_observed_at":"2026-08-09T18:59:24.223408Z","title":"Monocular Depth Es- timation using Diffusion Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.223408Z"},"links":{"cited_paper":"/paper/2302.14816","citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:79deda32b7c8baafa497cebd47c80216b50945e6e108cfab725514b40407f457","observation_id":"c5f6e2b0-8e5c-4e67-a6be-9e5bb73b2e68","resolution":{"observed_at":"2026-08-09T18:59:24.223408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.769588Z","title":"ECoDepth: Effective Condi- tioning of Diffusion Models for Monocular Depth Estimation,","venue":null,"work_id":"8ebf47ec-7ab6-498b-86b9-7d13865c98ec","year":2024},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.228715Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:3dbdc7b6a630cfe00894103c53fa3ff9c49fb8386b84a9710cfc52099b89c714","observation_id":"b82495cf-607d-4a69-899e-a10212453b4e","resolution":{"observed_at":"2026-08-09T18:59:24.774271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.754672Z","title":"Denoising Diffusion Probabilistic Models,","venue":null,"work_id":"9865f0e7-fe25-4f72-87a1-39fb59a0291b","year":2020},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.233318Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:dc898b29f666c01e4b059bd6132f9b1df03c8be14d689d50ec80178cceff102c","observation_id":"4c6581ba-72b5-4c8d-bb0f-43aa76a17b5f","resolution":{"observed_at":"2026-08-09T18:59:24.759635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.740364Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models,","venue":null,"work_id":"6bfb5307-1461-4a80-a628-a293f9442416","year":2022},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.238107Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:1d9d7643cd71bae73b1fbf7981f1b26803f0f471897930591c0fe2a46dc700c5","observation_id":"368cbe0f-5a27-4fa1-b00c-157b58b78ffd","resolution":{"observed_at":"2026-08-09T18:59:24.744925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.725082Z","title":"Unleashing text-to-image diffusion models for visual perception","venue":null,"work_id":"a9060263-1751-40f8-b467-40b9ed5dbd53","year":2023},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.242852Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:365d782c0b1e80b2057fdeeb31c4e83da2c4030fccc98a8bab0e7c3dd8d47736","observation_id":"dcc01a49-9459-4811-ba30-132f1f3ac2f6","resolution":{"observed_at":"2026-08-09T18:59:24.729840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.710072Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"94583a03-0ba6-44df-b329-85497afa3a9f","year":2021},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.247824Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:193c4737483fb43b8a4743ca15b8178e4294c6fd556150556eaea69bb0046675","observation_id":"4bc38951-c1e0-4680-9908-228f2ee9fe7e","resolution":{"observed_at":"2026-08-09T18:59:24.714940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.694948Z","title":"Prompt- free diffusion: Taking","venue":null,"work_id":"e03f0cd1-bb08-4fe4-b182-cd6b86b560f6","year":2024},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.252360Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:01ffe41382627421751356bc5b3c0a7a42a7f24d0a92e5107d4e1b7e12cfc1f9","observation_id":"de318bc3-8436-4f5b-93ab-342ed2169a63","resolution":{"observed_at":"2026-08-09T18:59:24.699799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.680183Z","title":"Vision Meets Robotics: The KITTI Dataset,","venue":null,"work_id":"a35aea6a-9481-4c26-84bf-2088d7818e47","year":2013},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.256829Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:78b80b2cede269f942627b17223592be02c0fc44f6cb8cb722d7590cbc770155","observation_id":"aa9451b4-4bb2-49f1-8bf9-a74c0822b59c","resolution":{"observed_at":"2026-08-09T18:59:24.685188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.664649Z","title":"Scalability in perception for autonomous driving: Waymo open dataset","venue":null,"work_id":"b1127f18-a7ec-401d-9530-ff2a2702303d","year":2020},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.261266Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:725ac06e91c912df367d21d6b0223752413bd76d6520b54485bab87595785e56","observation_id":"d3b3a1da-da8a-45f6-8769-e76a10640cc5","resolution":{"observed_at":"2026-08-09T18:59:24.670403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.650516Z","title":"Digging into Self-Supervised Monocular Depth Prediction,","venue":null,"work_id":"29eeb529-16fd-4358-a76e-2a8f9d2f2470","year":2019},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.265827Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:37bfa565c9bda87deb24c8e4e5fe93ca1aa921fe1e90576a446f9069b04c410d","observation_id":"5d9a0f3b-1228-4c5f-b397-b18c1aef67e4","resolution":{"observed_at":"2026-08-09T18:59:24.655082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.636409Z","title":"Generative Adversarial Nets,","venue":null,"work_id":"d10bf3b8-de91-45e7-8142-efbade4257a6","year":2014},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.270237Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:f2da54d352c6593221bd698712a52d6bde7972e33d37a204fcb677b416b725d2","observation_id":"59b0b686-5a2f-47be-8662-767b065c0f3b","resolution":{"observed_at":"2026-08-09T18:59:24.640835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07875","last_updated":"2017-12-06T20:01:54Z","snapshot_observed_at":"2026-07-06T05:27:45.080675Z","submitted_at":"2017-01-26T21:10:29Z","title":"Wasserstein GAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07875","snapshot_observed_at":"2026-08-09T18:59:24.274683Z","title":"Wasserstein GAN,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.274683Z"},"links":{"cited_paper":"/paper/1701.07875","citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:871ccc4e00994eea897a9529ede8c1a961e1804e523ac6bd40e547bbd92064a5","observation_id":"9ca4b530-5e6f-4aca-9c38-1e3db601a715","resolution":{"observed_at":"2026-08-09T18:59:24.274683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.622068Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis,","venue":null,"work_id":"14a85898-d39c-49cf-a9be-a90590188c36","year":2019},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.279592Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:d86df7db571de36f380876a2bb268a975070333cb35b62c559f1ce2d15537634","observation_id":"cd7a85ba-daf9-4eb7-a934-9664f6420de2","resolution":{"observed_at":"2026-08-09T18:59:24.626759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.606713Z","title":"Alias-Free Generative Adversarial Networks,","venue":null,"work_id":"08df9482-cfe2-4f92-932c-6089247782de","year":2021},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.284094Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:d0b2fbae89a57f29bb91bd75807626027be67b9f162d86a6fecd4b586c1dff08","observation_id":"a4321294-c05c-4cc4-8918-7babf0f5f2ba","resolution":{"observed_at":"2026-08-09T18:59:24.612367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.591099Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models,","venue":null,"work_id":"2dce4dfe-712b-4b37-af58-e6684bde648e","year":2023},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.288551Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:e94ffd50b49459fcbcd6007c814d0f73fe8b194d9ff02a22701a79a880b94110","observation_id":"2b7fb163-4d77-4acd-94cc-4a53cac72f57","resolution":{"observed_at":"2026-08-09T18:59:24.595929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-09T18:59:24.292785Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.292785Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:7453c6b88fcda22206f8e9876727e9c0ca8949e0025723bf2d557359ad103782","observation_id":"06087712-ef29-42cb-ae62-bf541bfe45bd","resolution":{"observed_at":"2026-08-09T18:59:24.292785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-09T18:59:24.297222Z","title":"Laion-400m: Open Dataset of CLIP-filtered 400 Million Image-Text Pairs,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.297222Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:d9f49db47ec45b0c74dc1f9a91ae0cf1d5f70d1afd26347feae7f69aeb853236","observation_id":"093b8edf-99f5-4578-9551-4f9b90ef62e1","resolution":{"observed_at":"2026-08-09T18:59:24.297222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.576702Z","title":"Coyo-700m: Image-text Pair Dataset,","venue":null,"work_id":"ce96a242-128a-4c81-995a-768ff9e575e2","year":2022},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.301845Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:1fa0061f03a9386894c61890be6fbe4c1e35cf24b9bab72478050bfe525fb6ba","observation_id":"42737385-bfbb-4bb2-81df-24eafba7dde7","resolution":{"observed_at":"2026-08-09T18:59:24.581397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.561589Z","title":"CBAM: Convolutional Block Attention Module,","venue":null,"work_id":"3916d0b0-5ce6-483e-85de-c0469711540d","year":2018},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.306284Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:4160d8b3be8eab538417ec8c266b7a549f10c6aa731a651fa7c396d9e4909c3c","observation_id":"5ab62a16-326d-46d3-b192-0664d5c20271","resolution":{"observed_at":"2026-08-09T18:59:24.566563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.546524Z","title":"Multi-Scale Context Aggregation by Dilated Convolutions,","venue":null,"work_id":"16fbd9ff-d46a-4c40-afbb-d9180a329ed9","year":2016},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.310668Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:46fa15f0ae422545eb492767326afa3f286ff49d3bb18c780e66227721bbda91","observation_id":"26f67a44-f05d-4b1b-8771-fa6dedb4a7b2","resolution":{"observed_at":"2026-08-09T18:59:24.551360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.529937Z","title":"Swin Transformer: Hierarchical Vision Transformer Using Shifted Windows,","venue":null,"work_id":"d33069cf-0b85-4870-98b7-0f7ac38e4494","year":2021},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.315009Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:901d7ede95558f59cc1370ef99e8894eecafddf019d01b2bfe2f040d49ceb7c3","observation_id":"a4e407be-b60f-4f56-bb0c-0d6a4cc830a2","resolution":{"observed_at":"2026-08-09T18:59:24.535386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.513376Z","title":"Attention is All You Need,","venue":null,"work_id":"f9b129d6-1ea8-40ef-a4b2-42a899d4f676","year":2017},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.319678Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:201cd5d4afd3e6161ce16af37d58bd83b7309facf1b6acc7f38e300cc68fe140","observation_id":"269da017-59fd-4cd8-98b9-cb1fe61a4b9a","resolution":{"observed_at":"2026-08-09T18:59:24.518508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.498543Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library,","venue":null,"work_id":"38250f85-8c0b-4f29-abf3-e8e8d4e382ce","year":2019},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.324098Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:fb91521b4910b5f5870004097b06b3c46c3c86ffb087b162a5d0f6c8ca760174","observation_id":"e1640406-1414-4221-84e7-81e399dd2426","resolution":{"observed_at":"2026-08-09T18:59:24.503238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.482604Z","title":"Unsupervised CNN for Single View Depth Estimation: Geometry to the Rescue,","venue":null,"work_id":"7aaea22a-6372-446f-9e02-59de0f85eb67","year":2016},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.328710Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:82d3f7cdd2ebd7f5deb0f389de2588e891b9f31c33ca3e2b6e2dbb1e3ef59b9f","observation_id":"cfeb1638-f1b0-4b59-9e98-63bee5048ac9","resolution":{"observed_at":"2026-08-09T18:59:24.487647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.467076Z","title":"AdaBin: Improving Binary Neural Networks with Adaptive Binary Sets,","venue":null,"work_id":"8c9d9f9a-a86f-4af0-8c71-ea129e89b3ce","year":2022},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.333071Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:f22374dfc2d7f82e557a823eaad7b93be5be1f09ed136490eb355f72e0ddb070","observation_id":"269c3377-9acc-46a6-8f4b-4d2c61bc533e","resolution":{"observed_at":"2026-08-09T18:59:24.471951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:59:24.450206Z","title":"Vision transformers for dense prediction","venue":null,"work_id":"8588d809-f872-4458-9556-2dd1b2cdb528","year":2021},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.337337Z"},"links":{"citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:2734054357558935ee70183bbee5da8cd3da8d794a80385ad472409832c907ec","observation_id":"6203cb4d-f3b1-4370-a5f5-e508641a2de6","resolution":{"observed_at":"2026-08-09T18:59:24.456664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12288","last_updated":"2023-02-23T19:13:10Z","snapshot_observed_at":"2026-07-06T14:55:15.719380Z","submitted_at":"2023-02-23T19:13:10Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12288","snapshot_observed_at":"2026-08-09T18:59:24.341963Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T18:59:24.341963Z"},"links":{"cited_paper":"/paper/2302.12288","citing_paper":"/paper/2502.01666"},"observation_digest":"sha256:4e638621d3c8903b23772e2d1401ee76e862eea10caa85d99c11589a52fa9231","observation_id":"408685cd-a326-44b1-bff1-582255514e63","resolution":{"observed_at":"2026-08-09T18:59:24.341963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.01666","last_updated":"2025-02-01T15:37:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T15:06:42.439228Z","submitted_at":"2025-02-01T15:37:22Z","title":"Leveraging Stable Diffusion for Monocular Depth Estimation via Image Semantic Encoding"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2502.01666."}