{"as_of":"2026-08-11T07:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1af1de573953819b2a669f174541f948a9ff8ff2f83e821ab67e11f61a23bcbe","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-23T06:08:14.988386Z","state":"measured"},{"denominator":89,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":89,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:55:16.333093Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-06-30T06:24:19.433510Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02576","snapshot_observed_at":"2026-08-07T14:55:16.333093Z","title":"Depthmaster: Taming diffusion models for monocular depth estimation.arXiv preprint arXiv:2501.02576, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17358","last_updated":"2025-05-23T00:27:23Z","snapshot_observed_at":"2026-08-10T09:49:39.145100Z","submitted_at":"2025-05-23T00:27:23Z","title":"Repurposing Marigold for Zero-Shot Metric Depth Estimation via Defocus Blur Cues","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:55:16.333093Z"},"links":{"cited_paper":"/paper/2501.02576","citing_paper":"/paper/2505.17358"},"observation_digest":"sha256:6de73039a5995e8171555c0dccfdd6021e535e6ccf654a39004cc9463f97d88a","observation_id":"6b97218f-e004-45b6-8129-744c017d3822","resolution":{"observed_at":"2026-08-07T14:55:16.333093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02576","snapshot_observed_at":"2026-08-07T14:01:03.664695Z","title":"Depthmaster: Taming diffusion models for monocular depth estimation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20297","last_updated":"2025-05-26T17:59:57Z","snapshot_observed_at":"2026-08-09T20:52:47.722838Z","submitted_at":"2025-05-26T17:59:57Z","title":"DiSA: Diffusion Step Annealing in Autoregressive Image Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:03.664695Z"},"links":{"cited_paper":"/paper/2501.02576","citing_paper":"/paper/2505.20297"},"observation_digest":"sha256:76c3d4bc4cc569781b880419bfc994c2e08dddab9d657b21a6813ca175c95908","observation_id":"c134ff6c-3d90-4aea-87de-5a5a1702b26c","resolution":{"observed_at":"2026-08-07T14:01:03.664695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02576","snapshot_observed_at":"2026-08-06T20:52:02.565213Z","title":"Depthmaster: Taming diffusion models for monocular depth estimation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01634","last_updated":"2025-07-02T12:05:57Z","snapshot_observed_at":"2026-08-09T10:47:49.129397Z","submitted_at":"2025-07-02T12:05:57Z","title":"Depth Anything at Any Condition","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T20:52:02.565213Z"},"links":{"cited_paper":"/paper/2501.02576","citing_paper":"/paper/2507.01634"},"observation_digest":"sha256:a0b319c79ec68435f7101f69e1ba7719942ebc6c29c380270e179dd71415b8e8","observation_id":"3b4eb97b-2738-4707-9bef-2aa811145078","resolution":{"observed_at":"2026-08-06T20:52:02.565213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02576","snapshot_observed_at":"2026-08-06T15:38:27.433354Z","title":"Depthmaster: Taming diffusion models for monocular depth estimation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15454","last_updated":"2025-07-21T10:06:23Z","snapshot_observed_at":"2026-08-08T13:12:10.336932Z","submitted_at":"2025-07-21T10:06:23Z","title":"ObjectGS: Object-aware Scene Reconstruction and Scene Understanding via Gaussian Splatting","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:27.433354Z"},"links":{"cited_paper":"/paper/2501.02576","citing_paper":"/paper/2507.15454"},"observation_digest":"sha256:2f54053d4280f203eed3e8d93955c32f6acce788c92c10df2994661a95d5f2c1","observation_id":"07633251-cdf4-4cbc-91ec-bc52a010a8a1","resolution":{"observed_at":"2026-08-06T15:38:27.433354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"cited_work":{"arxiv_id":"2501.02576","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.02576","snapshot_observed_at":"2026-06-30T06:24:19.433510Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","venue":"cs.CV","work_id":"5fdab3fd-9375-4fda-beb7-e01231471c47","year":2025},"citing_paper":{"arxiv_id":"2605.11578","last_updated":"2026-05-12T06:03:26Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:03:26Z","title":"The Midas Touch for Metric Depth","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T01:36:59.161241Z"},"links":{"cited_paper":"/paper/2501.02576","citing_paper":"/paper/2605.11578"},"observation_digest":"sha256:2e813269df76915371443df6726e9548b69617f79d6e89d95108fc4195f84346","observation_id":"ed50065b-6cd1-413d-8bae-964c122b0d7e","resolution":{"observed_at":"2026-05-13T01:37:03.305515Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"cited_work":{"arxiv_id":"2501.02576","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.02576","snapshot_observed_at":"2026-06-30T06:24:19.433510Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","venue":"cs.CV","work_id":"5fdab3fd-9375-4fda-beb7-e01231471c47","year":2025},"citing_paper":{"arxiv_id":"2606.30370","last_updated":"2026-06-29T14:34:16Z","snapshot_observed_at":"2026-08-04T02:29:58.828670Z","submitted_at":"2026-06-29T14:34:16Z","title":"MUSE: Unlocking Timestep as Native Task Steering for One-Step Dense Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T06:17:53.096700Z"},"links":{"cited_paper":"/paper/2501.02576","citing_paper":"/paper/2606.30370"},"observation_digest":"sha256:6131576627d2722228c8167b89aa5a930843aa013603cfcd81c877cb29244358","observation_id":"779f4154-61ba-44f2-9d15-ce105f9af910","resolution":{"observed_at":"2026-06-30T06:24:19.435221Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02576","snapshot_observed_at":"2026-08-01T07:32:49.841013Z","title":"Depthmaster: Taming diffusion models for monocular depth estimation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21438","last_updated":"2026-07-23T15:44:18Z","snapshot_observed_at":"2026-08-08T13:50:53.731917Z","submitted_at":"2026-07-23T15:44:18Z","title":"DAPM: UAV Monocular Depth Estimation from Any Height, Pitch, Roll and FOV","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T07:32:49.841013Z"},"links":{"cited_paper":"/paper/2501.02576","citing_paper":"/paper/2607.21438"},"observation_digest":"sha256:8eaa88e7517b154d3d9c5d330f59da3e4e059af9a5586b9df18dc291db7a800c","observation_id":"7de04795-5f14-4260-9f49-b4be02c5784a","resolution":{"observed_at":"2026-08-01T07:32:49.841013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.02576/citation-record","integrity":"/paper/2501.02576/integrity","json":"/paper/2501.02576/citation-record.json","paper":"/paper/2501.02576"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mgnet: Monocular geo- metric scene understanding for autonomous driving","venue":null,"work_id":"0306b76c-a6f1-4244-b01a-9f291463387a","year":2021},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:bc64acffb3f39cd8f0cb599b368c21916252e4e3c04f9b44244efbb0528ef1dc","observation_id":"33d5ff37-87c7-42d6-9892-149405b74c8c","resolution":{"observed_at":"2026-05-23T06:12:39.656024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pseudo-lidar from visual depth estimation: Bridging the gap in 3d object detection for autonomous driving","venue":null,"work_id":"c6bda3dd-c990-443a-8ff9-1a461f13cdf7","year":2019},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:3edc32adca42d67d564f45be63608d673b6199487d7bc8c9d2eb43acbbd02102","observation_id":"4c3c9d4c-8c00-4f0f-a8b5-99012b04cbd8","resolution":{"observed_at":"2026-05-23T06:12:39.680273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.06310","last_updated":"2020-02-15T07:29:02Z","snapshot_observed_at":"2026-07-06T08:00:25.359981Z","submitted_at":"2019-06-14T17:36:11Z","title":"Pseudo-LiDAR++: Accurate Depth for 3D Object Detection in Autonomous Driving","version":3},"cited_work":{"arxiv_id":"1906.06310","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1906.06310","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pseudo-lidar++: Accurate depth for 3d object detection in autonomous driving","venue":null,"work_id":"6a73b5ce-84ee-46e5-9b16-8421ecedca46","year":1906},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/1906.06310","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:be69a9381346c201bc6746886f7f9f7a4db9241430adec59ab70e233cac8948d","observation_id":"6643c14d-3862-45d0-8bcf-d4cc3bf8bc65","resolution":{"observed_at":"2026-05-23T06:12:38.894254Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ro- bodepth: Robust out-of-distribution depth estimation under corruptions","venue":null,"work_id":"4c76937d-9287-4b76-938f-58f1e2b3c4cb","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:50911dc7aefeba1cdaacbc5e28632a9c1a504dec437db4e4699e90bf0c341fbc","observation_id":"6a6a9c2d-f498-4a5a-af2d-6a02756d9976","resolution":{"observed_at":"2026-05-23T06:12:39.616512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Consistent video depth estimation","venue":null,"work_id":"96473ec8-1cf9-4d85-93a6-25bfcee7f8e5","year":2020},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:09ae9b9724ab85ed11bda8e2fc9c4b67c641c9cdf8b3482178701eca5a495502","observation_id":"e391a15f-6297-4403-a87d-b3af119f7676","resolution":{"observed_at":"2026-05-23T06:12:39.623102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Low power depth estimation of rigid objects for time-of-flight imaging","venue":null,"work_id":"93d40336-0bbb-4384-9eaf-5700d72dca46","year":2019},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:5270c281135da10dd6ba27834f6106e1c929bc42128a08eacbce00fe4eaaf707","observation_id":"db4f505f-a51b-4c62-a010-b997a13f8cb4","resolution":{"observed_at":"2026-05-23T06:12:39.608924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"a38e213a-d055-4dc9-b015-6094b277326e","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:6d3ccfdb706da14cc59b7b66c2081baf5f4af5bda42cdcbd971e2506dcbfad83","observation_id":"d57a87a1-4be5-45ca-a2c2-5d253d63c1c8","resolution":{"observed_at":"2026-05-23T06:12:39.613082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":"496fa3aa-4891-4602-9130-1eaea76c02b1","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:c042f2c25ca4a98a07cd5e6c29775b99745687ef29d26f97f00b93aa18ffb198","observation_id":"a66b4a9c-0bee-4862-8005-8a4888ddb882","resolution":{"observed_at":"2026-05-23T06:12:39.724655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"713c2c21-7642-4246-9689-6f2703c963ac","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:63a4d5faf441515d92c49a43d1f14efc303efc14669622d1a2938bb4cbca09ff","observation_id":"d6276a9a-72b4-4e63-bab3-c26bf474e794","resolution":{"observed_at":"2026-05-23T06:12:39.635924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision transformers for dense prediction","venue":null,"work_id":"4f6acca3-45e5-46bb-83c9-c08088e71060","year":2021},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:b98356654999e2c56915ab0c429240a637eee4ad50e390af3dab95bf2960b5fb","observation_id":"82e3b092-64be-409d-b30c-008b837f09f6","resolution":{"observed_at":"2026-05-23T06:12:39.619942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12288","last_updated":"2023-02-23T19:13:10Z","snapshot_observed_at":"2026-07-06T14:55:15.719380Z","submitted_at":"2023-02-23T19:13:10Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth","version":1},"cited_work":{"arxiv_id":"2302.12288","doi":"10.48550/arxiv.2302.12288","metadata_source":"pith","pith_arxiv_id":"2302.12288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth","venue":"cs.CV","work_id":"c902e427-c54a-4fc4-8aef-d0243f90ea39","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2302.12288","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:8443ba08bba673338408f827c30984b3234fa3849ef7e3f032e26621df50c7aa","observation_id":"0e6d4939-b1be-4dbe-8611-e1e39b126081","resolution":{"observed_at":"2026-05-23T06:12:38.883697Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omnidata: A scalable pipeline for making multi-task mid-level vision datasets from 3d scans","venue":null,"work_id":"27dea19a-bb7f-456c-9849-c1d05ce3377f","year":2021},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:f82eb0e545b6b7b3a8010d38967d7081df93796643b8d77c75dcb12b6bdfa144","observation_id":"9e8254e0-a9fc-46c7-8a73-bc0892966fec","resolution":{"observed_at":"2026-05-23T06:12:39.688148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards robust monocular depth estimation: Mixing datasets for zero-shot cross- dataset transfer","venue":null,"work_id":"d1788be1-f41d-4bb2-bcdb-af5510fad2bf","year":2020},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:3fb49fbdc3c83263c2e0be6ec01e7e80f5849f5702aa0b52c339f6b638620b25","observation_id":"2810502f-b1a8-45c9-a18e-81fe60612037","resolution":{"observed_at":"2026-05-23T06:12:39.794529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.00569","last_updated":"2020-03-28T08:26:57Z","snapshot_observed_at":"2026-08-10T23:37:00.896765Z","submitted_at":"2020-02-03T05:38:33Z","title":"DiverseDepth: Affine-invariant Depth Prediction Using Diverse Data","version":3},"cited_work":{"arxiv_id":"2002.00569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2002.00569","snapshot_observed_at":"2026-06-28T22:42:46.959502Z","title":"Diversedepth: Affine-invariant depth prediction using diverse data","venue":null,"work_id":"dc3a9027-21ce-4860-898b-954f2e701750","year":2002},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2002.00569","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:f2f8acf0b402ca9a7057adafc09f3d5d19c977bd391462a1ae7f8a80f3162a77","observation_id":"23f54bc8-e7fb-48fa-a0b0-c78d5d6320a0","resolution":{"observed_at":"2026-05-23T06:12:38.972365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2407.08187","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaledepth: Decomposing metric depth estimation into scale prediction and relative depth estimation","venue":null,"work_id":"0e750fea-4a10-47ed-b7c3-fa29f0c20619","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:8b5e1166a9d4fb9b49af8fa4714754398fd76e80a952cd7ca174fbacf7957de1","observation_id":"337f7b94-f6e1-451d-a9ec-13a774b912f6","resolution":{"observed_at":"2026-05-23T06:12:38.942797Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Repurposing diffusion-based image generators for monoc- ular depth estimation","venue":null,"work_id":"e84146d1-ce02-4bc8-a2a5-598f46281bcd","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:cbf7fea2cf2c5377b4ec376255bc7d6b16473b1321180243e6d0b3aa1c9a6fd8","observation_id":"e59bdf7f-e2e6-4741-bdc4-f17571929061","resolution":{"observed_at":"2026-05-23T06:12:39.814154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Geowizard: Unleashing the diffusion priors for 3d geometry estimation from a single image","venue":null,"work_id":"39cd9dde-0a77-44f3-b8ea-68c034a2b25a","year":2025},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:9b69455458161b7126354ed5db0ef9e1c291d9be9e6c36efa0f172984d7673b0","observation_id":"128e152d-0bb0-441f-ad6a-87d55320adbd","resolution":{"observed_at":"2026-05-23T06:12:39.591580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Depthfm: Fast monocular depth estimation with flow matching","venue":null,"work_id":"cab24512-2eee-412d-8d1d-8a43e2e30cf4","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:1257a3d8aa3144b7c390000d5e896daff2d6b54fafb8267104474df9b935d82a","observation_id":"513963d9-45c2-4f43-b386-8ddc4cd43874","resolution":{"observed_at":"2026-05-23T06:12:39.595173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06090","last_updated":"2024-12-01T12:13:57Z","snapshot_observed_at":"2026-08-09T15:47:28.585941Z","submitted_at":"2024-03-10T04:23:24Z","title":"What Matters When Repurposing Diffusion Models for General Dense Perception Tasks?","version":4},"cited_work":{"arxiv_id":"2403.06090","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.06090","snapshot_observed_at":"2026-07-03T10:58:02.612683Z","title":"What matters when repurposing diffusion models for general dense perception tasks?","venue":null,"work_id":"b2b212bd-ca38-458e-a486-a323518a71bf","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2403.06090","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:38eb14ac9e224ede4a732f6039e0596fdbac576615885784c1f3fc0274a085b6","observation_id":"f965914a-7220-4267-9906-f7e0efeecab8","resolution":{"observed_at":"2026-05-23T06:12:38.903996Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18124","last_updated":"2025-01-18T20:14:54Z","snapshot_observed_at":"2026-08-10T12:46:39.807482Z","submitted_at":"2024-09-26T17:58:55Z","title":"Lotus: Diffusion-based Visual Foundation Model for High-quality Dense Prediction","version":5},"cited_work":{"arxiv_id":"2409.18124","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.18124","snapshot_observed_at":"2026-07-10T01:46:41.338329Z","title":"Lotus: Diffusion-based visual foundation model for high-quality dense prediction","venue":"cs.CV","work_id":"8d5ebf0a-93cf-4ef4-bce5-341327c58f8b","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2409.18124","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:94f6575810061b10d89b8c997481885fa00a5877cd7f211854161d73a6f6a0ee","observation_id":"b3e44472-b897-4049-af84-874aee2344eb","resolution":{"observed_at":"2026-05-23T06:12:38.878807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":"f08e9fa3-0e04-42cc-b8cb-dd66c59c277d","year":2022},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:fb27efda10537063637831d44278cc94f939cae0335480d7775c647101763eec","observation_id":"bc144933-3371-4a25-a149-6542581d9c1a","resolution":{"observed_at":"2026-05-23T06:12:39.630044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"237fd586-0940-4985-8247-c5b194ba8975","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:df9000af667e83d2bff2c5401117f2c5c3e7a58cb7884cadb073da8977aaa47f","observation_id":"d013d09b-bd4c-48e7-bcb1-a78a7c9f2f6b","resolution":{"observed_at":"2026-05-23T06:12:39.692010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"8e496fc5-c5e6-4ed7-b997-8586b689fd7f","year":2015},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:a71bd2b071ced083e4de16843e3532502cb47ea78ab52f5bacdb10550c22ff93","observation_id":"f624d0ac-6587-4974-9af4-c58cf4168d7c","resolution":{"observed_at":"2026-05-23T06:12:39.798702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":"2307.04725","doi":"10.48550/arxiv.2307.04725","metadata_source":"pith","pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","venue":"cs.CV","work_id":"1f9d1d3b-a6d6-45a9-9f13-51393c03be8a","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:fd41c3d09226ab4ed239ad1f7504ed9a87974f15ebc675c8f59354bce4733bff","observation_id":"49a52153-ebf0-4f39-8963-e9ecf5c2c1c6","resolution":{"observed_at":"2026-05-23T06:12:38.962957Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation","venue":null,"work_id":"c09f8103-1115-4538-910b-fcac1154bc24","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:bde7e1608c0f600384858c3d0a5fea253f92c0052a9f6486d8e7b3c347f99e60","observation_id":"796b129d-7cc1-4d48-9067-01c7749edae6","resolution":{"observed_at":"2026-05-23T06:12:39.806560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smartbrush: Text and shape guided object inpainting with diffusion model","venue":null,"work_id":"5e314ab9-64a2-49fc-984a-934a54b06662","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:cc0cc293a8313abf9737a11dd5cef64ce499712fd30c16e9d594ac89e47bdb43","observation_id":"8dc778d6-17b3-49cd-88ed-9535b94b6d07","resolution":{"observed_at":"2026-05-23T06:12:39.817749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14091","last_updated":"2024-03-18T16:48:13Z","snapshot_observed_at":"2026-07-06T17:06:41.478216Z","submitted_at":"2023-12-21T18:09:30Z","title":"HD-Painter: High-Resolution and Prompt-Faithful Text-Guided Image Inpainting with Diffusion Models","version":3},"cited_work":{"arxiv_id":"2312.14091","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14091","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hd-painter: high-resolution and prompt-faithful text-guided im- age inpainting with diffusion models","venue":null,"work_id":"c196031d-5e03-450d-836e-44b3d8a03c19","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2312.14091","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:4006f115ef77da908f19fbd84da5a1f5ff6a9116b873d6441ad045515dcd33ad","observation_id":"17874781-283e-4f75-a17f-e496b54ad78e","resolution":{"observed_at":"2026-05-23T06:12:38.958553Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Srdiff: Single image super-resolution with diffusion probabilistic mod- els","venue":null,"work_id":"32dd18ca-d264-40bf-aa08-7a03d25eb375","year":2022},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:df77493c87961aade5c1980e129ee3a57f13bbd6cc453142226e83bb2ec6d68e","observation_id":"ec6d1277-dfca-4fa2-9e49-48a368d7b253","resolution":{"observed_at":"2026-05-23T06:12:39.787184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploiting diffusion prior for real-world image super-resolution","venue":null,"work_id":"5b49cc95-00e2-44bb-8156-2746ebaa82ea","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:6d5f50d0df61011b0347926a0baabce4c984bf2876abb81909bef3ca3606127c","observation_id":"0f28c937-1cf9-4cdb-9039-db2e7bec4d80","resolution":{"observed_at":"2026-05-23T06:12:39.790736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"d1a8bd70-180d-4186-aa54-06935b3df570","year":2020},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:bf8f1bfa466d13af092a2955c3a2a6d2b07c481a25083b81f4425d9f56b5e0e3","observation_id":"9cdc35f0-d515-4a1b-b3bb-cb05d5443e59","resolution":{"observed_at":"2026-05-23T06:12:39.810146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":"2011.13456","doi":"10.1088/1748-9326/aae98d","metadata_source":"pith","pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","venue":"cs.LG","work_id":"d9110e53-a5d4-4794-a4c5-a575e91c31ad","year":2020},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:25b4991c83b3613cbfcf710f27ec6501cb70b9f34926d75d198aaca772876ac5","observation_id":"b6b1f06a-e88c-4c53-ba76-73845ad9574f","resolution":{"observed_at":"2026-05-23T06:12:38.937884Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:58:00.812405+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:58:00.812405+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.00132","last_updated":"2021-06-23T18:28:15Z","snapshot_observed_at":"2026-08-09T17:55:20.243599Z","submitted_at":"2021-05-31T23:00:54Z","title":"On Fast Sampling of Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":"2106.00132","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.00132","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On fast sampling of diffusion probabilistic models","venue":null,"work_id":"28f4d037-fdd8-4254-92c7-3361c8b2633b","year":2021},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2106.00132","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:849a3cffb4b455cb035c398ee1fc4381d78a84f84a1357cbcc46fad27aa48ab8","observation_id":"fda0fc8b-b9ed-4979-9289-d57c132881c4","resolution":{"observed_at":"2026-05-23T06:12:38.933600Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02600","last_updated":"2021-09-12T07:49:25Z","snapshot_observed_at":"2026-08-02T20:28:50.761816Z","submitted_at":"2021-04-06T15:46:16Z","title":"Noise Estimation for Generative Diffusion Models","version":2},"cited_work":{"arxiv_id":"2104.02600","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.02600","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Noise estim ation for generative diﬀusion models","venue":null,"work_id":"e162655f-de5d-47a9-9b16-f0fd2a46698a","year":2021},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2104.02600","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:e9f406c2c584804555e3ac92b2288fa509e5558b4218e29fbb49c21c0b10fb96","observation_id":"1c57d2c8-12c1-4bc4-9780-bb5b395601ea","resolution":{"observed_at":"2026-05-23T06:12:38.928358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":"2010.02502","doi":"10.48550/arxiv.2010.02502","metadata_source":"pith","pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Denoising Diffusion Implicit Models","venue":"cs.LG","work_id":"8fa2128b-d18c-405c-ac92-0e669cf89ac0","year":2020},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:bd5cba85a7995a9076c9cc87f452bca55940f92e945b5c887ffb5e5ded173905","observation_id":"371538fc-82d9-4a57-b1e8-9129c4aa1324","resolution":{"observed_at":"2026-05-23T06:12:38.922947Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T13:49:41.147667+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cascaded diffusion models for high fidelity image generation","venue":null,"work_id":"2c62e969-ff8e-4cea-8e9e-4f3784679108","year":2022},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:ac3dc1dee62c19ad8e37ac61fe35829976cc27023154af9d38bd4e68e8bde62f","observation_id":"a945fbd8-daba-46cb-bf21-7985e5af32a6","resolution":{"observed_at":"2026-05-23T06:12:39.768819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Score-based generative modeling in latent space","venue":null,"work_id":"b676ca36-db51-46af-b501-d128d57f5dec","year":2021},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:4c905d33f37b625b2f8646074086c5c36eec6a615b7f6b60c62c31069537aea4","observation_id":"9c5fb490-faf9-4831-977c-ea06c50f02b3","resolution":{"observed_at":"2026-05-23T06:12:39.772565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LAION-5b: An open large- scale dataset for training next generation image-text models","venue":null,"work_id":"db07426a-ee8c-430f-a304-2a56a08accce","year":2022},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:ddf34f3b905ced4876074699afbb012e8602a3bb138d3a5cbca426431d260998","observation_id":"decf5386-7498-4ed3-b365-4a9800ecc700","resolution":{"observed_at":"2026-05-23T06:12:39.756909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A path towards autonomous machine intelligence version 0.9. 2, 2022-06-27","venue":null,"work_id":"b93ffaa5-a0af-4796-bcce-c7e4dc2dbbbb","year":2022},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:80f95fd2626c4a7edf56706f435a79cc68f09ba99cb841b4df12ebd661ea5745","observation_id":"3dbc41fb-b3a1-4cee-942a-4a80c9eb4dfe","resolution":{"observed_at":"2026-05-23T06:12:39.752945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":"6e0af992-37f6-435a-93d0-4760942864aa","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:429378a642f865851e56a7c415f9f417a27535f86cb695e66ae1c2ab94f43632","observation_id":"b583ee54-e561-4508-9c18-8d6b508241f7","resolution":{"observed_at":"2026-05-23T06:12:39.761181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"cited_work":{"arxiv_id":"2410.06940","doi":"10.48550/arxiv.2410.06940","metadata_source":"pith","pith_arxiv_id":"2410.06940","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","venue":"cs.CV","work_id":"1aff8ef8-079b-4afe-9e6a-148e6fd08e6a","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2410.06940","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:56c014f318f6189dd1c594ef1448c5b7a956c43f050d6e5c68e75f11caddd3f7","observation_id":"54b05ad3-536e-4e33-b12e-5ec8ff94e605","resolution":{"observed_at":"2026-05-23T06:12:38.918311Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision meets robotics: The kitti dataset","venue":null,"work_id":"5f965990-6823-49de-973a-5c85818fc62f","year":2013},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:b831542bcf8231eed477aaa91e5102742844bad64b8160e61590f8d73fb16310","observation_id":"e36eb734-06cc-4891-b98b-94670395b35a","resolution":{"observed_at":"2026-05-23T06:12:39.743576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A naturalistic open source movie for optical flow evaluation","venue":null,"work_id":"fec9e751-daa1-445b-8c20-75010f0dd35a","year":2012},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:f6baa95b36d75595e9cc0ffee0a7aad3a26f432ed6d76d98a5bc830e367abb3e","observation_id":"97910c5d-4660-458f-a7ed-b4c8d65e8e37","resolution":{"observed_at":"2026-05-23T06:12:39.748473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sun rgb-d: A rgb-d scene under- standing benchmark suite","venue":null,"work_id":"2ab4e405-aaed-4608-898e-18234f2156f2","year":2015},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:b5a4ed982917f7efc03509edc8f4abb6e409ee3bbd2512db319a4b319c5fc81f","observation_id":"e7e59477-db8c-4a4e-99d9-c1ce08b78db1","resolution":{"observed_at":"2026-05-23T06:12:39.765043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Indoor segmen- tation and support inference from rgbd images","venue":null,"work_id":"a1992897-2882-4765-97b3-289d8ffa3be9","year":2012},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:dbe70ed9617fe86fd79bfc88525ad24c0b9ae3d6cfa5dff55b46e5fc423dc46c","observation_id":"0786e208-9691-4e41-9dce-5fdc5a84cce8","resolution":{"observed_at":"2026-05-23T06:12:39.776040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cornet: Context-based ordinal regression network for monocular depth estimation","venue":null,"work_id":"815610cd-e659-4ccf-a361-f32e63ebdb75","year":2021},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:6e655aed8d64b3e7d04863e04cb4c59742d4951acf33e19963caf5c97640e593","observation_id":"55e8bd8c-5c29-4f41-9915-55fcb6661f83","resolution":{"observed_at":"2026-05-23T06:12:39.783142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Depth map prediction from a single image using a multi-scale deep network","venue":null,"work_id":"cc9a66f6-b3f3-466c-ad4d-7461bd7bdce9","year":2014},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:72af6da5ac1b63e35d5a7534a8fa7e3a8c56c6272013607a3bdce47bceb27730","observation_id":"27d189b7-12ef-47ea-be7b-4996e1baab35","resolution":{"observed_at":"2026-05-23T06:12:39.728346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deeper depth prediction with fully convolutional residual networks","venue":null,"work_id":"2542b713-4683-4d42-84ef-74c17a07fbfd","year":2016},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:171cd8366aa8010ca997bff14214b842635e82843ba698a59ca7bb0f0eaba71d","observation_id":"9e0e0d33-f056-46b2-838f-0d446dd33f76","resolution":{"observed_at":"2026-05-23T06:12:39.736155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T06:20:45.395012Z","title":"Squeeze-and-excitation networks","venue":null,"work_id":"a20feb39-6fc4-4dd2-8ebf-1e9b07dcd27f","year":2018},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:436b65e1cefa5a0cc8c455751d4958883f663417872893bb02b44e9100a7120a","observation_id":"4171306d-ae52-49d6-b50b-bc71a4363970","resolution":{"observed_at":"2026-05-23T06:12:39.739935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Predicting depth, surface normals and se- mantic labels with a common multi-scale convolutional architecture","venue":null,"work_id":"dda71167-935b-47a0-9eb7-4b0aaa6225f5","year":2015},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:92d666ab858a40f6b55d3ed8e4d9023214c9c308e423b2cd9f30303fecd44c8f","observation_id":"4524ce3f-f5f0-42c8-8afe-78dbc7ea5a74","resolution":{"observed_at":"2026-05-23T06:12:39.732334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Web stereo video super- vision for depth prediction from dynamic scenes","venue":null,"work_id":"c5e995f9-3df9-43e9-b047-74448a29d23a","year":2019},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:9be5f655291584fcf0a80611105b3b805261f81b323b78b6bb739914c1a4a40f","observation_id":"bb3684e7-761c-4cf8-a43f-4ca9f00e7556","resolution":{"observed_at":"2026-05-23T06:12:39.779660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Monocular depth estimation using laplacian pyramid-based depth residuals","venue":null,"work_id":"4c7a1cae-1b73-4569-ad81-8a4fa6e8cdb1","year":2021},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:232c7df8adb1e673f7bac324e240e65b184417a9349ccbbc9e236cd4428a4498","observation_id":"a23443a7-63fe-4f84-b8d4-647401d3d5cb","resolution":{"observed_at":"2026-05-23T06:12:39.720770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01502","last_updated":"2022-06-06T08:55:02Z","snapshot_observed_at":"2026-08-06T03:14:28.220190Z","submitted_at":"2022-03-03T03:27:20Z","title":"NeW CRFs: Neural Window Fully-connected CRFs for Monocular Depth Estimation","version":2},"cited_work":{"arxiv_id":"2203.01502","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.01502","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"New crfs: Neural window fully-connected crfs for monocular depth estimation","venue":null,"work_id":"00407f24-830c-46b9-8928-19d0b8244e6d","year":2022},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2203.01502","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:97684762931a38168f4e963b8ac2f011e5eae4eeeab84976e1770bd6b01d570c","observation_id":"83614a87-f96f-491d-911b-78d0c04d0c97","resolution":{"observed_at":"2026-05-23T06:12:38.914041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unleashing text-to-image diffusion models for visual perception","venue":null,"work_id":"a09da328-de19-429a-91f7-72a46b12e9d7","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:e488b4e878dac74ffdac82ffbc88da995e85b37bca0dc7085d1c1c3e412684bb","observation_id":"98718c4a-7781-4d2c-9cc5-b22e3569e139","resolution":{"observed_at":"2026-05-23T06:12:39.706986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ecodepth: Effective conditioning of diffusion models for monocular depth estimation","venue":null,"work_id":"e0f2c776-41dd-48a4-acbf-dab63a6c149b","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:6439a46908f3cc2b7f2625c01097371de3679a9ef3f6bbe160ba32a32e30dd0e","observation_id":"1dd16cbb-58a8-412b-ab25-12f52829ee56","resolution":{"observed_at":"2026-05-23T06:12:39.710665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Estimating depth from monocular images as classification using deep fully convolutional residual networks","venue":null,"work_id":"e3ace122-b224-4551-954a-90db6b3aa481","year":2017},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:a9cdf2aa4907d4fb2f691d71a3a617b145bc76109f01c96d3aef99264dd5077a","observation_id":"b7bd3732-07e7-4ea7-ab90-38dbaa2b2e7d","resolution":{"observed_at":"2026-05-23T06:12:39.703206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Monocular depth estimation with augmented ordinal depth relationships","venue":null,"work_id":"8ed19ab1-4764-4b6e-9dc7-1457f709a1f7","year":2019},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:6962629d61e8eeb8b62ee267c893c2ace50078006cb49fb83e62f1406d28c74e","observation_id":"610a338e-bfa1-4daf-aad2-eb5cd159c245","resolution":{"observed_at":"2026-05-23T06:12:39.714136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adabins: Depth estimation using adaptive bins","venue":null,"work_id":"b7b73401-9e82-4193-b720-ec5d16585e17","year":2021},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:161934ff1d09f7c5270821735b3b33b25023b7535b43fefafcd7728dd4925459","observation_id":"d8914cda-f777-4872-82bb-d8296e1d713f","resolution":{"observed_at":"2026-05-23T06:12:39.717617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.00987","last_updated":"2022-04-03T04:38:02Z","snapshot_observed_at":"2026-08-05T13:28:31.353552Z","submitted_at":"2022-04-03T04:38:02Z","title":"BinsFormer: Revisiting Adaptive Bins for Monocular Depth Estimation","version":1},"cited_work":{"arxiv_id":"2204.00987","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.00987","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Binsformer: Revisiting adaptive bins for monocular depth estimation","venue":null,"work_id":"49452974-67ba-4736-be98-da629f6f2af2","year":2022},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2204.00987","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:13d237278d06139dc199f25aa618a0e2dc56c7f087b58fdf6d9459e4c2e1026f","observation_id":"daa0fdef-913b-424c-8785-9b44f68c6644","resolution":{"observed_at":"2026-05-23T06:12:38.909011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ha-bins: Hierarchical adaptive bins for robust monocular depth estimation across multiple datasets","venue":null,"work_id":"784768fb-6b2f-4981-b3b3-f798da627bf6","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:0e1bfcc228d5313381ce3970340a6797c91f185e1def55394f599445a22b401b","observation_id":"d65c2f76-99bd-4f67-a7c1-4c576c6394ba","resolution":{"observed_at":"2026-05-23T06:12:39.802842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Enforcing geometric constraints of virtual normal for depth prediction","venue":null,"work_id":"e3b83809-c179-4261-afd9-d2ee975cb87f","year":2019},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:2f0a35a326b8f07a0f9727279ba6c433e1cbc0bd3f022d3ed5686e4e18bb876a","observation_id":"2ddb22f1-32b6-45ec-9798-443fcbb7a3c1","resolution":{"observed_at":"2026-05-23T06:12:39.639568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08044","last_updated":"2024-03-18T04:25:43Z","snapshot_observed_at":"2026-07-06T16:31:37.625496Z","submitted_at":"2023-10-12T05:34:45Z","title":"EC-Depth: Exploring the consistency of self-supervised monocular depth estimation in challenging scenes","version":2},"cited_work":{"arxiv_id":"2310.08044","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08044","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ec-depth: Exploring the consistency of self-supervised monocular depth estimation under challenging scenes","venue":null,"work_id":"b2a39e0b-ddc5-42fc-a345-6daa8b9a0d20","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2310.08044","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:ff033b3b10f2ffa085826419b9efb6b700b5081154cf61c568a8e8f8541b585b","observation_id":"47e02df8-1a7d-450e-b87a-970859619768","resolution":{"observed_at":"2026-05-23T06:12:38.874057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Geonet: Geometric neural network for joint depth and surface normal estimation","venue":null,"work_id":"e5d450d2-564e-49e7-b5af-c8a540b12242","year":2018},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:4c86e9e6b179bb582a75a66ec74df5591fc7b535ea61726b0206f092097465ea","observation_id":"6a6bee00-7853-4037-bbb6-1df3d1bfb99b","resolution":{"observed_at":"2026-05-23T06:12:39.642515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Plane2depth: Hierarchical adaptive plane guidance for monocular depth estimation","venue":null,"work_id":"c06f42e1-4378-4f56-ab78-a6154ac0a1db","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:2d18d7bde5242af5991e04c383f255a4995e8595667c0caf23e07d0052594fec","observation_id":"0e8a53a9-9728-47a8-8b06-1f03edd7cbb4","resolution":{"observed_at":"2026-05-23T06:12:39.645422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pad-net: Multi-tasks guided prediction-and-distillation network for simultaneous depth estimation and scene parsing","venue":null,"work_id":"f77edeea-997d-4b30-af63-122eea236519","year":2018},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:102015d5128a059e7aedecb60e06e61c6186581eb145f0ba7b0cafbc9c5a665a","observation_id":"189b5d2d-aa82-4797-814b-a51196369859","resolution":{"observed_at":"2026-05-23T06:12:39.649019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards scene understanding: Unsupervised monocular depth estimation with semantic- aware representation","venue":null,"work_id":"d217fd62-709f-4af5-8b90-0f40c24d9d30","year":2019},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:2f02825661d5209165af59c57db66c483c3b5e4165f94c9077df5695211cd384","observation_id":"b87e3bfe-ac01-4363-8f3a-562e55f44e77","resolution":{"observed_at":"2026-05-23T06:12:39.664306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":"2304.07193","doi":"10.48550/arxiv.2304.07193","metadata_source":"pith","pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv2: Learning Robust Visual Features without Supervision","venue":"cs.CV","work_id":"26b304e5-b54a-4f26-be7e-83299eca52e4","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:9bdb5cb369d613501d4c5e6a84140111728f9401055876b2f1624d93db41b673","observation_id":"da509556-579c-4bb6-a1d7-df292ecc4451","resolution":{"observed_at":"2026-05-23T06:12:38.899373Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusionedge: Diffusion probabilistic model for crisp edge detection","venue":null,"work_id":"9e65163a-0304-4a32-8492-42f268f53924","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:fb1d864a3f7e355e9bff5b0dcb783123469bc61c6bf7fc78065d651e31bbb3d1","observation_id":"1eb99ded-3925-444c-98e2-13ed8704201e","resolution":{"observed_at":"2026-05-23T06:12:39.598708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robust estimation of a location parameter","venue":null,"work_id":"68508196-6712-4cf3-9047-278671670bbe","year":1992},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:c6f926336f96d38942da6950008556fccfdfaee03f3736c007c73ae858247822","observation_id":"01f13765-59c6-46b3-988c-07165b1dd961","resolution":{"observed_at":"2026-05-23T06:12:39.587851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:7af42cba37da42161b9c9f22a0466127a45ec3be604351c3f1211a558c5fc3e5","observation_id":"381fcea6-4077-4dec-a4fb-8626378b2cf7","resolution":{"observed_at":"2026-05-23T06:12:38.869279Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to recover 3d scene shape from a single image","venue":null,"work_id":"fc2e8259-436b-4613-936d-a38356f3c593","year":2021},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:ba835c28f857f8fdefd7d6b4699dda32a48f49a50d9080d771d97b89a791266a","observation_id":"aba0eb03-7627-4afd-ae36-ea519e11fc7a","resolution":{"observed_at":"2026-05-23T06:12:39.602830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hierarchical normalization for robust monocular depth estimation","venue":null,"work_id":"04adc5d6-ecad-4aba-8f47-2ec4509531de","year":2022},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:f737c4333124d4b92c5d737d4663af616f91df61d3fa2182e1d79d1536cb77ed","observation_id":"0bc1f36d-3f3a-42e1-841e-e5f12bfb6b61","resolution":{"observed_at":"2026-05-23T06:12:39.626503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hypersim: A photorealistic synthetic dataset for holistic indoor scene understanding","venue":null,"work_id":"768b325a-b30e-4b68-ab60-220411680aee","year":2021},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:d73e1c4b04ea05103d0b49cec1d4d29828046cac68292460d13e88fbb1f91c26","observation_id":"feec0756-acff-448c-b32d-7d1fb76f325d","resolution":{"observed_at":"2026-05-23T06:12:39.668621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.10773","last_updated":"2020-01-29T12:13:20Z","snapshot_observed_at":"2026-07-06T08:53:28.193420Z","submitted_at":"2020-01-29T12:13:20Z","title":"Virtual KITTI 2","version":1},"cited_work":{"arxiv_id":"2001.10773","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.10773","snapshot_observed_at":"2026-07-07T22:24:11.153404Z","title":"Virtual KITTI 2","venue":"cs.CV","work_id":"c0d9c030-aa25-44e7-9cc4-72d7403f1447","year":2020},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2001.10773","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:b3d715ebbc61e320e5717b668d3e8b51ae529b687f534df1c7748553dda6d78a","observation_id":"394cc980-193c-47e0-8573-1d1796b47ca5","resolution":{"observed_at":"2026-05-23T06:12:38.967375Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision meets robotics: The kitti dataset","venue":null,"work_id":"8f94742e-1d3c-4a1b-a7f7-424bc6ab443d","year":2013},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:aec0356f5c492bc8538afb0eaeff427ef6a53ee320bb2853259f27751fbd5816","observation_id":"0a77b613-e7f7-4484-a7a8-7a96140115c1","resolution":{"observed_at":"2026-05-23T06:12:39.672569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"63f95505-2acc-4cac-a589-298c749c30f5","year":2012},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:fdc77c68be8f2e281f118d44de3c0e249babbd24f4b1365c936d7cad3fbbace7","observation_id":"cac6320e-46be-42d8-b1f7-b997f69d0156","resolution":{"observed_at":"2026-05-23T06:12:39.676292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":"a796979f-2985-47e8-9a6a-f4e08c514389","year":2017},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:e495e8a1aaa5c58611a992b84e4ee2ebd7c5b497501a994b915b7fc1488a305e","observation_id":"4784d002-0142-48b8-8c31-8adbef70975f","resolution":{"observed_at":"2026-05-23T06:12:39.695532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A multi-view stereo benchmark with high- resolution images and multi-camera videos","venue":null,"work_id":"ffedce30-e402-4131-b7f1-cd2ad4396aab","year":2017},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:8c9a029baf940a2f1ea3d9656762af0eddec2a38d6a17b64fde16d43a706a30b","observation_id":"b3a747ec-474a-47d7-beec-d42da02c3eda","resolution":{"observed_at":"2026-05-23T06:12:39.660335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.00463","last_updated":"2019-08-29T04:17:49Z","snapshot_observed_at":"2026-08-11T01:17:48.312983Z","submitted_at":"2019-08-01T15:39:54Z","title":"DIODE: A Dense Indoor and Outdoor DEpth Dataset","version":2},"cited_work":{"arxiv_id":"1908.00463","doi":null,"metadata_source":"pith","pith_arxiv_id":"1908.00463","snapshot_observed_at":"2026-07-10T01:46:41.331880Z","title":"Diode: A dense indoor and outdoor depth dataset","venue":"cs.CV","work_id":"1585d72c-48a8-4f2a-adff-0f38f7b78307","year":2019},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/1908.00463","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:69981a182160a37c254f5915a97a59a13a467fa1619341cb1379a71ac92143a5","observation_id":"36a69866-ef9c-4e65-a85c-dcf1dc2118c6","resolution":{"observed_at":"2026-05-23T06:12:38.889151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02073","last_updated":"2025-04-21T12:09:08Z","snapshot_observed_at":"2026-08-02T06:32:26.688405Z","submitted_at":"2024-10-02T22:42:20Z","title":"Depth Pro: Sharp Monocular Metric Depth in Less Than a Second","version":2},"cited_work":{"arxiv_id":"2410.02073","doi":"10.48550/arxiv.2410.02073","metadata_source":"pith","pith_arxiv_id":"2410.02073","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Depth Pro: Sharp Monocular Metric Depth in Less Than a Second","venue":"cs.CV","work_id":"0b67883b-1901-45f1-9d58-1ef7a928df23","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2410.02073","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:a50d94c9c528b80476623ae2595383b4eb84e8c7084fa1a2bad1f1a65f456174","observation_id":"ef60d5ba-1a6a-475f-b326-099938244a4c","resolution":{"observed_at":"2026-05-23T06:12:38.947991Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reproducible scaling laws for contrastive language-image learning","venue":null,"work_id":"78b16e46-e8f6-4215-9106-233b7457590d","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:2abcebec5b3c88a227e64d2280e3011952e4e34706360b37e3fd712f19fdd2bf","observation_id":"87171d23-92cd-48d3-8775-1bb2c5c4311f","resolution":{"observed_at":"2026-05-23T06:12:39.683894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multimodal autoregressive pre-training of large vision encoders","venue":null,"work_id":"55638324-224b-490e-855b-d9de9bb76a22","year":2024},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:4150325f543020a0543653ed11ff65279d82e11d296c179f993be2da9c668d05","observation_id":"25f64a5a-fede-4f5e-a65b-f146e652f109","resolution":{"observed_at":"2026-05-23T06:12:39.699190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":"2304.02643","doi":"10.1109/iccv51070.2023.00371","metadata_source":"pith","pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Segment Anything","venue":"cs.CV","work_id":"2bbf46ca-720a-45a1-8e9c-10c33fbeada0","year":2023},"citing_paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-23T06:08:14.988386Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2501.02576"},"observation_digest":"sha256:c991d340d2c1159b9af227572fb29b08c002121719adedc16ab2cc173c0aefe2","observation_id":"0dd8bb21-f7a8-463f-b85f-c383a3444fbe","resolution":{"observed_at":"2026-05-23T06:12:38.953432Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:58.489975+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:58.489975+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.02576","last_updated":"2026-04-23T14:21:49Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T15:57:41.915551Z","submitted_at":"2025-01-05T15:18:32Z","title":"DepthMaster: Taming Diffusion Models for Monocular Depth Estimation"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":22,"verified_fuzzy":60},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 7 inbound Pith citation observations for arXiv:2501.02576."}