{"as_of":"2026-08-07T07:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9cf78172b025d5be09618ca5dcf3a8d3cf9e778d8f6e787d25de4c11b73b0c86","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:39:00.381942Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:54:38.195630Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T00:54:42.163341Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"cited_work":{"arxiv_id":"2507.15321","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15321","snapshot_observed_at":"2026-08-06T00:54:42.163341Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","venue":"cs.CV","work_id":"0467a42a-fa88-4c58-8e24-5703405b7a50","year":2025},"citing_paper":{"arxiv_id":"2508.04103","last_updated":"2025-08-06T05:46:12Z","snapshot_observed_at":"2026-08-06T00:54:30.831839Z","submitted_at":"2025-08-06T05:46:12Z","title":"Compact and robust optical frequency reference module based on reproducible and redistributable optical design","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:54:38.195630Z"},"links":{"cited_paper":"/paper/2507.15321","citing_paper":"/paper/2508.04103"},"observation_digest":"sha256:3a3d4bf94ec8840fc3f6d742808313e8a94e87818975b8d76b2bf5d374af7f34","observation_id":"e0ac6bdd-6f5e-4367-bc95-5c321c141d21","resolution":{"observed_at":"2026-08-06T00:54:42.276824Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15321","snapshot_observed_at":"2026-08-03T16:43:26.435628Z","title":"Benchdepth: Are we on the right way to evaluate depth foundation models?arXiv preprint arXiv:2507.15321, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.12425","last_updated":"2026-05-25T12:13:04Z","snapshot_observed_at":"2026-08-04T22:13:51.531102Z","submitted_at":"2025-12-13T18:39:23Z","title":"Boosting Monocular Metric Depth Estimation via Bokeh Rendering","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T16:43:26.435628Z"},"links":{"cited_paper":"/paper/2507.15321","citing_paper":"/paper/2512.12425"},"observation_digest":"sha256:646540d2af15dc055c687075725cd1a2e09eabc9f45b896a774aba20db65a325","observation_id":"53cef9eb-a739-4a71-ab27-dff1b09ced7c","resolution":{"observed_at":"2026-08-03T16:43:26.435628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.15321/citation-record","integrity":"/paper/2507.15321/integrity","json":"/paper/2507.15321/citation-record.json","paper":"/paper/2507.15321"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:06.527164Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":"1bb67220-8607-43c3-96ba-654ee4ddd310","year":2023},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:56.309276Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:3ab28eab48ee82bc3c6a00b0559a544c2d8d2b20880902ab44e9461729fbb065","observation_id":"e124307c-0bcc-4c7a-89ca-ed41e151d917","resolution":{"observed_at":"2026-08-06T15:39:06.623257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:06.392567Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detection,","venue":null,"work_id":"ab3b957a-76cf-467c-ab2b-354f0cd397cd","year":2023},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:56.374755Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:88684c656a21a6a3b09566ad19b73c806594b423e6c5fa839776d7f7aff680dd","observation_id":"adcab25c-3d16-40a5-a930-5b1809337831","resolution":{"observed_at":"2026-08-06T15:39:06.454132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:56.471746Z","title":"Nicer-slam: Neural implicit scene encoding for rgb slam,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:56.471746Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:ee642e178acafb732009f0f770b22dbe1a8863619ff57cde14a4bc2cae6b21c9","observation_id":"93b164f9-3292-492c-8a9c-37ad1371bac8","resolution":{"observed_at":"2026-08-06T15:38:56.471746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04343","last_updated":"2025-06-01T06:23:12Z","snapshot_observed_at":"2026-07-06T18:26:42.010940Z","submitted_at":"2024-06-06T17:59:56Z","title":"Flash3D: Feed-Forward Generalisable 3D Scene Reconstruction from a Single Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04343","snapshot_observed_at":"2026-08-06T15:38:56.555384Z","title":"Flash3d: Feed-forward generalisable 3d scene reconstruction from a single image,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:56.555384Z"},"links":{"cited_paper":"/paper/2406.04343","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:59a18c4ecf6672d07d00588877d1c034ba7a498f7c86c9567c2cf6fe06ed5348","observation_id":"dfc3e3d5-4399-4ae0-b590-d2c2c63da337","resolution":{"observed_at":"2026-08-06T15:38:56.555384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:06.207955Z","title":"Depth map prediction from a single image using a multi-scale deep network,","venue":null,"work_id":"ca1c8064-c9c2-4117-82fd-aaa90f7b6860","year":2014},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:56.646555Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:018606e66dfbde4949379f1bc9c6c73c1e0bf8d462d31a2680cab428e85d9e2b","observation_id":"6aeaa437-dfa7-4ead-bb4d-18b8aae8d8a0","resolution":{"observed_at":"2026-08-06T15:39:06.283461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12288","last_updated":"2023-02-23T19:13:10Z","snapshot_observed_at":"2026-07-06T14:55:15.719380Z","submitted_at":"2023-02-23T19:13:10Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12288","snapshot_observed_at":"2026-08-06T15:38:56.731960Z","title":"Zoedepth: Zero-shot transfer by combining relative and metric depth,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:56.731960Z"},"links":{"cited_paper":"/paper/2302.12288","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:7d6fbcddd6a9a7fd9017884de62c79a9dccebeef8d0c11d659a31665710ba21a","observation_id":"f2a35ac1-5863-4e2f-b2da-55d94603b8be","resolution":{"observed_at":"2026-08-06T15:38:56.731960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:05.986776Z","title":"Repurposing diffusion-based image generators for monocular depth estimation,","venue":null,"work_id":"8779657d-0057-4a91-ace9-66c4b0a75d48","year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:56.859472Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:b6eaf51a4b14095ca652c7b4a4f494dfcacfee7863d6bd9ce069e693a510ebbd","observation_id":"1bebbf98-376c-4b4b-81bf-f6afaa5ae5fa","resolution":{"observed_at":"2026-08-06T15:39:06.097312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09414","last_updated":"2024-10-20T11:24:09Z","snapshot_observed_at":"2026-07-06T18:30:32.982860Z","submitted_at":"2024-06-13T17:59:56Z","title":"Depth Anything V2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09414","snapshot_observed_at":"2026-08-06T15:38:57.027314Z","title":"Depth anything v2,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.027314Z"},"links":{"cited_paper":"/paper/2406.09414","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:34eb5a38fb3df3a0b088df6033ca0f5836389a1da612b6f11cb74cc1158dc495","observation_id":"7a554f73-967f-4f5c-b545-0c82c0edebfc","resolution":{"observed_at":"2026-08-06T15:38:57.027314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:05.814118Z","title":"Towards robust monocular depth estimation: Mixing datasets for zero-shot cross-dataset transfer,","venue":null,"work_id":"2f576bda-7e4a-4d3a-a54f-b10996e4f866","year":2022},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.139665Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:325eed57c1c4d35e54477629863a21480253e1a690e7a0997485fc1cfe953288","observation_id":"f3655d69-e6c4-4d74-bfd5-8c5b76487266","resolution":{"observed_at":"2026-08-06T15:39:05.892989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19115","last_updated":"2025-04-15T06:33:45Z","snapshot_observed_at":"2026-07-06T19:39:23.839070Z","submitted_at":"2024-10-24T19:29:02Z","title":"MoGe: Unlocking Accurate Monocular Geometry Estimation for Open-Domain Images with Optimal Training Supervision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19115","snapshot_observed_at":"2026-08-06T15:38:57.185124Z","title":"Moge: Unlocking accurate monocular geometry estimation for open-domain images with optimal training supervision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.185124Z"},"links":{"cited_paper":"/paper/2410.19115","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:051989c72bca5af558ed22c4ced59dee5c0f9b5c1a84251082a6548e18cee640","observation_id":"8a15b29b-dc96-4465-b23d-caacc236bef3","resolution":{"observed_at":"2026-08-06T15:38:57.185124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:05.612830Z","title":"Vggt: Visual geometry grounded transformer,","venue":null,"work_id":"2ea68350-4e97-4a59-8687-f62ae2191d46","year":2025},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.261071Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:94810a7dc9e018587316a411b4af4fa3a918d08e89feec36a0860ec6a437ee63","observation_id":"5de7b7b2-9072-4558-9ff3-a1b376030544","resolution":{"observed_at":"2026-08-06T15:39:05.680425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12671","last_updated":"2024-06-21T02:45:10Z","snapshot_observed_at":"2026-08-06T18:25:52.660589Z","submitted_at":"2024-06-18T14:44:12Z","title":"GeoBench: Benchmarking and Analyzing Monocular Geometry Estimation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12671","snapshot_observed_at":"2026-08-06T15:38:57.331296Z","title":"Geobench: Benchmark- ing and analyzing monocular geometry estimation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.331296Z"},"links":{"cited_paper":"/paper/2406.12671","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:46652b600e830a6430e683612be28d2decb2d91b1b38d5ee634605966eb50480","observation_id":"42d7aab9-a3c5-42f1-bc46-345e900d21c1","resolution":{"observed_at":"2026-08-06T15:38:57.331296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:05.438232Z","title":"Unidepth: Universal monocular metric depth estimation,","venue":null,"work_id":"5524202b-c7c7-4d25-a981-023f6966eca5","year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.399988Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:bc8729881f460c41da47195d5734c7af834dda3a92af786ab2e112f4418d3da9","observation_id":"19c2c986-2c44-4086-aea0-44b895e9382c","resolution":{"observed_at":"2026-08-06T15:39:05.504635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:05.286898Z","title":"Metric3d v2: A versatile monocular geometric foundation model for zero-shot metric depth and surface normal estimation,","venue":null,"work_id":"ddd6df2e-9d0a-4029-9fcd-45f5a4ac03c3","year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.480331Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:d8473e5884080bd30b5e2697d76eb12addcda84d392504cda7f8a2afe16ddc42","observation_id":"eed43b4e-17c4-49cc-b268-576da9317761","resolution":{"observed_at":"2026-08-06T15:39:05.350764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06090","last_updated":"2024-12-01T12:13:57Z","snapshot_observed_at":"2026-07-06T17:42:08.056523Z","submitted_at":"2024-03-10T04:23:24Z","title":"What Matters When Repurposing Diffusion Models for General Dense Perception Tasks?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06090","snapshot_observed_at":"2026-08-06T15:38:57.550913Z","title":"What matters when repur- posing diffusion models for general dense perception tasks?,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.550913Z"},"links":{"cited_paper":"/paper/2403.06090","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:bd95e6e5f50b0ecb9af0970a6f139203dfd3a5340bbea6ede357b955b299c342","observation_id":"e14575a5-c5c5-4ba1-a698-7c0228fb8a80","resolution":{"observed_at":"2026-08-06T15:38:57.550913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:05.124562Z","title":"Depth prompting for sensor-agnostic depth estimation,","venue":null,"work_id":"8e1ec36d-0355-422f-addd-9e43538d9a6b","year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.650113Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:690f84e63395ad86440094c3f8c2faab74cc863e4838ca73ce97d5f435fdcd3c","observation_id":"9184d487-9640-4afc-87b3-46c6989abc6f","resolution":{"observed_at":"2026-08-06T15:39:05.202744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09466","last_updated":"2025-04-23T10:38:09Z","snapshot_observed_at":"2026-08-04T04:25:25.092886Z","submitted_at":"2025-01-16T10:59:29Z","title":"DEFOM-Stereo: Depth Foundation Model Based Stereo Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09466","snapshot_observed_at":"2026-08-06T15:38:57.699345Z","title":"Defom-stereo: Depth foundation model based stereo matching,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.699345Z"},"links":{"cited_paper":"/paper/2501.09466","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:135ac955b63f3ce17d151ae2312bb08af7f82d858d4ac6f901c908da3f5cb3a2","observation_id":"12b1237a-160e-4624-90fd-f9bf50c68e64","resolution":{"observed_at":"2026-08-06T15:38:57.699345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:57.769703Z","title":"Monster: Marry monodepth to stereo unleashes power,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.769703Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:d1822d28ffcf82237f0a1fe521a02fbb6e09d8dd965dadeb6df632b03837fbd9","observation_id":"a7093496-27fb-4510-b995-f7933a1dfcb5","resolution":{"observed_at":"2026-08-06T15:38:57.769703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T15:38:57.853633Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.853633Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:f2a917250e53c99b566295bab68b65d0b7492020091a651493d10547777749aa","observation_id":"6d21e2ec-5381-420b-87bf-cdf84b5b7774","resolution":{"observed_at":"2026-08-06T15:38:57.853633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:04.952220Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models,","venue":null,"work_id":"0cf8abb3-c6f0-4792-8af8-7f0291f905aa","year":2023},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.930699Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:1e761f9336adbe0259d73a0925f235edd4467f5ea0772eeef5e7b4c9c4c3d805","observation_id":"e7e4d6a5-5ae8-4a6f-a054-9cbe5a3f1ef9","resolution":{"observed_at":"2026-08-06T15:39:05.043266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:04.756086Z","title":"Momentum contrast for unsupervised visual representation learning,","venue":null,"work_id":"f3c3780d-45fb-401c-b9bd-a7d26ae90b78","year":2020},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:57.978691Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:ee1a87bde19194d5796d607ab1f35c844f993aef23722f0e12429f0a5e28e947","observation_id":"8c2f7bb8-647a-4acc-9e59-6069e3b09299","resolution":{"observed_at":"2026-08-06T15:39:04.862225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T15:38:58.031970Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.031970Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:7d456c558783c6efcf7aa86379e5bdac82d81019bd4dd17d31b8df64b48764d8","observation_id":"9c2bd717-c7dc-4f3c-b7eb-f0824f670b18","resolution":{"observed_at":"2026-08-06T15:38:58.031970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:04.547741Z","title":"Iterative geometry encoding volume for stereo matching,","venue":null,"work_id":"62dca51a-2e52-40dc-8b43-dd0e1f1422ed","year":2023},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.114383Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:a0935d9562d591dd0f72d591ce9e12b4e7a70043032118b761bdf48264361e54","observation_id":"3f1aaad2-0acf-467f-89e4-e2685cf467ad","resolution":{"observed_at":"2026-08-06T15:39:04.620530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10799","last_updated":"2024-12-09T18:58:03Z","snapshot_observed_at":"2026-07-06T19:33:16.949210Z","submitted_at":"2024-10-14T17:57:23Z","title":"Towards Foundation Models for 3D Vision: How Close Are We?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10799","snapshot_observed_at":"2026-08-06T15:38:58.191736Z","title":"Towards foundation models for 3d vision: How close are we?,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.191736Z"},"links":{"cited_paper":"/paper/2410.10799","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:da580b3c676b07963c11d13eaca59ed5bf2be4bba96928e9d963a26fee70606a","observation_id":"cdce873d-4773-4311-9e8b-469dbc993f02","resolution":{"observed_at":"2026-08-06T15:38:58.191736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:04.388598Z","title":"Hypersim: A photorealistic synthetic dataset for holistic indoor scene understanding,","venue":null,"work_id":"bf6ace1e-f0b9-4812-87f2-e1f2e7938161","year":2021},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.260110Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:16b17920c2ca6ed2752277a8387ef972f1c4ede6736eefed745841bc810014c2","observation_id":"3f5ee3a3-266f-46c6-90c3-7e3391dbf9f3","resolution":{"observed_at":"2026-08-06T15:39:04.455152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06679","last_updated":"2024-06-10T18:00:03Z","snapshot_observed_at":"2026-08-04T14:40:31.615500Z","submitted_at":"2024-06-10T18:00:03Z","title":"PatchRefiner: Leveraging Synthetic Data for Real-Domain High-Resolution Monocular Metric Depth Estimation","version":1},"cited_work":{"arxiv_id":"2406.06679","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06679","snapshot_observed_at":"2026-08-06T15:39:01.081932Z","title":"PatchRefiner: Leveraging Synthetic Data for Real-Domain High-Resolution Monocular Metric Depth Estimation","venue":"cs.CV","work_id":"aadc46a2-5fb2-43da-aba9-0d1cf1d7e31e","year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.327844Z"},"links":{"cited_paper":"/paper/2406.06679","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:db847d2fc887f478e7a423947b83de2ab2901b48d4d4ed3110e23579ade637b1","observation_id":"d85d2515-3ad8-42b6-9cd7-50a2e7e746ef","resolution":{"observed_at":"2026-08-06T15:39:01.173560Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:04.239503Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":"0ae8e7c5-98b4-4d55-81d8-0e3c632693a3","year":2022},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.418125Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:020165662ee58ca95af1bf0a5e2eceedc3b02e655e9ab2abf4b94d234a860a87","observation_id":"591b2cd5-74c6-4d1e-9bfe-ddf2b0dd4675","resolution":{"observed_at":"2026-08-06T15:39:04.285408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:58.523236Z","title":"Vision meets robotics: The kitti dataset,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.523236Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:2b98d76211b1d4301fe09a4752c8a47d9d822721b3411d4a953c543bea6d275f","observation_id":"c33a0e96-fced-4633-9794-6bb2e50d38b1","resolution":{"observed_at":"2026-08-06T15:38:58.523236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:04.058944Z","title":"Indoor segmentation and support inference from rgbd images,","venue":null,"work_id":"ed5c7d05-1314-47d7-b703-cc395d50fd19","year":2012},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.606170Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:00466b0364caf2113ba6a9f3a279bcb8961e43db7799a320e5448287be592d44","observation_id":"85c784cc-ea03-4105-a4e5-8aef0276d83e","resolution":{"observed_at":"2026-08-06T15:39:04.133548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:03.900578Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite,","venue":null,"work_id":"76603ef6-e670-46b9-946a-187e4eed6fa3","year":2012},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.666629Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:8b25007e622010019e1d87f85a9157c1554efd9f019f0308ad3e070789a35e78","observation_id":"c4dd90ab-3975-4be5-9694-cfe619831fdb","resolution":{"observed_at":"2026-08-06T15:39:03.952936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:03.774388Z","title":"The cityscapes dataset for semantic urban scene understanding,","venue":null,"work_id":"284c732b-7e94-445b-8ac9-2a189b8dce0c","year":2016},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.728758Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:404b43d54fc571e5aa70cebbc22039d2ba0819fb89a67e72429e142c50b06d91","observation_id":"7b690b27-4108-45bf-92ff-a28efcc1a271","resolution":{"observed_at":"2026-08-06T15:39:03.848489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:03.746406Z","title":"Depthformer: Exploiting long-range correlation and local information for accurate monocular depth estimation,","venue":null,"work_id":"53732481-8c50-4d39-8c5c-758955c8b2e5","year":2023},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.841146Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:5db378f49663810eaa11481125715ee4812db47109701b41f8846d386aeffe87","observation_id":"757f17bd-a06f-476e-a41e-e67c0744bc2e","resolution":{"observed_at":"2026-08-06T15:39:03.758253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:03.511686Z","title":"Adabins: Depth estimation using adaptive bins,","venue":null,"work_id":"9bf6e68d-67c1-44e5-89a7-758090243eda","year":2021},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:58.928702Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:e3c81ab6925f0d393707832faf62f9b34086fdcd5e4dc326e53327bca62a811a","observation_id":"54b88136-f9b9-4a72-98dd-bff95671089f","resolution":{"observed_at":"2026-08-06T15:39:03.545218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02284","last_updated":"2023-12-04T19:03:12Z","snapshot_observed_at":"2026-07-06T16:56:49.877351Z","submitted_at":"2023-12-04T19:03:12Z","title":"PatchFusion: An End-to-End Tile-Based Framework for High-Resolution Monocular Metric Depth Estimation","version":1},"cited_work":{"arxiv_id":"2312.02284","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.02284","snapshot_observed_at":"2026-08-06T15:39:00.902416Z","title":"PatchFusion: An End-to-End Tile-Based Framework for High-Resolution Monocular Metric Depth Estimation","venue":"cs.CV","work_id":"e221dc27-4851-4d8d-90f2-874e06015ef4","year":2023},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.027567Z"},"links":{"cited_paper":"/paper/2312.02284","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:3548ef165c7499b97c52d3e6a2a19b8a0f79642e0c0cd73f1dbebc5e719e2a80","observation_id":"ac69cdee-f522-4b64-b1e0-d10e4598d939","resolution":{"observed_at":"2026-08-06T15:39:00.965831Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:03.314383Z","title":"Single-image depth perception in the wild,","venue":null,"work_id":"6530b001-17bf-4069-9f9c-d76df6564d01","year":2016},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.115166Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:c60619b9e0285155071ac1703624f63c282d4a7c8da056c2961acae158e545d2","observation_id":"50e728e2-4a2b-4b6b-a62f-3c81232f9f63","resolution":{"observed_at":"2026-08-06T15:39:03.410056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:03.103334Z","title":"Deep ordinal regression network for monocular depth estimation,","venue":null,"work_id":"bda1e364-8460-4b34-b98e-9d32a2b9246a","year":2002},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.167023Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:7ba561b499e57f864744fb961c281715266ed957a408e456217bb1d4e95f9300","observation_id":"57e06796-663f-448d-8031-28fcd1c1a00f","resolution":{"observed_at":"2026-08-06T15:39:03.257739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.00987","last_updated":"2022-04-03T04:38:02Z","snapshot_observed_at":"2026-08-05T13:28:31.353552Z","submitted_at":"2022-04-03T04:38:02Z","title":"BinsFormer: Revisiting Adaptive Bins for Monocular Depth Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.00987","snapshot_observed_at":"2026-08-06T15:38:59.230082Z","title":"Binsformer: Revisiting adaptive bins for monocular depth estimation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.230082Z"},"links":{"cited_paper":"/paper/2204.00987","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:068443d22ba5739e3cae2e445df3f5b4c7fe2a1c474448326b22b30e1c43df50","observation_id":"79cf1f24-97b5-41b9-bc42-9ba1530400be","resolution":{"observed_at":"2026-08-06T15:38:59.230082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-06T15:38:59.300054Z","title":"Scaling laws for neural language models,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.300054Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:2498db5de4e55ef31ba96ccf5b47077eb2ee71b7d6ca7730556bad93e375b317","observation_id":"867874e3-cd3e-4eff-91c1-f72c3d933feb","resolution":{"observed_at":"2026-08-06T15:38:59.300054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10891","last_updated":"2024-04-07T06:52:21Z","snapshot_observed_at":"2026-08-01T22:50:12.319180Z","submitted_at":"2024-01-19T18:59:52Z","title":"Depth Anything: Unleashing the Power of Large-Scale Unlabeled Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10891","snapshot_observed_at":"2026-08-06T15:38:59.360973Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.360973Z"},"links":{"cited_paper":"/paper/2401.10891","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:efd01bb207f529d7f15086f936788f174bbfc3d6f3d9c0b080f5c5c7c25d3993","observation_id":"987f3ed6-fe38-47e6-8a36-81d471dafb96","resolution":{"observed_at":"2026-08-06T15:38:59.360973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:02.761816Z","title":"Dust3r: Geometric 3d vision made easy,","venue":null,"work_id":"fee08c6d-b210-490b-8c81-b613164d0ae5","year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.416344Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:e520a142666981e79e7d8d4fb0a0fb4d8cc87237cf996ed36d025ccbe01c0f78","observation_id":"9396cd64-c70e-44c2-80ad-5fec841c9b52","resolution":{"observed_at":"2026-08-06T15:39:02.953972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01933","last_updated":"2025-07-10T17:55:35Z","snapshot_observed_at":"2026-08-07T02:38:51.317693Z","submitted_at":"2025-06-02T17:53:09Z","title":"E3D-Bench: A Benchmark for End-to-End 3D Geometric Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01933","snapshot_observed_at":"2026-08-06T15:38:59.460980Z","title":"E3d-bench: A benchmark for end-to-end 3d geometric foundation models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.460980Z"},"links":{"cited_paper":"/paper/2506.01933","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:d8f5b76e6f9d1efe25c84033a88c565cf30dab6cc448f8e18c1b3a9741d7069b","observation_id":"4a1a5d5d-126b-4a22-bf84-66f8fffa328c","resolution":{"observed_at":"2026-08-06T15:38:59.460980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:02.493213Z","title":null,"venue":null,"work_id":"2ddf88ac-0176-49c5-9902-323837139d1d","year":1995},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.494352Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:f7cac48964f3800133aecdc78c79bb7eb06ba4e6392e815b178152acf9d84309","observation_id":"149ecf09-f962-4366-a6da-0ba71a253ab9","resolution":{"observed_at":"2026-08-06T15:39:02.625938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:02.202776Z","title":null,"venue":null,"work_id":"d3ad7a25-8b3e-4eb3-9dd3-7b278892fa70","year":2018},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.557011Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:6678b37102ae0def4b54b5d66b5481cf1b5816b24834f0745541ab31142c4f13","observation_id":"a50d503c-ec5e-45d8-b380-11af94307fb8","resolution":{"observed_at":"2026-08-06T15:39:02.372087Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:02.061996Z","title":"3d gaussian splatting for real-time radiance field rendering.,","venue":null,"work_id":"8de7b60a-9a45-45b8-ac11-81cfa7e6ed89","year":2023},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.598841Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:e2b9b7075e56ead68bb49d6302e13e97aa905075271a40c7adc17b776f989ef6","observation_id":"51024def-81d0-40a6-b28a-357ef5033b14","resolution":{"observed_at":"2026-08-06T15:39:02.101639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:01.881037Z","title":"Neural fields in visual computing and beyond,","venue":null,"work_id":"049aa84a-e200-4a52-bb3f-c43d571d1938","year":2022},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.677479Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:117f94b3a5e51d8c3e5aa988e344ec0c2d17aaaf870db304f816871e68469660","observation_id":"dff4708f-a404-46fa-940a-d24a1f858657","resolution":{"observed_at":"2026-08-06T15:39:01.969107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13642","last_updated":"2025-03-19T05:09:14Z","snapshot_observed_at":"2026-08-05T18:02:56.273979Z","submitted_at":"2024-06-19T15:41:30Z","title":"SpatialBot: Precise Spatial Understanding with Vision Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13642","snapshot_observed_at":"2026-08-06T15:38:59.749275Z","title":"Spatialbot: Precise spatial understanding with vision language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.749275Z"},"links":{"cited_paper":"/paper/2406.13642","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:5b746721e70643b97a81ef37483f280fe5c1fad31625739b00a91ef56e359fe5","observation_id":"5957f5e9-d878-47cd-9323-840f7158ce10","resolution":{"observed_at":"2026-08-06T15:38:59.749275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:59.812005Z","title":"Fine-tuning image-conditional diffusion models is easier than you think,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.812005Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:4ecd9e341bf5528b1de8e50031224b428fd06b736cd216c05f1c1d5a714c3f46","observation_id":"140f60d3-444d-4955-9868-be753e04eb79","resolution":{"observed_at":"2026-08-06T15:38:59.812005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:01.794219Z","title":"A large dataset to train convolutional networks for disparity, optical flow, and scene flow estimation,","venue":null,"work_id":"6136ac07-133e-467a-b5fc-58ba0510abbf","year":2016},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.860879Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:b473b8e6f3bd16cd5fa6ed915ac125e0c61cdc5889366b17cd42fa6e9f520ad9","observation_id":"61631d19-b42d-4889-b400-44709195006d","resolution":{"observed_at":"2026-08-06T15:39:01.836751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:01.646647Z","title":"High-resolution stereo datasets with subpixel-accurate ground truth,","venue":null,"work_id":"9ea8d8fd-1b9b-4db8-9340-4c648b4f6500","year":2014},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:59.932166Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:294b0dcac9946e87b230fac6a3920d226f2a5bc537f19303f334ff348ac573bc","observation_id":"87b26cbc-8d62-4889-bdc6-f3d6d6a120e6","resolution":{"observed_at":"2026-08-06T15:39:01.696324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:01.517091Z","title":"A multi-view stereo benchmark with high-resolution images and multi-camera videos,","venue":null,"work_id":"af7811d8-f1f2-483d-8824-c20d04e0da9f","year":2017},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:00.029681Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:ff0299f49457dae809d42a2b847f40f394ff8fd86dab637f96416445ecbf3e94","observation_id":"20c6d611-49ff-4085-ac0f-8695b1d41ab1","resolution":{"observed_at":"2026-08-06T15:39:01.602098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:39:00.108139Z","title":"U-net: Convolutional networks for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:00.108139Z"},"links":{"citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:d8c23c0d502dac92e374d5e67da0524ad8738e4ac1d6ab2fc5af90fafbb08280","observation_id":"d6ccfc61-7544-4473-9543-f89513578890","resolution":{"observed_at":"2026-08-06T15:39:00.108139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09817","last_updated":"2018-05-24T17:58:02Z","snapshot_observed_at":"2026-07-06T06:41:05.545426Z","submitted_at":"2018-05-24T17:58:02Z","title":"Stereo Magnification: Learning View Synthesis using Multiplane Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09817","snapshot_observed_at":"2026-08-06T15:39:00.237420Z","title":"Stereo magnification: Learning view synthesis using multiplane images,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:00.237420Z"},"links":{"cited_paper":"/paper/1805.09817","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:8432b235a5cbf09e0d071075cb770e0a624fd2a5dfd08c8c6bf41fa9787e558f","observation_id":"471a704a-28a9-4e58-b852-7c7cc8fdece0","resolution":{"observed_at":"2026-08-06T15:39:00.237420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05797","last_updated":"2019-06-13T16:29:58Z","snapshot_observed_at":"2026-08-01T13:51:16.469557Z","submitted_at":"2019-06-13T16:29:58Z","title":"The Replica Dataset: A Digital Replica of Indoor Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05797","snapshot_observed_at":"2026-08-06T15:39:00.381942Z","title":"The replica dataset: A digital replica of indoor spaces,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:00.381942Z"},"links":{"cited_paper":"/paper/1906.05797","citing_paper":"/paper/2507.15321"},"observation_digest":"sha256:8f6a88c9cd3391e20a5b8443e0783ba31f85b7cca33f5d767b71bf1a2a3c0f29","observation_id":"f89b0fbf-50d0-4aaf-a545-abfa029b65a2","resolution":{"observed_at":"2026-08-06T15:39:00.381942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.15321","last_updated":"2025-07-21T07:23:14Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T15:32:39.453149Z","submitted_at":"2025-07-21T07:23:14Z","title":"BenchDepth: Are We on the Right Way to Evaluate Depth Foundation Models?"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":2,"verified_fuzzy":27},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 2 inbound Pith citation observations for arXiv:2507.15321."}