{"as_of":"2026-08-13T14:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea9c883df5c45e7ce6a53e737d78e78d0329fdb65f907b62d5b792abcd59c544","coverage":[{"denominator":93,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":93,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:14:37.473052Z","state":"measured"},{"denominator":93,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":93,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.17385/citation-record","integrity":"/paper/2411.17385/integrity","json":"/paper/2411.17385/citation-record.json","paper":"/paper/2411.17385"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.026925Z","title":"Monocular depth es- timation using cues inspired by biological vision systems","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.026925Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:ea79810b17377ef83ecbe60272916fe01a63e87f0b01b202410fd8c2d5076d61","observation_id":"e05f48c6-47ed-4620-bb4e-73afd925ad5b","resolution":{"observed_at":"2026-08-12T12:14:37.026925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15551","last_updated":"2024-03-22T18:05:33Z","snapshot_observed_at":"2026-08-13T00:47:38.695124Z","submitted_at":"2024-03-22T18:05:33Z","title":"Language-Based Depth Hints for Monocular Depth Estimation","version":1},"cited_work":{"arxiv_id":"2403.15551","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.15551","snapshot_observed_at":"2026-08-12T12:14:37.653505Z","title":"Language-Based Depth Hints for Monocular Depth Estimation","venue":"cs.CV","work_id":"9368e44a-7c91-4c79-a407-c3220010a883","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.032874Z"},"links":{"cited_paper":"/paper/2403.15551","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:a4a8da5f7e944814f5f5a3e4151d328db7d02bfe036509157b82091f85c1bb4d","observation_id":"d8ee6f5c-7b41-4dcc-8ae8-952c4cf6f1cf","resolution":{"observed_at":"2026-08-12T12:14:37.658789Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.038529Z","title":"Enhancing 2d represen- tation learning with a 3d prior","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.038529Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:e7ad04ed96adaee722edc27101144ea462655e0184dcb631e513d58661575058","observation_id":"44b537a1-f758-4e3f-a74c-92f78f8a7f16","resolution":{"observed_at":"2026-08-12T12:14:37.038529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11748","last_updated":"2025-04-25T15:56:39Z","snapshot_observed_at":"2026-08-12T22:59:51.522236Z","submitted_at":"2024-08-21T16:16:18Z","title":"Understanding Depth and Height Perception in Large Visual-Language Models","version":5},"cited_work":{"arxiv_id":"2408.11748","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.11748","snapshot_observed_at":"2026-08-12T12:14:37.627394Z","title":"Understanding Depth and Height Perception in Large Visual-Language Models","venue":"cs.CV","work_id":"e101cd6e-3b8f-4f28-9e66-205f59069635","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.043868Z"},"links":{"cited_paper":"/paper/2408.11748","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:d285066a130a66e0b05123985541212d4662725d8ed66292410dcc1708394b2f","observation_id":"bea1c90b-7d57-4d7a-bb72-ecfcdea5cee2","resolution":{"observed_at":"2026-08-12T12:14:37.635621Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.049496Z","title":"Revisiting feature prediction for learning visual rep- resentations from video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.049496Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:ec4efa88289885acc066b3f535b238cc4ec13269e42c2edeccd7d85e723453cd","observation_id":"70c5b2c6-9680-4c6f-8771-9866c0313d82","resolution":{"observed_at":"2026-08-12T12:14:37.049496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.055216Z","title":"Adabins: Depth estimation using adaptive bins","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.055216Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:137a97410b0a623ea0c4e1fc9d9405f0411619a4500a00fe330651d2f791aae5","observation_id":"0853f4e1-92db-4d54-8842-3b33020c8a76","resolution":{"observed_at":"2026-08-12T12:14:37.055216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.060798Z","title":"Depth perception of surgeons in minimally invasive surgery.Surgi- cal innovation, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.060798Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:72575c4289236b44bf305c2d278b778acc499d3a4e3003f58789441ded7d57f2","observation_id":"4f9dd450-3f12-4512-a25d-b8089ec835e4","resolution":{"observed_at":"2026-08-12T12:14:37.060798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.066172Z","title":"Tenenbaum, and Alexei A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.066172Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:60efb2e043199924585e327a073549b0c4bc24b733a45000b2ea9dacc24cc885","observation_id":"e223606a-2db7-4e2f-b24b-e3c8c7e6c5fd","resolution":{"observed_at":"2026-08-12T12:14:37.066172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.071439Z","title":"Intelligent image and video com- pression: communicating pictures","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.071439Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:0f10936585d53d12dce5e2e79033ff02bf8d742fc99e999161038d470465215d","observation_id":"8f4777cd-7901-4073-8cba-025f28889dd4","resolution":{"observed_at":"2026-08-12T12:14:37.071439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.076943Z","title":"Mvsformer++: Revealing the devil in transformer’s details for multi-view stereo","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.076943Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:8332633d57c753cd7d740fc0ae6c873d34a9a11d1f9b31a23eec29049c88cf08","observation_id":"b3886ff7-c75b-4a8d-8d1b-a840e9f938db","resolution":{"observed_at":"2026-08-12T12:14:37.076943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.081675Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.081675Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:82fa61317909f452d7ee5eb95cea91c78a915d36895db8020f003ef45705caef","observation_id":"135847b3-415b-46e9-bd3d-205cbddab256","resolution":{"observed_at":"2026-08-12T12:14:37.081675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.087059Z","title":"Single- image depth perception in the wild","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.087059Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:5ba2340ef9f15c33729f17cf25932e3a32c8d150aa92db32b33ee6a38ce884a0","observation_id":"1168e1b1-9bd2-4752-94e7-fc49f0c3d54f","resolution":{"observed_at":"2026-08-12T12:14:37.087059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.091958Z","title":"Cimpoi, S","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.091958Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:bce9b2527ac07125460d2757917d2bf77d82bfdfde4d9d3be8af753afe060059","observation_id":"f68445e6-8415-42e0-a14f-bc1f78cab160","resolution":{"observed_at":"2026-08-12T12:14:37.091958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.097133Z","title":"Objaverse-xl: A universe of 10m+ 3d objects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.097133Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:40650a6a74713416f898fbd066541f4103277816d94b61d722859a0d8c5cae8f","observation_id":"d463da72-d186-40f4-a424-ec18d624cf7a","resolution":{"observed_at":"2026-08-12T12:14:37.097133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.101749Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.101749Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:6210c96be49adb5a41b3dce20390ea781fd3200215a6a01820161b89a5f6388e","observation_id":"1556a904-3f65-4664-bef8-fb70d8efd5ec","resolution":{"observed_at":"2026-08-12T12:14:37.101749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.670542Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"b4bd4321-09ab-4fae-86f1-7a5add15bbe0","year":2021},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.106679Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:1ebb2d342ec48b5c2177aed70107288a1b0fdf0305ce7cfd94043ae3b25f95df","observation_id":"594db69e-a0ea-49ce-86a1-5630da918c08","resolution":{"observed_at":"2026-08-12T12:14:38.675883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.655403Z","title":"Depth map prediction from a single image using a multi-scale deep net- work","venue":null,"work_id":"ceee6496-a955-4107-96b5-92b9d51b923c","year":2014},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.111362Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:c6e89c735c0ef54cc42f2dcb16771ad9306899da49a5f97cfac4c52f3ad63049","observation_id":"558dbafb-1fcc-4ac0-b60a-602d8f563d99","resolution":{"observed_at":"2026-08-12T12:14:38.660233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.115974Z","title":"Prob- ing the 3d awareness of visual foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.115974Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:2a31669791f0903e036d17bf6fcb928b6ba06985bee890904bf875e0c7471a08","observation_id":"8c27ecc4-5943-4973-8600-b35bc69da5d7","resolution":{"observed_at":"2026-08-12T12:14:37.115974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.616826Z","title":"Scalable pre- training of large autoregressive image models","venue":null,"work_id":"dc8cb5dc-caaa-454a-aa62-5d7a7ff8653f","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.125401Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:147b1e8a3a23fdee79cc251c60cff426318628ce42a9736b0aaefda9f04153bf","observation_id":"3aa027f6-d91f-4170-834f-122043e487a8","resolution":{"observed_at":"2026-08-12T12:14:38.621358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.130577Z","title":"Deep ordinal regression net- work for monocular depth estimation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.130577Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:aeb5dccbc65c215eda6be07be1fe353b48c230083c30a928d5a056d55832c1c8","observation_id":"50c2652c-b0bc-4a06-87b0-7a55a8d9be01","resolution":{"observed_at":"2026-08-12T12:14:37.130577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.591782Z","title":"Dream- sim: Learning new dimensions of human visual similarity using synthetic data","venue":null,"work_id":"f8c4842c-587b-449c-88e2-dade850d25ff","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.135650Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:f00b0112fbdc6ce3da30dfdd76964e7e9da05b3a2f6eea4ad4d2c1f81853ef21","observation_id":"2f2687c2-3df2-4494-83dc-07bf887a0b1b","resolution":{"observed_at":"2026-08-12T12:14:38.596495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.577747Z","title":"Unsupervised cnn for single view depth estimation: Geome- try to the rescue","venue":null,"work_id":"d05b7c62-40ca-4c32-86af-3c50534f0b4f","year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.140120Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:5e9391bd2451f4e94258342fd4a6e9f256fc88068e35a89b4f9b980c1f114083","observation_id":"b53b2fed-4526-45e8-ae51-0c7503626cf9","resolution":{"observed_at":"2026-08-12T12:14:38.582498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12671","last_updated":"2024-06-21T02:45:10Z","snapshot_observed_at":"2026-08-12T23:40:01.265126Z","submitted_at":"2024-06-18T14:44:12Z","title":"GeoBench: Benchmarking and Analyzing Monocular Geometry Estimation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12671","snapshot_observed_at":"2026-08-12T12:14:37.144770Z","title":"Geobench: Benchmarking and analyzing monocular geome- try estimation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.144770Z"},"links":{"cited_paper":"/paper/2406.12671","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:9c9728d030746b237c00c847377c248654270888f664411e9db467278483040c","observation_id":"4818f94e-4cd5-41a8-be39-a1f00ec3c50f","resolution":{"observed_at":"2026-08-12T12:14:37.144770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.563114Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":"e0083e21-9a9a-40aa-bd28-87e3bfbfbaff","year":2012},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.149614Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:49fd6c99afbfc17155c057e38aa009b845b6bd411e21f6152f620188c9daf5f5","observation_id":"d11c7fe8-96e9-4c9b-8071-ae874bc7cb56","resolution":{"observed_at":"2026-08-12T12:14:38.568204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.548153Z","title":"Wichmann, and Wieland Brendel","venue":null,"work_id":"7bf6e7ae-13ca-4553-b112-9d69640ae524","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.154774Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:04ce5995695e67ed17e51b20915e747a206cdae8349c13049ef7df5968e81fa2","observation_id":"30f4e189-3643-426f-8fd6-22106b45b0b5","resolution":{"observed_at":"2026-08-12T12:14:38.552776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.533876Z","title":"Unsupervised monocular depth estimation with left- right consistency","venue":null,"work_id":"10b7b0d9-1a5b-4a66-b41e-1753a63710a6","year":2017},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.159745Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:5aeacc54e97c8bc46a08fa2a23879fba6888374f699aa1453ed7133b584e95c9","observation_id":"b5159a78-8b68-4c90-a6b6-01e97c7535c6","resolution":{"observed_at":"2026-08-12T12:14:38.538616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.165317Z","title":"Digging into self-supervised monocular depth estimation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.165317Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:8cfb2aadc2459b0fa76c059a1d68e40d10fa3847fb6c843747657840a3752acd","observation_id":"8238833d-b12b-4644-a9ec-3e6f6f29b644","resolution":{"observed_at":"2026-08-12T12:14:37.165317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.510290Z","title":"Depth from videos in the wild: Unsupervised monocular depth learning from unknown cameras","venue":null,"work_id":"7694785a-03dd-4daf-96de-72b92d1b3042","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.170683Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:ed8385d12c163cece7e9d38358b2bf147be07fa3db88df738f7a817a62cbff3e","observation_id":"bc14b216-6d40-4f75-9268-14112640d3bd","resolution":{"observed_at":"2026-08-12T12:14:38.515096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13788","last_updated":"2024-12-19T17:51:42Z","snapshot_observed_at":"2026-08-13T00:49:16.784722Z","submitted_at":"2024-03-20T17:51:53Z","title":"DepthFM: Fast Monocular Depth Estimation with Flow Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13788","snapshot_observed_at":"2026-08-12T12:14:37.176099Z","title":"Depthfm: Fast monocular depth estimation with flow match- ing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.176099Z"},"links":{"cited_paper":"/paper/2403.13788","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:f217775c203606cef0d7b5ff1effd19a3aac46665ecf861e234ae995e8e4dcc0","observation_id":"8b75096f-af4a-4ce3-b314-56dc0ad8c5cc","resolution":{"observed_at":"2026-08-12T12:14:37.176099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.180769Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.180769Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:e228366feef18a0ec1896b72c433ac56b2cfccc08cd1b9d309e9108cd2da9ab1","observation_id":"3b2e73b8-b082-4b4a-a795-11522911603d","resolution":{"observed_at":"2026-08-12T12:14:37.180769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.484973Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"3d1adc83-4fa8-4af2-828e-36b9c980881a","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.185416Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:adbfe2e320e4e53b71089c720a6069be451c406dc10dfe5de366994afae0b473","observation_id":"45a7cb5f-7999-43fe-be4d-97cc2c615781","resolution":{"observed_at":"2026-08-12T12:14:38.490337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.189803Z","title":"The organization of behavior: A neu- ropsychological theory","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.189803Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:83dd90195a2c30116ef04489bdfb2ec794eba0c7c25d23d72ad6bf720edf425e","observation_id":"e721aac8-8bdc-415e-a3be-2a8f88a4191b","resolution":{"observed_at":"2026-08-12T12:14:37.189803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-12T12:14:37.194121Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.194121Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:e2ed73cd5945b9ac352b85ba178c2b22e3ebbcb27b33787b625cdbf6ca5848c3","observation_id":"453dea97-b72d-4a64-8b94-f943dfd7060e","resolution":{"observed_at":"2026-08-12T12:14:37.194121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.461998Z","title":"Lrm: Large reconstruction model for single image to 3d","venue":null,"work_id":"4a89d243-90d3-4a2d-ad08-d95c3611d554","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.199669Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:447c4abfd262cf6534540a69bf34f394fe264236e613fd1bd11f5c14899ac159","observation_id":"5b843ee7-da6b-4d8a-9254-3bdcf72c28ac","resolution":{"observed_at":"2026-08-12T12:14:38.466813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.448625Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"482e79b9-279a-4079-8268-2ec68adb9860","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.203955Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:997310acf1b7822bf9b541771d108f038c5ab589671373a98dece06334c58440","observation_id":"52f1548f-39bf-4415-ad1a-3dfe1ad69f3c","resolution":{"observed_at":"2026-08-12T12:14:38.452848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.435224Z","title":"Squeeze-and-excitation net- works","venue":null,"work_id":"12b72956-c405-483a-968c-da3ed8707d30","year":2018},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.208264Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:684eb20ee9816066ed766639ef291112baaa49fcec88abfb90f912408c9f16e6","observation_id":"e0de06bf-ad51-4b5f-a4dc-8afedce4726d","resolution":{"observed_at":"2026-08-12T12:14:38.439793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.419950Z","title":"Monodtr: Monocular 3d object detection with depth-aware transformer","venue":null,"work_id":"005956ca-f883-4962-b409-a0bbcc74e500","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.212514Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:eff16d037a71173e7ac9809bfb197148aaa03e89ed34ddf9663c57876161a494","observation_id":"e241a5c7-42a7-4420-b70e-1a9f43bc5185","resolution":{"observed_at":"2026-08-12T12:14:38.424875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.405484Z","title":"Receptive fields and functional architecture of monkey striate cortex.The Journal of Physiology, 1968","venue":null,"work_id":"99b99764-4fa4-49dd-a44a-a0c2944a21bd","year":1968},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.216824Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:59783cdaac230773be0bffa228149ba6786e23d68ccad683f6e763e461c9bbc2","observation_id":"e7263066-896c-4d43-98b8-9b77e62500a6","resolution":{"observed_at":"2026-08-12T12:14:38.410285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.391304Z","title":"Brostow, and Jamie Watson","venue":null,"work_id":"26b2de35-e8b4-45a4-82c6-175df38a9eeb","year":2025},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.221199Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:56f6ebb1c588e1fbb0ca6d60d66964c7d9bf0930aedf30ef93d63bec91eac670","observation_id":"897813cf-f8f4-48b8-938a-fa66d43a67b3","resolution":{"observed_at":"2026-08-12T12:14:38.395917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.375907Z","title":"The perception of depth","venue":null,"work_id":"ab62673b-b287-4891-b3b9-af746b57ab66","year":2011},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.226169Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:98cc01bbab011c2a719308a669443ccfe7a9569ef72656b0723724e6cf1ab742","observation_id":"84a7c5f1-91fa-4010-88be-41693e046e7e","resolution":{"observed_at":"2026-08-12T12:14:38.381046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.362078Z","title":"Repurpos- ing diffusion-based image generators for monocular depth estimation","venue":null,"work_id":"c22a652b-c9ae-4b17-9f3b-5132a9e0cd55","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.230589Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:b1182a5ea1dd0a3996bdcff651231689aeb38cb092d2dd9daf18fe683b1ed2ea","observation_id":"a1707475-a7c5-4fff-ade4-eb655a015eaf","resolution":{"observed_at":"2026-08-12T12:14:38.366510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.348474Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":"51ee99a3-cb3a-4e52-92ba-8c7a50b79db4","year":2015},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.235931Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:3eaf9f26551b76289585781cbbe441c3c11308d2821714ed2ea9d4b49c34df48","observation_id":"14642ff0-b590-4ac2-91a1-87e35ddcc8fb","resolution":{"observed_at":"2026-08-12T12:14:38.352933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.334670Z","title":"Segment any- thing","venue":null,"work_id":"8308d376-6e83-4ce8-8691-ed7d5b420d4d","year":2023},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.240430Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:0334e7d82151f13f7a0dcada6674c184c88a3a5ee2ef18fd17a97cb787abbd9e","observation_id":"14c27e97-cfe2-490f-a794-695cd8f40931","resolution":{"observed_at":"2026-08-12T12:14:38.339112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.321432Z","title":"Temporally consistent horizon lines","venue":null,"work_id":"02e4d505-1387-4b13-a904-d4bdcca4e8f9","year":2020},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.244662Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:50071635ad011eea14aa17c43260f0c06b708a17a47a29ef068e1f26fa7d50ad","observation_id":"d16fa6f6-db1e-4b87-8fe9-9c29b8c07df8","resolution":{"observed_at":"2026-08-12T12:14:38.325842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.307276Z","title":"On the viability of monocular depth pre-training for semantic segmentation","venue":null,"work_id":"5c31665b-53b6-435e-b1dd-4358acd3a579","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.249493Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:4fe9e31ac2f993fbfd9ee94ad7bfa6f66864a5cdf76cbf2e07b114b810ac4f1a","observation_id":"76935e37-5113-4f7c-8856-440651efb0ba","resolution":{"observed_at":"2026-08-12T12:14:38.312220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.294196Z","title":"Perceptual depth indicator for s-3d con- tent based on binocular and monocular cues","venue":null,"work_id":"282e04fe-274f-4e84-8287-776b726eaa0b","year":2012},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.254812Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:3f9ff95b1cefaa60de10b264d9ae66d7d332411d69755a767fc2ef9707ac29c4","observation_id":"1f4c526b-45d1-4133-8a0c-4d5732345662","resolution":{"observed_at":"2026-08-12T12:14:38.298724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.280651Z","title":"Multi-task learning with 3d-aware regulariza- tion","venue":null,"work_id":"59f73602-cd39-4834-b255-6e864d9817e9","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.259718Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:667c0dc56519a3575f50bc89a9cc2c71bc87920318679b5a285fdc6839e09a6d","observation_id":"7208957d-52f5-4415-aaba-4aba7661f24a","resolution":{"observed_at":"2026-08-12T12:14:38.285014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.266577Z","title":"Movideo: Motion-aware video generation with diffusion models","venue":null,"work_id":"ea2c0c75-1bd1-410b-a362-64786d233680","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.264051Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:40b99f031a28c119d02265dd3158bac35ecb51f5211a51e0a8a0899448bb5da2","observation_id":"a87ec203-7d68-4ccc-8e33-d50046ccb163","resolution":{"observed_at":"2026-08-12T12:14:38.271466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04138","last_updated":"2025-02-28T14:49:44Z","snapshot_observed_at":"2026-08-13T13:53:08.314191Z","submitted_at":"2024-06-06T14:59:39Z","title":"The 3D-PC: a benchmark for visual perspective taking in humans and machines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04138","snapshot_observed_at":"2026-08-12T12:14:37.268443Z","title":"The 3d-pc: a benchmark for visual per- spective taking in humans and machines","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.268443Z"},"links":{"cited_paper":"/paper/2406.04138","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:ba63090ed24522f04cc908a42519ca7d3bcd0977865a22f6dad0c8718e9414d7","observation_id":"8ca620d4-e994-404c-bce2-28dbba1cc9f5","resolution":{"observed_at":"2026-08-12T12:14:37.268443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.252847Z","title":"Vapid: A rapid vanishing point detector via learned optimizers","venue":null,"work_id":"45e33abe-cf63-4c9c-a264-a6118181175b","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.273235Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:4e3647968074359145fa3e1bbed2d6f6b060317d692f0dbf2c99aa54e4e62001","observation_id":"85d06987-565d-4e83-98da-6be66bf5cdfe","resolution":{"observed_at":"2026-08-12T12:14:38.257606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.238579Z","title":"A convnet for the 2020s","venue":null,"work_id":"b4228194-89c1-4e52-b3c9-02e1313c7fc4","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.277756Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:ff7510a9df707b4312e69780c271f9ee1c22fd195b8ac52a7d400b7526deac8d","observation_id":"22046a66-5083-4f13-af85-30ca8679b123","resolution":{"observed_at":"2026-08-12T12:14:38.243794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.224333Z","title":"Ima- genet3d: Towards general-purpose object-level 3d under- standing","venue":null,"work_id":"5a615cc0-2997-4cb5-ae17-5a91473e9d4a","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.282120Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:2a1a3403c9d4adf1d7cc41ff05fb31685a4a2ad45717ff2ccbcf40ad1f5006cf","observation_id":"83a3804a-720f-4993-bba2-6459c66312ef","resolution":{"observed_at":"2026-08-12T12:14:38.229103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.209689Z","title":"Lexicon3d: Probing visual foundation models for complex 3d scene understand- ing","venue":null,"work_id":"293cd18b-307e-4efa-a7c0-de53c0ff680e","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.286712Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:469b2165728b1afc0f61b4d305453a1285c6d1f58c7cbfd87eae41a80385a471","observation_id":"cb11e874-bc37-4d60-b8fc-4e0bb5923420","resolution":{"observed_at":"2026-08-12T12:14:38.214308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.194814Z","title":"Im- proving semantic correspondence with viewpoint-guided spherical maps","venue":null,"work_id":"8b21e58c-aacc-4525-8c5a-c740695c5cce","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.291301Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:b9a47553579e4f9f4a361bf09e8218b72bcec9a266cc3b0c7c30f88ef420c1fd","observation_id":"f178694a-b51a-4677-a141-a659ef013ee9","resolution":{"observed_at":"2026-08-12T12:14:38.199954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.180450Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"af699e0c-e413-4278-8fbd-6aa84936cd0a","year":2012},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.295764Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:541d0ff9e7ec414064226f08d9eb443a8368f2856b18a40818a6a917f87846bc","observation_id":"848c6ed3-91c3-4025-a4b8-73b44d8b6e70","resolution":{"observed_at":"2026-08-12T12:14:38.185084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11300","last_updated":"2023-09-07T21:18:15Z","snapshot_observed_at":"2026-08-13T10:29:52.575350Z","submitted_at":"2023-08-22T09:29:05Z","title":"Approaching human 3D shape perception with neurally mappable models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11300","snapshot_observed_at":"2026-08-12T12:14:37.300096Z","title":"Approaching human 3d shape perception with neurally mappable models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.300096Z"},"links":{"cited_paper":"/paper/2308.11300","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:c0aba4c8309c9776eb9bc4a567453cb252f09d9800621f2c06dbe7a642fb4c15","observation_id":"bd317d2a-ac7f-4d93-88b0-e6fede04873f","resolution":{"observed_at":"2026-08-12T12:14:37.300096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.166069Z","title":null,"venue":null,"work_id":"01e81291-1421-4c91-974d-f70ddabda09b","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.304579Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:02737dfa776793870971eb94f43e39d47c6c88069b4809d4a62e546d1158d782","observation_id":"8da013da-92e2-48d3-95c6-8abed814c080","resolution":{"observed_at":"2026-08-12T12:14:38.170598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.150562Z","title":"The hippocampus as a cognitive map, 1978","venue":null,"work_id":"748f5a8e-5b87-461a-92e2-aff18c8c0393","year":1978},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.309688Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:7552097e74b560e324309e962b77374478a6fa9ce10d9336e59d712457d60929","observation_id":"dc3b1ca4-ddcc-4699-ad7f-79ef79af8526","resolution":{"observed_at":"2026-08-12T12:14:38.156194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.136449Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"4f08e676-84b8-4785-8135-d347952f8219","year":2021},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.314372Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:9e39e3c33f8ddce613f22f6e05d05d0ff3f68a9bd3c366aea1de901996254456","observation_id":"f93acfe4-f329-4330-a509-16aeec0ab8b2","resolution":{"observed_at":"2026-08-12T12:14:38.141130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.121077Z","title":"Large-scale, high-resolution comparison of the core visual object recogni- tion behavior of humans, monkeys, and state-of-the-art deep artificial neural networks","venue":null,"work_id":"783f52b8-5fdb-4805-820f-91f0f409af60","year":2018},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.318994Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:fe90e7c6c467d26332daacf8bff5fc0d205f814cba81c131733fda8f8279a7e4","observation_id":"56345b51-f593-4862-a5cb-43de0b875ad0","resolution":{"observed_at":"2026-08-12T12:14:38.126668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.106179Z","title":"Towards robust monocular depth estimation: Mixing datasets for zero-shot cross-dataset transfer","venue":null,"work_id":"2f2ea2d9-7000-40b6-bf6d-643c1ba5cef7","year":2020},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.324148Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:331377a40290c02d1e6f9ca2df6ce2a11aea3d14a3e1429a6e95cbd8859a5021","observation_id":"58f01b6d-5d36-4e97-b356-3dfe05b1eb7f","resolution":{"observed_at":"2026-08-12T12:14:38.110855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.092430Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":"7ec996af-7a73-46a4-977b-e9e5871d709b","year":2021},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.329589Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:52d5aeb52e1552ccb5689abecae0855ab34deab902dbadff83210d19e8a02214","observation_id":"d0727c5b-18b4-46f5-8ddb-3b02fe9bfb4f","resolution":{"observed_at":"2026-08-12T12:14:38.097037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.077984Z","title":"High-resolution image syn- 10 thesis with latent diffusion models","venue":null,"work_id":"cd44bd46-9cc4-47d3-974c-026d68a76dec","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.334824Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:83dc00446c70765712cc1f241862f3e56c9cca7cd004488457a845b577822df5","observation_id":"642d484a-e3a6-422e-b56d-f9d93ff3ae90","resolution":{"observed_at":"2026-08-12T12:14:38.082992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.062895Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"d24d7830-22ab-41ab-a3ed-8dc149dd28c4","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.339536Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:4d1913b0b9a36382fb04420754ba57a1d861f259e1b080a3cbf6c49b717821ca","observation_id":"70a0a757-fd4f-4c3d-800c-ae06459589c3","resolution":{"observed_at":"2026-08-12T12:14:38.067808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.047848Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"8b62fd10-2c1c-4785-b314-2fcd43fe30e7","year":2012},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.344417Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:91a8a7a0819cf720355ddcd709de467d68088161dc9ed9afe43746aa2b4c3921","observation_id":"8420dafa-910d-4d9f-8fdd-440981593642","resolution":{"observed_at":"2026-08-12T12:14:38.052348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.033050Z","title":"Sun rgb-d: A rgb-d scene understanding benchmark suite","venue":null,"work_id":"993065a3-5400-4560-865e-9709c2a9fbfa","year":2015},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.349397Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:ad64da878864a7157f9955eff56fef4f41d22377a498e7d852e9dda0b2945091","observation_id":"3a75e0da-93ec-4243-a33e-92f5ccbf0399","resolution":{"observed_at":"2026-08-12T12:14:38.038094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.017092Z","title":"Deconstructing self-supervised monocular recon- struction: The design decisions that matter","venue":null,"work_id":"22a3522c-dbc1-4f14-a592-e6739c03bbef","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.354184Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:d35c489f50d2c445272a5842679447b517e90ab74f4637e96d11cd549ae7c248","observation_id":"a71ed343-8f3f-4937-b514-abf62010ecc0","resolution":{"observed_at":"2026-08-12T12:14:38.022356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.002986Z","title":"An- alyzing results of depth estimation models with monocular criteria","venue":null,"work_id":"2b10915f-88ca-4ebb-926d-dcfe5f74b9c8","year":2023},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.358953Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:6e3ee3fda61a4e17b8d85325355d3735210de51f069c0fec58939e6059143e52","observation_id":"977ddd42-cd2b-4bd9-b987-b87907d6ba29","resolution":{"observed_at":"2026-08-12T12:14:38.007662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.988885Z","title":"Transformer based line segment classifier with image context for real-time vanishing point detection in man- hattan world","venue":null,"work_id":"bd683543-1664-45db-890d-cae1d809a9ac","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.363612Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:377b794ea7498dcba64a58510d0574f8fab3dd1df7758b502a94dff1877cd710","observation_id":"68c14ea1-2514-4fce-85b8-56781ee5803e","resolution":{"observed_at":"2026-08-12T12:14:37.993626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.973935Z","title":"Deit iii: Revenge of the vit","venue":null,"work_id":"9865b5ef-ef94-4931-a54f-c56106f0a7e9","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.368010Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:17e108a4dfa5f44e14c981dafe92e60c6deacd03a5d64a4790540e912696113d","observation_id":"b94e7e94-61ea-4de7-b42f-2b0e5808cb06","resolution":{"observed_at":"2026-08-12T12:14:37.978642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19115","last_updated":"2025-04-15T06:33:45Z","snapshot_observed_at":"2026-08-12T22:15:34.788779Z","submitted_at":"2024-10-24T19:29:02Z","title":"MoGe: Unlocking Accurate Monocular Geometry Estimation for Open-Domain Images with Optimal Training Supervision","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19115","snapshot_observed_at":"2026-08-12T12:14:37.372660Z","title":"Moge: Unlocking accurate monocular geometry estimation for open-domain images with optimal training supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.372660Z"},"links":{"cited_paper":"/paper/2410.19115","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:27a8d76f5a5a1210ada416a3b58ce05c7d92d59bbb75e46f6b7054895b4d1027","observation_id":"109d4f70-2336-4731-918c-90f36854a552","resolution":{"observed_at":"2026-08-12T12:14:37.372660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.958933Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":"4ed0b49c-1061-4fbe-a52f-67f8cb0c0f35","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.378283Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:d595545a7faae9b835f910e89936eef2b24740aa80d6746f602383d4a4ff8003","observation_id":"b84a3379-ac0d-44d9-95ae-66787f8f81b4","resolution":{"observed_at":"2026-08-12T12:14:37.964658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.945021Z","title":"Instance shadow detection","venue":null,"work_id":"c59bdd91-09d7-49df-91cf-1d60448f30f1","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.382987Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:358a06115fdca8fd87900472596b4460cec9d10fe15c6af691cc64c6d67e0866","observation_id":"7bcf84a2-baf3-4df7-ac03-780e5a1b4177","resolution":{"observed_at":"2026-08-12T12:14:37.949839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.930639Z","title":"Croco: Self-supervised pre-training for 3d vision tasks by cross-view completion","venue":null,"work_id":"4338a498-6592-4fc8-9585-68e2c6052ed9","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.388087Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:b908dc2118b01de5e62b65ddaeb2e49c72f43ba52eecff87fb98a8eedacf25dd","observation_id":"d6b851ef-17bd-4224-9543-a3d6384b3f58","resolution":{"observed_at":"2026-08-12T12:14:37.935851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.915266Z","title":"Pytorch image models","venue":null,"work_id":"4021c0ce-ae57-453e-8d0e-a3aca6a0e614","year":2019},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.392448Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:eedab417a849b9523ffd8b77bf29222c771fa4ef353ebcc76f3a3f9faf02ac3c","observation_id":"85cc3a59-9644-4806-a438-4a9559e9fa5c","resolution":{"observed_at":"2026-08-12T12:14:37.920580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.901618Z","title":null,"venue":null,"work_id":"cf575524-cf0a-47df-a006-b36d741553b1","year":2020},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.396730Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:7b57ab22de79621877753fa02cbafb458f8fb67c2484e52194377ec6f6d9e26d","observation_id":"85d10efb-ed2f-4e8a-8af0-b1074719d274","resolution":{"observed_at":"2026-08-12T12:14:37.906086Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.887285Z","title":"Horizon lines in the wild","venue":null,"work_id":"1d7d0809-82b6-44a9-a18b-be814488bf40","year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.401240Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:dca88bd79e1c5c3489bca2b29c3e2170f5843f0411b7272f0c43f881eac4d9ff","observation_id":"f5d8237b-40be-4a98-a31b-a29383f73991","resolution":{"observed_at":"2026-08-12T12:14:37.891873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.872768Z","title":"Aggregated residual transformations for deep neural networks","venue":null,"work_id":"fff4596c-47de-46c2-ab2d-36b4bbe3d254","year":2017},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.405604Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:cb007282ffd4f8c338a521486803b341963b4a6fdae776cfa34e4f234d2d1037","observation_id":"1d3078a7-b066-4bed-83fd-450f9289b519","resolution":{"observed_at":"2026-08-12T12:14:37.877626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.856285Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"c8966307-e9be-4c4e-bad0-68d2d2803971","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.410548Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:86c1f016bc3dfc66df0c31d38e83b49b9192d36bb73283db9147eb58d4e52ca5","observation_id":"b40228f4-dd74-4958-b195-a1070ab847a1","resolution":{"observed_at":"2026-08-12T12:14:37.861747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.840152Z","title":"Depth any- thing v2","venue":null,"work_id":"f2b82620-4551-481c-a856-0e63f46ba746","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.415157Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:19173759e35344f01a7799fe5031e6124ed6355ff7c9b95debc0fe1d6d42f7a7","observation_id":"c5c0224a-27cd-47bd-beba-ed2224fdbe9e","resolution":{"observed_at":"2026-08-12T12:14:37.845120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.824238Z","title":"Improving 2d feature representations by 3d-aware fine-tuning","venue":null,"work_id":"253388d7-4ef6-407c-ae54-26e2d8060581","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.419763Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:4f72def9bb1445398d84a91ce9c3bf0d701c4229608d463f0ad60f1a794a8ab1","observation_id":"f9a6c2f8-13d2-4a02-b34c-1b30b45ae9a0","resolution":{"observed_at":"2026-08-12T12:14:37.830086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.808636Z","title":"Detect- ing vanishing points using global image context in a non- manhattan world","venue":null,"work_id":"3bfda3a1-c3dc-49be-9b35-7863c918ea4b","year":2016},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.424680Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:b1febd9a39bb1d8d89bf8d70a6d4e7aed4ab0e1139763e7b84d32eb8f74329fc","observation_id":"e5a23698-e02c-4f3b-a5aa-1055203192f7","resolution":{"observed_at":"2026-08-12T12:14:37.813642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.792186Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"4388a8ff-c67c-498c-9412-d0773e487986","year":2023},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.429270Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:24d0a88e8491a4f05dd854b41de925c6f215eec226200ae1cf42121cdf697d77","observation_id":"12a6993b-794f-4b60-833c-a6bcdbd788d5","resolution":{"observed_at":"2026-08-12T12:14:37.797664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.775616Z","title":"A general protocol to probe large vision models for 3d physical understanding","venue":null,"work_id":"80609477-dc16-4963-8827-7dc6b2afc057","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.434334Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:d94357b1a1247b6c185b6d190c553ad985fd79f9e608b9b489b12e1ca2664af8","observation_id":"552dedff-1068-436f-943e-70a47c5fc1d9","resolution":{"observed_at":"2026-08-12T12:14:37.780759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.439454Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.439454Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:f991efb679daf32d5864be6d99c019a1ec16f5813972fddb06ea09c0662b67cf","observation_id":"0dab749c-87e5-4654-802c-aaedd28ac533","resolution":{"observed_at":"2026-08-12T12:14:37.439454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.749065Z","title":"ConDense: Consistent 2d/3d pre- training for dense and sparse features from multi-view im- ages","venue":null,"work_id":"8701d961-d0b6-40c7-b748-97eb5379c5b7","year":2024},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.444037Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:9d87cc0b35d8d5876931ae81c571fa95ebd73af0b17d77de13c80b544de7693e","observation_id":"e10e2a01-d775-4c25-97cd-a58e9682ed76","resolution":{"observed_at":"2026-08-12T12:14:37.753893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.733259Z","title":"ibot: Image bert pre-training with online tokenizer","venue":null,"work_id":"3575b444-ebc3-4a1b-82ab-3e7d9e44caed","year":2022},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.448381Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:254f86961f3abdd4af9220a2f9f07b2cd2edb19c2e7558b6096766b8b72f6fdb","observation_id":"a831ba42-f4cb-4e24-ab3a-182f7426ccec","resolution":{"observed_at":"2026-08-12T12:14:37.738798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.717483Z","title":"Unsupervised learning of depth and ego-motion from video","venue":null,"work_id":"879e4e3c-18c7-4577-b323-eef921be41e2","year":2017},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.452964Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:0faa3bcaa6c37c59090724b47cbfd1af6872ab464d3df8463087f25ccba88df9","observation_id":"0be2abc9-6888-4d96-b121-21f04dd9b053","resolution":{"observed_at":"2026-08-12T12:14:37.722385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.701808Z","title":"Detect- ing dominant vanishing points in natural scenes with appli- cation to composition-sensitive image retrieval.Transactions on Multimedia, 2017","venue":null,"work_id":"316799ce-70b8-45e8-9429-0a638aecbabf","year":2017},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.457408Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:c97bab0897e2490846c66dae8b804a2bb7b4b8e3737c41f7f290ef100678718a","observation_id":"63aed1ab-7625-404f-81b4-f1823724e00f","resolution":{"observed_at":"2026-08-12T12:14:37.707043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18125","last_updated":"2025-04-27T06:50:23Z","snapshot_observed_at":"2026-08-12T22:36:38.589325Z","submitted_at":"2024-09-26T17:59:11Z","title":"LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18125","snapshot_observed_at":"2026-08-12T12:14:37.463309Z","title":"LLaV A-3D: A simple yet effective pathway to empowering LMMs with 3d-awareness","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.463309Z"},"links":{"cited_paper":"/paper/2409.18125","citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:2b2c7a424f1387247eb587ce64afaa4a69d058c93879cb7601e6d859eb1cb345","observation_id":"5665a978-8a58-45e4-b63a-a3a5dbf64faa","resolution":{"observed_at":"2026-08-12T12:14:37.463309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.686580Z","title":"Semantic amodal segmentation","venue":null,"work_id":"bbf525e9-a687-40dd-80fd-97ec0b4497ed","year":2017},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.468786Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:90053c38d4ca96cc8b32fe0a823f893499697fd7aaf412170c5199d3e0c78c88","observation_id":"b91b9e6f-14f0-46c5-a8a2-c58505ea7000","resolution":{"observed_at":"2026-08-12T12:14:37.691281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:37.670392Z","title":"patch size-14","venue":null,"work_id":"d164636b-d122-4551-a9d9-411fe832f5d0","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.473052Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:21d39bc20ca29b08d1f7c79ebd784295418e0e2d4a1bf90522f021581dd1a645","observation_id":"9867cbe0-7f86-43b2-9cd9-f6401bf14d3b","resolution":{"observed_at":"2026-08-12T12:14:37.676162Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:14:38.630587Z","title":null,"venue":null,"work_id":"0517d783-f624-4523-be6b-e26aa5c74846","year":null},"citing_paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T12:14:37.120825Z"},"links":{"citing_paper":"/paper/2411.17385"},"observation_digest":"sha256:d4545f8fef61d6174b0b43c5fd81fdfd1c9f2f2945da1a54a767739eca001e1e","observation_id":"adbc3f6b-10eb-4a6d-8f0d-39cdee3f5c11","resolution":{"observed_at":"2026-08-12T12:14:38.635686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.17385","last_updated":"2025-03-19T11:00:12Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T12:07:42.064751Z","submitted_at":"2024-11-26T12:44:17Z","title":"DepthCues: Evaluating Monocular Depth Perception in Large Vision Models"},"reference_resolution":{"displayed":93,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":2,"verified_fuzzy":61},"total_outbound_references":93},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 93 of 93 outbound references and 0 inbound Pith citation observations for arXiv:2411.17385."}