{"as_of":"2026-08-17T15:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2b0f3aec698dde780698580e0ae93f33c91b89c055932e09d1335b9e419a9b10","coverage":[{"denominator":103,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T17:26:22.572375Z","state":"measured"},{"denominator":104,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":104,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:13:38.624015Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T23:14:01.779436Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09072","snapshot_observed_at":"2026-08-15T19:13:38.624015Z","title":"Cross-view completion models are zero-shot correspondence estimators.arXiv preprint arXiv:2412.09072, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17220","last_updated":"2025-06-23T02:14:32Z","snapshot_observed_at":"2026-08-16T13:42:56.567515Z","submitted_at":"2025-06-20T17:59:55Z","title":"Emergent Temporal Correspondences from Video Diffusion Transformers","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T19:13:38.624015Z"},"links":{"cited_paper":"/paper/2412.09072","citing_paper":"/paper/2506.17220"},"observation_digest":"sha256:0f2205564905adddbd8d955a20ec3e36781ea128fec2e814a2acc85597a58687","observation_id":"720025fd-2594-439a-b772-c81b13b132b4","resolution":{"observed_at":"2026-08-15T19:13:38.624015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"cited_work":{"arxiv_id":"2412.09072","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09072","snapshot_observed_at":"2026-06-29T23:14:01.779436Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators, December 2024","venue":null,"work_id":"1b5feeac-d1ba-40fc-b2af-03fce6a3e07e","year":2024},"citing_paper":{"arxiv_id":"2509.26645","last_updated":"2026-03-03T12:58:09Z","snapshot_observed_at":"2026-08-08T05:03:09.924311Z","submitted_at":"2025-09-30T17:59:51Z","title":"TTT3R: 3D Reconstruction as Test-Time Training","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-17T06:41:16.306593Z"},"links":{"cited_paper":"/paper/2412.09072","citing_paper":"/paper/2509.26645"},"observation_digest":"sha256:c4602da88c4ee6701608e4697dd39609c5f6ae8589771bb9727b52a0f14dc71c","observation_id":"793d6e31-3cfb-4f99-abc5-10f3afd64398","resolution":{"observed_at":"2026-05-17T06:41:16.480288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"cited_work":{"arxiv_id":"2412.09072","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09072","snapshot_observed_at":"2026-06-29T23:14:01.779436Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators, December 2024","venue":null,"work_id":"1b5feeac-d1ba-40fc-b2af-03fce6a3e07e","year":2024},"citing_paper":{"arxiv_id":"2605.22190","last_updated":"2026-05-21T08:57:21Z","snapshot_observed_at":"2026-07-06T23:32:35.159280Z","submitted_at":"2026-05-21T08:57:21Z","title":"No Pose, No Problem in 4D: Feed-Forward Dynamic Gaussians from Unposed Multi-View Videos","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T06:27:21.559658Z"},"links":{"cited_paper":"/paper/2412.09072","citing_paper":"/paper/2605.22190"},"observation_digest":"sha256:49e3ac0dd8aa46deb522b770258ea7d69ea69da49e98b37120aede5b2148b28c","observation_id":"125283ca-d290-4258-8a41-986dd796b577","resolution":{"observed_at":"2026-05-22T06:31:10.218383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"cited_work":{"arxiv_id":"2412.09072","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09072","snapshot_observed_at":"2026-06-29T23:14:01.779436Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators, December 2024","venue":null,"work_id":"1b5feeac-d1ba-40fc-b2af-03fce6a3e07e","year":2024},"citing_paper":{"arxiv_id":"2605.26230","last_updated":"2026-05-25T18:01:05Z","snapshot_observed_at":"2026-08-15T16:53:28.323305Z","submitted_at":"2026-05-25T18:01:05Z","title":"Geometry-Aware Representation Denoising for Robust Multi-view 3D Reconstruction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T23:08:52.333329Z"},"links":{"cited_paper":"/paper/2412.09072","citing_paper":"/paper/2605.26230"},"observation_digest":"sha256:4bca3e11509152a95ce06cee4fa4ea944f63c529e056a6c861583b1368490525","observation_id":"bfdd6d7f-ab69-4285-8540-5a3514cb442c","resolution":{"observed_at":"2026-06-29T23:14:01.780879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.09072/citation-record","integrity":"/paper/2412.09072/integrity","json":"/paper/2412.09072/citation-record.json","paper":"/paper/2412.09072"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.183047Z","title":"Multimae: Multi-modal multi-task masked autoencoders","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.183047Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:d7ab15593c54c089700aed9411ae2c95f573ceac6683245b363844a9c6606f96","observation_id":"0a278511-167a-4492-8a3b-c03efbf24fee","resolution":{"observed_at":"2026-08-11T17:26:22.183047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.190642Z","title":"Multi-view depth estimation by fusing single-view depth probability with multi-view geometry","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.190642Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:8475e99ba3326e07ea32a63f227b5c62809cdccbd9fdecaa826a319902e56ade","observation_id":"e13609e6-28ff-4d33-a739-49868178c996","resolution":{"observed_at":"2026-08-11T17:26:22.190642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.194805Z","title":"Hpatches: A benchmark and evaluation of handcrafted and learned local descriptors","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.194805Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:4aa4beba75b014b3de8b2cd1a1713856ec9f5bc13dda22b2a938b8d9f9661c57","observation_id":"44ff660a-72b7-4820-bcc5-448ffac78af2","resolution":{"observed_at":"2026-08-11T17:26:22.194805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.198690Z","title":"Dualrefine: Self-supervised depth and pose estima- tion through iterative epipolar sampling and refinement to- ward equilibrium","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.198690Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:25c0194ab3962415b115a1ea054aba92cf7a94a8682c16111e311edbdfc7dfde","observation_id":"ebec7e63-d5a5-4a7f-9236-c9d814698bff","resolution":{"observed_at":"2026-08-11T17:26:22.198690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.203198Z","title":"Beit: Bert pre- training of image transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.203198Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:3cd8ba691ffa5d670ac4fab2b3e590e90c0aca693aead531e006a1a5be44744a","observation_id":"40b7943d-66e3-40be-859a-d012eac8273d","resolution":{"observed_at":"2026-08-11T17:26:22.203198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.207325Z","title":"Unsupervised learn- ing of visual features by contrasting cluster assignments","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.207325Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:e9164cbf0a3f3dceff59936ad5587fb3e4c69e8e1d7ad0da5b0c033fb034b0c9","observation_id":"a306bf00-8351-4ebf-a368-4f7d50e9e81b","resolution":{"observed_at":"2026-08-11T17:26:22.207325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.211287Z","title":"Unsupervised monocular depth and ego-motion learning with structure and semantics","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.211287Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:69de003a22739032535a2994464daa25f69dfb2040dba9ddd630a85f42135419","observation_id":"c4ccf75b-84bd-474a-9168-3deb3b6d8f2f","resolution":{"observed_at":"2026-08-11T17:26:22.211287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.215153Z","title":"Adaptive fusion of single-view and multi-view depth for autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.215153Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:53a40b71bfb20422f73478fd140b6db150f3d271d32eb83235b071f254db2cb2","observation_id":"fb3251d3-9b5a-4595-be1c-680e12830fbf","resolution":{"observed_at":"2026-08-11T17:26:22.215153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.219384Z","title":"Cats: Cost aggregation transformers for visual correspondence","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.219384Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:f09e058f0fdf0a8e0c94d73826e6b74e7d5c1eea10a71fd29101762f29e46722","observation_id":"c1c8bfb6-2396-4986-b2cf-90b15c57cddf","resolution":{"observed_at":"2026-08-11T17:26:22.219384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.223254Z","title":"Cats++: Boosting cost aggregation with convolutions and transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.223254Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:492a0617746b4b0ce8274e8dca81a7c904f40e65ccd20759088006c58faa2eb4","observation_id":"aea1e8e9-1f92-4a44-94fb-dd77372437ac","resolution":{"observed_at":"2026-08-11T17:26:22.223254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.227052Z","title":"Cat- seg: Cost aggregation for open-vocabulary semantic seg- mentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.227052Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:54b9ee3304bde773e0ef0e0f6193862d47803251c4f8ef6ce8e67193c90c27fe","observation_id":"d69305c4-a786-4bd0-b141-901bcb7e590b","resolution":{"observed_at":"2026-08-11T17:26:22.227052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.231199Z","title":"Emerging property of masked token for effective pre-training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.231199Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:5205959a36d073ec2d8da79e4eda35aaaeca279a9a9f3bb95f19087c1cd417d5","observation_id":"e61697df-5275-43cf-8d61-ddbbd1906d6d","resolution":{"observed_at":"2026-08-11T17:26:22.231199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.235014Z","title":"Salience-based adaptive masking: re- visiting token dynamics for enhanced pre-training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.235014Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:7173d0841eb6b768e42356ba911de7e18e73e356e5eb06fd520ce698d40f6055","observation_id":"61ba3a4e-3904-4972-b89f-ee177336d404","resolution":{"observed_at":"2026-08-11T17:26:22.235014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.238534Z","title":"The cityscapes dataset for semantic urban scene understanding","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.238534Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:fb87ce1cf5ed3c8385926679e7bc7841015f209c42c352b2114dce7c5ad30324","observation_id":"637a174d-48a6-4207-ac98-fa87268e1bb8","resolution":{"observed_at":"2026-08-11T17:26:22.238534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16588","last_updated":"2024-04-12T09:38:33Z","snapshot_observed_at":"2026-08-07T09:40:32.614733Z","submitted_at":"2023-09-28T16:45:46Z","title":"Vision Transformers Need Registers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16588","snapshot_observed_at":"2026-08-11T17:26:22.242171Z","title":"Vision transformers need registers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.242171Z"},"links":{"cited_paper":"/paper/2309.16588","citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:be0fcf7c3987708557645e2b76b1b8c9ab16252fcd4e7c10414602d1c288fc4d","observation_id":"698c7939-5f6f-4765-a3d8-65ad396dc386","resolution":{"observed_at":"2026-08-11T17:26:22.242171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-11T17:26:22.246368Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.246368Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:26682609a538828aefbd909ca6e127b38f3b7df9e1428219db6895fe34aabad8","observation_id":"5750c8b5-f27e-4950-9a20-8e7724a0eca9","resolution":{"observed_at":"2026-08-11T17:26:22.246368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-11T17:26:22.249980Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.249980Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:1aedeb89dadb94f2cb4b2ab17c16eeb38292efaa5aa83f783014d3b0ba35eb87","observation_id":"7f0c2a43-6964-4804-8eb9-0f5a0286a0e8","resolution":{"observed_at":"2026-08-11T17:26:22.249980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.254552Z","title":"Dkm: Dense kernelized feature matching for geometry estimation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.254552Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:757ee62e2b95cef2867067df67fb5801f37e901e6165c3babfea4d8f2544f6ee","observation_id":"6af82e26-79a9-4ebe-ad8a-2757c4fc90bd","resolution":{"observed_at":"2026-08-11T17:26:22.254552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.258360Z","title":"Roma: Robust dense feature matching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.258360Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:b535516d287bb9fe54e10bb808998e9483490cbf12103637df5a4d981313b869","observation_id":"33ecf33d-4b03-4d18-b777-9dcbabb00b10","resolution":{"observed_at":"2026-08-11T17:26:22.258360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.261949Z","title":"Predicting depth, surface nor- mals and semantic labels with a common multi-scale con- volutional architecture","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.261949Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:5cd10bf307e36c861d3ee3497f1dc38b1891fa0d320add745d9820770560f7bd","observation_id":"ebb91a23-487a-44a8-9a36-49b55ff68040","resolution":{"observed_at":"2026-08-11T17:26:22.261949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.265716Z","title":"Probing the 3d awareness of visual foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.265716Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:23d144c052a6b5a2691c0764dfc4fcdab552f4e6618f486f32451d6a984d839b","observation_id":"4ac7fb32-0f4c-450b-9297-38f2727442ec","resolution":{"observed_at":"2026-08-11T17:26:22.265716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.270028Z","title":"Single-view and multi-view depth fusion","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.270028Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:99c8d7e910cc122b08e57a996667d7d1f89ff0d01f2f253336f539f313904fa9","observation_id":"bb1c2ac9-8252-4c2e-8f50-b581824df2a5","resolution":{"observed_at":"2026-08-11T17:26:22.270028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03382","last_updated":"2023-03-16T05:58:10Z","snapshot_observed_at":"2026-08-16T17:23:03.058020Z","submitted_at":"2022-02-07T17:59:04Z","title":"Corrupted Image Modeling for Self-Supervised Visual Pre-Training","version":2},"cited_work":{"arxiv_id":"2202.03382","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.03382","snapshot_observed_at":"2026-08-11T17:26:22.642980Z","title":"Corrupted Image Modeling for Self-Supervised Visual Pre-Training","venue":"cs.CV","work_id":"ca3c4ae7-3c8e-44d9-aef7-7c51f5de8012","year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.273689Z"},"links":{"cited_paper":"/paper/2202.03382","citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:1b00f12254ed8814aa13e01b52fa6229c4216d6484cf6add120b409af0c94404","observation_id":"93311a26-a4e7-4e66-b674-c2903da98d2c","resolution":{"observed_at":"2026-08-11T17:26:22.649221Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.278239Z","title":"Disentangling object motion and occlusion for unsupervised multi-frame monocular depth","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.278239Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:4f488859a05a18a2d51fd5c6906f23ab99f4358900745775905da6e7dbc9dc1e","observation_id":"9ba6b1f7-88bb-4ac3-8ffe-ed00a835a2dc","resolution":{"observed_at":"2026-08-11T17:26:22.278239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.286957Z","title":"Vision meets robotics: The kitti dataset.The Inter- national Journal of Robotics Research, 32(11):1231–1237,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.286957Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:7765e48c8b8fa9e5bc53c07a1c6ac56a2db07d59fb91ba11cb748e54e3f461db","observation_id":"70cadec9-abe5-4f84-be21-aa3e91f6d8dc","resolution":{"observed_at":"2026-08-11T17:26:22.286957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.429620Z","title":"Unsupervised monocular depth estimation with left- right consistency","venue":null,"work_id":"1662ee05-2c83-4615-883b-1335b17d6b6c","year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.296249Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:e9a1bb6907915f3180e925d64cc23f7e05401919a7f503e461f64dbc78c55e27","observation_id":"b5cef6a7-d87c-4478-9bdc-3c4951dd6646","resolution":{"observed_at":"2026-08-11T17:26:23.433748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.418833Z","title":"Digging into self-supervised monocular 10 depth estimation","venue":null,"work_id":"a32bb1df-b56c-4ea5-8081-de2af2f3a715","year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.300074Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:b7f72cfacdcf21f148a3c1370912fc9aedd32339b8ea563d4d691712855ae860","observation_id":"e7cbbc60-a5eb-49af-a682-c6c6559b6464","resolution":{"observed_at":"2026-08-11T17:26:23.423045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.395875Z","title":"Depth from videos in the wild: Unsupervised monocular depth learning from unknown cameras","venue":null,"work_id":"fdeaa8c8-05bf-4147-a27a-c0dc47a7135a","year":2019},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.307647Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:14e12c8246275dac688189d931fea25d26104a6031d5647eeb66ed6281abba78","observation_id":"1b7d05a7-ff36-41c4-b87d-891f4b265fb8","resolution":{"observed_at":"2026-08-11T17:26:23.400042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.384330Z","title":"Bootstrap your own latent-a new approach to self-supervised learning","venue":null,"work_id":"3e482e63-c056-4fef-8003-0765cf2e4017","year":2020},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.311343Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:42fac58b3ee5b3c57361978f6e3ebbaaab693aee8e12b0c15ca0176a222a5d8b","observation_id":"4f6181ce-7d1d-48c2-90f8-5b28aaced9ba","resolution":{"observed_at":"2026-08-11T17:26:23.388219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.372967Z","title":"3d packing for self-supervised monocular depth estimation","venue":null,"work_id":"e5919001-a6a1-4d3d-8b86-2a7cb1d48d6b","year":2020},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.315431Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:c96683282b4d994cd14db4755492748934e2a699f44a673e4fc524f96133bfff","observation_id":"29f32d1d-2fc5-4c56-88a0-d57eaddd003d","resolution":{"observed_at":"2026-08-11T17:26:23.376842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.361718Z","title":"Geometric unsupervised domain adaptation for semantic segmentation","venue":null,"work_id":"1f5c2ffa-0e7c-43d1-a9db-de99882f1603","year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.319018Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:159da1c14a37614078fa2740a8dfed0f24fd1a57df7d94cd803ea373fa757470","observation_id":"b6527152-a654-4da5-b99b-bc67a005a38a","resolution":{"observed_at":"2026-08-11T17:26:23.365537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.350720Z","title":"Multi-frame self-supervised depth with transformers","venue":null,"work_id":"46880019-5ae6-41f9-9632-b6f85fdd7f84","year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.322755Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:039fef9b3460ec6b95db8fc8c8114312e47a0d0663c10b9dcb638699f316638b","observation_id":"bc924880-fba1-42d7-a2a3-b8d3f3f0d043","resolution":{"observed_at":"2026-08-11T17:26:23.354352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.340288Z","title":"Siamese masked autoencoders","venue":null,"work_id":"a270b31e-20a7-4a96-af23-38362b5ad18e","year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.326516Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:3df93c7b0ad71a51130f6a4a381f59458e98a46d4275efcdb914efe5b5101eef","observation_id":"54a9a9f2-8eaa-4029-940c-9b3c944d6cd1","resolution":{"observed_at":"2026-08-11T17:26:23.343845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.328728Z","title":"Few-shot object de- tection with foundation models","venue":null,"work_id":"5972dbdb-8445-4866-82da-6a5efe077498","year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.330201Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:646dd2319432047e82e0b4d7d87432fa01074e3cac125625d5b6e857fa6d1185","observation_id":"35b9cb3f-ce3b-45bd-923d-8608382ef6fc","resolution":{"observed_at":"2026-08-11T17:26:23.332965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.333669Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.333669Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:4a9df11400b1a3d3fd0b1cb71f6f75d86603bbf88b078866a6db0b587c329251","observation_id":"c8d5dc32-dbc0-4e21-8bfb-5178025f9992","resolution":{"observed_at":"2026-08-11T17:26:22.333669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.337896Z","title":"Momentum contrast for unsupervised visual rep- resentation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.337896Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:d2c0e689c1340ea01725cfb0487a7714737a43e79ad2e01c36538ee508fe0ae9","observation_id":"adf0f4d1-fd56-4cda-9548-319eb0526e05","resolution":{"observed_at":"2026-08-11T17:26:22.337896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.305328Z","title":"Masked autoencoders are scal- able vision learners","venue":null,"work_id":"b8008370-0b75-42ea-b8c5-a16a1d969433","year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.341442Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:44e52ae3488ae1fdc1157d001cbe0e58ee5d642c66e5433fb463154c622bf267","observation_id":"a8a4dd4e-ce02-4893-a9f7-22c25d3b453c","resolution":{"observed_at":"2026-08-11T17:26:23.308935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.295080Z","title":"Ra-depth: Resolution adaptive self-supervised monocular depth estimation","venue":null,"work_id":"e1ff96fa-cc5c-4c57-8a7c-6b8efaf04ddb","year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.345089Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:9ab54de5e36d119a2f9e9ffcea4d45ddcf6b9a84bcc3f7f090cf779fcf5a21ed","observation_id":"bb705f49-4a13-4937-9d64-26a5df762225","resolution":{"observed_at":"2026-08-11T17:26:23.298769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.284270Z","title":"Stereo processing by semiglobal matching and mutual information","venue":null,"work_id":"f11482a8-0089-4933-8487-3a2ab4130db4","year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.348807Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:246b4ec9c39bd7ab02b3b6c45b9a4970d323dd0630ffe4ee5714d8eb13a55fb5","observation_id":"e6ec740e-41e1-40a6-b503-996accc0760f","resolution":{"observed_at":"2026-08-11T17:26:23.288460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.273457Z","title":"Deep matching prior: Test-time optimization for dense correspondence","venue":null,"work_id":"6774d1c2-fb2e-4f10-890a-8e6967fa9f99","year":2021},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.352857Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:8ff98cca3fc362dde7ec81c5a4553cdf3c3cddd7e944a8e57e4429dda56ca810","observation_id":"a6a34b6a-9e23-4aae-8499-58940ae2a2b2","resolution":{"observed_at":"2026-08-11T17:26:23.277236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.262685Z","title":"Cost aggregation with 4d convolutional swin transformer for few-shot segmentation","venue":null,"work_id":"8ab31981-c56e-4f3f-acaf-727b076d12b4","year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.356296Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:3e366e157da11cfe4a1f13a981c9da3b156ec84e0543629fea9a7a8d5df1abac","observation_id":"4cf293ca-97c7-4a89-9990-fe7b3859e29b","resolution":{"observed_at":"2026-08-11T17:26:23.266856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.251969Z","title":"Neural matching fields: Implicit representation of matching fields for visual correspondence","venue":null,"work_id":"94e8616d-511a-4ec8-b9e9-89fb06d02549","year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.359996Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:6501a987e2d6e845a5e0cb44fec9da4130f2428218be0fb24cc85efdf59f6e99","observation_id":"7f71e6d9-d651-453a-a1b8-31eba43cc491","resolution":{"observed_at":"2026-08-11T17:26:23.255945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.241454Z","title":"Unifying feature and cost aggregation with transformers for semantic and visual correspondence","venue":null,"work_id":"5e89feb8-3e71-4905-80ea-a23beb39dba7","year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.363540Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:2307b5f3afea6e3f8ca1629055f53abd0a1fad0ebbf1a088a7a85944384a2768","observation_id":"ca0775a4-17cb-4295-bdf2-8ba02ecd7a17","resolution":{"observed_at":"2026-08-11T17:26:23.245199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.231258Z","title":"Self-supervised monocular trained depth estimation using self-attention and discrete disparity volume","venue":null,"work_id":"1e1fb075-5f8f-45fd-bd4a-bbe9899ceb39","year":2020},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.367772Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:8fc3f9a134a14023c628065b0529219c475060abf29ab36dfb04122b78a0a981","observation_id":"bc839408-9882-42c4-979a-8239352c5d9f","resolution":{"observed_at":"2026-08-11T17:26:23.234953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.220700Z","title":"Barron, Ariel Gordon, Kurt Konolige, and Anelia Angelova","venue":null,"work_id":"e46032a6-3998-4334-a9a0-1e36abb89fc3","year":2020},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.371270Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:6381969e5e9ebb30b939c0643994d0891ac2d070aa304e319738c3b27284e71e","observation_id":"db9d2a30-1159-4252-ac01-011c7e28476f","resolution":{"observed_at":"2026-08-11T17:26:23.224348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.210454Z","title":"Re- purposing diffusion-based image generators for monocular depth estimation","venue":null,"work_id":"ab3b89fa-22b8-430d-8801-2001087f002e","year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.374610Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:dfcd4965a430c2a6a23a9e9c32fda8424d0c8bd0b92f77609f887661bda51c9e","observation_id":"8db5b47b-3e53-4dd8-a8de-bc90cfd05f4f","resolution":{"observed_at":"2026-08-11T17:26:23.214011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.200491Z","title":"Recurrent transformer net- works for semantic correspondence","venue":null,"work_id":"f8cb43ea-d1b0-405d-a75d-c7a73be1544b","year":2018},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.378264Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:632c8999e80c423c67761da28602d274cb14e20cbdb50f16773c12ccf38c9204","observation_id":"8360aff0-3df1-4f15-be12-b4f7ac8b0299","resolution":{"observed_at":"2026-08-11T17:26:23.204069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T17:26:22.382913Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.382913Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:d7ca8c59a6e5b5a07b54125bdfd429f2c8c3c4b03df37a588dd7590b9f4e9164","observation_id":"dbef4299-76b3-476c-8098-95859f58fe2c","resolution":{"observed_at":"2026-08-11T17:26:22.382913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.190565Z","title":"Cottereau, and Wei Tsang Ooi","venue":null,"work_id":"f5f04588-024f-4e9e-b1b6-35b86090e60c","year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.386506Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:1e9c3585b386ce74c3ba6867f47335bdb62372b7cb9d52ff121b47939249f435","observation_id":"9e60236b-298e-40b3-ad43-af37f1101d8f","resolution":{"observed_at":"2026-08-11T17:26:23.194003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.180581Z","title":"Sfnet: Learning object-aware semantic correspon- dence","venue":null,"work_id":"1621faa7-275d-4ced-a3ac-00532a4fe7e2","year":2019},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.389732Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:7e479f2a961f569a9ced2efbc9f935cbd328e398033c576184f1971379f3d15c","observation_id":"8256a336-a18c-4c9e-964b-a1512e0d2945","resolution":{"observed_at":"2026-08-11T17:26:23.184256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09756","last_updated":"2024-06-14T06:46:30Z","snapshot_observed_at":"2026-08-16T13:43:05.357000Z","submitted_at":"2024-06-14T06:46:30Z","title":"Grounding Image Matching in 3D with MASt3R","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09756","snapshot_observed_at":"2026-08-11T17:26:22.393179Z","title":"Grounding image matching in 3d with mast3r","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.393179Z"},"links":{"cited_paper":"/paper/2406.09756","citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:61d77b72af9e755546cc5a36b7c281bfbd0a5b16ede3299c03d9b05103008074","observation_id":"6c1665bb-cf59-4e64-bd1c-b3c15adcf5b4","resolution":{"observed_at":"2026-08-11T17:26:22.393179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.170797Z","title":"Unsupervised monocular depth learn- ing in dynamic scenes","venue":null,"work_id":"4ab76f70-f78a-4370-a9d6-9722259cb56d","year":1908},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.397032Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:ea8a13c06682c37d28297b6d13bbbe83e8b274d260e637659d16fa0d3ba2309b","observation_id":"7c5efdd4-3a1b-46ee-98ef-6867ca1789c3","resolution":{"observed_at":"2026-08-11T17:26:23.174565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.160716Z","title":"Learning to fuse monocular and multi-view cues for multi- frame depth estimation in dynamic scenes","venue":null,"work_id":"e826df78-a28e-4e07-bbfc-0e498ed0c1c6","year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.400579Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:bc5321c30f015b5c25442b17ee7c6009b1d66dddd061f74f60dc62472557c301","observation_id":"43ab95c4-8edb-479d-9954-be8230f0ef8e","resolution":{"observed_at":"2026-08-11T17:26:23.164419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.150441Z","title":"Megadepth: Learning single-view depth prediction from internet photos","venue":null,"work_id":"d2132228-eb08-49ea-a2ba-13a9238969fd","year":2018},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.404214Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:fcc94525330096f5a51bae6f1c851a67e721985616b07284522f80b9d552f76d","observation_id":"116990f6-919b-449b-8a63-8eb56a212ff0","resolution":{"observed_at":"2026-08-11T17:26:23.154061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.140467Z","title":"Self- low: Self-supervised learning of optical flow","venue":null,"work_id":"ac3508c9-61a6-4f76-8fc7-0847785567da","year":2019},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.407691Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:14957476572fe1a224269dfe93c1a1f3e0174613d4b584ce6d768da89b0244c7","observation_id":"e30033df-043a-449b-ae8a-b29b63f80c20","resolution":{"observed_at":"2026-08-11T17:26:23.144006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.130126Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"1dbfe25d-ba82-4912-80a6-c60d18e4dbed","year":2021},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.411325Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:31b0eeb0c9c4a1ba78a9af2a8a8b1b02e4feeb914c805fd133702238138debf0","observation_id":"6ae2e18f-22d7-4c24-9a2b-7a1207bcf841","resolution":{"observed_at":"2026-08-11T17:26:23.133711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.120295Z","title":"Flowdiffuser: Advancing optical flow estimation with diffusion models","venue":null,"work_id":"345ba4ef-788d-49d4-8958-32bb29bacacb","year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.415007Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:c89903b0d649a6ede34b5bf8a5d4f2c18891f3d13264033d99b8bf4b601a586c","observation_id":"f20fe20b-0b34-4949-b8e4-ce1847113a07","resolution":{"observed_at":"2026-08-11T17:26:23.123768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.108475Z","title":"Unflow: Un- supervised learning of optical flow with a bidirectional cen- sus loss","venue":null,"work_id":"d82c73f4-8370-4907-855d-eb48e72bb6c4","year":2018},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.418466Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:5940d0eb45f0fc0142cccfb673059cd39a69fbdffb800cf64d4f521fb3876eb5","observation_id":"384962cc-366c-4b41-89a1-8a768ff4bb87","resolution":{"observed_at":"2026-08-11T17:26:23.112400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.098036Z","title":"Dgc-net: Dense geometric correspondence network","venue":null,"work_id":"d40c2ac7-8a49-4b96-965b-ffb6318fa38a","year":2019},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.421990Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:9753dd555e2a4d70eff00c63f9b464455cba930011f61e22308e03fb06a81564","observation_id":"f87b6dc8-902a-4c88-94e1-a4249c2272dc","resolution":{"observed_at":"2026-08-11T17:26:23.101637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.086925Z","title":"Hypercorrela- tion squeeze for few-shot segmentation","venue":null,"work_id":"7e1f3cef-169b-4fc7-a8a9-f5a12638a107","year":2021},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.425386Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:a2bde7abffcde5a31d81b09781c9c348babb58a633ec1da922343869cd30895b","observation_id":"f86e295d-750b-437e-8f76-eb99f0f5144d","resolution":{"observed_at":"2026-08-11T17:26:23.090974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.076006Z","title":"Efficientps: Efficient panoptic segmentation","venue":null,"work_id":"2201d2af-f539-4fb4-9ebb-7a54e5011095","year":2021},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.428829Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:4507020af640513cb3b6d3c1ba9be527cecb96b28ac939c4a89a34b9480306d0","observation_id":"768f6d8a-7179-4f32-a1cc-527cd4006e4f","resolution":{"observed_at":"2026-08-11T17:26:23.079918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19094","last_updated":"2024-01-25T07:10:41Z","snapshot_observed_at":"2026-08-16T15:28:17.651716Z","submitted_at":"2023-05-30T14:58:24Z","title":"Diffusion Model for Dense Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19094","snapshot_observed_at":"2026-08-11T17:26:22.432059Z","title":"Diffusion model for dense matching","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.432059Z"},"links":{"cited_paper":"/paper/2305.19094","citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:1dee09315dad09b00ec4f1b5042325b154321764736b053fa1ccbfac802a2351","observation_id":"6815345d-1feb-4720-8d19-e998907b5e03","resolution":{"observed_at":"2026-08-11T17:26:22.432059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.065424Z","title":null,"venue":null,"work_id":"113b65e6-8ff3-4395-be83-a92a6a443772","year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.435734Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:569029d2cfecb05dd3d5341342ed60e5f9ad792654fa9a25aabed724549244b5","observation_id":"585be47b-76c1-4404-a83e-f1c2dffc484d","resolution":{"observed_at":"2026-08-11T17:26:23.068962Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.054904Z","title":"Automatic differentiation in pytorch","venue":null,"work_id":"8222d25c-b71a-4439-98c0-a840c4007a6a","year":2017},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.439499Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:59c5b1f837ca57b3f254236878d295406ecfe4b30a157bc6638545463ccdf4a4","observation_id":"73a43ba4-3899-4b14-8fb8-f2fbac38920e","resolution":{"observed_at":"2026-08-11T17:26:23.058525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.442886Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.442886Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:844983c7c8f3cbf0850e77abdcb13caf4b835b80cd5387a50f33105aa789f957","observation_id":"a0f16e01-6705-4a6f-b951-bb6191cbee99","resolution":{"observed_at":"2026-08-11T17:26:22.442886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.037653Z","title":"Context encoders: Feature learning by inpainting","venue":null,"work_id":"d42684f4-72e8-4102-95df-1946e454d6c9","year":2016},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.446515Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:89063483c5b33f87f0e5c5940548fc62e6b58bd004183868a0d26ede6002dd51","observation_id":"fb037e9b-e1e9-4a5c-acd4-33641c652634","resolution":{"observed_at":"2026-08-11T17:26:23.041478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.026066Z","title":"Don’t forget the past: Recurrent depth esti- mation from monocular video","venue":null,"work_id":"12c740c8-1e1f-47f5-ac57-a7619b1feed8","year":2020},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.450102Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:1e615b9f0df0856bf69790edf1b105291eef0a17a468ee443a6c0bbf3328fc7d","observation_id":"74915db1-cee7-4418-bcf8-31070ac2e815","resolution":{"observed_at":"2026-08-11T17:26:23.030207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.014637Z","title":"Unidepth: Universal monocular metric depth estimation","venue":null,"work_id":"305c40e8-9a4e-4fe3-a798-2ce9b14299b4","year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.453812Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:cb040ee908563145d664f82ca9f5532d63d8497c86d2bc86c618b2109e368534","observation_id":"b59676a7-eab2-4598-956e-3301c2d627c8","resolution":{"observed_at":"2026-08-11T17:26:23.018469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-17T10:09:03.767186Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-11T17:26:22.457490Z","title":"Movie gen: A cast of media foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.457490Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:c4c13d3de57d0f16bbfc025a8852470aa1740e522080ff8392225887fb547bf9","observation_id":"90a33d30-8629-4759-8996-5560876d457c","resolution":{"observed_at":"2026-08-11T17:26:22.457490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:23.003516Z","title":"Vi- sion transformers for dense prediction","venue":null,"work_id":"14f2777f-b4b1-4d75-a265-6106378da33a","year":2021},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.461211Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:dfade1cb8375eacca0117f083881e700d67fc4c62320e3b3d7447721dfc1d0ab","observation_id":"4177e0ab-f453-427d-bd34-0f0d1e335a1b","resolution":{"observed_at":"2026-08-11T17:26:23.007625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.992923Z","title":"Unsupervised deep learning for optical flow estimation","venue":null,"work_id":"29e86be6-c4d7-4931-83f0-7fa0d3e71449","year":2017},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.464694Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:84f544c368590e3ced4afd4daf2dfc32230d656f6bdc5651305474a5ea9ec2bb","observation_id":"1c41c84a-a03f-41aa-ae61-26206d3c93cb","resolution":{"observed_at":"2026-08-11T17:26:22.996682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.982339Z","title":"Sacreg: Scene-agnostic co- ordinate regression for visual localization","venue":null,"work_id":"486a90c7-e8ed-4384-977b-ec8195c9df39","year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.468391Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:f58d7c6cf5c8a23faa23d0f45ebc478ea00e3b1908db1eb91dc2db04eb4505c8","observation_id":"b1407576-e942-4935-92fb-d3bc5f5e28a8","resolution":{"observed_at":"2026-08-11T17:26:22.986065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.970869Z","title":"Neighbourhood consensus networks","venue":null,"work_id":"56af3e29-e25b-44c3-9cd1-cd795f30488f","year":2018},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.471810Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:7f1fa887d51d0ac119f70c9b7a5d552a43c632c2a7a2344adbe743ae6136aeed","observation_id":"a1ff8899-7f51-4245-82cb-72feec59d2b9","resolution":{"observed_at":"2026-08-11T17:26:22.974626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.475272Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.475272Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:d8f5c82795f5436362bdc9c1da253b4937109d846148904bfdf8477b0982ae0a","observation_id":"9487e71d-818b-46a7-a362-f82c7fb7f7ce","resolution":{"observed_at":"2026-08-11T17:26:22.475272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.953354Z","title":"Attention meets geometry: Geom- etry guided spatial-temporal attention for consistent self- supervised monocular depth estimation","venue":null,"work_id":"2055128e-50ee-46f3-91d6-6aee0ad778a5","year":2021},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.478751Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:5c549acca9d5b5dc5ea5f4fc7757cc5e97892860981d3d2ff9a301ff1c43d43c","observation_id":"fe538e13-a490-4bc3-b1f1-67a9bcecc70a","resolution":{"observed_at":"2026-08-11T17:26:22.957187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.942421Z","title":"A multi-view stereo benchmark with high- 12 resolution images and multi-camera videos","venue":null,"work_id":"f9032026-1d92-4722-aa9c-e032dcb35dbe","year":2017},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.482094Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:52be328703294716b8252373f49d954a7fa095ef19b79d11cbd512ed920b08dc","observation_id":"b9e308b0-1351-4b6d-b4b9-b6e75ba0e0fa","resolution":{"observed_at":"2026-08-11T17:26:22.946200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.932083Z","title":"Ransac-flow: generic two-stage image alignment","venue":null,"work_id":"8255ff4c-846e-4f28-af92-6b5e17da23ce","year":2020},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.485579Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:4ce2ded17f3d795fa767de33d78159b34ebce90266c790676b40ad8d32d28802","observation_id":"d827e27e-e391-4070-b7ed-0fd07dbb14a7","resolution":{"observed_at":"2026-08-11T17:26:22.935786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.921642Z","title":"Emergent correspondence from image diffusion","venue":null,"work_id":"1403704b-7fa0-40b5-a9a9-81d0b6172427","year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.488962Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:2b63708cbeed4e6d9c3c5bd9bd1cbad4dadc23fd1c1e854b41b70638a7578cab","observation_id":"783d4860-590b-4c68-a735-2750f802c800","resolution":{"observed_at":"2026-08-11T17:26:22.925571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.909993Z","title":"Gocor: Bringing globally optimized correspon- dence volumes into your neural network","venue":null,"work_id":"928a7f34-c8cf-4619-a197-bba01e04643b","year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.492319Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:a6a3f1950a45c15702113dec764ecb0473845f48ad6a4b00e0a490e2d0f9fd72","observation_id":"5a17d202-c663-40b5-a271-348e9fb3e2ab","resolution":{"observed_at":"2026-08-11T17:26:22.914128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.899069Z","title":"Glu- net: Global-local universal network for dense flow and cor- respondences","venue":null,"work_id":"206206ac-28f9-4673-a319-af60548cd25a","year":2020},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.496252Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:2abe4e842b2b8fe35ba8be90b55cb9c0cd8d2e10dce6974bba2620e418dedf41","observation_id":"8a3419b4-31a4-4862-9dfa-d4ba005cfa17","resolution":{"observed_at":"2026-08-11T17:26:22.902872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.887882Z","title":"Learning accurate dense correspondences and when to trust them","venue":null,"work_id":"057389b2-dbd4-49e6-b51e-b631a23e2fee","year":2021},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.506234Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:e5d0d6aa9b02b1bfc10adceeb45e6c0fd5b762143d996a15fb9e7c3e825e2d02","observation_id":"ac347442-4a5a-4173-9566-cc618ec9fe78","resolution":{"observed_at":"2026-08-11T17:26:22.891877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.876771Z","title":"Pdc-net+: Enhanced probabilistic dense corre- spondence network","venue":null,"work_id":"7f56d629-12ad-47ac-a58c-81c51f774bd5","year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.511064Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:0614f594b730a55ba616c8e83497eedc026b34cd5688f2bfac8ae676d1f28605","observation_id":"409eabc7-e094-42ad-9f11-3d52778dd998","resolution":{"observed_at":"2026-08-11T17:26:22.880701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.865794Z","title":"Attention is all you need","venue":null,"work_id":"b3e05382-d1d4-4bcf-a5c3-07f8fae8683a","year":2017},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.514545Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:77744c9d0d1b457e2d1d32231858e3ccf9cfa58177fb3da3914eb28ac7f6b367","observation_id":"ca55503d-88f3-49cd-921a-f78293ef6dae","resolution":{"observed_at":"2026-08-11T17:26:22.869509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.854849Z","title":"Dust3r: Geometric 3d vision made easy","venue":null,"work_id":"b239ebf7-3a0c-4fdd-8a8d-e34d2ff4e112","year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.517779Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:d310e6d7381ce1c148b46a9afab90106835bbcdcc969fe228640ee2e4cb9aaad","observation_id":"34b5fbda-2891-4b61-ae3c-988eea59e981","resolution":{"observed_at":"2026-08-11T17:26:22.858624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.844412Z","title":"Crafting monocular cues and velocity guidance for self-supervised multi-frame depth learning","venue":null,"work_id":"880a598d-ac0f-4092-8576-67b47bdeec1e","year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.521071Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:e98a88b65d51f590a2b083b5454c3c0d277ef8f69f387613bff9f55dfc361d3e","observation_id":"cb69555a-3c7d-47d7-baf2-e9328e0e26d9","resolution":{"observed_at":"2026-08-11T17:26:22.848111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.832860Z","title":"Unos: Unified unsupervised optical- flow and stereo-depth estimation by watching videos","venue":null,"work_id":"e469f8e0-5100-48df-ab5c-bfb57d5637cb","year":2019},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.524414Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:d8b2475571fd8c0ad58771d88deca007cba8f8bdf23324da4251a101ecdded29","observation_id":"6f9841eb-7b23-4c4f-abd1-8820a8de76bc","resolution":{"observed_at":"2026-08-11T17:26:22.837259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.821876Z","title":"Sea-raft: Simple, efficient, accurate raft for optical flow","venue":null,"work_id":"c08ad3c9-46b1-4134-846f-a419f918f709","year":2025},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.527879Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:3dbef79fb6578f9d14dd5637a997f20f0962c14dc1f77ee8dd3a8c99393a0a9c","observation_id":"f07ccbe8-4e12-4ef5-a731-68e2d9370391","resolution":{"observed_at":"2026-08-11T17:26:22.825487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.811289Z","title":"Image quality assessment: from error visibility to structural similarity","venue":null,"work_id":"3bd6ec9d-f91f-44d9-bcf0-9a616c7a98f7","year":2004},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.531613Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:3212ce403581b0860579f45b675652dbbfd280a0e388a52156a8443a1337ee8b","observation_id":"9cc1edc1-1fd9-4166-821e-90e2768c4d88","resolution":{"observed_at":"2026-08-11T17:26:22.814884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.800890Z","title":"The temporal opportunist: Self-supervised multi-frame monocular depth","venue":null,"work_id":"2bab528e-b759-4164-8ad0-3fda333ab89a","year":2021},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.535232Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:123dc0f71c10851e09585b3d9685fff8f86287a98f1921eb883a1db4306cd6cb","observation_id":"70fc410d-ddbc-4fcf-a93d-f93ae123688b","resolution":{"observed_at":"2026-08-11T17:26:22.804471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.790651Z","title":"Croco: Self-supervised pre-training for 3d vision tasks by cross-view completion","venue":null,"work_id":"454dda16-e9ca-4432-9a52-a51f12a2f1e2","year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.538671Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:a57054020384f51f312736f040704c66c632b6a0801e1c564c8adb39e188e9d8","observation_id":"9262cfd7-2416-44e4-86c9-006ef6eefb93","resolution":{"observed_at":"2026-08-11T17:26:22.794153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.780161Z","title":"Croco v2: Improved cross-view completion pre- training for stereo matching and optical flow","venue":null,"work_id":"7575aee8-db1e-46e8-af73-6f362a999294","year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.542027Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:e8947e45c5626f3926e1d926a2abe7335998777fb4501df867acde5954ff421c","observation_id":"b88df8be-7653-4bde-805c-94a2869e6746","resolution":{"observed_at":"2026-08-11T17:26:22.783895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.545373Z","title":"Gmflow: Learning optical flow via global matching","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.545373Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:0069f8e4be9225109f854a5acc44664aa191e1c5447c8d5f0844564e96ab0fcd","observation_id":"4b1b9312-35ec-410b-afeb-0bffd2601fb0","resolution":{"observed_at":"2026-08-11T17:26:22.545373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.763796Z","title":"Depth anything: Un- leashing the power of large-scale unlabeled data","venue":null,"work_id":"23611e92-9941-489b-b4fc-a9cc27ebaab9","year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.548860Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:ee4564b003c59a1a56cfe124a56f31ec396476fcd45864ad03a44ad35050bb62","observation_id":"2684c6e6-7806-4cbf-b686-55f80262d35b","resolution":{"observed_at":"2026-08-11T17:26:22.767323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.753563Z","title":"Mvs2d: Efficient multi-view stereo via attention-driven 2d convolutions","venue":null,"work_id":"55b8de34-6a39-4d4c-bda4-a304e098136c","year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.552182Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:3bb256dcb75ff3ae456691e8f3d732ee66e7afc2c2b763ba6add31ca54ebe898","observation_id":"ce5ea5eb-6074-45ba-9a60-4244e0706148","resolution":{"observed_at":"2026-08-11T17:26:22.757508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.742476Z","title":"Met- ric3d: Towards zero-shot metric 3d prediction from a sin- gle image","venue":null,"work_id":"2ee41f8b-cb9e-493d-927e-388df1058234","year":2023},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.555421Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:b77bbeaee2be2b8970beb16f7c359dddb9c20fa6b56ff6ed09893439eeabf577","observation_id":"5a959ecb-1ffb-48eb-8740-1fadc0c78d2a","resolution":{"observed_at":"2026-08-11T17:26:22.746545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.731148Z","title":"Back to basics: Unsupervised learning of optical flow via brightness constancy and motion smoothness","venue":null,"work_id":"96d721da-e083-4f5d-9bf5-5a3104faebfc","year":2016},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.558997Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:ace1af77e4a6a7a3756b90bf4a31ce6fddb63aa1e627aa4a2baa58ac28d74711","observation_id":"db8c6e6b-0a0f-41bb-91a7-63db35eeebf7","resolution":{"observed_at":"2026-08-11T17:26:22.734988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.720158Z","title":"A tale of two features: Stable diffusion complements dino for zero-shot semantic correspondence","venue":null,"work_id":"a0a85d9b-cbfe-4cea-a797-6ec5316ca5e8","year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.562513Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:71549fa6f19218b91a8aad19712a8872ffb0b929ef325ddeffb6f6a1d9e7f83b","observation_id":"c3459da9-d212-4328-b1eb-88facfa9ebb1","resolution":{"observed_at":"2026-08-11T17:26:22.723949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.708043Z","title":"Monovit: Self-supervised monocular depth estimation with a vision transformer","venue":null,"work_id":"39ba4d72-2869-4240-89a9-e7e1fed58c20","year":2022},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.565780Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:431de2e3ba12a1e2cd746d8c8c5a4d66b61953ba763a4c65895027d84a51fd17","observation_id":"015c1a55-f16a-449a-80c3-93c8c983c437","resolution":{"observed_at":"2026-08-11T17:26:22.711780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.696275Z","title":"Unsupervised learning of depth and ego- motion from video","venue":null,"work_id":"22b6a55f-892d-4970-8488-76106ada9cef","year":2017},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.569016Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:5f944dc76bff966e5d5520896bf2c5abe5ddbedea2549a9ae347eeb039852067","observation_id":"4d0c66f9-a0c8-44d4-ad22-09591cd984fb","resolution":{"observed_at":"2026-08-11T17:26:22.700496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T17:26:22.685314Z","title":"A survey on open- vocabulary detection and segmentation: Past, present, and future","venue":null,"work_id":"e983da3d-d9a4-4ed4-baca-e7c35a74e20a","year":2024},"citing_paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T17:26:22.572375Z"},"links":{"citing_paper":"/paper/2412.09072"},"observation_digest":"sha256:43cf962df4a060adbeff85b8c41a45654655b1c3914220b01b595bc4c466d481","observation_id":"f3eac1cc-1a12-42ab-808e-61366ae768c3","resolution":{"observed_at":"2026-08-11T17:26:22.689019Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.09072","last_updated":"2024-12-12T08:58:20Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T23:57:27.758940Z","submitted_at":"2024-12-12T08:58:20Z","title":"Cross-View Completion Models are Zero-shot Correspondence Estimators"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":1,"verified_fuzzy":64},"total_outbound_references":103},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 100 of 103 outbound references and 4 inbound Pith citation observations for arXiv:2412.09072."}