{"as_of":"2026-08-07T18:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d560a8e69460d3ac1e83a38650c1af5200c0e1ec9f58a5941ef9af8541197f0f","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:10:29.220185Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03851/citation-record","integrity":"/paper/2608.03851/integrity","json":"/paper/2608.03851/citation-record.json","paper":"/paper/2608.03851"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.14460","last_updated":"2023-07-26T19:01:49Z","snapshot_observed_at":"2026-08-05T14:21:33.902926Z","submitted_at":"2023-07-26T19:01:49Z","title":"MiDaS v3.1 -- A Model Zoo for Robust Monocular Relative Depth Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14460","snapshot_observed_at":"2026-08-05T11:10:29.045805Z","title":"Midas v3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.045805Z"},"links":{"cited_paper":"/paper/2307.14460","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:1bb208be4425ffc0f56a34fa275e7205bc29b4d4b9d6254a5a453181abe2cb7a","observation_id":"d816899c-f40e-42f0-b90b-311051521ca4","resolution":{"observed_at":"2026-08-05T11:10:29.045805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.977961Z","title":"Transformerfusion: Monocular rgb scene reconstruction using transformers.Advances in Neural In- formation Processing Systems, 34:1403–1414, 2021","venue":null,"work_id":"f75d3094-4d8d-4eb8-a2bf-71ee81ae6612","year":2021},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.051238Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:8454777cbc72d13bf3a86cc88dce39fbdd15fccb8e716894b4727364cb7f4390","observation_id":"9995b2a9-7359-4a09-8ad1-7b5c60b91dc4","resolution":{"observed_at":"2026-08-05T11:10:29.985163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11673","last_updated":"2024-01-22T03:22:49Z","snapshot_observed_at":"2026-08-04T07:38:22.574750Z","submitted_at":"2024-01-22T03:22:49Z","title":"MVSFormer++: Revealing the Devil in Transformer's Details for Multi-View Stereo","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11673","snapshot_observed_at":"2026-08-05T11:10:29.055982Z","title":"Mvsformer++: Revealing the devil in transformer’s details for multi-view stereo.arXiv preprint arXiv:2401.11673, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.055982Z"},"links":{"cited_paper":"/paper/2401.11673","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:4268b895196c4d3dac6061ede85e64c8181ff38afbfb9376d50cce66dd5cdc51","observation_id":"d204dec7-71a4-471f-892c-5df9c752cf99","resolution":{"observed_at":"2026-08-05T11:10:29.055982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18088","last_updated":"2025-08-27T17:52:42Z","snapshot_observed_at":"2026-08-01T01:17:47.017808Z","submitted_at":"2025-06-22T16:26:53Z","title":"RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18088","snapshot_observed_at":"2026-08-05T11:10:29.061950Z","title":"Robotwin 2.0: A scalable data gen- erator and benchmark with strong domain randomization for robust bimanual robotic manipulation.arXiv preprint arXiv:2506.18088, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.061950Z"},"links":{"cited_paper":"/paper/2506.18088","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:7b14345d6f831002565ecebb563432e62037a7bc9e44e2a998ca1dbffa6ed920","observation_id":"6faf7283-a2ec-46de-95ae-9ca25da4c454","resolution":{"observed_at":"2026-08-05T11:10:29.061950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.067528Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.067528Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:a8287fad2f867793777e1fee0c28e6e5d2300117e6e29288a4d9f4f6d75dfffc","observation_id":"49f28371-44c7-4cd8-aa6f-1687a1b5ae04","resolution":{"observed_at":"2026-08-05T11:10:29.067528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.945025Z","title":"Deep- videomvs: Multi-view stereo on video with recurrent spatio- temporal fusion","venue":null,"work_id":"2179999a-2d52-4e24-8858-abde46ce598e","year":2021},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.072612Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:456351a34abbedd561afe47858d3b247259cc365ea7805a381381727ab6caff6","observation_id":"be67dd5b-6a92-4423-b771-5e6c26768152","resolution":{"observed_at":"2026-08-05T11:10:29.951471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.925246Z","title":"Predicting depth, surface nor- mals and semantic labels with a common multi-scale con- volutional architecture","venue":null,"work_id":"2a11c2e4-1917-4453-8632-f6980cb07413","year":null},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.077971Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:b647b7a5f433a832e6fe311b5231e8284a89895873d892bf1616f612800c5d26","observation_id":"83dacb93-e4b7-41b7-86ea-e19ec5a05f86","resolution":{"observed_at":"2026-08-05T11:10:29.930718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.905776Z","title":"Depth map prediction from a single image using a multi-scale deep net- work.Advances in neural information processing systems, 27, 2014","venue":null,"work_id":"8a0a3a62-1a5f-4b24-a429-d0dc509fbcd1","year":2014},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.083023Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:28e2b12e747bb8216b150a1aee0f27f628a3aeed3df740f96f9653703368a946","observation_id":"63a40deb-f677-464c-b378-a85139493eb8","resolution":{"observed_at":"2026-08-05T11:10:29.911566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.889100Z","title":"Rpr-net: A point cloud-based rotation-aware large scale place recognition network","venue":null,"work_id":"00dfd2be-8b7a-46c4-833d-cc47bc980725","year":2022},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.087855Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:5b39b0da875f5d165a7ca245fd6eaf9b99777487de198317665efaaf6f14b105","observation_id":"7175e3a0-9b7c-4ce4-8527-dcf2c5066c21","resolution":{"observed_at":"2026-08-05T11:10:29.894529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.871891Z","title":"Multi-view stereo: A tutorial.Foundations and trends® in Computer Graphics and Vision, 9(1-2):1–148, 2015","venue":null,"work_id":"beea9e89-2abe-478c-9c6c-0a21d92297ed","year":2015},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.092647Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:617a002e3f57bffc2a37dd8528a1c71a5bd4b89bfed54de2b1d578de943b23c1","observation_id":"af88f880-4e63-430c-beab-a68e991d471f","resolution":{"observed_at":"2026-08-05T11:10:29.877525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.855172Z","title":"Multi-view stereo by temporal nonparametric fusion","venue":null,"work_id":"e0c24776-6a2b-4018-91e3-977860116ed4","year":2019},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.097773Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:35e0aeea6a11b6fc55d99c20cca0cba252b821123c5a487e15ea9d030c482839","observation_id":"eaffe0f9-c9c6-4a9c-95e1-a76311284113","resolution":{"observed_at":"2026-08-05T11:10:29.860377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00538","last_updated":"2019-05-02T00:59:31Z","snapshot_observed_at":"2026-07-06T07:49:52.652287Z","submitted_at":"2019-05-02T00:59:31Z","title":"DPSNet: End-to-end Deep Plane Sweep Stereo","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00538","snapshot_observed_at":"2026-08-05T11:10:29.102749Z","title":"Dpsnet: End-to-end deep plane sweep stereo.arXiv preprint arXiv:1905.00538, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.102749Z"},"links":{"cited_paper":"/paper/1905.00538","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:43f56bf2fdc73ba9285b9780f063638484cab59f813cab685ee81335c6f0db32","observation_id":"2ea18035-e0d3-40e1-8acd-11e8671016cc","resolution":{"observed_at":"2026-08-05T11:10:29.102749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.838468Z","title":"Mvsanywhere: Zero-shot multi-view stereo","venue":null,"work_id":"4aaa46b5-a656-4145-be7e-1bd55411a747","year":2025},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.108730Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:08c55c03fd901a20c77f91d8a39f07a3d670a1f90ca6174f6d7eb5e277c47008","observation_id":"3624e518-6e4c-4cec-a431-cadaaada4a44","resolution":{"observed_at":"2026-08-05T11:10:29.844222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-05T11:10:29.114403Z","title":"Fine-tuning vision-language-action models: Optimizing speed and suc- cess.arXiv preprint arXiv:2502.19645, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.114403Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:21619d6015a58741783aa79e537ef9cf668fa7cbceee491f4b90c70aa199efc7","observation_id":"e2d0d5a0-9018-4463-91ff-4719925bbe1b","resolution":{"observed_at":"2026-08-05T11:10:29.114403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.119910Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.119910Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:2ca68d7dfdfac27bde52dab8f0890fa93d09cd495a93283ec2dccac190df81e9","observation_id":"36f7a18b-a4f3-441f-b5bd-41f316396f5a","resolution":{"observed_at":"2026-08-05T11:10:29.119910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.125020Z","title":"Spatial forcing: Implicit spatial representation align- ment for vision-language-action model.arXiv preprint arXiv:2510.12276, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.125020Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:b6ce599492d9e3449d2d3ec6d8a63f031e91214530bcd1771fc8be462b2be7ac","observation_id":"a383b989-caff-462f-8f60-8e8c344311b4","resolution":{"observed_at":"2026-08-05T11:10:29.125020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.809108Z","title":"Libero: Benchmarking knowl- edge transfer for lifelong robot learning.Advances in Neural Information Processing Systems, 36:44776–44791, 2023","venue":null,"work_id":"9d900444-2bb4-44f5-9c2c-776c5b80982a","year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.130166Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:ed5e4bc19bacf2b4dfd5bfc057cd80d913433657d858b6a62183289c123dc1a0","observation_id":"06c19f4b-d283-438f-8831-6a94d2b8a05d","resolution":{"observed_at":"2026-08-05T11:10:29.814993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.791053Z","title":"Mixture of ex- perts: a literature survey.Artificial Intelligence Review, 42 (2):275–293, 2014","venue":null,"work_id":"e0479356-fc49-4c11-bc0e-be716c8c50e0","year":2014},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.135654Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:67cd0d297c6e628580455474cfad6641534a7c6ca59fda1e6412c6635f834d26","observation_id":"c646e42a-d21e-4bed-9cc0-483e5f9eb10b","resolution":{"observed_at":"2026-08-05T11:10:29.797191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-05T11:10:29.141909Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.141909Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:460d4fd6dd5e0a180bacb52ce0d3dbdfb59eb909a5543d7e6f1b101c2b970982","observation_id":"c789e0ba-4cfa-4707-bb96-0458094f892c","resolution":{"observed_at":"2026-08-05T11:10:29.141909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.774760Z","title":"Simplere- con: 3d reconstruction without 3d convolutions","venue":null,"work_id":"59e74080-94d2-4848-96b5-9208047ae84e","year":2022},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.147201Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:1de26f2f2174de5d1ce79c887ff70aeb38b79509dbd5cd428810a9913dacbd19","observation_id":"76db3f21-27c8-48dc-b316-e7e14395619c","resolution":{"observed_at":"2026-08-05T11:10:29.780019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.758286Z","title":"Doubletake: Geometry guided depth estimation","venue":null,"work_id":"f19056f3-fc26-4e04-8308-d5dede441edf","year":2024},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.154568Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:2eb0a66950a76ae119bf999680600ecb3beeb2e3a5e7581ccdf0740c2cb194fd","observation_id":"9d23dc17-7e3a-4c56-9d02-a833f6841d48","resolution":{"observed_at":"2026-08-05T11:10:29.764157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.741137Z","title":"Scene co- ordinate regression forests for camera relocalization in rgb-d images","venue":null,"work_id":"7014bd5d-94b4-40a6-8a0a-02ed5669c115","year":2013},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.159997Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:f6adfb67a9b332f03e14def02774cccc092044aca233e670cf72e17463f014c1","observation_id":"2ce235a6-5087-4e5c-88b2-7fc31155977d","resolution":{"observed_at":"2026-08-05T11:10:29.746926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.723269Z","title":"V ortx: V olumetric 3d reconstruction with trans- formers for voxelwise view selection and fusion","venue":null,"work_id":"c9a159b7-362f-4946-9151-1d235c33d221","year":2021},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.165860Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:9eb0852e4eb98ef8206a9d20cb175cbecc58fd55e4cac2e80673f65aa4fe599e","observation_id":"71067505-83e1-4cf5-983b-2ef1109e789d","resolution":{"observed_at":"2026-08-05T11:10:29.728683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.705073Z","title":"Neuralrecon: Real-time coherent 3d re- construction from monocular video","venue":null,"work_id":"99b5fac1-4a7f-4281-9e20-5e5076812779","year":2021},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.170560Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:875be7ef28c1f9280101420b65d3c83921723bfcc2536526fc55303bcfe34890","observation_id":"caf10882-c026-46ba-abaf-1893e31ef27d","resolution":{"observed_at":"2026-08-05T11:10:29.711453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.687843Z","title":"Depth from motion for smartphone ar.ACM Transactions on Graphics (ToG), 37(6):1–19, 2018","venue":null,"work_id":"09c356f0-acf5-41e1-a74c-6c104c4a1c26","year":2018},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.175604Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:063326ea09915132c0e72ebd618d198cd5a6a80fc5ced536ef30c5e9e0ebe697","observation_id":"bb826d9b-0abb-48cc-b56b-d34ff07256ad","resolution":{"observed_at":"2026-08-05T11:10:29.693815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.670716Z","title":"Vggt: Vi- sual geometry grounded transformer","venue":null,"work_id":"b265d652-c0f2-4a83-8891-15911042c0ea","year":2025},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.180429Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:02bb01c2310dd424fc7ff2f5f732a3728f145e7e63c37809ad922533a09efa7d","observation_id":"9512cbed-47d7-4124-a9b0-58ece4c9846f","resolution":{"observed_at":"2026-08-05T11:10:29.676093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.651292Z","title":"Mvdepthnet: Real-time multiview depth estimation neural network","venue":null,"work_id":"cf26de8f-ccd5-42bd-8613-93527d3274c5","year":null},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.185545Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:6dac6e344afaf04bd6ee6cd02aaa65c3bf657d74a79b1e90edc9c48d88946d96","observation_id":"e7388717-a1eb-412b-917d-0595ef5e160a","resolution":{"observed_at":"2026-08-05T11:10:29.657677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.190381Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.190381Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:3421877c931da973ecc0a7b0bfd52276a005ff0d4717a4800934e22197c25f5f","observation_id":"0de56fb5-1b57-43e2-8df7-0cafe9757f82","resolution":{"observed_at":"2026-08-05T11:10:29.190381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.617859Z","title":"Depth any- thing v2.Advances in Neural Information Processing Sys- tems, 37:21875–21911, 2024","venue":null,"work_id":"1d2e307d-2201-4c01-9d2c-6db838d76f13","year":2024},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.195444Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:9cab17f2e2de01af08f8abcd75d0d4fa20ff12501645e877d03881b8a78507de","observation_id":"e2f8c282-f936-4d47-8c1b-38547b5b1141","resolution":{"observed_at":"2026-08-05T11:10:29.623688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.598638Z","title":"Mvsnet: Depth inference for unstructured multi-view stereo","venue":null,"work_id":"33303b06-1bd0-436a-b036-ebc747d37462","year":2018},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.200915Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:6a918652f757bee79c1b215281a8ce99542e16c5a4f79277edbd6e00792fb9f5","observation_id":"0378cfd1-0e97-42ea-b911-560b669e5d01","resolution":{"observed_at":"2026-08-05T11:10:29.604009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.579090Z","title":"Stablenormal: Reducing diffusion variance for stable and sharp normal.ACM Transactions on Graphics (TOG), 43(6):1–18, 2024","venue":null,"work_id":"fab04ca7-bad2-4951-822e-3c764ae969e7","year":2024},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.205653Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:490d3987905a60c962b0953c797ddcaf7b66147ef6cd59514bec9baa49eccf23","observation_id":"1968908e-f1df-4a93-8b4e-c2cb9bb79411","resolution":{"observed_at":"2026-08-05T11:10:29.585186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.558151Z","title":"Scannet++: A high-fidelity dataset of 3d in- door scenes","venue":null,"work_id":"6308d130-dd55-4fa7-8b9a-3e155d255f3d","year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.210240Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:24db3036720e03a23170234e8954ca4ff48e926e87a8c6e5c24441c1330fcc4a","observation_id":"1cf5216d-145c-4a31-a20f-d76757a0db71","resolution":{"observed_at":"2026-08-05T11:10:29.564327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:10:29.535322Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"0dd4aa19-2276-4dfa-a298-db3ec1722ef4","year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.215446Z"},"links":{"citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:64f2179243a5b48413c6de993c74cb9c16ee03eca6a731a48db0851d21ac41d0","observation_id":"9c625a1d-907e-4a65-8856-2f07d5651d3a","resolution":{"observed_at":"2026-08-05T11:10:29.543100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09579","last_updated":"2023-12-15T07:21:12Z","snapshot_observed_at":"2026-08-04T23:02:53.446031Z","submitted_at":"2023-12-15T07:21:12Z","title":"MobileSAMv2: Faster Segment Anything to Everything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09579","snapshot_observed_at":"2026-08-05T11:10:29.220185Z","title":"Mobilesamv2: Faster segment anything to everything.arXiv preprint arXiv:2312.09579, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T11:10:29.220185Z"},"links":{"cited_paper":"/paper/2312.09579","citing_paper":"/paper/2608.03851"},"observation_digest":"sha256:8997b9b33066fbb77d2cfcfb09ba1497f240226e1b7d8df646abfa7cbbf30592","observation_id":"1376e2ce-61eb-4b83-9661-6a4a3a35b0f7","resolution":{"observed_at":"2026-08-05T11:10:29.220185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03851","last_updated":"2026-08-04T15:54:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T17:36:10.381261Z","submitted_at":"2026-08-04T15:54:32Z","title":"LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2608.03851."}