{"as_of":"2026-08-19T13:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:904ce00164eed4ffdee7c1a982a5345cf168a956b73e3685adc9149654055f95","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:52:45.377852Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.14709/citation-record","integrity":"/paper/2506.14709/integrity","json":"/paper/2506.14709/citation-record.json","paper":"/paper/2506.14709"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.827890Z","title":"Vision meets robotics: The KITTI dataset,","venue":null,"work_id":"38d02835-189f-4ba3-a3a9-2d3c6f52bcec","year":2013},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.240610Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:996da7d77e03f054a23b0ae9c21f08e0a9964ffdc7d85fad78784d83e6f5b129","observation_id":"00a3db3f-7e23-4156-b096-122a4b864897","resolution":{"observed_at":"2026-08-15T19:52:45.832352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.246270Z","title":"Virtual kitti 2,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.246270Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:cd85cb5a06a24b284dc82bb8a958d8450180e7b8b3819166b917ef1ac5e7f0b2","observation_id":"3acf712d-e037-48c8-8eb1-fbd090da2c01","resolution":{"observed_at":"2026-08-15T19:52:45.246270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.804401Z","title":"Synthetic depth-of-field with a single-camera mobile phone,","venue":null,"work_id":"6895f789-f0fe-4b56-974c-2d60926e80d5","year":2018},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.251093Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:1ae5715fe023a839e163aecb54b0b6bbce3b6d52bb217f4d2bfbb236f8a38d4b","observation_id":"cfa96d96-f0e9-42fd-8c57-be38cd657751","resolution":{"observed_at":"2026-08-15T19:52:45.808723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.791119Z","title":"Practical stereo matching via cascaded recurrent network with adaptive correlation,","venue":null,"work_id":"b614fba9-3434-48a4-ab46-3299fe03064c","year":2022},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.256001Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:01b604d973086d94711687f6441cca3279ecfb0d1521add3813c9fbb008b3e4a","observation_id":"c27b7219-08a4-4256-8c21-1c02712b3676","resolution":{"observed_at":"2026-08-15T19:52:45.795547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.777072Z","title":"Wavelet synthesis net for disparity estimation to synthesize DSLR calibre bokeh effect on smartphones,","venue":null,"work_id":"34516376-a8f8-46cd-af51-503df0324ea4","year":2020},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.260642Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:edb845c9f65ad7d6d195833c67a8a90c9e5f30b6a7261561da769e03be89186f","observation_id":"0ebe905c-0d8c-4451-b273-1c8d29cd3a92","resolution":{"observed_at":"2026-08-15T19:52:45.781637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.762558Z","title":"RIA V-MVS: recurrent-indexing an asymmetric volume for multi-view stereo,","venue":null,"work_id":"72e8e485-cdd4-4533-b961-24a5e1e0eb67","year":2023},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.265122Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:6847508d8c4373329b9858da77a7d13d54d50717eb1701b9b11d542ca93b95d2","observation_id":"f766b7de-e58b-44f0-88f5-fff757a0143d","resolution":{"observed_at":"2026-08-15T19:52:45.767007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.748511Z","title":"Geomvsnet: Learning multi- view stereo with geometry perception,","venue":null,"work_id":"b7ffd6dd-fc7e-4d36-b75f-9e9c6fb2b0dd","year":2023},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.270228Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:2c8af2580c87f3f68b1d5acfb9d2433629e3ec287a9f080ad18fa4add6d56a6f","observation_id":"d1171d0b-d7aa-4e40-ba7b-2d3f0ec224a3","resolution":{"observed_at":"2026-08-15T19:52:45.753047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.733138Z","title":"A taxonomy and evaluation of dense two-frame stereo correspondence algorithms,","venue":null,"work_id":"ab200e61-c052-40b9-bd7d-2de27c8fe0c4","year":2002},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.274828Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:7fa55e9a5ae334c83fd289c5bca97a322b53e6f0e6a944b5c7e6eec0245c87fc","observation_id":"b9ee441f-4c70-453f-a81a-f1afbeadebed","resolution":{"observed_at":"2026-08-15T19:52:45.738817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.717686Z","title":"Indoor segmenta- tion and support inference from RGBD images,","venue":null,"work_id":"c6488da3-4605-419c-b8a0-c856e9981f77","year":2012},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.279346Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:b8e052fdb2aa532772156310cb0af80b00f97121c09707ae139da1b70a542f5a","observation_id":"1cd5a28c-c7ac-4639-982e-81fb337ce55d","resolution":{"observed_at":"2026-08-15T19:52:45.722827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.702279Z","title":"Monoc- ular relative depth perception with web stereo data supervision,","venue":null,"work_id":"8b5ffb15-f0c5-4272-8934-2d2124219a5c","year":2018},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.283808Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:4b0cae472e8be7c6c72830502bbd662042698d4305663e6f33b4f6dd0a213722","observation_id":"44f03c47-fd5d-45a1-bef4-154f7b90ec44","resolution":{"observed_at":"2026-08-15T19:52:45.706973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.687100Z","title":"Learning single camera depth estimation using dual-pixels,","venue":null,"work_id":"740bcc56-2c2d-4f2a-bd94-e400f263208a","year":2019},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.288175Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:57cb1208144c9231f6733700a30c1ddc62811f860ce9a466f939eef2ebc1caff","observation_id":"afd823aa-0f98-469f-8829-96f72fef6f28","resolution":{"observed_at":"2026-08-15T19:52:45.691845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.672730Z","title":"Structure- guided ranking loss for single image depth prediction,","venue":null,"work_id":"11067ea3-3032-41e3-b26f-e2b71e64acec","year":2020},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.292725Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:fe1d4da70e7db0faec1d31ebc89108bb3c0404b4b8967a8508c6dd70e39e6e02","observation_id":"c377ad6f-2142-45e6-a247-a8657c43a642","resolution":{"observed_at":"2026-08-15T19:52:45.677438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.657841Z","title":"Towards robust monocular depth estimation: Mixing datasets for zero-shot cross- dataset transfer,","venue":null,"work_id":"efd51851-325e-4cb3-ae00-56f3c180ffe2","year":2021},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.298058Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:acb5e7a96960049f274e66aa99183bb10108659f0a4bfd226acba718b1387dbe","observation_id":"abaaa61c-4d9d-4cec-b219-e537752e1508","resolution":{"observed_at":"2026-08-15T19:52:45.662482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.643038Z","title":"Defocus deblurring using dual-pixel data,","venue":null,"work_id":"f1ccb358-866d-487d-a8a1-474a65ebd80d","year":2020},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.302936Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:3c0200a3813b9dd77fbbe44d2df2c23d4883b19e02e887f602f3d1134fedaf7f","observation_id":"5dffd253-226b-4f28-be30-ba5373a844d8","resolution":{"observed_at":"2026-08-15T19:52:45.647703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.307355Z","title":"Hess, Blender Foundations: The Essential Guide to Learning Blender 2.6","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.307355Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:64309aea20d0c3d50ea5db468622efde191a33f8033eae6d6064c4564be0643e","observation_id":"95350a7e-c359-4df1-9fff-527455feaadd","resolution":{"observed_at":"2026-08-15T19:52:45.307355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.619377Z","title":"Hypersim: A photorealistic synthetic dataset for holistic indoor scene understanding,","venue":null,"work_id":"ee2b8900-5548-4ba6-abf2-cf001b0d6d26","year":2021},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.311613Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:b4e76c4dc1c77d32f0ca35f132b9f58383c56d6feecc092915459bc31103da2c","observation_id":"c31cc392-1910-4c06-831c-c7874cf6f482","resolution":{"observed_at":"2026-08-15T19:52:45.624114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.604259Z","title":"Du 2net: Learning depth estimation from dual-cameras and dual-pixels,","venue":null,"work_id":"859f0b95-07b0-4f8f-81ad-bdbddb3c1620","year":2020},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.316108Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:4a3986ef8ec76661b68e67c2cb1e16cc028328e5e41c49af454cfa5ca45b3847","observation_id":"67fa6be1-3c22-4339-8905-20870fe181a0","resolution":{"observed_at":"2026-08-15T19:52:45.609632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.589785Z","title":"Dual pixel exploration: Simultaneous depth estimation and image restoration,","venue":null,"work_id":"d507f2fd-8d25-49c1-9e9c-ae61b1f7d966","year":2021},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.320562Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:1d39c351c5c0adcdcd529c3603dcb47ef6685ef41becc8722ab64dd808a016f5","observation_id":"ef31e1f2-c6e4-40e8-a8c4-05bcd7cfc860","resolution":{"observed_at":"2026-08-15T19:52:45.594323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.574153Z","title":"Modeling defocus-disparity in dual-pixel sensors,","venue":null,"work_id":"155d7c2d-709a-44fe-b8f8-be95709f0a16","year":2020},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.324941Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:c406368c20ef22a724617f8e97d2db4ac3e62f40d2195b9f1a066592f9fb9021","observation_id":"c08949d6-b161-4c12-8976-ad16e542c003","resolution":{"observed_at":"2026-08-15T19:52:45.578929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.329310Z","title":"U-net: Convolutional networks for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.329310Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:8d065ac5255c24beaeb8e69f53e82d6ce08b23134163d2282603e2e658046b65","observation_id":"e1183ed3-e95b-42e0-a0bf-1ac2be8cd2f8","resolution":{"observed_at":"2026-08-15T19:52:45.329310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.547492Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks,","venue":null,"work_id":"068ae559-a1f6-4a7c-a0e9-b5c7961c554a","year":2019},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.334063Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:d8f8695bbd4511b6abe14a41e9631b2da30e7f41edd569a4d4aea3b493f997f0","observation_id":"6b98111e-a706-4552-868f-c55b76bc90e4","resolution":{"observed_at":"2026-08-15T19:52:45.553096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.533075Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":"65e286eb-8a23-48df-82b5-8ed1d7a8df78","year":2009},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.338339Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:faea61e5f261b3703618053ee7a6124a5d48f14ba41a26de82d0f92f05d65658","observation_id":"f5a00325-0674-4cb6-839b-f56f2140ac00","resolution":{"observed_at":"2026-08-15T19:52:45.537642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.518745Z","title":"Mobilenetv2: Inverted residuals and linear bottlenecks,","venue":null,"work_id":"1b8e72c3-eecb-437c-bb0c-671205d30bbf","year":2018},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.342498Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:c5b3c2e614c9c75406a7355123c3835d31370d199313eb4993bd982a678ae87a","observation_id":"664a48a5-ea61-46e6-b31e-f4ab83b9269f","resolution":{"observed_at":"2026-08-15T19:52:45.523426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.503959Z","title":"Parallax attention for unsupervised stereo correspondence learning,","venue":null,"work_id":"ceb116e5-6f9c-4069-9b35-8fb58dba8b61","year":2022},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.346909Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:d553a1ecda287614d0a5c7d7e86babc4399702bde141ac0dd0dacb65a97e1198","observation_id":"bb2b0ac6-5811-4859-a009-5ea19597b739","resolution":{"observed_at":"2026-08-15T19:52:45.508441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.489345Z","title":"Megadepth: Learning single-view depth pre- diction from internet photos,","venue":null,"work_id":"705cee34-79c8-4478-87ba-6a844b147000","year":2018},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.351155Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:75b459fb1e2ef92a1a2ac0f90f98b1ba31a5c8d3cb26ced1e789a16dece7178b","observation_id":"71da7ec6-e5d0-468b-8c81-ed0a37bda008","resolution":{"observed_at":"2026-08-15T19:52:45.494131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.355798Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.355798Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:842228916026e038c2fd2b8de81e249115fa7af82cb42a5f2ebd9beabade0e20","observation_id":"6473f7df-151e-4858-a8a1-ec2d43afedd1","resolution":{"observed_at":"2026-08-15T19:52:45.355798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.464639Z","title":"A large dataset to train convolutional networks for disparity, optical flow, and scene flow estimation,","venue":null,"work_id":"aac29d6a-0258-4770-92a4-fa5489d3fc1b","year":2016},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.360242Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:a6b28614b21c699eca8d5af435ae57b705d746d300aea260d41642ed7d45a3af","observation_id":"1a74c3d9-fc4d-430c-a2c8-0c5d08d408a1","resolution":{"observed_at":"2026-08-15T19:52:45.469384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.449816Z","title":"Pytorch: An imperative style, high- performance deep learning library,","venue":null,"work_id":"caffd7d1-699e-4069-8b73-0d9055d69f30","year":2019},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.364718Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:adda8f30291c8da10e43a9354f6bc99b860f57a3d9d7f67e7166a96c284aad0d","observation_id":"9e64182b-8371-4712-aad0-ab7c54e4087b","resolution":{"observed_at":"2026-08-15T19:52:45.454615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.369194Z","title":"Adam: A method for stochastic optimiza- tion,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.369194Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:1b142d19b848a070728a3460cd9e4ee0d334c367dda0f4ca38376fef8629c5b6","observation_id":"63c84ccb-78d3-4b49-91fd-074f6cb231db","resolution":{"observed_at":"2026-08-15T19:52:45.369194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:52:45.423811Z","title":"Raft-stereo: Multilevel recurrent field transforms for stereo matching,","venue":null,"work_id":"1111556f-2af0-4a7a-aa10-cd27dd4ccd8c","year":2021},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.373597Z"},"links":{"citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:e3e5808d24b0cd13c9aa9b0fcdc56591f58c586de5e575a3c1ea75749658f221","observation_id":"2bbc2a94-fb34-4490-8572-3b60819d90ba","resolution":{"observed_at":"2026-08-15T19:52:45.429890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12288","last_updated":"2023-02-23T19:13:10Z","snapshot_observed_at":"2026-07-06T14:55:15.719380Z","submitted_at":"2023-02-23T19:13:10Z","title":"ZoeDepth: Zero-shot Transfer by Combining Relative and Metric Depth","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12288","snapshot_observed_at":"2026-08-15T19:52:45.377852Z","title":"Zoedepth: Zero-shot transfer by combining relative and metric depth,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T19:52:45.377852Z"},"links":{"cited_paper":"/paper/2302.12288","citing_paper":"/paper/2506.14709"},"observation_digest":"sha256:691b004f0e9c1b04f98eda6ef98be10047fb238a144938b9afe5f4dd9ad7c308","observation_id":"2f0bc4c6-43fe-458c-a2b9-4a4a0707eff4","resolution":{"observed_at":"2026-08-15T19:52:45.377852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.14709","last_updated":"2025-07-31T19:52:38Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T07:05:11.167362Z","submitted_at":"2025-06-17T16:49:27Z","title":"DiFuse-Net: RGB and Dual-Pixel Depth Estimation using Window Bi-directional Parallax Attention and Cross-modal Transfer Learning"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2506.14709."}