{"as_of":"2026-08-07T12:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4dce010a029441562ff94ce09da65111284dc34664198e63b4a3a4718afd143f","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:12:21.686913Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.05857/citation-record","integrity":"/paper/2508.05857/integrity","json":"/paper/2508.05857/citation-record.json","paper":"/paper/2508.05857"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.542493Z","title":"Social eye gaze in human-robot interaction: a review","venue":null,"work_id":"624ca280-def9-4096-b36e-c1f687dd928c","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.210844Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:251a0a15c6e420a2065184eaa04b00724b83de200bd498e47da6debb7c4b40aa","observation_id":"4e2923ee-f787-4f6b-b870-ae6bb5f5e83c","resolution":{"observed_at":"2026-08-05T23:12:22.545200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.535117Z","title":"Multimae: Multi-modal multi-task masked autoen- coders","venue":null,"work_id":"e9cdb736-4dc7-43a6-8b64-9b01aa967b13","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.230744Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:a4121f362913948dd26ebe1ea76e597a8bbfd8d1e1d29feaca47b19e517c8477","observation_id":"52ce08d3-3d81-479d-99a9-2f619e7c29d3","resolution":{"observed_at":"2026-08-05T23:12:22.537683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.527173Z","title":"Escnet: Gaze target detec- tion with the understanding of 3d scenes","venue":null,"work_id":"f8d2e82e-630f-4760-bb24-3e4b32e75dd5","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.323049Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:07045f77e8ec23fdf85c34255e07636629713b716fe37e947e727606f3063d9c","observation_id":"ed803d02-9a6c-4c91-ad2d-df0bff25b8aa","resolution":{"observed_at":"2026-08-05T23:12:22.530076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.518522Z","title":"Unsupervised gaze representation learning from multi-view face images","venue":null,"work_id":"8db19504-0985-427c-bbf1-5b40bd4427ae","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.387407Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:08422ac7539481ed7dff404678edded716f16244cb3dd9705207ac39bfb2b9a3","observation_id":"8c4676fb-cb19-4b4a-8f0c-938dedc5051c","resolution":{"observed_at":"2026-08-05T23:12:22.521719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.510057Z","title":"3d pictorial structures for multiple human pose estimation","venue":null,"work_id":"7e91b9e6-ef4c-4d98-8091-dd16cddb4571","year":2014},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.419028Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:a62fe78c1ee909c3f8ac9a1599cafd434500a5c4085751965b6cf1f79c1c8fd2","observation_id":"a95c762c-89b4-4bd9-9f0c-501218673abd","resolution":{"observed_at":"2026-08-05T23:12:22.513010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.501237Z","title":"How far are we from solving the 2d & 3d face alignment problem? (and a dataset of 230,000 3d facial landmarks)","venue":null,"work_id":"463115bd-75e6-4cd6-900c-1331647eea44","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.447875Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:628334e94c9fdcb1c1ed8149006bdd1545c1c3581800d9cfd42b4ba3363ffabe","observation_id":"03fc9910-f779-4f92-b430-02d4d55a486f","resolution":{"observed_at":"2026-08-05T23:12:22.504869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.493051Z","title":"Mvsnerf: Fast general- izable radiance field reconstruction from multi-view stereo","venue":null,"work_id":"9cf7890a-e909-44da-b8ee-dec83c559fc0","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.525152Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:8d03c98203e4e87da4e99380847504768fb53db0df9faa83eb0aed907cff965a","observation_id":"a693057a-acc5-4b56-ac48-1bc67a8a1e11","resolution":{"observed_at":"2026-08-05T23:12:22.495971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.485028Z","title":"Dvgaze: Dual-view gaze estima- tion","venue":null,"work_id":"bfcb5ee1-9f1f-4e15-89b7-37daea70e3d8","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.575104Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:8540e32d6de420c69884c7e86227fbcae64c3f89fdeeecd35ce1d7f2bf30bc79","observation_id":"d70fee5d-5f09-41d1-a2bc-7bbd98c1c5ce","resolution":{"observed_at":"2026-08-05T23:12:22.488148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.476960Z","title":"Connecting gaze, scene, and attention: Generalized attention estimation via joint modeling of gaze and scene saliency","venue":null,"work_id":"40708bec-02b1-45a1-8669-9beac56efb28","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.618672Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:2df0918ddddf2624cf407ae1f2a2b59ca8f5015255d6852350d903419208413e","observation_id":"0e70f4c2-2bce-4b35-ac21-94e35617521e","resolution":{"observed_at":"2026-08-05T23:12:22.479913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.468722Z","title":"Detecting attended visual targets in video","venue":null,"work_id":"d9818411-d82f-495b-97f0-d93e6029c730","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.675129Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:9ce8844f163e4b0e133fd35c70017c97e34a7ee7a80b2b70be9ba5ae1a83ea39","observation_id":"7f599bc5-d63a-42a4-9bdb-40ab458e91ac","resolution":{"observed_at":"2026-08-05T23:12:22.471601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.459882Z","title":"Gaze estimation for as- sisted living environments","venue":null,"work_id":"2581719e-747a-41ca-aa7e-97390b5b14a6","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.745413Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:1a33e6e62b738b9d641ea7de2b53574d6be969a2a5d3d28d5ed55dd590972388","observation_id":"2f471177-13cd-4abf-8c95-b56ca21b4135","resolution":{"observed_at":"2026-08-05T23:12:22.462753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.452043Z","title":"Fast and robust multi-person 3d pose estima- tion from multiple views","venue":null,"work_id":"bcea130c-7761-4bdf-b025-b09395f905f9","year":2019},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.790854Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:cb9a09a90e01831c6556e18512baf3268079210cdeccadd8dcb846d6a360a297","observation_id":"0e11cedc-5973-4109-8ba1-28a7abb8f260","resolution":{"observed_at":"2026-08-05T23:12:22.454697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.444053Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"648e3e16-7acb-4207-91f0-112c654ba4d8","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.847447Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:e4d49758de260b987ddfe8ed1e87a1125ebca4f6434050ced58c3142cfa0711f","observation_id":"03ec5235-6363-40dc-b45c-d6fd225589bb","resolution":{"observed_at":"2026-08-05T23:12:22.446857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.435992Z","title":"The eyes have it: the neuroethology, func- tion and evolution of social gaze","venue":null,"work_id":"229e9f66-7d9a-4698-9fb6-cbf63820cd0f","year":2000},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.951124Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:c833f83eb16cac66a314f6f0d68c66442904641e74af4fe0cbb3e10232ccbd3b","observation_id":"4f78b97c-0877-45d0-b46e-b66909208892","resolution":{"observed_at":"2026-08-05T23:12:22.438835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.428065Z","title":"Dual attention guided gaze target detection in the wild","venue":null,"work_id":"90e1f47e-28a5-4002-8b86-38303598b596","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.009149Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:589bd2d07e0ab10ff5f457f449aed53599bc86e64e8f41ac44b5da25b245e8e0","observation_id":"b9199957-2ddf-41d4-8465-fec1100cca3c","resolution":{"observed_at":"2026-08-05T23:12:22.430669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.419316Z","title":"Social interactions: A first-person perspective","venue":null,"work_id":"a689841a-bb57-44c2-8a4c-ac52b3918f7a","year":2012},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.102338Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:5fd338ec342b3e12a10c602b4ae9ac5a681f3683d39c79a71f941401a12fa674","observation_id":"388f2899-635c-429e-832a-ba8b16f73f8b","resolution":{"observed_at":"2026-08-05T23:12:22.422024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.410236Z","title":"Learning to recognize daily actions using gaze","venue":null,"work_id":"bdc39f36-9b15-4278-96bb-ba272e3ec437","year":2012},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.188101Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:51ccd544b773cf622b631ddcfc2e16a97d990567b0421bb9d6b489c9fa749465","observation_id":"2eba7f01-a287-4953-a4ee-3be18de76ecb","resolution":{"observed_at":"2026-08-05T23:12:22.413683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.401432Z","title":"A meta-analysis of gaze differences to so- cial and nonsocial information between individuals with and without autism","venue":null,"work_id":"88ab9b14-6032-4499-8d89-8742db21293a","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.231133Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:1a4e93f76f41f5293f16f29ff1f07fe1c9a557f3eb1a7bcde013db9d782392a9","observation_id":"7e7f57f1-931e-4a54-a67d-ebb66133d881","resolution":{"observed_at":"2026-08-05T23:12:22.404650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.290903Z","title":"Accurate, dense, and robust multiview stereopsis","venue":null,"work_id":"4a36a0dc-bcde-4c81-b9c7-7ead7190bb42","year":2009},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.271658Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:382caac2a4bab8727d224e54a48e1084e46e128931bdab1c6f8f64f3e37cbda4","observation_id":"30f3bfbb-4417-47cb-ae1d-7aedcd65b865","resolution":{"observed_at":"2026-08-05T23:12:22.395446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.282472Z","title":"A modular multimodal architecture for gaze target prediction: Application to privacy-sensitive settings","venue":null,"work_id":"83c32546-29db-4805-91c8-45e50f2482e5","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.377604Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:e45b2d8f55a0a2328251508a98381861b7b7b8657dc8b62d727e77ccedffa438","observation_id":"a13ea215-9296-4154-9605-80d88597d8bd","resolution":{"observed_at":"2026-08-05T23:12:22.285408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.274074Z","title":"A unified model for gaze following and social gaze prediction","venue":null,"work_id":"5841ba10-fcf5-459b-b351-c7555406a019","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.432892Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:225ae14a2ae876c1e05fa8941ec973ba8e6d786c474b039f18841dab50b33f01","observation_id":"f533c465-6f83-4f38-9c0d-6149a0dd17bd","resolution":{"observed_at":"2026-08-05T23:12:22.277017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.261693Z","title":"MTGS: A novel framework for multi-person temporal gaze following and social gaze prediction","venue":null,"work_id":"151b3f1f-653b-40a5-ae74-a635a16e4769","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.554134Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:1ab29f8f35aaa4898e367e97adea0251b4b16a453536446cb2bf2f797a349de3","observation_id":"9e182156-d73c-44ec-b31b-6e247615d08f","resolution":{"observed_at":"2026-08-05T23:12:22.264411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:16.630251Z","title":"Multiple view ge- ometry in computer vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.630251Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:7cb34f2249ae2709c03ad1e38dbe3523e865dd388ea0dcc61e8efa63ae640118","observation_id":"7f402f56-6764-4894-877d-2cb67d522279","resolution":{"observed_at":"2026-08-05T23:12:16.630251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.248968Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"df16e965-82f7-4f8a-9962-82ddd66871fd","year":2016},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.667615Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:874ab356e3d0f2a13af865eb3584faf6325f368988b8b6052498debeddbc2528","observation_id":"47ec140e-1c92-4a6c-97a5-7c3a791f7e03","resolution":{"observed_at":"2026-08-05T23:12:22.251792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.241074Z","title":"Epipolar transformers","venue":null,"work_id":"c2758328-0fc8-41fb-a297-5f3b6bcb7330","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.741497Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:3e30b93d674578a19c0f735b57535880b5cfc07d1ecb3aae3bfccc595921e72d","observation_id":"e8298c99-ff81-4e4a-b496-e58332ece39b","resolution":{"observed_at":"2026-08-05T23:12:22.243588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.232520Z","title":"Rotation-constrained cross-view feature fusion for multi-view appearance-based gaze estimation","venue":null,"work_id":"dbe80d3e-6bd8-437a-82fe-fb82e7043cdc","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.825432Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:914d728a84085400f9d84195461b15f12d3c9c5548ee2f8227cdeeca26dff0e8","observation_id":"a5f25754-6fa2-4c86-98dc-94978ee481ca","resolution":{"observed_at":"2026-08-05T23:12:22.235253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.224596Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"7bb2b06e-9c41-4cc8-8957-6b5397990e7d","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.862349Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:a658bb301a8f322609f066103ccfbd50a01e34cbdadffa35002f6920a299f8fd","observation_id":"efbf6fc0-820c-436c-963d-c7cff65f5d29","resolution":{"observed_at":"2026-08-05T23:12:22.227557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.216145Z","title":"We know where they are looking at from the rgb-d camera: Gaze following in 3d.IEEE Transac- tions on Instrumentation and Measurement , 71:1–14, 2022","venue":null,"work_id":"c9056948-60d2-4a49-b912-a97ae8bd1d0d","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.928346Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:ba8f3804b2b893679a91125f033a8bd860278cbe5d7b3e582878dc3550775fa4","observation_id":"cf60ba83-ac8f-49a5-a87f-dbcd9224f176","resolution":{"observed_at":"2026-08-05T23:12:22.219548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.208065Z","title":"Gfie: A dataset and baseline for gaze-following from 2d to 3d in indoor environments","venue":null,"work_id":"61ef1f7d-3eeb-4ec1-9e40-e5240ae74f1c","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.948306Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:9be984a866f822a6983f8bcecbd51bfb35a9c47d0dbcaeddd7c3275015700d1e","observation_id":"155c5f73-7e87-4bef-97e8-b74ca44622ca","resolution":{"observed_at":"2026-08-05T23:12:22.210796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.199514Z","title":"Smart construction","venue":null,"work_id":"10fe7b59-2428-47f9-8fc7-a683ca0d2904","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.054971Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:7360d0179081471ff968c01f6babf8677b82d018526ea9a9be5432cc3f6bf6de","observation_id":"dbd2547c-477f-4c40-b1b6-9561160a1e83","resolution":{"observed_at":"2026-08-05T23:12:22.202312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.191028Z","title":"Epidiff: Enhancing multi-view synthesis via localized epipolar-constrained diffusion","venue":null,"work_id":"8bad731e-03be-465c-9ddc-cfd5ceecd8e7","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.132449Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:cfe98398172a863c53f4835bafa0928d314b84172156672b4d15f388e0e907dc","observation_id":"d5e37013-6e06-4cc1-8d68-6579e3678c6f","resolution":{"observed_at":"2026-08-05T23:12:22.194026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.182632Z","title":"Learnable triangulation of human pose","venue":null,"work_id":"699a4458-1b81-4cdf-bb08-813a6e4af182","year":2019},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.200874Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:2f60943008874a100f24b100d9cf392a35a8a7d5fb0221535445a723545edb53","observation_id":"71bad21c-01fc-40c9-8df7-1179db1cdbbc","resolution":{"observed_at":"2026-08-05T23:12:22.185565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.174143Z","title":"Eye tracking in human- computer interaction and usability research: Ready to deliver the promises","venue":null,"work_id":"b4cc278b-1477-4497-8972-6b8c87cfdfc5","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.337137Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:a81999b9931753172e80dee895cccf4117df0a4cad73dd46ee710ba976e37ad3","observation_id":"88e564a6-194f-45f4-bc94-209e06017148","resolution":{"observed_at":"2026-08-05T23:12:22.177399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.165034Z","title":"Learning a multi-view stereo machine","venue":null,"work_id":"5401c14e-21f6-4ef9-ae49-c72fa5a2c9ea","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.370807Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:b48fec63d31b77f6eb9c9db69759c050866f84f2d353c7f4715c8e7c73912f6b","observation_id":"2043dc41-fac4-4e2c-9539-4a12399166b3","resolution":{"observed_at":"2026-08-05T23:12:22.168536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.156382Z","title":"Gaze360: Physically uncon- strained gaze estimation in the wild","venue":null,"work_id":"ce44c79c-5eae-49cc-a61c-e51453a0f4fe","year":2019},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.441279Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:b3015342440a089281959b1ac01e61e347f5a5a37f139a3a0e2ece4bef5dbb90","observation_id":"edc7f50c-d2cc-42fb-ac3e-6d04ccc9b5db","resolution":{"observed_at":"2026-08-05T23:12:22.159485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.148231Z","title":"What uncertainties do we need in bayesian deep learning for computer vision? Advances in Neural Information Processing Systems, 30, 2017","venue":null,"work_id":"79dd1026-2f78-4025-878c-c904e50b17a5","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.595861Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:55a6bff22a46d02e0ea36bcd85035616745b033a0ae7358fd3e99b991e7373a9","observation_id":"9e5ccd9d-2b8c-4f74-ae7b-4c7be4363416","resolution":{"observed_at":"2026-08-05T23:12:22.151071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.140233Z","title":"Imagenet classification with deep convolutional neural net- works","venue":null,"work_id":"666f465f-b8c0-4b19-9b59-96134d7d629c","year":2012},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.659693Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:988b000d8611d1a4565cc14a57f279d0d2f7c7f133682eb0c32370f020ecff15","observation_id":"95e12600-3ba4-4db6-a129-8a081abb0e0a","resolution":{"observed_at":"2026-08-05T23:12:22.142931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.131841Z","title":"Looking here or there? gaze following in 360-degree images","venue":null,"work_id":"d25e572f-39b5-4007-8bd0-d7a2ce6c26d6","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.803981Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:31c623cbc5b96e637419602957023657c14ec9fd0682f8d69b99c87b045adf65","observation_id":"be0f8150-2a37-48b9-9412-dc34a16d677e","resolution":{"observed_at":"2026-08-05T23:12:22.134884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.123388Z","title":"Believe it or not, we know what you are looking at! In Proceedings of the Asian Conference on Computer Vision , pages 35–50","venue":null,"work_id":"52fe35f1-8b93-4d26-aa14-db9cba53686a","year":2018},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.876025Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:ef6555019d9c8cc1507c050b2df317b9513f083bc57651cf614863cf7df86cd2","observation_id":"6122db05-f11a-44dc-ac68-573b2a5fede6","resolution":{"observed_at":"2026-08-05T23:12:22.126223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.114998Z","title":"Deepgaze iie: Calibrated prediction in and out-of- domain for state-of-the-art saliency modeling","venue":null,"work_id":"48b0593a-4acd-4791-bd26-ec9a38125a42","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.982830Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:7934cd802a6fd7b098550a55856bee753ad63f6ea4bc02a1f7211cec7cfcc100","observation_id":"658c4319-ae62-47da-9dbe-60b92cd7e6d0","resolution":{"observed_at":"2026-08-05T23:12:22.117920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.106241Z","title":"3d gaze estimation for head-mounted devices based on visual saliency","venue":null,"work_id":"73e4111a-80c8-4fa3-9708-5b01dcd4fd00","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.097529Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:05bc5b5350efcf4542a40a33890701480b08fa45b95ab080f3eb1b457d79126d","observation_id":"3d2a0165-87ee-4210-80f5-82e5fd8083b5","resolution":{"observed_at":"2026-08-05T23:12:22.109348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.097483Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"7c1c2c3f-d27a-4200-b609-f47bd6726c29","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.232538Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:77c14f060102a6bd785e40fc4f2af8bf7b12201b7f3f48e7e551dad2e65d5740","observation_id":"c47ee526-5ea7-4883-919d-8a521d0b134f","resolution":{"observed_at":"2026-08-05T23:12:22.100497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.088184Z","title":"Patch- level gaze distribution prediction for gaze following","venue":null,"work_id":"70bb08c6-0624-4612-84fb-f193e7af52cb","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.407703Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:de4f14facffda75b5825ffb864d2fe2a55d54e50a4c37b507c7ab7d6f5ca1761","observation_id":"929ac6c8-2678-4e2f-9ff2-2f09056893d5","resolution":{"observed_at":"2026-08-05T23:12:22.091512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.079929Z","title":"Diffusion- refined vqa annotations for semi-supervised gaze following","venue":null,"work_id":"a05f1226-1055-46aa-b7c4-0d1ebc61b4e7","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.562393Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:346a67e7734aeade8ef4bb1e7f72360983c4cade9822fa059fe8ecc7e96a3deb","observation_id":"ea72dccd-691b-4bd4-b346-ff4098582bde","resolution":{"observed_at":"2026-08-05T23:12:22.082681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:18.672118Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.672118Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:d36c6fd152dc1e68c48d05d07b0019957896dfd3c18609c9659ee4a2d6bce9e1","observation_id":"c19e05b0-9dbd-4a75-a01e-03116bc58e17","resolution":{"observed_at":"2026-08-05T23:12:18.672118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.064909Z","title":"Dynamic 3d gaze from afar: Deep gaze estimation from temporal eye- head-body coordination","venue":null,"work_id":"5b801980-f93d-444b-bbde-5be4bafb40c3","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.824660Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:4341378da0dc1d08052dba15814610292243b4405e7be6c3d77a77d19aa7a0f1","observation_id":"149fcc32-ce9b-4d68-85fd-81d30dc409bd","resolution":{"observed_at":"2026-08-05T23:12:22.068107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.055048Z","title":"Apriltag: A robust and flexible visual fiducial system","venue":null,"work_id":"f706e7bd-ba8e-43c2-865f-aae5cf1860c8","year":2011},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.948418Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:5b63936b8e8c0c696f01489720afc1d48d183f29890cb4b2c05dc6ad99efc955","observation_id":"00b85e36-76dc-4f42-b415-a7ed39e0a8bc","resolution":{"observed_at":"2026-08-05T23:12:22.059502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.046925Z","title":"3d social saliency from head-mounted cameras","venue":null,"work_id":"ba178457-ea23-4c25-a886-4b765f2420ed","year":2012},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.094285Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:10590f3b019f12ee8a2b69c72afe66a05325ad9b58113f9f759d8c7591d775af","observation_id":"da1b9572-e422-433f-bd6a-ca4aff5b346e","resolution":{"observed_at":"2026-08-05T23:12:22.049759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.951192Z","title":"Towards end-to-end video-based eye-tracking","venue":null,"work_id":"77e49462-b400-42be-813f-d176dc420057","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.228983Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:d3fb7bfd391538fca380bb7e497a421b4e7adb405a7c39d9a1a31f40fe003810","observation_id":"10a7cfee-a17b-47c8-a285-0b43e4e87d9a","resolution":{"observed_at":"2026-08-05T23:12:21.963845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.934095Z","title":"Cross view fusion for 3d human pose estimation","venue":null,"work_id":"0dd9d06d-866a-4cae-b365-91c308e6dc35","year":2019},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.359995Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:047fa27abaa40388ed8d1f79a8fde804f9ec0aee1cf2a46860a661c6744ace07","observation_id":"3f825fa6-e3e9-4962-bf18-f91756385c5b","resolution":{"observed_at":"2026-08-05T23:12:21.940424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.924233Z","title":"Where are they looking? In Advances in Neu- ral Information Processing Systems","venue":null,"work_id":"ed4384a9-1937-4432-9679-9c207f5c30a6","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.514789Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:9b22b843e621971c4d6d8a2b32e6f0977c5f440904facff30b00d615807da1c0","observation_id":"ab7e0b32-c20f-4231-b10d-0f96a88ed62e","resolution":{"observed_at":"2026-08-05T23:12:21.927491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.916664Z","title":"Following gaze in video","venue":null,"work_id":"568793b9-7d7d-4274-94c7-68b56108e1bf","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.706265Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:165e9bfb95ddf3f5c71f06548909bc21db76c304a01a1bc1944575442f2eb9af","observation_id":"15f29581-6cfb-4117-807f-35968b262094","resolution":{"observed_at":"2026-08-05T23:12:21.919173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.909145Z","title":null,"venue":null,"work_id":"bd563600-3e3d-476f-a18f-047a296632b4","year":2018},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.828932Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:72cdd4253dbc35b420ec80e4f4d9bd6a1f2cc57f101b5542ab5e36dacc25002e","observation_id":"a6953361-7bbb-4d2b-85d2-87945c2ed952","resolution":{"observed_at":"2026-08-05T23:12:21.911604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.900628Z","title":"Flexible cooperation be- tween human and robot by interpreting human intention from gaze information","venue":null,"work_id":"a9aa6866-29b2-4df1-a02a-1a898cf0e34d","year":2004},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.955552Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:f5767f141ed506b4f14c5a50d628bca2d55e4df72b5e4b5b4d35a24d9c8c9fe8","observation_id":"33e65222-8da5-48ae-aa7a-cad1f20b86d6","resolution":{"observed_at":"2026-08-05T23:12:21.903162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12778","last_updated":"2024-11-14T11:21:09Z","snapshot_observed_at":"2026-07-06T17:47:02.560132Z","submitted_at":"2024-03-19T14:45:17Z","title":"ViTGaze: Gaze Following with Interaction Features in Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12778","snapshot_observed_at":"2026-08-05T23:12:20.018137Z","title":"Vitgaze: Gaze follow- ing with interaction features in vision transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.018137Z"},"links":{"cited_paper":"/paper/2403.12778","citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:3ca802dc36c11d2f466ce27c1351b4dc8c6f5d41d2d036d7a9dc29fb5e7980ae","observation_id":"b804309d-78c2-449d-8ac6-fb68046bdb0e","resolution":{"observed_at":"2026-08-05T23:12:20.018137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.892471Z","title":"Child- play: A new benchmark for understanding children’s gaze behaviour","venue":null,"work_id":"4dd05964-9004-47ee-8747-9626cb4bd166","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.143092Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:0433793fb5c3406c95fd71365d383e66304f5d8ef6865cf18b5322200745b29f","observation_id":"42da7089-37cf-4165-8e3f-01626c36240d","resolution":{"observed_at":"2026-08-05T23:12:21.895514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.884795Z","title":"Sharingan: A transformer architecture for multi-person gaze following","venue":null,"work_id":"7668a417-8640-4388-b637-a77d84adc15c","year":2008},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.292328Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:8d11c02c4585722608118d78e2e244003f9e8593a4b986c2801368169e77ad36","observation_id":"6a5cb637-9ba8-4199-8e43-a31328f7e8f9","resolution":{"observed_at":"2026-08-05T23:12:21.887608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.877200Z","title":"Multi- modal across domains gaze target detection","venue":null,"work_id":"f9e2482c-9a29-46fc-bf81-4969d34c4b59","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.337172Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:328074146438bab99e54ef861acca19f2ebbcd4f61c155c94daef432fc914b67","observation_id":"ae3672a0-1e31-40b6-ba8f-23f4aa225746","resolution":{"observed_at":"2026-08-05T23:12:21.879975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.869724Z","title":"Object-aware gaze target detection","venue":null,"work_id":"c3f94109-ef4f-47fa-81b1-6e281b5fee74","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.356424Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:3fab22a8d6c4bc4b5e6fdfc9446e752c40ee9732859e651388ec038c1f44b07b","observation_id":"a619653e-c759-409d-b032-43853affa962","resolution":{"observed_at":"2026-08-05T23:12:21.872393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.860873Z","title":"Al-gtd: Deep active learning for gaze target detection","venue":null,"work_id":"434832f2-205d-4330-a6fa-338a4db62372","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.432347Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:9ccfe53e3e17ccc02b48673c395de1e2affbb6c1ca8b370a58f8b7d1a7ccb9f4","observation_id":"f2522758-e819-4743-b559-719a937102dd","resolution":{"observed_at":"2026-08-05T23:12:21.864357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.853497Z","title":"End-to-end human-gaze- target detection with transformers","venue":null,"work_id":"3838d942-490f-4f31-ab71-d02ad8370b7f","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.533389Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:f7173a277c5585360fe69f69d45b0fb274220278caf41728aa10d5ecd63f4af5","observation_id":"b5f3f99f-9e5b-4aaa-ae29-4089dd5ec054","resolution":{"observed_at":"2026-08-05T23:12:21.856241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.845757Z","title":"V oxelpose: Towards multi-camera 3d human pose estimation in wild en- vironment","venue":null,"work_id":"0738901c-b2f1-4c68-9fa8-bbab1a2ce5b3","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.563750Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:0bbf49f2b776f8a4afffc4ebaf0c26642f78e2890ddb7ba4fd374eba26314f95","observation_id":"a8f5f774-f34b-41de-b052-a90c39709734","resolution":{"observed_at":"2026-08-05T23:12:21.848717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.837610Z","title":"YOLOv5: A state-of-the-art real-time object de- tection system","venue":null,"work_id":"05d2964b-0ea0-4b67-aae2-6e90c544559b","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.696848Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:7b4725338f252bcf06b636f2946b5e5b8389c4c7f84ac398be351073024030de","observation_id":"853f8169-80b2-4e39-8cda-1abc006d73bd","resolution":{"observed_at":"2026-08-05T23:12:21.840272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.830644Z","title":"Attention is all you need","venue":null,"work_id":"ebe8576a-75c5-4b3e-9d89-307533cf3bfe","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.823248Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:2b7ba1177aa74e1ff038e5f78fee985171b63aacca6934e2c19166029798247a","observation_id":"3e598bf3-81bc-4b53-8b84-1fa6f40f75b3","resolution":{"observed_at":"2026-08-05T23:12:21.833120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.823508Z","title":"Gaze behavior in autism","venue":null,"work_id":"2ed6e382-c0fc-4d5e-8bba-8e306a508717","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.939260Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:174b9fddf0efd2b2eb235e6010364c3085c48a25552a3e273e2dd3b134165d85","observation_id":"22d55566-8c0a-4eb9-bd69-0fdb44cc1bdc","resolution":{"observed_at":"2026-08-05T23:12:21.826071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.815379Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":"1d9671f4-0881-4cdf-a9a6-cd569416b5d5","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.986605Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:14bf1909ebe4fd7e822ca912cc628b61e2692411fcb7b56ea39b3fc44fb675cf","observation_id":"4ed24cb1-88b5-4e53-b84d-f4307e022a29","resolution":{"observed_at":"2026-08-05T23:12:21.818139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.807422Z","title":"Gaze target detection based on head-local-global coordination","venue":null,"work_id":"5043a552-1622-4509-b612-7a3050f39c64","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.124734Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:44d434611907f99adcec49ac56f10383823bc5825d69f48df4d83e425e103252","observation_id":"dd7e66be-68d2-4588-a89a-5467673922e6","resolution":{"observed_at":"2026-08-05T23:12:21.810171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.798547Z","title":"Gaze target de- tection by merging human attention and activity cues","venue":null,"work_id":"19e96b91-2f1b-46f6-8fbc-e3bb09d12914","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.218647Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:2a8b00fcf78f97dfd849aa95e305d244c499651cc3ce083aac447b181545e09c","observation_id":"49ab7205-106a-4fc6-9bf3-d355efdfb6de","resolution":{"observed_at":"2026-08-05T23:12:21.802114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.790176Z","title":"Mvs2d: Efficient multi-view stereo via attention-driven 2d convolutions","venue":null,"work_id":"cabeee7d-7428-466c-b100-7e08cd9add83","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.330545Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:8f4a0f3195d51a9283d0b2a26a73518ed631ef0c691badd170d7d943deb2a314","observation_id":"1dc093d5-ead5-47d2-8367-8d9f0901a288","resolution":{"observed_at":"2026-08-05T23:12:21.793178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.781056Z","title":"Mvsnet: Depth inference for unstructured multi-view stereo","venue":null,"work_id":"b1e8e2b0-6b92-4f91-89a6-a30bb9099248","year":2018},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.480786Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:274208749ff80a47d409dfed3b3e9751737195cd7aed94dede188473d8069316","observation_id":"5eadb762-3ab5-4b8e-b458-06f23fff0bf3","resolution":{"observed_at":"2026-08-05T23:12:21.784079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.772473Z","title":"Learning to recover 3d scene shape from a single image","venue":null,"work_id":"127c0698-6552-4b56-ad5b-04305cb7086c","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.591051Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:3ac312e51c58c28ea8ec41497dcaad36d41fda46d74bb67ab8dbe716e3d44b09","observation_id":"c69aadec-9f84-47e2-a8a6-715f0dff1056","resolution":{"observed_at":"2026-08-05T23:12:21.775160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.764560Z","title":"Metric3d: Towards zero-shot metric 3d prediction from a single image","venue":null,"work_id":"d59a6672-4ae8-4a17-807d-0be35e1693f4","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.676249Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:d3a23a2f219e482621cd66fd67e7bac62435ace37c57fb255a88cea907b5d2b1","observation_id":"6e79cc9c-8857-4ed3-9039-41cf9876d622","resolution":{"observed_at":"2026-08-05T23:12:21.767265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.756071Z","title":"What i see is what you see: Joint attention learning for first and third person video co-analysis","venue":null,"work_id":"e4c9b29e-c42a-4729-b4f4-3cb8041150f7","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.678787Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:f5949f5d6b870ea55e80722e9cee94832ad51135a4210a8d8730d2a3459f6319","observation_id":"9527fb49-843c-46a1-8176-e3060eb82beb","resolution":{"observed_at":"2026-08-05T23:12:21.759023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.747402Z","title":"Eth-xgaze: A large scale dataset for gaze estimation under extreme head pose and gaze variation","venue":null,"work_id":"82cdadcd-c40f-4516-8c3f-3027035f2863","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.681392Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:1a0456045754eb5b6276f8314aefcc47db192cc1ec18a7e2a5af00c46405a12c","observation_id":"a529d215-2842-499a-9d39-00a029319665","resolution":{"observed_at":"2026-08-05T23:12:21.750275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03320","last_updated":"2025-02-13T19:52:38Z","snapshot_observed_at":"2026-08-07T09:26:05.929391Z","submitted_at":"2024-08-06T17:55:58Z","title":"Hedge Fund Portfolio Construction Using PolyModel Theory and iTransformer","version":3},"cited_work":{"arxiv_id":"2408.03320","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.03320","snapshot_observed_at":"2026-08-05T23:12:21.716345Z","title":"Hedge Fund Portfolio Construction Using PolyModel Theory and iTransformer","venue":"q-fin.PM","work_id":"0d1383fb-84ea-4559-ab24-14fba41bd782","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.684190Z"},"links":{"cited_paper":"/paper/2408.03320","citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:9c5cb3cbaec8239f566db6f179829e636b595be32912cf4f275e0b6c102c4897","observation_id":"e3504334-2fc1-4319-b4fa-77abba49c50c","resolution":{"observed_at":"2026-08-05T23:12:21.721577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.738482Z","title":"We extend our model to use more than 2 views (S3)","venue":null,"work_id":"3369a9be-dcd8-40cf-bba7-934155bb2f65","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.686913Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:a0713c8f2743970ecfafb77d4b08e25137869aa2e3d3e7c59fb4924371270797","observation_id":"0e24a479-b5ed-453c-bbcd-9d9e0a0230f4","resolution":{"observed_at":"2026-08-05T23:12:21.741481Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T23:12:14.479188Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":70},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 0 inbound Pith citation observations for arXiv:2508.05857."}