{"as_of":"2026-08-11T10:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:01af9516de657ff404db289a2e068deaa2a62d23bfe2308f7157d0fd02ae45e0","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T00:37:50.994273Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.18124/citation-record","integrity":"/paper/2501.18124/integrity","json":"/paper/2501.18124/citation-record.json","paper":"/paper/2501.18124"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.439628Z","title":"Advanced endoscopic navigation: surgical big data, methodology, and applications,","venue":null,"work_id":"50600368-4b1b-4d17-9c28-2d0b1644da18","year":2018},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.867097Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:f990b609bfd76cec79da425e782a262f9a81723b63c2de7f3a934d44f37c2a85","observation_id":"37ff09fb-d352-489f-8f25-19f05535cdd2","resolution":{"observed_at":"2026-08-10T00:37:51.444696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.423738Z","title":"Comparative study of hand–eye calibration methods for augmented reality using an endoscope,","venue":null,"work_id":"fc73fcc7-1899-4b67-b3d0-716bf7019327","year":2018},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.872904Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:c1f642cc4237f188f5fc381e0987100b5735207ac2d7686336c7fc3650a74fd9","observation_id":"d30a612c-d9ad-480d-9bdb-12b5204000de","resolution":{"observed_at":"2026-08-10T00:37:51.428732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.407847Z","title":"Magnetic tracking of wireless capsule endoscope in mobile setup based on differential signals,","venue":null,"work_id":"a2d4726d-79ee-4349-97a5-8fd0f1956f62","year":2021},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.877905Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:5ba0816b22a92fb0c66373f73b13778f6575a1c142318f555aaa9bdcf19c11ba","observation_id":"125a9150-2f1c-4dee-a0c6-23d8c40b9504","resolution":{"observed_at":"2026-08-10T00:37:51.412951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.393243Z","title":"Location recognition using prioritized feature matching,","venue":null,"work_id":"cfe3e6d1-d693-4aa7-b98b-6a4f0bdb94e8","year":2010},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.882920Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:ba475a9bdb57143bb5063ebb3dd13e60588bccacf545bc2f03b2f3f574988f68","observation_id":"c7938811-8146-4349-bd40-8e49b5c76e47","resolution":{"observed_at":"2026-08-10T00:37:51.397684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.378563Z","title":"Fast localization in large-scale environ- ments using supervised indexing of binary features,","venue":null,"work_id":"277ef72f-c584-44d4-86c1-625c87deb118","year":2015},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.888038Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:631ce7ce730b0bafaa0d3a0e085a1423de0cbf09a2d6b742de847a0534ddd429","observation_id":"7a42b7da-04c6-4813-810b-e1ee6acfbb83","resolution":{"observed_at":"2026-08-10T00:37:51.383118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.363930Z","title":"A critical analysis of image-based camera pose estimation techniques,","venue":null,"work_id":"1c416d64-d095-42f8-96cb-0e7c9bc270a9","year":2024},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.893493Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:b5afdd5da9432482683920cd95e809211bb913c3b373783048b0d3a57255d5be","observation_id":"ba38d361-36a7-4529-8175-63c95aff1253","resolution":{"observed_at":"2026-08-10T00:37:51.368381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.349246Z","title":"Offsetnet: Deep learning for localization in the lung using rendered images,","venue":null,"work_id":"5a59c25b-9638-42a6-ba18-0b496dc99204","year":2019},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.899065Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:687b8e3aabcd9aefa36a1572a1fd7c52709d3e28cda17120544a8cd2c3a8c12b","observation_id":"1bc85022-04ef-4259-a2ab-e37ab5f5ee1d","resolution":{"observed_at":"2026-08-10T00:37:51.353751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.332928Z","title":"Bronchopose: an analysis of data and model configuration for vision-based bronchoscopy pose estimation,","venue":null,"work_id":"39de94c6-ba67-426f-a986-cc6ef99ededd","year":2023},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.904278Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:8ea6d9284f6b770b2d8b1d30379d4ef6d71edcd08b815c8b30321d4d060eab21","observation_id":"db26c5f1-4c10-4c2f-b0dd-5ce23d7ef092","resolution":{"observed_at":"2026-08-10T00:37:51.338156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.316090Z","title":"Endoslam dataset and an unsupervised monocular visual odometry and depth estimation approach for endoscopic videos,","venue":null,"work_id":"795c4529-9275-4bab-a63c-e399720c7dc6","year":2021},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.909008Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:92a339fa025a57a3f35f41cd92d444881777ee0aae90d6f2bd660c821d25b7bb","observation_id":"f7eeec39-befc-4018-a3c6-ff075b4ea2d7","resolution":{"observed_at":"2026-08-10T00:37:51.321960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.295123Z","title":"Self-supervised monocular depth estimation for gastrointestinal endoscopy,","venue":null,"work_id":"2c06fae9-f32e-47c8-a0dd-012680cab308","year":2023},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.913200Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:a8a4498facb9b128b1e5c1ef2a78b91d62242c98e09519d94a3423d978199589","observation_id":"a6cabc6e-ff61-49e2-b217-fa3425db3ab7","resolution":{"observed_at":"2026-08-10T00:37:51.303644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.278401Z","title":"Self-supervised lightweight depth estimation in endoscopy combining cnn and trans- former,","venue":null,"work_id":"7304aa7b-db96-4e54-b227-36c11fa06512","year":2024},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.917456Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:9032085149489dc4017428d5fabbfc406a797203d8ba2a2c70b0d41fc085560f","observation_id":"c0aa8683-9418-4a0a-a504-1ae3d3070824","resolution":{"observed_at":"2026-08-10T00:37:51.283820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.262450Z","title":"Image-based localization using lstms for structured fea- ture correlation,","venue":null,"work_id":"3d32c576-a578-4477-bcf0-cf2760f79c05","year":2017},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.921926Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:1373f14bdd4c3be60eaaf496a4707fca9fe139e1d749d162ba80d8e4f7c239ec","observation_id":"ddecb84b-1430-4876-953d-85d909779934","resolution":{"observed_at":"2026-08-10T00:37:51.267512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.246347Z","title":"Vidloc: A deep spatio-temporal model for 6-dof video-clip relocalization,","venue":null,"work_id":"fae8efef-ce8d-4320-9d98-43006d0b4124","year":2017},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.926287Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:a08eb9bad08ada78e5eb48afdcaf8f88b6ae584f244bb8d8d5b0e5f18118f64b","observation_id":"b7f4a2ea-eca9-46d9-8ed7-56bc5df8bdf9","resolution":{"observed_at":"2026-08-10T00:37:51.251925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.229113Z","title":"Unsupervised-learning-based continuous depth and motion estimation with monocular endoscopy for virtual reality minimally invasive surgery,","venue":null,"work_id":"65139a01-bc55-4c39-9480-c5f4f67f334c","year":2020},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.930402Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:8f392c4a2baad5f91007dec52ca875a118294625ae41c8d452285ba1657e4262","observation_id":"b53adb1e-7b48-493f-8d7f-7822a8a2b6c9","resolution":{"observed_at":"2026-08-10T00:37:51.234423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:50.934433Z","title":"Bimodal cam- era pose prediction for endoscopy,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.934433Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:e22239d55d874a44874de1d1bac155863a706e2879b1f01d685ba0a5f28adc91","observation_id":"6fc2e20c-c029-456c-be2b-f263be9c2ab7","resolution":{"observed_at":"2026-08-10T00:37:50.934433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.202121Z","title":"Self-supervised learning for monocular depth estimation on mini- mally invasive surgery scenes,","venue":null,"work_id":"e3dcd07e-d4d1-4328-beb0-00aa498328d3","year":2021},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.938549Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:801a37cda883c804f49662c05b7c9bd4115b7e310b166a509368993ce403012f","observation_id":"966043b9-775b-4b2d-90d9-d1e23640fd12","resolution":{"observed_at":"2026-08-10T00:37:51.207722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:50.942467Z","title":"Posenet: A convolutional network for real-time 6-dof camera relocalization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.942467Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:4d110551bbdf49ef301d3a4318fb32cc5e504e2e5d7b9c45da660640ffddaa52","observation_id":"9f225d01-d481-4d03-a856-633469a2c917","resolution":{"observed_at":"2026-08-10T00:37:50.942467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.176552Z","title":"Deep regression for monocular camera- based 6-dof global localization in outdoor environments,","venue":null,"work_id":"fed40773-a874-49c3-a136-3c33a67f2e1c","year":2017},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.946350Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:39fffa27a0c6cce0af6ab391c8b8213d48057d8554f3660bfb5f558dde2573ae","observation_id":"d0612bea-16ec-4054-af0d-0a81ae445739","resolution":{"observed_at":"2026-08-10T00:37:51.181923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.160285Z","title":"Atloc: Attention guided camera localization,","venue":null,"work_id":"1691aa96-c4e8-43cd-9f58-f8675e4f5b95","year":2020},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.951312Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:43c9e242e2f622a88d947891ab91fddb8c692d507bbf8ddc0a5dc02d735a1358","observation_id":"dc5aeade-4654-4c9c-9c82-fada89d03a24","resolution":{"observed_at":"2026-08-10T00:37:51.165509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.145772Z","title":"Adversarial networks for camera pose regression and refinement,","venue":null,"work_id":"912ba258-a22f-46a5-bf46-6a9628157e93","year":2019},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.956237Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:2dbd34b419d1a9c1afa24757ea5236b6c15765c5b63bcaac605619d1c6c4f89a","observation_id":"5cb9b583-6ca7-486a-8aef-f08e6a2cdd32","resolution":{"observed_at":"2026-08-10T00:37:51.150235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.130273Z","title":"Vmloc: Variational fusion for learning-based multi- modal camera localization,","venue":null,"work_id":"fc4b41bb-9466-4d52-9bc7-b860ccda35fe","year":2021},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.961396Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:c50eda145673222dc44afcada2c4202fa990c6eeba5bef98d626b475a65a8e42","observation_id":"95a6f0b1-071d-4b61-bb7c-4e2fa07fdff7","resolution":{"observed_at":"2026-08-10T00:37:51.135656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:50.966069Z","title":"Learning multi-scene absolute pose regression with transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.966069Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:dc72f341ea19f6f4457a0879f4e09fc0ba246a39dade3e652419500552631d33","observation_id":"98ed6504-4d7a-4df9-9689-f704b74da482","resolution":{"observed_at":"2026-08-10T00:37:50.966069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.105371Z","title":"Digging into self-supervised monocular depth estimation,","venue":null,"work_id":"1d52a2d5-ce15-4382-9de3-ebeb2927ebf6","year":2019},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.970691Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:4521d915129b328ca76c231ae64f8f56496ac2219ce8e6b3844002eeccd9f977","observation_id":"5912b30a-5e3e-448e-bd01-59f92fa13ca2","resolution":{"observed_at":"2026-08-10T00:37:51.110121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.089170Z","title":"Fastflownet: A lightweight network for fast optical flow estimation,","venue":null,"work_id":"4babb2a4-1004-42f8-af14-5ab2b52cf53e","year":2021},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.975354Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:0efed0cb03579d6c306ce6301dd7a00fb82157a109da6e197056bc7e5980b27d","observation_id":"db4dfdbb-3840-48dc-82e1-cb22ffcfbc26","resolution":{"observed_at":"2026-08-10T00:37:51.094126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07992","last_updated":"2024-05-20T16:36:21Z","snapshot_observed_at":"2026-08-09T20:13:32.035904Z","submitted_at":"2024-05-13T17:59:56Z","title":"MambaOut: Do We Really Need Mamba for Vision?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07992","snapshot_observed_at":"2026-08-10T00:37:50.980142Z","title":"Mambaout: Do we really need mamba for vision?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.980142Z"},"links":{"cited_paper":"/paper/2405.07992","citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:956f713b8e76af4569298af8ecedd10f53664e774a38a7cf6e3cc3a78ba384ef","observation_id":"33e2e2a0-9e2b-43b8-819b-b803d1d980bb","resolution":{"observed_at":"2026-08-10T00:37:50.980142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:50.985434Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.985434Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:46062fb066e6e6f8a1f59cb1e275746c0962188d8043414f99e1132d10ad43ad","observation_id":"16faa96e-9d3b-4a0f-b507-d0cde8d78874","resolution":{"observed_at":"2026-08-10T00:37:50.985434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.062336Z","title":"Landmark based bronchoscope localization for needle insertion under respiratory deformation,","venue":null,"work_id":"7bf61043-5038-4ed7-bb0d-8a81c0ed75b3","year":2023},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.989857Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:fd4def6699c78a2b40addacc78eb05452682d0f92e11f4b84962cd935f604534","observation_id":"13d1308c-c5b2-4aa3-bfb9-f2fdddb1cd15","resolution":{"observed_at":"2026-08-10T00:37:51.067822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:37:51.044004Z","title":"Geometry- aware learning of maps for camera localization,","venue":null,"work_id":"3557ce3c-b13c-4507-b522-787318ceeca3","year":2018},"citing_paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T00:37:50.994273Z"},"links":{"citing_paper":"/paper/2501.18124"},"observation_digest":"sha256:5240078295803f9feeedf559bfeb116a15b5ef09b2481eeb72d143fe57bf0d70","observation_id":"2739d95f-f33e-45ab-a81a-2db02c0ee92e","resolution":{"observed_at":"2026-08-10T00:37:51.050873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.18124","last_updated":"2025-02-02T14:32:01Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T00:32:03.663259Z","submitted_at":"2025-01-30T03:58:41Z","title":"REMOTE: Real-time Ego-motion Tracking for Various Endoscopes via Multimodal Visual Feature Learning"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2501.18124."}