{"as_of":"2026-08-09T13:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:604d1bf93a677c80f34e88f12e8c52edfbf6ec9d8e7236aa2266a2f1ba68c819","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:39:42.406991Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14346/citation-record","integrity":"/paper/2505.14346/integrity","json":"/paper/2505.14346/citation-record.json","paper":"/paper/2505.14346"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:55.671648Z","title":"Accessed on March 7th, 2025","venue":null,"work_id":"d0a66cd6-c434-4076-9ebd-200bed06563f","year":2025},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:34.862985Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:7395c057a810360eeaf4c4c8be2bd4d58a7e1ae664516ac30c9843abc4539fc2","observation_id":"50c733df-7f08-4a61-9c77-49a021503606","resolution":{"observed_at":"2026-08-07T15:39:55.804426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:55.488038Z","title":"Hiervl: Learning hierarchical video- language embeddings","venue":null,"work_id":"4b2a3b8d-1fdc-481d-80fa-76660cec92c6","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:34.908511Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:6afbc1ad994ed6e002de55f1c4e7f0af09b9348012699c7af64598ed4daa58a7","observation_id":"068715c7-b6cb-4516-9bbf-8dde0a7ad146","resolution":{"observed_at":"2026-08-07T15:39:55.537415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:55.249338Z","title":"Walk detection and step counting on unconstrained smartphones","venue":null,"work_id":"08a0ed2c-2807-4d26-a57a-2b3baada4018","year":2013},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:34.994090Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:d29fc653f5e77ec3246bfff1070bdf75d8edc6741c83d4dc23d3b33dbcc554a0","observation_id":"7a206475-7f7d-409d-909b-ac98fa9b5a62","resolution":{"observed_at":"2026-08-07T15:39:55.357212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:55.044549Z","title":"Ionet: Learning to cure the curse of drift in iner- tial odometry","venue":null,"work_id":"7c58b0e8-9029-4980-bac4-9cc95698b52a","year":2018},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.083495Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:8e02ee29a0a1036e729088a94182be172e78397af3d3a4e20c6b27235419dcd4","observation_id":"dd476cf6-6433-4635-ac89-61c2d284410e","resolution":{"observed_at":"2026-08-07T15:39:55.132961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.07491","last_updated":"2018-09-20T06:48:37Z","snapshot_observed_at":"2026-08-08T14:47:29.150733Z","submitted_at":"2018-09-20T06:48:37Z","title":"OxIOD: The Dataset for Deep Inertial Odometry","version":1},"cited_work":{"arxiv_id":"1809.07491","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.07491","snapshot_observed_at":"2026-08-07T15:39:42.585624Z","title":"OxIOD: The Dataset for Deep Inertial Odometry","venue":"cs.RO","work_id":"8f88fc4d-c8fe-4112-a25f-63467bc4e8cf","year":2018},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.200561Z"},"links":{"cited_paper":"/paper/1809.07491","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2a687e79caae29c2cc00d9957731fcaba43886414702be4720944779f6650ce0","observation_id":"192282dc-2e89-4f98-a3a7-564f6d1aa100","resolution":{"observed_at":"2026-08-07T15:39:42.686966Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:54.634588Z","title":"Soundingactions: Learning how actions sound from narrated egocentric videos","venue":null,"work_id":"e5b25250-4f9f-4d91-9606-0ed18d17d95a","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.289853Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:ed6eaa23ee7e408aa1d6f8e02f2e96ba4e08f9992ffa1e6a0f6caf936b6aebde","observation_id":"12445029-c4fb-461f-9bf3-fad79d884dfb","resolution":{"observed_at":"2026-08-07T15:39:54.882998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:54.294633Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":"d2babdcd-cc8f-4d4e-aea9-0910c38f9dd4","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.375999Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:8882428602527ed93d6dcd5186dca49bf05b8f9b86733123672246f1bf5b016f","observation_id":"b2d13a74-5c06-4703-8a5b-c6cbaea4e37b","resolution":{"observed_at":"2026-08-07T15:39:54.424581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:54.026814Z","title":"Scaling egocentric vision: The epic-kitchens dataset","venue":null,"work_id":"a49db011-653d-4290-af90-8fccb691a8b3","year":2018},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.460251Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:e14b4b871c6846342b209847855787def9b420392fccf47d06cbe2efc29d460c","observation_id":"240f988a-13d1-43e5-bceb-9cabd51da174","resolution":{"observed_at":"2026-08-07T15:39:54.173945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:53.757428Z","title":"Scenefun3d: fine-grained functionality and affordance un- derstanding in 3d scenes","venue":null,"work_id":"15d2d8c4-344d-4deb-9f1c-c78dc376140b","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.548857Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:c5d4d448c8e07717da1bd29a8ed8d531f4e5d650b836f0350f18eaa58c49fa02","observation_id":"30025a4a-db8b-4c41-b8d2-44c54714d3d4","resolution":{"observed_at":"2026-08-07T15:39:53.889316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T15:39:35.640619Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.640619Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:b8c8238554a0321983cb0a0a055699d81ea1483219b31a885a630e055fe4f585","observation_id":"36a24ec7-68c7-4c1d-9a2b-ca2ca00dbddc","resolution":{"observed_at":"2026-08-07T15:39:35.640619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03567","last_updated":"2024-08-07T06:10:45Z","snapshot_observed_at":"2026-08-03T19:26:56.163863Z","submitted_at":"2024-08-07T06:10:45Z","title":"Unlocking Exocentric Video-Language Data for Egocentric Video Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03567","snapshot_observed_at":"2026-08-07T15:39:35.752090Z","title":"Un- locking exocentric video-language data for egocentric video representation learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.752090Z"},"links":{"cited_paper":"/paper/2408.03567","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:966a7132c394d24da21902e7dfadf5278d76065765b8d7172cc2424d790d4ec1","observation_id":"7555dd37-727f-4b78-af8a-d5708220016a","resolution":{"observed_at":"2026-08-07T15:39:35.752090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13561","last_updated":"2023-10-01T20:16:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T20:42:21Z","title":"Project Aria: A New Tool for Egocentric Multi-Modal AI Research","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13561","snapshot_observed_at":"2026-08-07T15:39:35.842230Z","title":"Project aria: A new tool for egocentric multi-modal ai research","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.842230Z"},"links":{"cited_paper":"/paper/2308.13561","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:ba0dd165011619a7575625f55889da3f7b8aec1a54d2f853269a543ff87fb8a4","observation_id":"1912a798-b19a-4641-81a5-0ca13b99033d","resolution":{"observed_at":"2026-08-07T15:39:35.842230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:53.476765Z","title":"Actionslam: Using location-related actions as landmarks in pedestrian slam","venue":null,"work_id":"4b77dd21-d46e-494b-a3bc-b668a26d2cc0","year":2012},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:35.958986Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:64364314602c5b69a923f6dd51c07622a4ec757d49b7e764f7e09053a63395e4","observation_id":"5c3bce37-a30b-4d1d-a96f-6f26538a8edf","resolution":{"observed_at":"2026-08-07T15:39:53.639204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:53.222869Z","title":"Positioning method of pedestrian dead reckon- ing based on human activity recognition","venue":null,"work_id":"c52c6ac8-7898-40c0-8b26-e7b78df4b276","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.129370Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:b1c3161071ed652472bc1bef01569af5af73e81e92aebddf5e2bd1e8f0429e63","observation_id":"f1a8a41b-37bc-42ff-ad28-686d6c675576","resolution":{"observed_at":"2026-08-07T15:39:53.330866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:53.010083Z","title":"Egovqa-an egocentric video question answer- ing benchmark dataset","venue":null,"work_id":"1161ff60-3427-4bc5-8a9b-f9e0dfc71987","year":2019},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.213956Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:482292a84406ac481a99fee8ba41291d70ff99dfc1398364ec1d67558e534472","observation_id":"c1587f60-b5ec-4761-ba5b-7aac6ef3bf78","resolution":{"observed_at":"2026-08-07T15:39:53.124370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:52.716591Z","title":"Mmg-ego4d: Multimodal generalization in egocentric action recognition","venue":null,"work_id":"93f7ee97-e0a0-4bc5-a5c5-c90e2e63e814","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.312929Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:672fdbfe5673f44b97e6519e0174ec7fb3922483ce7c9cd723fcd4e648826084","observation_id":"1c680ab0-ec5a-4ac5-856e-a6af1e9edc7f","resolution":{"observed_at":"2026-08-07T15:39:52.891220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:52.475761Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":"d9fb43af-3e99-417a-9779-d7d2b4373e6f","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.380796Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:38b280bc5bc8f70a160a7214d52b0c9f9d302b4cf76367c18fc668bb76b2fe4e","observation_id":"9834b9cf-28a9-452a-87b8-9428d1b44d2d","resolution":{"observed_at":"2026-08-07T15:39:52.582526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:52.261147Z","title":"Ego-exo4d: Understanding skilled human activity from first-and third-person perspectives","venue":null,"work_id":"9b57b88b-bf5e-4546-b93f-fb2f69fbbec6","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.442471Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:28189560b2da4e7e86229120fc7eb1742c594f18bd25b3b35fc183db7a51c394","observation_id":"648d0fc2-2ac1-49ed-a721-a17bdfb85cae","resolution":{"observed_at":"2026-08-07T15:39:52.381446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:52.074630Z","title":"Conceptgraphs: Open-vocabulary 3d scene graphs for per- ception and planning","venue":null,"work_id":"72c41de4-a386-4531-b75c-abfe0448b90f","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.560776Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2f1bb79844cd3e78cbdd73df8075cc92663ec756b9f96ad8051c92c26aa1eaf0","observation_id":"eb341687-fe32-4e08-b139-0665aed1ded1","resolution":{"observed_at":"2026-08-07T15:39:52.175358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:51.810518Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"f70f8b7a-86a9-4abf-8229-1d421f4cee1c","year":2016},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.667942Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:3ea53e31c74e0dd448229cd791c4f4586bf5d0158e554998e78e4280eff2921d","observation_id":"4261985c-eaab-4bd7-b5db-61131c8886d7","resolution":{"observed_at":"2026-08-07T15:39:51.923368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:51.524946Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"c60e3837-e62d-4447-a9cc-0df7dfc47e7b","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.730576Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:307066ba192f038882650b0f2255fe5bd74cad8772ef9ebe6d854f0481229b8a","observation_id":"a4492060-62af-46b6-ba41-93286638aa0f","resolution":{"observed_at":"2026-08-07T15:39:51.673144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:51.261612Z","title":"Ronin: Robust neural inertial navigation in the wild: Benchmark, evaluations, & new methods","venue":null,"work_id":"da8ef707-9085-4e48-b61d-6f8e6ed36baf","year":2020},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.816642Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:6ebfc1814a87fe5dec560e5ae856cc60fc13001f49e82f0506fc365909a55cf6","observation_id":"bc9ed6fb-a028-4d52-a3ee-180e9881c285","resolution":{"observed_at":"2026-08-07T15:39:51.382102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:51.240124Z","title":"Fusion-dhl: Wifi, imu, and floorplan fusion for dense history of loca- tions in indoor environments","venue":null,"work_id":"e0aa3804-2690-4b59-b80c-3356ce2188b0","year":2021},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:36.977749Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:fe8cd204cf38a46020e0b1e727ec77a17c42c703775c9888958cf824db74c2b9","observation_id":"561751ad-9342-4738-a6c8-af999876968d","resolution":{"observed_at":"2026-08-07T15:39:51.244391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:51.075711Z","title":"Neural inertial localization","venue":null,"work_id":"5d6f0e72-4af2-44e0-9a17-736fde25b4d6","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.089605Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:06ed1087566d50725ff60c33bafb03a3920ca0524ac4f1dd89b49f81218e7ba1","observation_id":"d932512e-9bef-4bfc-bc61-8b1837c16047","resolution":{"observed_at":"2026-08-07T15:39:51.165060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:50.842469Z","title":"Egoexolearn: A dataset for bridging asyn- chronous ego-and exo-centric view of procedural activities in real world","venue":null,"work_id":"9e3b4192-b955-4ab0-9067-e22d54361045","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.160987Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:e9dc0fdd9f0430ff1d6202f56f83866e9f877411f4d62d136b76bbc63873c273","observation_id":"24df2dad-d2e7-463d-b483-fc1c1e80bb1a","resolution":{"observed_at":"2026-08-07T15:39:50.946754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21080","last_updated":"2024-12-30T16:57:05Z","snapshot_observed_at":"2026-07-06T20:14:45.295346Z","submitted_at":"2024-12-30T16:57:05Z","title":"Vinci: A Real-time Embodied Smart Assistant based on Egocentric Vision-Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21080","snapshot_observed_at":"2026-08-07T15:39:37.248378Z","title":"Vinci: A real-time embodied smart assistant based on egocentric vision-language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.248378Z"},"links":{"cited_paper":"/paper/2412.21080","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:1edcc46fd1d3f42f7286259fb9d25e1925b31ace1408d0b4549d560a7203f628","observation_id":"72f24855-0ec1-4f79-87f8-ae86f6cb6ffc","resolution":{"observed_at":"2026-08-07T15:39:37.248378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:50.681649Z","title":"Video re- cap: Recursive captioning of hour-long videos","venue":null,"work_id":"3010120d-eaaa-45fa-9cac-bb1fcdb43e0c","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.370390Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:917cb651aae47bad355602ca4e90b9a7ed1d2d7aa38c5cf15a759b30f2c63345","observation_id":"5e1eff14-63cd-40d1-a92d-434607266873","resolution":{"observed_at":"2026-08-07T15:39:50.760582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:50.414925Z","title":"Posenet: A convolutional network for real-time 6-dof cam- era relocalization","venue":null,"work_id":"6d4c28f8-1b7d-4e0b-9cec-d9434ecfd6a2","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.463530Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:7eed0d17911afb2d40c1a80c10fb72f7d6e4af2e39251408747d5f5dba46c259","observation_id":"704dff94-b0b8-467b-8530-0a2ab857ae9a","resolution":{"observed_at":"2026-08-07T15:39:50.549740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:50.156868Z","title":"Deep learning-based pdr scheme that fuses smartphone sensors and gps location changes","venue":null,"work_id":"b5acaa5d-1f97-48c7-959b-7f3d52ab7373","year":2021},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.572547Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:76dfcaaebc779c95db1fed2b5ffb645b299a389287ccb600bcbc9fe13bc0b42d","observation_id":"5000705c-a1bc-49d9-b00a-f22d90966116","resolution":{"observed_at":"2026-08-07T15:39:50.272811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:49.909166Z","title":"Rtab-map as an open- source lidar and visual simultaneous localization and map- ping library for large-scale and long-term online operation","venue":null,"work_id":"6a34438b-2bb1-48f5-a22c-162288a71224","year":2019},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.657874Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:14ad20b14b803b6d18c36060292bf6576c7cdab97d5d9f1bfaa634bd8aff6f8e","observation_id":"98139734-9047-4a18-a93d-a7801989107e","resolution":{"observed_at":"2026-08-07T15:39:50.045479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:49.681052Z","title":"Keyframe-based visual–inertial odometry using nonlinear optimization","venue":null,"work_id":"50f14b8c-a7d6-4b41-9617-a8c755c90e7f","year":2015},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.758673Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:979936ec334f9bc29e7b8ab6ec7a4afe945199aca7ed9fecfb2ad7de6e6f7574","observation_id":"706ace9a-5447-41d9-a864-9c010d21356f","resolution":{"observed_at":"2026-08-07T15:39:49.788880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:49.432454Z","title":"A bluetooth/pdr inte- gration algorithm for an indoor positioning system","venue":null,"work_id":"5d131afb-6158-4cd9-b013-7067de084b89","year":2015},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.876233Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:46f9ac907e2be367dc01379ef315f569c5fca57fe79677bf5f6f015f60d1f965","observation_id":"c8cf1c0f-b30a-4324-89dc-4e117ddfdd82","resolution":{"observed_at":"2026-08-07T15:39:49.549468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01670","last_updated":"2022-10-13T03:31:05Z","snapshot_observed_at":"2026-08-02T02:01:02.764427Z","submitted_at":"2022-06-03T16:28:58Z","title":"Egocentric Video-Language Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01670","snapshot_observed_at":"2026-08-07T15:39:37.983698Z","title":"Egocentric video-language pretraining","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:37.983698Z"},"links":{"cited_paper":"/paper/2206.01670","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:7ef7ee297286858a8e45b918b0a5f343250342fbc981a29864e1d6a66777deda","observation_id":"73604ce4-2222-470b-bfc7-87998e443f22","resolution":{"observed_at":"2026-08-07T15:39:37.983698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15251","last_updated":"2025-05-05T12:16:10Z","snapshot_observed_at":"2026-08-07T17:59:34.896477Z","submitted_at":"2025-02-21T07:02:05Z","title":"SiMHand: Mining Similar Hands for Large-Scale 3D Hand Pose Pre-training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15251","snapshot_observed_at":"2026-08-07T15:39:38.081654Z","title":"Sim- hand: Mining similar hands for large-scale 3d hand pose pre- training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.081654Z"},"links":{"cited_paper":"/paper/2502.15251","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:6d1363856d342e89fa3b10814606de45e030bc594b3cb0b9870a3fd974276889","observation_id":"c4fe656a-b08b-4edc-b17c-ddad512d7d63","resolution":{"observed_at":"2026-08-07T15:39:38.081654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00343","last_updated":"2024-09-05T11:58:51Z","snapshot_observed_at":"2026-08-03T19:30:02.777803Z","submitted_at":"2024-08-31T04:19:02Z","title":"EgoHDM: An Online Egocentric-Inertial Human Motion Capture, Localization, and Dense Mapping System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00343","snapshot_observed_at":"2026-08-07T15:39:38.208632Z","title":"Egohdm: An online egocentric-inertial human motion capture, localization, and dense mapping system","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.208632Z"},"links":{"cited_paper":"/paper/2409.00343","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:34c622a4412f777a4cd5e50db8dc5e29873ae573fa9cc04f3b01249f49440764","observation_id":"94834aa9-216a-436d-b7b3-351f53c0a7ab","resolution":{"observed_at":"2026-08-07T15:39:38.208632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:49.254433Z","title":"Single-to-dual-view adaptation for egocentric 3d hand pose estimation","venue":null,"work_id":"50980f29-ad1b-4dfe-9724-9910de01bf7f","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.296172Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:978b710dd7fe92100630d4019ef883cad7e382dc415e859396c70d78210b81ce","observation_id":"4ce67aba-239d-4247-8808-68853a96b90c","resolution":{"observed_at":"2026-08-07T15:39:49.330232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:49.103007Z","title":"Tlio: Tight learned inertial odometry","venue":null,"work_id":"94e5ad52-976c-4195-946c-6407f2f2ee67","year":2020},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.392808Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:770dbd80eb7ba757d266f6dcc980f4433b8309c4e811c61b2fabdf7bd33646b6","observation_id":"f4c02532-35f8-4c80-aba3-0fca997c5ee2","resolution":{"observed_at":"2026-08-07T15:39:49.184482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.951686Z","title":"Vsrd: Instance-aware volumetric silhouette rendering for weakly supervised 3d object detection","venue":null,"work_id":"5173a4b4-bf21-4712-8a7f-761bebce3e8b","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.478118Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:1bbcbdcbc4170af5da9cf755eea3eb5147889bb2e07ba1925f5f01ce88a6d435","observation_id":"a05c3491-c3f6-4f0c-b6a6-c25f9b54ab51","resolution":{"observed_at":"2026-08-07T15:39:49.021716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:38.586545Z","title":"Distinctive image features from scale- invariant keypoints","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.586545Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:9958a7df3b36e801f9a7bad55a415bf4fea8eee61c3ca77aef73f6b3aa545491","observation_id":"ba5616b4-4719-4ebe-93a6-c7b2e6607fbd","resolution":{"observed_at":"2026-08-07T15:39:38.586545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.771947Z","title":"Ovir-3d: Open-vocabulary 3d in- stance retrieval without training on 3d data","venue":null,"work_id":"9ad33352-b857-4eda-8bc7-04428525a226","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.670909Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:14a344cdb5323ad68ff30e4934a4e76b69e4fe19b245d6093ebdd4ea4fbe5f54","observation_id":"7d43c3fb-2a9f-4470-aea6-bf06522cd40e","resolution":{"observed_at":"2026-08-07T15:39:48.841357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.650234Z","title":"Imu2clip: language-grounded motion sensor translation with multi- modal contrastive learning","venue":null,"work_id":"ad88a9db-0495-4fc1-a0ff-6d8925f487a6","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.784553Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:961df08ca020c809885db28a1343d6b64e2cfeace551304e185d35ab01fdede2","observation_id":"989b3ee3-a80c-48db-9426-fc24526a8edd","resolution":{"observed_at":"2026-08-07T15:39:48.702669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.487978Z","title":"A multi- state constraint kalman filter for vision-aided inertial navi- gation","venue":null,"work_id":"d4f97954-107e-468f-9192-9e5ff55f7fa6","year":2007},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:38.932564Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:43c2f5564b85dbd05ef286238a98a1021d0fc412f3424dc3052884713fb76a8a","observation_id":"6e64fb19-8b20-44a8-9e91-34a06e694207","resolution":{"observed_at":"2026-08-07T15:39:48.569794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.331293Z","title":"Slip: Self-supervision meets language-image pre- training","venue":null,"work_id":"9fd24f09-d7d4-48da-a52e-6cc02733bd85","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.011528Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:5949cdc64bd97fcc37a49a6691a95616da92cb36142fd95d643c91ef77c5be88","observation_id":"bc27b2cf-fcf2-4585-814b-139d4ec0978e","resolution":{"observed_at":"2026-08-07T15:39:48.407811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:48.179829Z","title":"Deep convo- lutional and lstm recurrent neural networks for multimodal wearable activity recognition","venue":null,"work_id":"af6b43d9-b18b-4097-9cd6-dfc2c2145cb2","year":2016},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.109123Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:e3fe1fda42f3719e495b511132cf858b89ee58879baec2a349aab93a52c60e73","observation_id":"d9fb2b6c-67a0-4147-a9f3-4151e680e0c3","resolution":{"observed_at":"2026-08-07T15:39:48.256670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:47.994567Z","title":"Re- view of microsoft hololens applications over the past five years","venue":null,"work_id":"56cd7daa-84bc-44a0-821f-3c496bb69037","year":2021},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.229177Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:1123876dea91b3981395ccfab969d4289b7f1c7d505ff36162b78b4ba7b7cc08","observation_id":"3fa8f81a-0b89-4e9d-b18f-769ebfebc1c0","resolution":{"observed_at":"2026-08-07T15:39:48.104424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:47.709013Z","title":"Modeling fine-grained hand-object dynamics for egocentric video representation learning","venue":null,"work_id":"0da35377-bab0-44b7-83a1-92352b12d664","year":2025},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.342351Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2bb78df88ca97a5548dbb42ba1f754c1787549860e58cba85ead6aafc577bbc0","observation_id":"6d560b64-bf3f-4996-bc45-9efd306e9264","resolution":{"observed_at":"2026-08-07T15:39:47.845508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:47.588676Z","title":"Egovlpv2: Egocentric video-language pre-training with fusion in the backbone","venue":null,"work_id":"7b0ec428-99d7-4812-8192-e7d56f241c92","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.428784Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:7446f42ca066b1b4d9f43249a07cf33953ab2492e3326f48264b386a1e56de5a","observation_id":"b8c8a1c8-68d3-4a79-af2c-54bb5bedaefc","resolution":{"observed_at":"2026-08-07T15:39:47.646535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:47.474072Z","title":"Pointnet++: Deep hierarchical feature learning on point sets in a metric space","venue":null,"work_id":"8f244e4e-4b0c-4991-b5cb-53648dae4ed0","year":2017},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.513629Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:7f83f0f364a9482c5ba6922cf880f468a45011f155fd861deabae4ef0316a362","observation_id":"697635c8-0f59-46cf-9fff-61a595b50582","resolution":{"observed_at":"2026-08-07T15:39:47.534691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:47.209776Z","title":"Vins-mono: A robust and versatile monocular visual-inertial state estimator","venue":null,"work_id":"ee87aed0-5817-4eed-a3f8-ed6682e3d885","year":2018},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.596757Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:c20186f72091cff62fe7fccdc1fbfc95aa23a4e56a6871f678b82fbee9a31e4a","observation_id":"30a782e4-d431-40d4-9e1d-fde2dcff0dda","resolution":{"observed_at":"2026-08-07T15:39:47.366756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:46.931038Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"cdff8476-0f2a-4506-ac9e-6d93bcecc987","year":2021},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.683793Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:0be7716957ced8aa1a819691310789ebcdefb4d26077589b78d66052dc06f235","observation_id":"7fee0379-1c2a-4d25-adde-4c3256b331df","resolution":{"observed_at":"2026-08-07T15:39:47.068084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:46.746299Z","title":"Lamar: Benchmarking localization and mapping for augmented reality","venue":null,"work_id":"e6104325-da60-4c4b-9eb5-5f58e1e03073","year":2022},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.770574Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2ad5d6ed9a26484673267dcd403a896621a1838b0c02894e6d216dfa5031e0ea","observation_id":"3c9449fe-3d87-470e-9ac5-87c1cd7ca8db","resolution":{"observed_at":"2026-08-07T15:39:46.799174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:46.554117Z","title":"Learning to segment referred objects from narrated egocen- tric videos","venue":null,"work_id":"abbed9a5-3dcb-4b77-87a9-5510abbe1e28","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.853287Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:3799102b6ce952a4234636ba173ed82366c9e5d17ff995f5f4e5cd37e29d3e9c","observation_id":"9edc5d0c-dab2-4e6c-918a-4f334c11bd90","resolution":{"observed_at":"2026-08-07T15:39:46.652556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:46.313227Z","title":"Last-mile navigation using smartphones","venue":null,"work_id":"0ad282e7-c378-4e8f-990d-ae3c6e120642","year":2015},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:39.932720Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:0017b63b7c77f7676fbc62fd3db61e1f47eda569378d02d5061e93aa8a16f4a9","observation_id":"3fb5fe28-a35d-407c-8cb2-80c301499d60","resolution":{"observed_at":"2026-08-07T15:39:46.414724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:46.156534Z","title":"Idol: Iner- tial deep orientation-estimation and localization","venue":null,"work_id":"752169d4-5598-4807-b332-9cc662781b1c","year":2021},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.009033Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:80c320996a60f1fd322b71046ddc2732c123e3c98bc783118308e4969be00e2c","observation_id":"9a0b1dc4-eeb1-46a8-ade0-73a08955b71b","resolution":{"observed_at":"2026-08-07T15:39:46.243566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13631","last_updated":"2023-10-29T14:04:25Z","snapshot_observed_at":"2026-08-05T15:00:57.933479Z","submitted_at":"2023-06-23T17:36:44Z","title":"OpenMask3D: Open-Vocabulary 3D Instance Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13631","snapshot_observed_at":"2026-08-07T15:39:40.122061Z","title":"Open- mask3d: Open-vocabulary 3d instance segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.122061Z"},"links":{"cited_paper":"/paper/2306.13631","citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:d524a5d330c042a3e0574633bc034c7c3e6025345eb66470f4bcc0833a7ccea2","observation_id":"c1966ac9-e1d8-48fa-83f7-6b8dfc648469","resolution":{"observed_at":"2026-08-07T15:39:40.122061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:45.974256Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks","venue":null,"work_id":"7f23dd87-a63b-486c-ab98-8c76557eed6a","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.204535Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2c918329674b6227fd4a95b5d248817f29c888e1f21d46cb2c4456b952f0bf8c","observation_id":"146fb7ca-14ff-471a-91dc-93f3c4ada970","resolution":{"observed_at":"2026-08-07T15:39:46.075526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:45.706280Z","title":"Mnas- net: Platform-aware neural architecture search for mobile","venue":null,"work_id":"28459ab2-3172-4421-923b-649e4c94143e","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.289977Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:e6389bdbe3976b3ea1a7432e332dff7f460a312a610b5e5d07611504debc3349","observation_id":"66976ade-a720-45ae-b85a-d49acc33ea79","resolution":{"observed_at":"2026-08-07T15:39:45.843843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:45.416393Z","title":"Strapdown inertial nav- igation technology","venue":null,"work_id":"0b335452-31a4-49ec-8070-bf50423c7d42","year":2004},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.396582Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:0183fa2c4fb7b89b1deee72737d79e6e9ac31406d9b3bd1281cc1eb86f97529d","observation_id":"245daa0d-08d4-4dce-b406-fd9bb2d6d713","resolution":{"observed_at":"2026-08-07T15:39:45.542520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:45.138530Z","title":"Attention is all you need","venue":null,"work_id":"5d26881f-e830-4a0a-9bf5-3cd2d8cfff43","year":2017},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.495621Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:38bc3327e5a363f66b546373596e5fd289b9999361b613a44f14fa9ffa478331","observation_id":"98c6e625-6dcb-479f-9b10-b55a3f81b08e","resolution":{"observed_at":"2026-08-07T15:39:45.266155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.953806Z","title":"Retrieval-augmented egocentric video captioning","venue":null,"work_id":"920c1a52-e541-45ac-a7c9-e3c1039ec1cc","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.623124Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:6a704d6b9d90f23e3855a61e411787ad36bc7c0ca453f560528c810cf473106c","observation_id":"ee34bb4b-997e-45fd-a418-9f128b209bd1","resolution":{"observed_at":"2026-08-07T15:39:45.053319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.821801Z","title":"Ulip: Learning a unified representation of language, images, and point clouds for 3d understanding","venue":null,"work_id":"9d809871-8191-4831-8688-2b4753dd24fc","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.725051Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:69e825007746fda2ca120a3367edbe61cd43e0e8ccdd23f8835319aae8748e6e","observation_id":"192092bf-46a4-4191-9d58-df4664ad8fa3","resolution":{"observed_at":"2026-08-07T15:39:44.871510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.625763Z","title":"Ridi: Robust imu double integration","venue":null,"work_id":"75b36d46-3aa7-46cf-b207-4acdde7a9a39","year":2018},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.826823Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:cb37dbcafb849524cfc0baa5dccfcd0c31c271303da6da297030a3478519bf5e","observation_id":"f062f437-b254-40ea-8530-85ab3d6cacf9","resolution":{"observed_at":"2026-08-07T15:39:44.714474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.422818Z","title":"Egolocate: Real-time motion capture, localization, and map- ping with sparse body-mounted sensors","venue":null,"work_id":"447ce988-60cb-4c29-a658-1fd185312543","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:40.975025Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:ddae9d7dee86b96a63da85f4c6a0506345e9b86b34d6410d0a58e458065090e4","observation_id":"6bd3b1cc-5d81-4930-b841-bc7ab0234601","resolution":{"observed_at":"2026-08-07T15:39:44.509920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.260477Z","title":"Automatic step detection in the accelerometer signal","venue":null,"work_id":"0daa3d78-85f3-44c0-81ec-9ad4f3456ff0","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.159579Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:d12ad0ad51f873e39d0be88e75927da485dd2be93851db0f1348ee9148efd625","observation_id":"35d1ccc0-71f2-4137-a7e7-18dd0d942d2c","resolution":{"observed_at":"2026-08-07T15:39:44.325536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.888668Z","title":"Re- tailopt: Opt-in, easy-to-deploy trajectory estimation from smartphone motion data and retail facility information","venue":null,"work_id":"60a8c701-80ae-4c60-b56a-4f87db311f2e","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.406044Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:51d223fbe69cc3c06055c94075c71965fb44c1afa9f4326e6ae9cd81af9fd5cc","observation_id":"3effe24c-4f8f-4134-aa86-1908dc2c39e8","resolution":{"observed_at":"2026-08-07T15:39:43.960819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.731252Z","title":"Imunet: Efficient regression architecture for inertial imu nav- igation and positioning","venue":null,"work_id":"b544f751-0d99-4aa5-9432-15d8bd6bbb92","year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.559844Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:6e888811bc6e08c17a92305d42262d45681e5cd9e31581fedaeb0375cd9d2098","observation_id":"754a219b-641f-4896-aff7-e78b4556d4ba","resolution":{"observed_at":"2026-08-07T15:39:43.813612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.603594Z","title":"Helping hands: An object-aware ego-centric video recog- nition model","venue":null,"work_id":"a5b22b36-75e4-4d75-a594-d044b40eba45","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.714309Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:f73ce06cd044456a4d44a10a35c8aa8786ca46f2e70a060ab5efd5929fda4672","observation_id":"4c73b1e0-7c23-4f1e-b48c-9393b3debf63","resolution":{"observed_at":"2026-08-07T15:39:43.662727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.480378Z","title":"Structural multiplane image: Bridging neural view synthesis and 3d reconstruction","venue":null,"work_id":"47ddfa36-6491-4dfe-a9e0-97feaa184c4e","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.827136Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:5ba8683668cc31b3ba16c78708f2c8478aca747dad427bf9eac122025f4a1e3f","observation_id":"5070c711-c143-4f4c-a3c3-b2a0d3b4770c","resolution":{"observed_at":"2026-08-07T15:39:43.536362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.241315Z","title":"Masked video and body-worn imu autoencoder for egocentric action recognition","venue":null,"work_id":"8a154cd1-219f-489e-8347-843432758503","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:42.008973Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2a6b9830325e33a164c52c74382e6af1e4534621d7a1a3e949832f80e6d0c5e1","observation_id":"7b3c07ef-9967-4e2f-8e4d-addffa783c73","resolution":{"observed_at":"2026-08-07T15:39:43.352003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:43.025402Z","title":"Learning video representations from large language models","venue":null,"work_id":"185028fc-6a95-441e-8a28-ae119f761075","year":2023},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:42.243921Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:2d784ac18f156e299ceb31bbe5142691a5d4d4a374076468cd10b7c76f6b5974","observation_id":"4bcaf59f-96b3-42e0-b710-eed5c2608d52","resolution":{"observed_at":"2026-08-07T15:39:43.127335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:42.893197Z","title":"While InternVL scores the highest on some metrics, SLIP generally attains stronger localization accuracy","venue":null,"work_id":"ff79e961-cb15-46c5-b1b0-dd47c0edc586","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:42.312113Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:edfc4c196c32b5ef608110f50aee3b107812c62b9d91e5cc3ea38d84e55121a4","observation_id":"44c7b5d8-0536-47a3-bda6-b47af1ea6b15","resolution":{"observed_at":"2026-08-07T15:39:42.945140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:42.776048Z","title":"The heatmaps featured in the video are interpreted similarly to those shown in Fig","venue":null,"work_id":"6fb5f044-4699-4a40-ba15-dfdbd5a3304c","year":null},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:42.406991Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:fcc4d0c3498dda0c524df15482ff23a057a60d112dda8a9b2f11bef78dd6afd9","observation_id":"9bb439eb-bf9b-49f4-8a38-ea00ac3b7aab","resolution":{"observed_at":"2026-08-07T15:39:42.833180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:42.134828Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":330,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:42.134828Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:8a80a4cb0d69060d6fd59d3c6a3b973b9e9b60ecaded531f7f48e3b01caa0ff4","observation_id":"08dc1c24-b30f-4b5c-8a91-7df63914776e","resolution":{"observed_at":"2026-08-07T15:39:42.134828Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:39:44.113047Z","title":"Springer, 2007","venue":null,"work_id":"59554c27-2fe9-4bc1-8536-c9aac1912e52","year":2007},"citing_paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance","version":2},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-07T15:39:41.292585Z"},"links":{"citing_paper":"/paper/2505.14346"},"observation_digest":"sha256:0d02e92f736ed661057a0a27449845238f5a61d1b40f68032f37b143f68d7fcf","observation_id":"7e411b4a-8c07-4048-8a98-bca4646ed033","resolution":{"observed_at":"2026-08-07T15:39:44.176782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14346","last_updated":"2025-07-26T23:19:43Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T15:33:50.790439Z","submitted_at":"2025-05-20T13:29:33Z","title":"Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":9,"verified_exact":1,"verified_fuzzy":63},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 0 inbound Pith citation observations for arXiv:2505.14346."}