{"as_of":"2026-08-13T01:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0cfcc4ebd28390812d5982b959b13c3eba26f6b98afa8113e4e9449ee48b65b9","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:58:30.863754Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.17662/citation-record","integrity":"/paper/2411.17662/integrity","json":"/paper/2411.17662/citation-record.json","paper":"/paper/2411.17662"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.710403Z","title":"Asano, Christian Rupprecht, and Andrea Vedaldi","venue":null,"work_id":"3ec9c346-c050-4186-93ce-46abc1935d26","year":2020},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.244724Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:4bf30cf31806542ddf8ca776a68e4f4b3d07c7049aa8326f56144bc503cb8ba6","observation_id":"45a931ba-3ca0-45e8-ad29-1628c745530a","resolution":{"observed_at":"2026-08-12T11:58:32.716030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.690745Z","title":"Masked siamese networks for label-efficient learning","venue":null,"work_id":"fe3792fe-25a2-4854-8223-fb0953bc1f16","year":2022},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.306457Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:ad5b7eaaa4933a51f51b8555d425829ee4345e422a9894f9d0c11065778aaed8","observation_id":"99adea34-f8ba-4a16-8e39-bc5593fddb1a","resolution":{"observed_at":"2026-08-12T11:58:32.696344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.670569Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":"1fb6d013-8a87-4e9b-a484-63b541532e4a","year":2023},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.386639Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:88bfb3d55cdfa14092776136a9a9a499a084852cf311d0c7e8b5e7b26639deab","observation_id":"1da66d68-359f-4a0c-af5c-d2a5a44c84cb","resolution":{"observed_at":"2026-08-12T11:58:32.677109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-12T08:59:05.030983Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-12T11:58:30.396246Z","title":"Layer normalization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.396246Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:9ded9b867fc3853d8089247b95323ca8ee8c58197a69c548b116472f15a432f0","observation_id":"ab3dc828-0fdd-4a0c-96cc-ad199c71d41b","resolution":{"observed_at":"2026-08-12T11:58:30.396246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.640832Z","title":"Real-time holistic robot pose es- timation with unknown states","venue":null,"work_id":"0f61ee4a-9ff5-4f81-bc3a-52667bbe0a53","year":2024},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.410441Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:33c625809005ee27179d53f114fd057763526b4cfe09ac8fdc1d463a624ee9f6","observation_id":"e06b225b-a153-4d7a-9425-d0b7f10088ae","resolution":{"observed_at":"2026-08-12T11:58:32.651528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.614833Z","title":"Vi- creg: Variance-invariance-covariance regularization for self- supervised learning","venue":null,"work_id":"06ed1d2a-b92b-424c-9ace-ad3922563a26","year":2022},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.424957Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:4daec164f2b859c103780dc69bb1bbd1857d4cbecdf7917a4e5d7b3d59805495","observation_id":"c02d0f67-2f05-485d-b024-3e3a97f3e489","resolution":{"observed_at":"2026-08-12T11:58:32.623168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.592401Z","title":"V-JEPA: Latent video prediction for visual repre- sentation learning, 2024","venue":null,"work_id":"277a18dc-c557-44cb-ac25-1506d521cf9c","year":2024},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.430159Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:d37c2148ec5c789eab3910e4e17a47ecdcae2432d539055604c0198e290bc051","observation_id":"a64e1469-527b-4cc2-a09d-ec211a1c8390","resolution":{"observed_at":"2026-08-12T11:58:32.599571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:30.435023Z","title":"Unsupervised learning of visual features by contrasting cluster assignments","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.435023Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:e8be27458e650c70ca21339bfce2abc3a9a2fc04628c2037ecba2ac94e7cb5ab","observation_id":"19c4acce-f26d-46fd-bd2a-ca91a7856970","resolution":{"observed_at":"2026-08-12T11:58:30.435023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.547648Z","title":"End-to-end learnable geometric vision by backprop- agating PnP optimization","venue":null,"work_id":"d465fd8e-d129-4baa-95a8-f996c9859012","year":2020},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.439860Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:4584dfc901fe16b2f6bd2b0904d2c1667e144e139858069e508070afbe196eae","observation_id":"17ed9d19-1f36-44ce-b8a8-58bbda831d60","resolution":{"observed_at":"2026-08-12T11:58:32.559259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.397597Z","title":"Learning human-to-robot handovers from point clouds","venue":null,"work_id":"0a953acc-23e1-41ce-9c35-96cb05a88233","year":2023},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.444613Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:02367e7c3eb4e1645402ecd7ccb6314b84009f5e7a62fc57d1b3062fcbf940ac","observation_id":"dd7df435-4d4a-4b3b-9470-3b0e2b88a51c","resolution":{"observed_at":"2026-08-12T11:58:32.495123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:30.450237Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.450237Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:812aa6db77c69403437d7067faed7d22c1edf358d15857fc9fbdbcb914b82b9f","observation_id":"588ec1a6-4170-425e-b4a4-5b3970a52dc9","resolution":{"observed_at":"2026-08-12T11:58:30.450237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.243763Z","title":"ARTag, a fiducial marker system using digi- tal techniques","venue":null,"work_id":"953180a9-362b-4e73-b4d8-c1d2315f58f6","year":2005},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.456130Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:623e84144f12cea81ded7f0c63da38580da1a6923051170239a9fa3ebf46367f","observation_id":"b89cce2b-0ebd-4dba-abaf-4a90d4829724","resolution":{"observed_at":"2026-08-12T11:58:32.292761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.227309Z","title":"Automatic generation and detection of highly reliable fiducial markers under occlusion","venue":null,"work_id":"f8ca30bc-acac-4652-a474-2b9a6d2b0b8b","year":2014},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.461521Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:afd2c97b2562138ecf729555b0bde7727cf426f6ac20bb0f5ae7798949c291ce","observation_id":"072a32c9-3d87-4b04-b9bb-290c07bca79b","resolution":{"observed_at":"2026-08-12T11:58:32.232675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.212073Z","title":"PoseFusion: Multi-scale keypoint correspondence for monocular camera-to-robot pose estimation in robotic ma- nipulation","venue":null,"work_id":"65cf97af-5046-4558-b2c3-6ad9cfd96d54","year":2024},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.466459Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:71bec822c2484caa730fedae022e59902d1af41bfb141237376518fe7e08264f","observation_id":"71329ec4-9414-4171-adf8-928567279f7d","resolution":{"observed_at":"2026-08-12T11:58:32.216810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.196243Z","title":"Robust robot-camera calibra- tion","venue":null,"work_id":"df0a8a89-6538-4e71-9f8e-0b463f6d1051","year":2011},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.471343Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:8734a1b7967edbd9a16d69a8c348b70c720bd1ad78df2d6d7ad24b0c79ce012a","observation_id":"5ca0d2f4-7165-4c07-9c32-3985023aebc6","resolution":{"observed_at":"2026-08-12T11:58:32.201976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:32.142572Z","title":"Single-view robot pose and joint angle estimation via render & compare","venue":null,"work_id":"36cc6a6f-f076-4d25-b14f-4f7fb94d538e","year":2021},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.476382Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:2a5cdfe1b5b0748c7872ec6fb54167d93e6959923a11d8a24e81a9331ad50c2f","observation_id":"0510c842-0410-47e0-a270-15e860b21286","resolution":{"observed_at":"2026-08-12T11:58:32.182338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.986781Z","title":"Fractalnet: Ultra-deep neural networks without residuals","venue":null,"work_id":"75d70535-5661-4444-8b98-cc9a98f052ce","year":2022},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.480849Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:ffeab1d4ab05e5e661e0ce92ab9471f0eea7d6e003691b7fa1330840fcca1cf6","observation_id":"a58ed2e2-2cac-4dee-a844-7b99fc8ab103","resolution":{"observed_at":"2026-08-12T11:58:32.035170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.961856Z","title":"Cornernet: Detecting objects as paired keypoints","venue":null,"work_id":"7bcaf57e-6a6a-40d2-a4a5-055819796c64","year":2018},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.485198Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:c2af303ad3386b8719e1d15a06aca3e6e63b5d93c194778c5b8c02815cbf40ec","observation_id":"79a53c31-1410-4a91-b02d-62d06c18c0c6","resolution":{"observed_at":"2026-08-12T11:58:31.967779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.946107Z","title":"Camera-to-robot pose estimation from a single im- age","venue":null,"work_id":"c8082302-b119-45b8-834e-ac31ea3d5279","year":null},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.489778Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:a0f9c112e25131f0bd2802004872c83b5995316e99555d6814606f01d88ea1a1","observation_id":"38e5641e-daf6-4dc7-9a31-6ce25d5c7cef","resolution":{"observed_at":"2026-08-12T11:58:31.950953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.926941Z","title":"EPnP: An accurate O(n) solution to the p n p problem.Inter- national journal of computer vision, 81:155–166, 2009","venue":null,"work_id":"a0114609-2543-45c2-ba47-2a4a97a83f40","year":2009},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.495061Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:ce674f379ac7574d1e8b83e77525d0c162513e94049501c4737ac0c733f6491d","observation_id":"6a78e223-ac25-4661-b122-ee1490f6aa7a","resolution":{"observed_at":"2026-08-12T11:58:31.935486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.908388Z","title":"Self-supervised monocular multi-robot relative localization with efficient deep neural networks","venue":null,"work_id":"750e7e9a-9ecc-4f07-85ae-f8bd7ab08867","year":2022},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.500678Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:02579399c50b4adfab7a7e1a3b598658b23ec7bc36445dab889bd25b9f584e90","observation_id":"6ba48074-ea20-4bb4-ae3b-4d876ec172b5","resolution":{"observed_at":"2026-08-12T11:58:31.914503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.889628Z","title":"Focal loss for dense object detection","venue":null,"work_id":"4aefed0e-aacc-4b40-b895-242a02243b1e","year":2017},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.506195Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:31e438af63118a88b69790b4165a0fa2f5f27a5093b018aa7284f06c08da7e89","observation_id":"8f954c27-3644-4777-b970-bcdeac2ca352","resolution":{"observed_at":"2026-08-12T11:58:31.895731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-12T11:58:30.540480Z","title":"Grounding Dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.540480Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:c03c3384a2fe6e1d385493f7c65e1ebc2833db94e8798261c68751408dceac15","observation_id":"57f0178e-7cae-4dbf-8e05-8aa2c817f931","resolution":{"observed_at":"2026-08-12T11:58:30.540480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-12T11:58:30.590266Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.590266Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:01f19cfa7b3ccf73c4f6db610d9d964bf0a97ec1763575cf390cb2b37d6176c8","observation_id":"5681c775-0b5a-4a10-80ad-2d9fdee5b282","resolution":{"observed_at":"2026-08-12T11:58:30.590266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.868849Z","title":null,"venue":null,"work_id":"ef7df560-aa19-4ecd-bb5e-d100b204d760","year":2023},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.632670Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:586cb71707f3ad0a593bcd68f9a782a2d45855820cbc890e3ea89db9e72aa0b3","observation_id":"5bb54d8f-5a24-4f2c-90aa-d6ef16283591","resolution":{"observed_at":"2026-08-12T11:58:31.875933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.845456Z","title":"AprilTag: A robust and flexible visual fiducial system","venue":null,"work_id":"7d9de595-dfbc-4876-a55a-d48b9427c960","year":2011},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.732276Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:3a7381b66b41ec9aa5abc589becaee01a655752d24cbf9b12e7d6bace0afb0ad","observation_id":"a15d35c9-cdeb-4d1a-b794-b5fcfa5b6a4a","resolution":{"observed_at":"2026-08-12T11:58:31.853851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.817192Z","title":"Range-aided ego-centric collaborative pose estimation for multiple robots","venue":null,"work_id":"e5a27748-124c-4d5a-b92e-d8d8c119689b","year":2022},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.774162Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:3ddf02c40398a6caa34c34679a61e4ad50e70ed822c78390085b4f38e2f11cd8","observation_id":"426ae691-6fa7-44e4-b7fa-487ae4123b73","resolution":{"observed_at":"2026-08-12T11:58:31.831486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:30.785107Z","title":"Robot sensor calibration: solving AX= XB on the euclidean group.IEEE Transactions on Robotics and Automation, 10(5):717–721, 1994","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.785107Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:ef0bdd21426930dd764bf85fd96f1fa6797d36becba04619a5a664ec7f3440f3","observation_id":"2e78531d-cc39-4d1e-b666-fabce90df7d0","resolution":{"observed_at":"2026-08-12T11:58:30.785107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08501","last_updated":"2020-07-16T17:53:02Z","snapshot_observed_at":"2026-07-06T09:38:53.228850Z","submitted_at":"2020-07-16T17:53:02Z","title":"Accelerating 3D Deep Learning with PyTorch3D","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08501","snapshot_observed_at":"2026-08-12T11:58:30.800696Z","title":"Accelerating 3d deep learning with pytorch3d","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.800696Z"},"links":{"cited_paper":"/paper/2007.08501","citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:5985708cc0fa9fd9fb044b609bb05cef5996899e968aae4d8151b8d820587446","observation_id":"ebe57347-5c62-4424-9563-572c3b50382d","resolution":{"observed_at":"2026-08-12T11:58:30.800696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.757777Z","title":"Coop- erative heterogeneous multi-robot systems: A survey","venue":null,"work_id":"50520aa8-01c0-4748-ab45-f1dc76eb168b","year":2019},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.809140Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:e6c5d738f17ac83dd99cf270320d407c9b00655c9c1e42829830f0472aa71a6a","observation_id":"91f8f729-3eb5-4ae5-82ca-2a17c70d7920","resolution":{"observed_at":"2026-08-12T11:58:31.788415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.608016Z","title":"Semi-perspective decoupled heatmaps for 3D robot pose estimation from depth maps","venue":null,"work_id":"4594756f-9870-46a3-a136-1673b3727831","year":2022},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.816100Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:66f62cadd2d889602ed7b9b30050f5c85b72dba5758787aec9685b4e4920b6e6","observation_id":"8f4ddd8d-d99b-4e16-be7a-1c1634dd249d","resolution":{"observed_at":"2026-08-12T11:58:31.665306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12914","last_updated":"2023-11-18T15:22:04Z","snapshot_observed_at":"2026-07-06T16:10:03.571613Z","submitted_at":"2023-08-24T16:40:47Z","title":"3D Pose Nowcasting: Forecast the Future to Improve the Present","version":2},"cited_work":{"arxiv_id":"2308.12914","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.12914","snapshot_observed_at":"2026-08-12T11:58:30.977359Z","title":"3D Pose Nowcasting: Forecast the Future to Improve the Present","venue":"cs.CV","work_id":"aeaaf5d6-d117-4808-8472-c46216accd12","year":2023},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.822993Z"},"links":{"cited_paper":"/paper/2308.12914","citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:534607357dbe74d5a52e5c6b85a4a866f0bf25e3cef0d41c8ec62442da4e534b","observation_id":"8663252c-bd85-4846-b681-56b4188081ec","resolution":{"observed_at":"2026-08-12T11:58:31.047298Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.499525Z","title":"Pose estimation and adaptive robot be- haviour for human-robot interaction","venue":null,"work_id":"0be1c443-edca-482d-b244-4f08751e91f0","year":2009},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.829658Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:104ccda5a62de29750b113d7a9e9265d046570f812f8d68bb03652be5baef7e1","observation_id":"45d471c7-8669-47fd-afc2-e80037eb1f0e","resolution":{"observed_at":"2026-08-12T11:58:31.552941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.381832Z","title":"Robot structure prior guided temporal attention for camera-to-robot pose estimation from image sequence","venue":null,"work_id":"825b9df4-c9b6-4fcc-8858-a8a238df34e0","year":2023},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.835473Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:0892782d49f33dd73ca8ba188d2169c79140557ac66435a61b8136d1df2f94a0","observation_id":"96f371e9-ca42-4460-9e30-75c645e1602a","resolution":{"observed_at":"2026-08-12T11:58:31.426826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.364352Z","title":"Robot structure prior guided temporal attention for camera-to-robot pose estimation from image sequence","venue":null,"work_id":"dba387be-6244-461f-8ad7-b5d53c9f0c6b","year":2023},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.841515Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:dabbba266a2c13086d1b14c676fc77e027b8aff8a8d1ed50ccc6abf224850dd4","observation_id":"adfa7c9f-f0f5-4048-8172-985be6493588","resolution":{"observed_at":"2026-08-12T11:58:31.369717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.344528Z","title":"Robokeygen: robot pose and joint angles estimation via diffusion-based 3d key- point generation","venue":null,"work_id":"11c02a94-7dc2-4d67-807a-2ac1b64f6bb6","year":2024},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.847082Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:0b593e148a18aa2958da64a82c18bfd6739bb42f7269f536dfc7c5dee3c9f48f","observation_id":"21c3ba52-2e3d-4bbc-9fcd-12e1555f4c17","resolution":{"observed_at":"2026-08-12T11:58:31.351067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.327565Z","title":"Multi-view human pose estimation in human-robot interac- tion","venue":null,"work_id":"3f9d499b-3b18-4a62-968d-150b6ae9bcf5","year":null},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.852408Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:b966fb7ccaeae070138af945b0b5b63c6dd79a2447f8df9c927b2a2e10325434","observation_id":"696d198c-7c92-49c5-b295-aae8fac08af1","resolution":{"observed_at":"2026-08-12T11:58:31.332747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.300309Z","title":"Calibrating a robot cam- era","venue":null,"work_id":"2a333786-d0ee-4e12-bee8-878e977f83a5","year":1994},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.858952Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:c1a4ec1ce99dfefc03f76900e184ec748a836ebcd0e4c0f496399722a8e0fdd6","observation_id":"de23f824-0741-4bc0-8443-2484f8c73230","resolution":{"observed_at":"2026-08-12T11:58:31.311334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:58:31.278214Z","title":"robotic arm","venue":null,"work_id":"bc1b5500-e400-4038-bd11-478efb31fe79","year":2023},"citing_paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T11:58:30.863754Z"},"links":{"citing_paper":"/paper/2411.17662"},"observation_digest":"sha256:6328df906eceef396b919de7e7f32dccd37178db496ffa73b370749992a68506","observation_id":"1ddafd90-a575-40f4-ae31-6fb3d0a2a0fb","resolution":{"observed_at":"2026-08-12T11:58:31.283821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.17662","last_updated":"2025-05-02T17:36:47Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-12T11:49:57.723414Z","submitted_at":"2024-11-26T18:26:17Z","title":"RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2411.17662."}