{"as_of":"2026-08-09T22:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0ead6648334690f29b41430a359a5d18eb622c449c5d3df125b65f33eba852ea","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:30:09.037820Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01221/citation-record","integrity":"/paper/2608.01221/integrity","json":"/paper/2608.01221/citation-record.json","paper":"/paper/2608.01221"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-06T00:30:08.089921Z","title":"arXiv:2506.09985","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.089921Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:2fb60b8ad74d5dfa05f421f3f6d930bfa886b0cc4342277597a0ddeb71f36d91","observation_id":"32782625-100b-467c-8b64-f840b11318bc","resolution":{"observed_at":"2026-08-06T00:30:08.089921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13030","last_updated":"2025-12-25T08:16:05Z","snapshot_observed_at":"2026-07-06T22:38:59.725645Z","submitted_at":"2025-12-15T06:58:40Z","title":"Motus: A Unified Latent Action World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13030","snapshot_observed_at":"2026-08-06T00:30:08.173080Z","title":"arXiv:2512.13030","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.173080Z"},"links":{"cited_paper":"/paper/2512.13030","citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:7a14da77f1ee13166811246cc51c7e384575e287a8a85dc74f5ebe1abe612309","observation_id":"3f14bef5-3ec1-4761-b1f1-15b067ac7c5e","resolution":{"observed_at":"2026-08-06T00:30:08.173080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-06T00:30:08.276319Z","title":"arXiv:2503.14734","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.276319Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:3de92642834710b97243989a0c116bdc96534ba00abd2bb3b95511e9a919c5a9","observation_id":"203d8ed6-7d8f-4e54-95ed-ae6a5d4ba20a","resolution":{"observed_at":"2026-08-06T00:30:08.276319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03233","last_updated":"2025-08-27T03:43:58Z","snapshot_observed_at":"2026-08-07T00:53:01.614001Z","submitted_at":"2025-05-06T06:59:28Z","title":"GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03233","snapshot_observed_at":"2026-08-06T00:30:08.379265Z","title":"arXiv:2505.03233","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.379265Z"},"links":{"cited_paper":"/paper/2505.03233","citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:38b2dd89b40e9900c80d6e9fac5e32c33e219a690c9f3ef2172eb41feb868c18","observation_id":"1cf59f4e-f1ec-4739-bb61-d4480c1d34c0","resolution":{"observed_at":"2026-08-06T00:30:08.379265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12998","last_updated":"2024-07-17T20:36:14Z","snapshot_observed_at":"2026-07-06T18:48:08.251086Z","submitted_at":"2024-07-17T20:36:14Z","title":"Surgical Robot Transformer (SRT): Imitation Learning for Surgical Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12998","snapshot_observed_at":"2026-08-06T00:30:08.523573Z","title":"Kim,J.W.;Zhao,T.Z.;Schmidgall,S.;Deguet,A.;Krieger, M.; Finn, C.; and Krieger, A","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.523573Z"},"links":{"cited_paper":"/paper/2407.12998","citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:87581400a77f9ccdd3365c9477617bc8c5d64545fe76b1be849e75b7bf60f1f2","observation_id":"9816e9bb-d297-488e-94aa-3b7d5fe1a34b","resolution":{"observed_at":"2026-08-06T00:30:08.523573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.23531","last_updated":"2026-07-15T06:36:08Z","snapshot_observed_at":"2026-08-04T13:07:01.112683Z","submitted_at":"2026-06-22T16:11:15Z","title":"BiliVLA: Scene-Aware Vision-Language-Action Model with Reinforcement Learning for Autonomous Biliary Endoscopic Navigation","version":4},"cited_work":{"arxiv_id":"2606.23531","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.23531","snapshot_observed_at":"2026-08-06T00:30:09.306681Z","title":"BiliVLA: Scene-Aware Vision-Language-Action Model with Reinforcement Learning for Autonomous Biliary Endoscopic Navigation","venue":"cs.RO","work_id":"ac760ded-7311-4343-b47d-48f9d0220683","year":2026},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.699592Z"},"links":{"cited_paper":"/paper/2606.23531","citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:751eb051da2a56549287db08b70a19c6043836cf8e86a9c2116cbd5e4f654be7","observation_id":"18b10e59-51e2-4984-9c75-35f4cf1192db","resolution":{"observed_at":"2026-08-06T00:30:09.366239Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:30:08.794747Z","title":"Ma,T.;Zheng,J.;Wang,Z.;Jiang,C.;Cui,A.;Liang,J.;and Yang,S.2026.Dit4dit:Jointlymodelingvideodynamicsand actions for generalizable robot control","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.794747Z"},"links":{"citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:2215c83b74802e5315a43b13537b24959afc023639a226c66c86882d98d288eb","observation_id":"8f3ad506-b0ea-4e8e-9c0d-126008f85abf","resolution":{"observed_at":"2026-08-06T00:30:08.794747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10333","last_updated":"2025-08-14T04:20:19Z","snapshot_observed_at":"2026-08-05T20:32:29.550851Z","submitted_at":"2025-08-14T04:20:19Z","title":"ReconVLA: Reconstructive Vision-Language-Action Model as Effective Robot Perceiver","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10333","snapshot_observed_at":"2026-08-06T00:30:08.940833Z","title":"arXiv:2508.10333","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.940833Z"},"links":{"cited_paper":"/paper/2508.10333","citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:746ebf26382048582d40df5226e5246b40f4b768aa273caeb4ea01be6dde9755","observation_id":"7c3528a9-9a6d-477e-9437-b8c2a6af53d9","resolution":{"observed_at":"2026-08-06T00:30:08.940833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:30:09.037820Z","title":"arXiv:2603.17240","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:09.037820Z"},"links":{"citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:0afb4eea3a2ebb0c70d32794cc54dd5a0516e6912f36c24efdbf2a64848047b9","observation_id":"04edfc55-9b84-45c0-973e-2c032ef840ad","resolution":{"observed_at":"2026-08-06T00:30:09.037820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17725","last_updated":"2024-10-23T09:55:22Z","snapshot_observed_at":"2026-07-06T19:38:22.461739Z","submitted_at":"2024-10-23T09:55:22Z","title":"YOLOv11: An Overview of the Key Architectural Enhancements","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17725","snapshot_observed_at":"2026-08-06T00:30:08.446407Z","title":"InInternational Conference on Learning Representations (ICLR)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.446407Z"},"links":{"cited_paper":"/paper/2410.17725","citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:0162a3e6bb8ef754aec271aa67fa5ad03b4cf15203ba2d3e40b07d1c169c27a1","observation_id":"594d319b-8c93-4108-b6bf-36b483d5c1d2","resolution":{"observed_at":"2026-08-06T00:30:08.446407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00837","last_updated":"2023-09-02T06:13:58Z","snapshot_observed_at":"2026-08-05T02:40:36.238307Z","submitted_at":"2023-09-02T06:13:58Z","title":"Autonomous Soft Tissue Retraction Using Demonstration-Guided Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00837","snapshot_observed_at":"2026-08-06T00:30:08.872892Z","title":"Singh,A.;Shi,W.;andWang,M.D.2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.872892Z"},"links":{"cited_paper":"/paper/2309.00837","citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:33914b0e6772b428f4eb6ded37cd04744ef85698fcf337f43bd9df7c1dbca7ac","observation_id":"16d91e27-1e85-4292-ab4d-2d562b84a340","resolution":{"observed_at":"2026-08-06T00:30:08.872892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-06T00:30:08.004735Z","title":"arXiv:2501.03575","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.004735Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:36cef8bf6801fbfa5d5db78c53c47489157c0688bd8c297304ad031b23d33e96","observation_id":"28c8caca-bfe0-4fb1-b5bd-2ea4d7363ef3","resolution":{"observed_at":"2026-08-06T00:30:08.004735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21998","last_updated":"2026-03-22T15:37:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T17:07:43Z","title":"Causal World Modeling for Robot Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21998","snapshot_observed_at":"2026-08-06T00:30:08.621080Z","title":"arXiv:2601.21998","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-06T00:30:08.621080Z"},"links":{"cited_paper":"/paper/2601.21998","citing_paper":"/paper/2608.01221"},"observation_digest":"sha256:522b49484c5f56cb371277ddab76c5d488d3470c8851f99344448a335ef05bc9","observation_id":"41dd09bb-384f-4657-bdb9-bcae5fe01246","resolution":{"observed_at":"2026-08-06T00:30:08.621080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01221","last_updated":"2026-08-02T13:11:22Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T21:56:02.159830Z","submitted_at":"2026-08-02T13:11:22Z","title":"EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2608.01221."}