{"as_of":"2026-08-21T01:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7513b9000bcf932acd8e8d4c60fc57294550eb0d21ed0266dfe55051f1d59b89","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:52:46.294825Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.19683/citation-record","integrity":"/paper/2504.19683/integrity","json":"/paper/2504.19683/citation-record.json","paper":"/paper/2504.19683"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.923701Z","title":"Rog- sam: A language-driven framework for instance-level robotic grasping detection,","venue":null,"work_id":"c6335205-bad2-4b8b-b0a2-1207bd3cd14f","year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.087821Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:7a127ee69129ecca42ef0b8923ec8d759e01eaca35cae6f6323dc368a387ca80","observation_id":"d1a297fa-f583-47cb-bfe5-3c13cf5fb968","resolution":{"observed_at":"2026-08-16T05:52:46.928316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.908954Z","title":"Coupling and decoupling: Towards temporal feedback for 3d object detection,","venue":null,"work_id":"ab2aed75-3ae8-4648-bf05-d40f1934296f","year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.092866Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:98fdb2af55185eb217fc1a23a79b223dfc589ab8667cbca4f217783938913ffe","observation_id":"93d9c62c-4fc4-4f56-8459-19db81f95931","resolution":{"observed_at":"2026-08-16T05:52:46.913653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.895647Z","title":"Openslot: Mixed open-set recognition with object-centric learning,","venue":null,"work_id":"dc688c7f-34d5-4dad-94e4-5d841d55efbe","year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.097193Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:26a3e96c54d0522ecd579ce8278720c6c0e7467e547f6de53e9c71549fd629ad","observation_id":"d6f6d4bb-0a92-4196-aa48-a322e98658ee","resolution":{"observed_at":"2026-08-16T05:52:46.900006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.883020Z","title":"Source- free elastic model adaptation for vision-and-language navigation,","venue":null,"work_id":"d6d44749-d37c-4dd4-85fd-6d3b38d544e4","year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.101472Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:d6180974d4dd8e18046807d01cb829352a5fea88984aea4d4a6c636f0ccc373c","observation_id":"30d82f98-ba3a-4da0-8c0c-5ade25b65950","resolution":{"observed_at":"2026-08-16T05:52:46.886998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.105757Z","title":"Flexvln: Flexible adaptation for diverse vision-and-language navigation tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.105757Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:5826332c917a7c6310b4b8aaba1bbfc8f353e77efe1807f144d8f2c0f588ed7d","observation_id":"36a4b377-03ce-4af6-93ed-b2900317475e","resolution":{"observed_at":"2026-08-16T05:52:46.105757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.860780Z","title":"Attention is all you need,","venue":null,"work_id":"a4cd847f-f2e5-4725-a8d1-bde5f5b47c77","year":2017},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.109968Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:9f023304e8a8e88f05289a5b1629a81e6ecaa63072fe6e73de53f72ad91c1f8e","observation_id":"5e7c822f-b722-405b-88d4-0224983c8ddf","resolution":{"observed_at":"2026-08-16T05:52:46.865096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.114766Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.114766Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:b7bcbee19625bbc3f3603e23c07ade7ac06229fe91a44760c0afa5ccc28b0451","observation_id":"683231f7-ffad-4c05-8bc6-a6f6710d4c2e","resolution":{"observed_at":"2026-08-16T05:52:46.114766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.839237Z","title":"Toward general cross-modal signal reconstruction for robotic teleoperation,","venue":null,"work_id":"659ccf30-de10-442e-8097-4d441e4afb0b","year":2024},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.118815Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:36a6432e69af1d4c35d346a66445c594a19b4a525cd5a89681d81105276f7e94","observation_id":"c19ef74c-3783-4861-be5e-faa91cc6b622","resolution":{"observed_at":"2026-08-16T05:52:46.843276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.122546Z","title":"Learning fine-grained bimanual manipulation with low-cost hardware,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.122546Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:90b41d876c8dd4dd32f4a791561674b132f12a7587cd0833f8fe2e2f8c2d38b8","observation_id":"322901fb-5621-4912-9008-72bd671bef9f","resolution":{"observed_at":"2026-08-16T05:52:46.122546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.817699Z","title":"Universal manipulation interface: In-the-wild robot teach- ing without in-the-wild robots,","venue":null,"work_id":"72c80087-948f-44b0-9f60-dbda22715d9b","year":2024},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.126519Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:2799c0aa81c84d0909627b1893d5ee4bd204a80c9a0a9deb030ccaec853af813","observation_id":"c4792b82-dd61-460b-9c87-a2f1510a9d1a","resolution":{"observed_at":"2026-08-16T05:52:46.822240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.130650Z","title":"Rlbench: The robot learning benchmark & learning environment,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.130650Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:a8da1279cd32275577adaa7d44724485398d00ac65998dfb650bbbbf0796c3d0","observation_id":"2253e06d-c2b1-4aa1-80c9-313a0f419607","resolution":{"observed_at":"2026-08-16T05:52:46.130650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.795690Z","title":"Perceiver-actor: A multi-task transformer for robotic manipulation,","venue":null,"work_id":"ff8a5400-07f6-486d-ac83-ccede224c07b","year":2022},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.134720Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:201d2681beae05726206679514ef84ba478422f45e47c251b5e1f3ac0b5cbbbc","observation_id":"00ae516f-2df3-42f1-a401-c3fd2e0e5812","resolution":{"observed_at":"2026-08-16T05:52:46.800021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.782875Z","title":"Act3D: 3D feature field transformers for multi-task robotic manipulation,","venue":null,"work_id":"dc6283a5-d53f-4b36-b4e1-65c9580f565c","year":2023},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.138850Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:edd6a49cd7d5ba46d4e85f77c6ae04fc1e7661ee248be7b06425d9aebe05d145","observation_id":"0edc1179-dcd8-4da8-85ea-2644c49924dc","resolution":{"observed_at":"2026-08-16T05:52:46.787077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.769688Z","title":"Polarnet: 3d point clouds for language-guided robotic manipulation,","venue":null,"work_id":"d0431961-12eb-4423-b0f9-fb1efd7c8fe3","year":2023},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.143033Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:26be18634856378eb81788fb5ad6ae43ecf48304ebfc3acf70f471342b995f76","observation_id":"4209fc01-7711-47f8-b42e-899bbd39940a","resolution":{"observed_at":"2026-08-16T05:52:46.773823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.755853Z","title":"Rvt: Robotic view transformer for 3D object manipulation,","venue":null,"work_id":"626e6437-b4d8-46b5-b3ba-68a0d53bf45b","year":2023},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.147173Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:08ca903e98558507bc35240913e87d9d66a88078d298da4c28660eb1725e1de2","observation_id":"0e96f7ad-a296-401e-897d-c19ad1312d53","resolution":{"observed_at":"2026-08-16T05:52:46.760609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.742322Z","title":"Rvt2: Learning precise manipulation from few demonstrations,","venue":null,"work_id":"88c9c433-7b83-4233-84be-60a7d4064f5e","year":2024},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.151023Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:fd03d0d9e8ec5582260a28dd7931067c6896baebf37a6f7cc6b3e0f97734e681","observation_id":"58078882-66ab-4ba9-bee2-a7b1000fad31","resolution":{"observed_at":"2026-08-16T05:52:46.747390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.728610Z","title":"Autoregres- sive action sequence learning for robotic manipulation,","venue":null,"work_id":"dd5188d0-c19d-4898-861d-3f89f7f82d83","year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.155052Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:3c4d41f505d3d2882841e8a47a3a94ec9a469cd3affb2c579237ab80f230e75c","observation_id":"3521b436-41a0-45e6-98e9-728b9f3362da","resolution":{"observed_at":"2026-08-16T05:52:46.733550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.714916Z","title":"Efficient self-supervised vision transformers for representation learning,","venue":null,"work_id":"f9af54ac-4471-456f-83ae-e4b51375dafd","year":2022},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.158976Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:857a34e623abf9aa15cd5002275698739a134b64552cb180d0bae7799058bd4f","observation_id":"94890ae7-cadd-4bb0-b520-3c9cfad4bde9","resolution":{"observed_at":"2026-08-16T05:52:46.719341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-08-14T01:02:41.198730Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-16T05:52:46.162890Z","title":"Efficiently modeling long sequences with structured state spaces,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.162890Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:5663b54880ee6fe9e32f9439b6847d5479171732e56c3c42697aed4e0af3e33f","observation_id":"0a8be072-001d-48c6-b791-ab4ddde942ba","resolution":{"observed_at":"2026-08-16T05:52:46.162890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.701873Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":"0abe9897-e82e-4f06-9f03-ed92d70a8227","year":2024},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.167363Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:a18fc1efca22d348067dbcc3e6619373bf39baf36ebc099ffc2b0233f8e43ac6","observation_id":"130e3a37-882d-40ac-b2b0-b26997c615a6","resolution":{"observed_at":"2026-08-16T05:52:46.706349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.688398Z","title":"Rignet: Robot intention grasp for dense stacked targets with multi-task siamese schema through rois learning,","venue":null,"work_id":"c5229ccc-f2cd-488f-a418-6e608ec26f10","year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.172045Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:94c5837a6aa7cae8024045a45f05020a3c21d3da58fd11a581920ec708ebc7f0","observation_id":"b63f403e-314d-400d-9975-a9429110dc19","resolution":{"observed_at":"2026-08-16T05:52:46.692780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.675308Z","title":"Foundationgrasp: Generalizable task-oriented grasping with foundation models,","venue":null,"work_id":"be620686-9bce-4e57-9c52-112c4e31e9d5","year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.175998Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:3a73fce74f965a0b8ca0f6a336d5e6a0abd472ca1f299ab039ca9f6506319bfe","observation_id":"81970d75-9593-4e75-93c1-6e68e202a7db","resolution":{"observed_at":"2026-08-16T05:52:46.679772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.661516Z","title":"Learning to reorient objects with stable placements afforded by extrinsic supports,","venue":null,"work_id":"1e7cf60a-17ff-4721-a2ed-813251bddfe4","year":2024},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.180076Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:ab94a74b32396423f271db97152e93f902d7ef1727cf683506f56ac1a44a6259","observation_id":"8e08f480-6316-49ed-a78d-e4fc16703401","resolution":{"observed_at":"2026-08-16T05:52:46.666636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.184161Z","title":"Watch and act: Learning robotic manipulation from visual demonstration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.184161Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:f005594394233dbb784993e431b75b5797763dbb8ef471b7bf8c4b75675ad3fe","observation_id":"9d161d8f-4373-4a92-9de8-7c169128cb0a","resolution":{"observed_at":"2026-08-16T05:52:46.184161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.639324Z","title":"A learning-based two-stage method for submillimeter insertion tasks with only visual inputs,","venue":null,"work_id":"8a2a4d2a-642b-44c0-a590-3037e940570c","year":2024},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.188154Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:1145782e4ddd4f7939134b1384d62dfbefdda84907b42367c2ee9efb0fc532a7","observation_id":"e792441c-f2c2-4467-9cb5-1a23582b61ee","resolution":{"observed_at":"2026-08-16T05:52:46.644402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.193035Z","title":"Grasp, see, and place: Efficient unknown object rearrangement with policy structure prior,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.193035Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:22b6629d8f4b5ed7a54cbe22f18a5a3fcee4a51dddb526fdecf896eafc966f40","observation_id":"429c32fa-1eb7-4fcc-9600-4670525fcb45","resolution":{"observed_at":"2026-08-16T05:52:46.193035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.197353Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.197353Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:5bcfeb246e2aa9632ca7717dc76f4cd7de4c89cf0321f1bda4b7576c96dab258","observation_id":"59ab443f-150e-4363-8f98-54ed04ffb9e9","resolution":{"observed_at":"2026-08-16T05:52:46.197353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.607202Z","title":"Zero-shot robotic manipulation with pre-trained image- editing diffusion models,","venue":null,"work_id":"4f283d53-c8e7-49fd-9ea4-aa49a657b017","year":2024},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.201423Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:68c9d95e7ff5b8d251412417512a1ca00355c2712c2058f2fcf21ede24c034b1","observation_id":"ed3703df-3897-42c5-9859-2c380723f10c","resolution":{"observed_at":"2026-08-16T05:52:46.611466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.592881Z","title":"Unleashing large-scale video generative pre-training for visual robot manipulation,","venue":null,"work_id":"5348cf9a-dde6-45f7-aafe-659b112747ce","year":2024},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.205684Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:63ad1b211a1bc6e7225885d70f7ab76aa282b41c8b0adbc311bc581f62cf0551","observation_id":"df68ed66-88eb-4097-88a4-0fd582fce9fb","resolution":{"observed_at":"2026-08-16T05:52:46.597880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.578364Z","title":"Gr-mg: Leveraging partially-annotated data via multi-modal goal-conditioned policy,","venue":null,"work_id":"24dbbc1a-4df5-4333-90bd-4cb3c2c77c07","year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.210562Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:050e02de1d97dba5c561bd2e0da9df8bfea742a4beadf70c4922590525bd2036","observation_id":"6d41f47c-dec7-446e-a5f1-d95d44a73f2f","resolution":{"observed_at":"2026-08-16T05:52:46.583199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00025","snapshot_observed_at":"2026-08-16T05:52:46.214506Z","title":"Any-point trajectory modeling for policy learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.214506Z"},"links":{"cited_paper":"/paper/2401.00025","citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:768be179d2a5ecaa9734d75f55b7eee3d89225767547904eae985aa50d281773","observation_id":"616fca62-be7a-454c-81e5-2680dcf7ad51","resolution":{"observed_at":"2026-08-16T05:52:46.214506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.565648Z","title":"Toward cognitive digital twin system of human-robot collaboration manipulation,","venue":null,"work_id":"e21a8805-995a-4d06-ad2b-4eaca1341998","year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.218795Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:90aa0402c6f2cab25ab3ea259765c5eae6420f87d02959b90993b6b33996b7e2","observation_id":"e9257393-6666-46a0-9a8a-483e03a041d6","resolution":{"observed_at":"2026-08-16T05:52:46.569547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.552478Z","title":"Towards general- izable zero-shot manipulation via translating human interaction plans,","venue":null,"work_id":"6292d9ae-9c53-4cd8-9109-368c854dd85a","year":2024},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.222737Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:1d57a28723fd2ea6d012025d272dbc672a64410fc9dc26bbe1051ac470d6fdba","observation_id":"f7bf4670-5de8-4db7-b6d4-b2a0437503fb","resolution":{"observed_at":"2026-08-16T05:52:46.556350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.539441Z","title":"Learning manipulation by predicting interaction,","venue":null,"work_id":"41da7730-bc0f-4771-894c-0e35e0bdf299","year":2024},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.226804Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:8ae6ef163ea46de40345fc60892e109e4edee77927e8b0a52766fecfc6ad9af3","observation_id":"208a892d-6724-445a-8b17-f73231123e9f","resolution":{"observed_at":"2026-08-16T05:52:46.543449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.526027Z","title":"Bc-z: Zero-shot task generalization with robotic imitation learning,","venue":null,"work_id":"17c58471-1f4f-4eb2-aedb-d83a555c22fb","year":2022},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.230855Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:37bd65f3c73a7858c4dd8c00d169178c3f29abb86082e6bae5352c6cede5fa52","observation_id":"46ed1c23-9eff-4447-a6e2-2e9390ca0ba5","resolution":{"observed_at":"2026-08-16T05:52:46.530839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.234889Z","title":"What matters in language conditioned robotic imitation learning over unstructured data,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.234889Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:c229243b2170ead1e0d8ca5ab69773bd16af89edc234508b2a58e002de7a5d9c","observation_id":"2cfdabce-6bdf-4cfb-81a6-e54f7a6d0f5e","resolution":{"observed_at":"2026-08-16T05:52:46.234889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.504034Z","title":"Contrastive imitation learning for language-guided multi-task robotic manipulation,","venue":null,"work_id":"d015161e-89b6-4d34-ba92-743ae0f0be73","year":2024},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.239847Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:8e44fcdc38dcb80b76bb4ccc05b846554b7fbe20410bb2b762ae38ec8bb6497d","observation_id":"51ae0edb-0c81-4a82-9745-e7c89c44fa14","resolution":{"observed_at":"2026-08-16T05:52:46.508306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.490444Z","title":"Rt-1: Robotics transformer for real-world control at scale,","venue":null,"work_id":"3fe99528-f107-47df-a4f5-6fb8fdb73a58","year":2022},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.244101Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:657eca84839feb399afe730cdac9d2a7c04143d2cc1aa205c48cda652b8bc70e","observation_id":"c09c6a69-c65f-4ea0-af95-eea65236638c","resolution":{"observed_at":"2026-08-16T05:52:46.494998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-16T05:52:46.248001Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.248001Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:eb5ac80e34f3883e8d06fb441bbed268096bff4c009344dea937287082c0f725","observation_id":"1e95e85b-3159-435c-8432-5b0190d8c21d","resolution":{"observed_at":"2026-08-16T05:52:46.248001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.477228Z","title":"Fusion-perception- to-action transformer: Enhancing robotic manipulation with 3-d visual fusion attention and proprioception,","venue":null,"work_id":"f7a376f5-b315-4c21-a6a2-a16df55565da","year":2025},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.252399Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:48da61c4d730de6e436b7f8c4260957a1fad64a2ef5e7810b38dc88b0bdecae3","observation_id":"df028db8-7697-42c5-a7dd-25f81012eb61","resolution":{"observed_at":"2026-08-16T05:52:46.481556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.257040Z","title":"Efficiently modeling long sequences with structured state spaces,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.257040Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:7a167acd30021c85d2e24391143873970caf23208e08de33b0bb156ce3a564d1","observation_id":"ee07785c-1ff1-45b5-91a2-836b116ce120","resolution":{"observed_at":"2026-08-16T05:52:46.257040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.261054Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.261054Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:61d630304b0d80500d673cbe20c80b3cfb8ea13e032ba319fefd3c6fca32c82a","observation_id":"507d3247-9980-422b-aaef-4fef44e19164","resolution":{"observed_at":"2026-08-16T05:52:46.261054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.445074Z","title":"Coarse-to-fine q- attention: Efficient learning for visual robotic manipulation via discreti- sation,","venue":null,"work_id":"5ebe8a90-2352-4731-8994-f517fe592cfc","year":2022},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.265106Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:1c05825ad07b4bab2ade4442bb76f61f06d00b6d5c751da258d25ddcd5d8df11","observation_id":"f7a334ad-38ae-4012-a018-877b702a3eec","resolution":{"observed_at":"2026-08-16T05:52:46.451162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.431446Z","title":"Instruction-driven history-aware policies for robotic manipulations,","venue":null,"work_id":"2cfb71e5-a03f-494e-8641-0d072927364d","year":2023},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.269184Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:1f15881ada532b1bddfb770a1a19a482afac613d7ed180079e01c86e1192445b","observation_id":"072ca29a-2e3e-41c9-b00c-232ff8dbc044","resolution":{"observed_at":"2026-08-16T05:52:46.435723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.274194Z","title":"V-rep: A versatile and scalable robot simulation framework,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.274194Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:a8c2370e0f22a86ed727de87fa000de61f9e644ececd2ffe338c7391b90ed312","observation_id":"beaf3ef5-5cca-4e5f-9afd-3f0a7733a131","resolution":{"observed_at":"2026-08-16T05:52:46.274194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.278313Z","title":"Mujoco: A physics engine for model-based control,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.278313Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:88a8e016c6272f42cf821c83e7864e88bd4557caea5abd716fbad8e5d497cc9d","observation_id":"17388a66-dd6d-4914-9e20-cfd544ff34a1","resolution":{"observed_at":"2026-08-16T05:52:46.278313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.401216Z","title":"Behavior transformers: Cloning k modes with one stone,","venue":null,"work_id":"c5ded2d4-b6a4-483c-b814-87623b9bd8ca","year":2022},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.282427Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:2e241e41087b25542346810cbb579c6cae0db6cb5e865743218098ae260bf6a6","observation_id":"e66a13a9-489f-46b0-b78b-4d113d325a4a","resolution":{"observed_at":"2026-08-16T05:52:46.405499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01511","last_updated":"2021-12-06T16:46:37Z","snapshot_observed_at":"2026-08-20T18:48:05.094743Z","submitted_at":"2021-12-02T18:58:09Z","title":"The Surprising Effectiveness of Representation Learning for Visual Imitation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01511","snapshot_observed_at":"2026-08-16T05:52:46.286502Z","title":"The surprising effectiveness of representation learning for visual imitation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.286502Z"},"links":{"cited_paper":"/paper/2112.01511","citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:580629fb948700aa6281cf7889fb98adcd4097c093cf48f95f9ce78bb9c8188a","observation_id":"548be5fd-fcc8-472a-8238-30808b9dbad2","resolution":{"observed_at":"2026-08-16T05:52:46.286502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.385818Z","title":"M2t2: Multi-task masked transformer for object-centric pick and place,","venue":null,"work_id":"351391fb-efef-4ba6-bfe4-24000a7a2d21","year":2023},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.290972Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:d7b94a53aaec1f41750e0411de8ba2a5f646791744519f949a39c00749849d2e","observation_id":"7e11eb57-3c4a-405f-81c1-1555d81e7e99","resolution":{"observed_at":"2026-08-16T05:52:46.392137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:52:46.294825Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T05:52:46.294825Z"},"links":{"citing_paper":"/paper/2504.19683"},"observation_digest":"sha256:0b126c23404061cfcca7e2aca423eda1efe5cf327ab26f267196c6906940ca20","observation_id":"21fa9687-b55b-42bd-a640-4caae6e59e84","resolution":{"observed_at":"2026-08-16T05:52:46.294825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.19683","last_updated":"2026-07-31T06:21:29Z","latest_version":4,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-20T18:48:34.448841Z","submitted_at":"2025-04-28T11:20:51Z","title":"GPA-RAM: Grasp-Pretraining Augmented Robotic Attention Mamba for Spatial Task Learning"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":33},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2504.19683."}