{"as_of":"2026-08-10T15:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5534de1b8804bf17cec937742590c6c164e7cc4819e638162ba716228df6a190","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T01:01:49.910250Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T17:27:41.375162Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":"2407.12957","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Papagiannis, N","venue":null,"work_id":"d807b706-9059-482a-8753-6284b077fe7f","year":2024},"citing_paper":{"arxiv_id":"2409.16283","last_updated":"2024-09-24T17:57:33Z","snapshot_observed_at":"2026-07-06T19:21:20.826877Z","submitted_at":"2024-09-24T17:57:33Z","title":"Gen2Act: Human Video Generation in Novel Scenarios enables Generalizable Robot Manipulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-15T12:17:01.294466Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2409.16283"},"observation_digest":"sha256:ba9fb51a282a4ac26f33b02185ee578f21cdf715e2ee7e9b474db0dea202b55a","observation_id":"900bbbef-4de8-4dec-ab25-df54be801184","resolution":{"observed_at":"2026-05-15T12:17:01.449995Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-08-09T01:01:49.910250Z","title":"R+ x: Retrieval and exe- cution from everyday human videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03729","last_updated":"2025-02-11T04:51:45Z","snapshot_observed_at":"2026-08-09T00:55:04.068120Z","submitted_at":"2025-02-06T02:43:23Z","title":"Action-Free Reasoning for Policy Generalization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T01:01:49.910250Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2502.03729"},"observation_digest":"sha256:33922dc019cc22f9a2573e3214e00bcd28b660e2bee3d977578f8ed6b412a0f1","observation_id":"ac5adba8-2315-48cd-b46a-546601ffd4d6","resolution":{"observed_at":"2026-08-09T01:01:49.910250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-08-07T14:01:00.944745Z","title":"Papagiannis, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20290","last_updated":"2025-06-03T22:50:28Z","snapshot_observed_at":"2026-08-09T08:53:34.877255Z","submitted_at":"2025-05-26T17:59:17Z","title":"EgoZero: Robot Learning from Smart Glasses","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:01:00.944745Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2505.20290"},"observation_digest":"sha256:90a9280b8b023aa19779b7fc563e73c8c1ca37e95a8c377e5d85f6b18a0002a7","observation_id":"005b6a97-3bcf-4f9e-83b4-eb79521f56fb","resolution":{"observed_at":"2026-08-07T14:01:00.944745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-08-06T22:40:11.070264Z","title":"R+x: Retrieval and execu- tion from everyday human videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21057","last_updated":"2025-06-26T07:14:59Z","snapshot_observed_at":"2026-08-09T12:47:03.205522Z","submitted_at":"2025-06-26T07:14:59Z","title":"Knowledge-Driven Imitation Learning: Enabling Generalization Across Diverse Conditions","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:40:11.070264Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2506.21057"},"observation_digest":"sha256:d8dbb322d19a5b280897c3c1130572948adc3e7a5c9b9da824ab5e9c81953e1e","observation_id":"c2fb27c5-5217-4029-a79d-e33693b2584b","resolution":{"observed_at":"2026-08-06T22:40:11.070264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-08-05T16:22:54.411674Z","title":"R+ x: Retrieval and execution from everyday human videos,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18691","last_updated":"2025-08-26T05:25:57Z","snapshot_observed_at":"2026-08-08T03:50:33.903574Z","submitted_at":"2025-08-26T05:25:57Z","title":"Deep Sensorimotor Control by Imitating Predictive Models of Human Motion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T16:22:54.411674Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2508.18691"},"observation_digest":"sha256:8814ad163faab08d05f90f3ad9f3bdf3029d647488f7a170bf9f69cecc1f9153","observation_id":"1c2ec488-cf83-437a-9d7c-35359c222bd6","resolution":{"observed_at":"2026-08-05T16:22:54.411674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-08-04T17:26:19.546566Z","title":"Papagiannis, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10952","last_updated":"2025-09-13T19:23:36Z","snapshot_observed_at":"2026-08-08T07:20:50.102524Z","submitted_at":"2025-09-13T19:23:36Z","title":"ImMimic: Cross-Domain Imitation from Human Videos via Mapping and Interpolation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T17:26:19.546566Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2509.10952"},"observation_digest":"sha256:7753715770118d980a2ac578013e7b96ff44fa6a97d2b2321570e01aa4f71fca","observation_id":"046d56f0-2544-49a9-9f14-0e88a060ce98","resolution":{"observed_at":"2026-08-04T17:26:19.546566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":"2407.12957","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Papagiannis, N","venue":null,"work_id":"d807b706-9059-482a-8753-6284b077fe7f","year":2024},"citing_paper":{"arxiv_id":"2509.21723","last_updated":"2026-05-01T09:02:01Z","snapshot_observed_at":"2026-08-08T16:18:02.148047Z","submitted_at":"2025-09-26T00:47:39Z","title":"VLBiMan: Vision-Language Anchored One-Shot Demonstration Enables Generalizable Bimanual Robotic Manipulation","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T13:47:30.943307Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2509.21723"},"observation_digest":"sha256:d45ff9979d3d2bfbe2045a80ca8d006515d3ef3ec821fda145b9e1eaaa776fe1","observation_id":"23d31570-e64a-4689-b8bd-9f80268eebe8","resolution":{"observed_at":"2026-05-18T13:51:25.750808Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":"2407.12957","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Papagiannis, N","venue":null,"work_id":"d807b706-9059-482a-8753-6284b077fe7f","year":2024},"citing_paper":{"arxiv_id":"2604.10809","last_updated":"2026-04-12T20:40:59Z","snapshot_observed_at":"2026-07-06T22:59:23.126963Z","submitted_at":"2026-04-12T20:40:59Z","title":"WARPED: Wrist-Aligned Rendering for Robot Policy Learning from Egocentric Human Demonstrations","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-10T15:14:24.932972Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2604.10809"},"observation_digest":"sha256:22b9809ac9cdf7c74a3e68d6c6a6b81070268faeb03886e0a7eb27aae1af6ea7","observation_id":"908f3090-7ec6-4def-b5a4-660a2947ab5f","resolution":{"observed_at":"2026-05-11T11:01:02.586462Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":"2407.12957","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Papagiannis, N","venue":null,"work_id":"d807b706-9059-482a-8753-6284b077fe7f","year":2024},"citing_paper":{"arxiv_id":"2604.15215","last_updated":"2026-05-29T06:48:30Z","snapshot_observed_at":"2026-07-12T19:46:45.862744Z","submitted_at":"2026-04-16T16:47:08Z","title":"A Hierarchical Spatiotemporal Action Tokenizer for In-Context Imitation Learning in Robotics","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T10:47:05.008564Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2604.15215"},"observation_digest":"sha256:6fb4f78800b37e07a033c47ec5bd48ae328cfafbd04ed7c85bf5e93d0fbf8c0c","observation_id":"a486d8c9-636f-4cfb-ae0b-cb98eec8fd5d","resolution":{"observed_at":"2026-05-10T10:49:56.274227Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":"2407.12957","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Papagiannis, N","venue":null,"work_id":"d807b706-9059-482a-8753-6284b077fe7f","year":2024},"citing_paper":{"arxiv_id":"2604.15215","last_updated":"2026-05-29T06:48:30Z","snapshot_observed_at":"2026-07-12T19:46:45.862744Z","submitted_at":"2026-04-16T16:47:08Z","title":"A Hierarchical Spatiotemporal Action Tokenizer for In-Context Imitation Learning in Robotics","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T17:24:01.180062Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2604.15215"},"observation_digest":"sha256:37860b911a9c17c942573c7c76c2269ecf3ce7d37ce9ce293ee750cc414099e1","observation_id":"74658011-0abd-46b0-8694-66001b89341d","resolution":{"observed_at":"2026-05-19T17:27:41.376982Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos","version":2},"cited_work":{"arxiv_id":"2407.12957","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.12957","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Papagiannis, N","venue":null,"work_id":"d807b706-9059-482a-8753-6284b077fe7f","year":2024},"citing_paper":{"arxiv_id":"2605.03637","last_updated":"2026-05-05T11:09:41Z","snapshot_observed_at":"2026-08-02T21:37:36.029720Z","submitted_at":"2026-05-05T11:09:41Z","title":"Bridging the Embodiment Gap: Disentangled Cross-Embodiment Video Editing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T15:44:25.021995Z"},"links":{"cited_paper":"/paper/2407.12957","citing_paper":"/paper/2605.03637"},"observation_digest":"sha256:8670ad58fa17aa5374d7399083d8bb081f7d481263cc6a9cbbecbed89fbd20f4","observation_id":"10cf7beb-7f86-4f23-af33-dd66878d335c","resolution":{"observed_at":"2026-05-12T11:01:31.504658Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2407.12957/citation-record","integrity":"/paper/2407.12957/integrity","json":"/paper/2407.12957/citation-record.json","paper":"/paper/2407.12957"},"outbound":[],"paper":{"arxiv_id":"2407.12957","last_updated":"2025-04-03T10:12:23Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-05T18:47:38.188906Z","submitted_at":"2024-07-17T18:59:56Z","title":"R+X: Retrieval and Execution from Everyday Human Videos"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2407.12957."}