{"as_of":"2026-08-08T10:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b876f73a2299da0a8e7864dde3cd3c3aba29a8372e1acad409da10a0ff6774c4","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:14:33.241364Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:07:47.422971Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06224","snapshot_observed_at":"2026-08-02T22:07:47.422971Z","title":"Ec-flow: Enabling versatile robotic manipulation from action-unlabeled videos via embodiment-centric flow.arXiv preprint arXiv:2507.06224,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18020","last_updated":"2026-06-06T17:01:08Z","snapshot_observed_at":"2026-08-02T22:07:45.299955Z","submitted_at":"2026-02-20T06:22:21Z","title":"UAOR: Uncertainty-aware Observation Reinjection for Vision-Language-Action Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T22:07:47.422971Z"},"links":{"cited_paper":"/paper/2507.06224","citing_paper":"/paper/2602.18020"},"observation_digest":"sha256:3a4b483faf00c3b4c01fe91efd0861d525bcc5fa63d187707453a5395609ccf9","observation_id":"ac84063b-7644-4b15-b317-99dec4d60ca9","resolution":{"observed_at":"2026-08-02T22:07:47.422971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.06224/citation-record","integrity":"/paper/2507.06224/integrity","json":"/paper/2507.06224/citation-record.json","paper":"/paper/2507.06224"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:39.243607Z","title":"Track2act: Predicting point tracks from internet videos enables generalizable robot manipula- tion","venue":null,"work_id":"27f19d81-ec4c-4a47-9259-85b8038fb9c3","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.102755Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:7ff7bd7e8e47ec5332b28f81ef7c009b94024804a8afec5689e68d9e436453a2","observation_id":"e8077ba9-7970-4ab7-bda6-e4813a59e5b5","resolution":{"observed_at":"2026-08-06T19:14:39.283160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-06T19:14:30.177708Z","title":"π0: A vision-language- action flow model for general robot control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.177708Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:3242a6abd2a07e80fd3501742ab0838872ffd0ad2e2b74c610f3647373965981","observation_id":"a5dfad87-88cc-4c58-9385-0a00a8513a55","resolution":{"observed_at":"2026-08-06T19:14:30.177708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:39.112363Z","title":"Zero-shot robotic manipulation with pre-trained image-editing diffusion models","venue":null,"work_id":"866d6520-0c94-458a-9273-a3d04286558f","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.246148Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:04f6a45db7ee91c394445bbf5c7223a9ad8dd7b96f6b2bd233ff4fc83d5f90a3","observation_id":"36e24d53-9f68-4e5f-82c2-e112b37558f4","resolution":{"observed_at":"2026-08-06T19:14:39.176008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-06T19:14:30.370193Z","title":"Rt-1: Robotics transformer for real-world control at scale","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.370193Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:693288aedf9a3e90e4166013f2115b0248ae86dd9d83915a4a4f01fa4ed0ea08","observation_id":"4323dbf9-8f51-45ef-aaad-7b7fe4261282","resolution":{"observed_at":"2026-08-06T19:14:30.370193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06158","last_updated":"2024-10-08T16:00:47Z","snapshot_observed_at":"2026-08-03T02:22:13.984027Z","submitted_at":"2024-10-08T16:00:47Z","title":"GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06158","snapshot_observed_at":"2026-08-06T19:14:30.472359Z","title":"Gr-2: A generative video-language-action model with web-scale knowledge for robot manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.472359Z"},"links":{"cited_paper":"/paper/2410.06158","citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:fd857c1c69c11e08e56fc2b79b84ecbbab9cb4fe716aa3fa804dc601d65365eb","observation_id":"127bd5ac-8728-4d62-8040-0de9ecd378db","resolution":{"observed_at":"2026-08-06T19:14:30.472359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:38.974107Z","title":"Diffusion policy: Visuomotor policy learning via action dif- fusion","venue":null,"work_id":"c94c619e-b32b-460b-972d-6075196ce94f","year":2023},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.568172Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:ffe5edfaeeffbc79d1270bd7921d566858c7d2e58055c21feb03f3c00647e2b7","observation_id":"13aa5b42-70c3-4b35-99cc-0cc2b0451966","resolution":{"observed_at":"2026-08-06T19:14:39.021539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:38.843055Z","title":"Learning universal policies via text-guided video genera- tion","venue":null,"work_id":"7d15e93b-d127-4b2c-b748-7866827614c2","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.639459Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:9703e6bee672d53c36d3d461637384989eba92d435eac94ccc42b130435256e7","observation_id":"55cffa15-f7ca-4868-8f1a-83fa05ba9a61","resolution":{"observed_at":"2026-08-06T19:14:38.901093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:38.680311Z","title":"Tenenbaum, Leslie Pack Kaelbling, Andy Zeng, and Jonathan Tompson","venue":null,"work_id":"e88e2447-c820-466d-8bbf-55f2e286681e","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.731498Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:f4ab2901e3e97f9dccd8b81e0dcb26d6f29b9e7cf42fa51208cbe7d9b4bdd72c","observation_id":"542778c7-caea-45c4-9e56-dae72c448825","resolution":{"observed_at":"2026-08-06T19:14:38.757867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:38.537737Z","title":"Graspnet-1billion: A large-scale benchmark for general ob- ject grasping","venue":null,"work_id":"c6c4e8cf-2278-4531-bb65-ceeb1ecd0474","year":2020},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.789563Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:28bbdc83234304f718ca9d80d60014d9c38f4f214cee6032fac8c2f57cc79575","observation_id":"d5e6492d-c325-4c4e-a6d6-6abd6c30e200","resolution":{"observed_at":"2026-08-06T19:14:38.607857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:38.415421Z","title":"FLIP: Flow-centric generative planning as general-purpose manipulation world model","venue":null,"work_id":"a1337817-ff95-4459-bbea-5d4cd59d848c","year":2025},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.827849Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:bb843a67d54221d9d2adee431f09bd4b8cf501b69eef70c09fa848617cde3f6a","observation_id":"3e8eaf33-1e9e-4838-9dec-dc6b90e85742","resolution":{"observed_at":"2026-08-06T19:14:38.481844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:38.288878Z","title":"The” something something” video database for learning and evaluating visual common sense","venue":null,"work_id":"16227f62-213e-45f9-a9ca-fa89153af257","year":2017},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.906618Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:5734c4328acdd0befdaf73a330725ef99bc1b4eda65227d97d212fa1370b56f0","observation_id":"85650fbd-a49f-4635-aa0f-dfd39172af7d","resolution":{"observed_at":"2026-08-06T19:14:38.334275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:38.202948Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"4e4d2dc8-d475-40bf-9de0-112571be4578","year":2016},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:30.964539Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:ace3052bfac43d4efd1581ff70c4a4304a34b3b8622ecd85042895049825c28c","observation_id":"14f8a7a5-5237-45a2-950c-7d8cd26472f2","resolution":{"observed_at":"2026-08-06T19:14:38.231494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:31.028495Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.028495Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:327f1a79e455021e84388c90a98aaef0e72242d99683c50a5181216ab367a067","observation_id":"f698c5cf-ef4b-4f08-b4a3-dae7b9f2b181","resolution":{"observed_at":"2026-08-06T19:14:31.028495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11831","last_updated":"2024-10-15T17:56:32Z","snapshot_observed_at":"2026-08-03T21:35:04.144048Z","submitted_at":"2024-10-15T17:56:32Z","title":"CoTracker3: Simpler and Better Point Tracking by Pseudo-Labelling Real Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11831","snapshot_observed_at":"2026-08-06T19:14:31.193592Z","title":"Co- tracker3: Simpler and better point tracking by pseudo- labelling real videos","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.193592Z"},"links":{"cited_paper":"/paper/2410.11831","citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:de04c7dc61823a307b086bb6634957e23316de141b59710cb404a7e5d6b01053","observation_id":"f781dd45-0f52-4086-9204-eb194c5d3ebc","resolution":{"observed_at":"2026-08-06T19:14:31.193592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:38.105975Z","title":"Openvla: An open- source vision-language-action model","venue":null,"work_id":"16df3b4c-f899-4889-a90c-61e4ecb758e5","year":2025},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.262104Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:1deaaa0602d7c954a5df45751eab963df684d426951eaa97866a74c12506048c","observation_id":"9ee40f9c-216d-4afa-8a33-1ae3bf9a943a","resolution":{"observed_at":"2026-08-06T19:14:38.142903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:37.966158Z","title":"Tenenbaum","venue":null,"work_id":"3470b660-9687-4138-b68a-cdf634f0d687","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.368911Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:04b1cc48cf3cf0f18b8c45952aeb83da615f8f5811d2a09762055999c88cd17f","observation_id":"81857de0-b29f-4f68-99e8-4edfd4357dea","resolution":{"observed_at":"2026-08-06T19:14:38.038432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:31.461589Z","title":"Bridgevla: Input-output alignment for efficient 3d manipu- lation learning with vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.461589Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:d1bc227384872d1db323d6cfbe7084f99dd8a7daefe1b228b880b32aba103165","observation_id":"0dd1e8d8-1c01-460a-a475-293356b8f9d2","resolution":{"observed_at":"2026-08-06T19:14:31.461589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:37.744361Z","title":"Gr-mg: Leveraging partially- annotated data via multi-modal goal-conditioned policy","venue":null,"work_id":"5b52d7c7-7b79-418f-aead-1e17fd753b28","year":2025},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.519197Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:cccbf6a5791f9d1f3f43803b1daa99fd605d8daf7d80b8c517bf0e8a705448a0","observation_id":"e5f441a1-1435-4c85-a4a8-03500b239107","resolution":{"observed_at":"2026-08-06T19:14:37.851038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:37.483797Z","title":"Dreamitate: Real-world visuomotor policy learn- ing via video generation","venue":null,"work_id":"9be14bc1-c3cf-4796-868a-71a254ecd0c1","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.549730Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:f13e7f4a1179ee7e72c98b43508a67a0b18f552bf0f2698a43bf2bf372d424f3","observation_id":"f8bc9425-675b-4b51-a95d-627da58cd7c7","resolution":{"observed_at":"2026-08-06T19:14:37.595105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:37.325117Z","title":"RDT-1b: a diffusion foundation model for bimanual manipu- lation","venue":null,"work_id":"91b00935-cc65-48f1-8a21-6307c10c9e6c","year":2025},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.577075Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:7aef3f72a2e899632800b075bf15f776bb4fda17d05b1c5f921872900c3e896c","observation_id":"ac9f95f5-a434-4f64-a554-bfd7fef1cb4d","resolution":{"observed_at":"2026-08-06T19:14:37.391234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:37.178005Z","title":"Struc- tured world models from human videos","venue":null,"work_id":"824f0bff-4f00-4bee-8027-692fd1471dd2","year":2023},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.613393Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:d309edda242c14280bc23b772245768849f3f2bfe16a3ab437ed88445e99d5d3","observation_id":"d4740894-1413-4680-ae80-b3194804a209","resolution":{"observed_at":"2026-08-06T19:14:37.246960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:36.976489Z","title":"R3m: A universal visual rep- resentation for robot manipulation","venue":null,"work_id":"f632a313-abe9-46ff-b5e7-57c13c9746d6","year":null},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.654489Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:751c5cc0d26fd4131cb60d497117c090bddfe42ebcd28f3ade19b5fd5c5adc63","observation_id":"bbb1b2e7-eb91-4120-9cc4-ff95b038a8e8","resolution":{"observed_at":"2026-08-06T19:14:37.097117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:36.627899Z","title":"Generate subgoal images before act: Unlocking the chain-of-thought reasoning in diffusion model for robot manipulation with multimodal prompts","venue":null,"work_id":"7f2ac28e-89a6-4f68-b45c-c88b8491bc3f","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.704487Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:bcf56b868b4f64640bfdbb3c5791b8cc54dea4a4b151bad270c8a1ecdbb8170d","observation_id":"0afcc61d-714d-4b96-91dd-1fa733f8059e","resolution":{"observed_at":"2026-08-06T19:14:36.775640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:36.318120Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":"cd2a8a46-bec1-4929-b628-3e20719eb223","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.762695Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:bb0cb89271728d1e6749c0332d749669ac2dce738cede9c170b455026813e4a5","observation_id":"1f2ae5da-05a3-4309-955b-72980b32e48a","resolution":{"observed_at":"2026-08-06T19:14:36.405157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-06T19:14:31.808903Z","title":"Spatialvla: Exploring spatial represen- tations for visual-language-action model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.808903Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:7b8118c9eee889374e9f3ff2bcbd1fe27fa1785fd9cbd096d00c1556ac4da6dc","observation_id":"b8f1abeb-0c17-44af-ab39-9a9ff2e90d54","resolution":{"observed_at":"2026-08-06T19:14:31.808903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:36.050720Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"cc753b01-07c8-401c-bb4a-2a2edbc7952a","year":2021},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.853648Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:6caed7d257f67236a391af06a61f109538a00c7ef8ccb1676aa8ecfba200cbd7","observation_id":"c9b0b784-342b-41c6-8346-37a9a4753bf9","resolution":{"observed_at":"2026-08-06T19:14:36.150315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:35.807347Z","title":"SAM 2: Segment anything in images and videos","venue":null,"work_id":"c9cc9976-2c7c-453a-ab98-e0fd9cd9eef0","year":2025},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.940747Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:913bd537f2b7f485beea04837ed746c1f1ac7cc81edd5c3583b61f5edecfa1b6","observation_id":"a0923067-d4a4-4aee-b1cd-83389d65237e","resolution":{"observed_at":"2026-08-06T19:14:35.954059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:31.994340Z","title":"Motion tracks: A unified representation for human-robot transfer in few-shot imitation learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:31.994340Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:79e1cfda80c5c2d98143a22622e48114800c42a3b3af622da0c728e7cf0024d7","observation_id":"713c7d9d-1001-4dce-a8ba-d0222c53838b","resolution":{"observed_at":"2026-08-06T19:14:31.994340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10300","last_updated":"2024-06-01T03:35:22Z","snapshot_observed_at":"2026-08-05T08:31:40.101811Z","submitted_at":"2024-05-16T17:54:15Z","title":"Grounding DINO 1.5: Advance the \"Edge\" of Open-Set Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10300","snapshot_observed_at":"2026-08-06T19:14:32.091476Z","title":"Grounding dino 1.5: Advance the” edge” of open-set object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:32.091476Z"},"links":{"cited_paper":"/paper/2405.10300","citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:2df09fc9aa56616bd002e6625495687a0f31de89b9557ca916e1389a5518f8d0","observation_id":"5f0d5f05-f035-4539-b631-0c5dda0c598e","resolution":{"observed_at":"2026-08-06T19:14:32.091476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-06T19:14:32.150326Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:32.150326Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:f85440d1b114d07289fda1f9f7a6dad99d598c0871d3d34af9311a7368f8c4ca","observation_id":"723e93df-9465-41d9-9119-95baeab262b2","resolution":{"observed_at":"2026-08-06T19:14:32.150326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:35.617455Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":"b2de3da5-c5ef-4810-be32-d959c4fb9510","year":2021},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:32.229545Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:b63c28af3102917cdafd0c0c4784db6639a92c02693981ef5eee03791c9ab6bb","observation_id":"458b5092-fc51-4f37-9e18-18d3fe2ac32b","resolution":{"observed_at":"2026-08-06T19:14:35.657720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:35.361983Z","title":"Zhao, Ken Goldberg, Ryan Hoque, Lawrence Yunliang Chen, Simeon Adebola, Gaurav S","venue":null,"work_id":"ffd224e0-7d0b-4658-a90e-a39680049da7","year":2023},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:32.321698Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:5645fd0c5d2e3765df65d4abba85afbc6187db38d3c70935c9af21cd74888f8d","observation_id":"34884d26-5203-4d2a-8d9b-0854ae38a9e7","resolution":{"observed_at":"2026-08-06T19:14:35.453904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00025","snapshot_observed_at":"2026-08-06T19:14:32.442338Z","title":"Any-point trajectory modeling for policy learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:32.442338Z"},"links":{"cited_paper":"/paper/2401.00025","citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:f3ad83914da4b3a862b807f0ad0e080ccc5e529a29d8120b573f71b573da8ddb","observation_id":"51f83d5d-571f-42a6-a09b-e53234cdd456","resolution":{"observed_at":"2026-08-06T19:14:32.442338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:35.133514Z","title":"Unleashing large-scale video generative pre-training for visual robot manipulation","venue":null,"work_id":"aa1e0f6b-e109-47af-b58b-3c88cb8ba0ec","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:32.545562Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:85b0d4c9e8d8ac7b790cc740e52df16c8e089f913ae55d7f801d8d9dce78d9b9","observation_id":"4049eddf-063a-49ab-9a40-f8dcf8a1fde1","resolution":{"observed_at":"2026-08-06T19:14:35.193795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:34.934239Z","title":"Flow as the 10 cross-domain manipulation interface","venue":null,"work_id":"9e74e8a7-e6c4-4053-b21c-6f2ee3fc19e2","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:32.643201Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:4a027519c3fbc83ec89e6e6daf76ee72730ea8742c28a14c4f524dd45b6fc59b","observation_id":"6824ea62-99a2-4311-8d0d-444a1f9ad9e1","resolution":{"observed_at":"2026-08-06T19:14:35.023994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:34.664579Z","title":"Learning interactive real-world simulators","venue":null,"work_id":"459be3e9-b11e-4e25-a659-8d3e72d74630","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:32.704068Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:5e76a19935f5ba1f1965b233496fc80cf818ddf346ab6712b887be90c35d5162","observation_id":"9e9c923e-e8b2-41d9-ae90-907c9f77441a","resolution":{"observed_at":"2026-08-06T19:14:34.811384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:34.536601Z","title":"Meta- world: A benchmark and evaluation for multi-task and meta reinforcement learning","venue":null,"work_id":"8e64b29b-a61b-43e3-ad88-eeadb56547b2","year":null},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:32.876769Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:dfa622dcddce107ff1f0969849143cf3a7136089eba27c77e81d12e96b889475","observation_id":"4d3ce9d9-55b9-47a3-aa03-c9148ad87c69","resolution":{"observed_at":"2026-08-06T19:14:34.568444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:34.342027Z","title":"Dexgrasp- net 2.0: Learning generative dexterous grasping in large- scale synthetic cluttered scenes","venue":null,"work_id":"e8880cef-e2f8-4f87-a2fd-5b4543a3404c","year":null},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:32.936825Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:b0284bd5e68730c366cb52da36f572560f5f5d19b4aa0ab3abb0a12d48583bdc","observation_id":"463bdcf9-857a-4898-b309-ac140f88f8f3","resolution":{"observed_at":"2026-08-06T19:14:34.416327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:34.244327Z","title":"General flow as foundation affordance for scalable robot learning","venue":null,"work_id":"e66254bb-94ad-4ccc-b2e0-30d406d25a75","year":null},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:32.991864Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:e9c4f16c66153f37e425dcbdcdce75594ffc2e0fecee5eea82fcfb0fcbb33b25","observation_id":"e815db07-ac50-4768-b0ef-3d0551567720","resolution":{"observed_at":"2026-08-06T19:14:34.274918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:34.124049Z","title":"Vlmpc: Vision-language model pre- dictive control for robotic manipulation","venue":null,"work_id":"0e7edb71-40a5-48fb-b872-35640d4f6b87","year":2024},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:33.044564Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:809d6c6f1b1d29645bc74498cf5a05f48a2bcc62ce3880684d6b30c68e076abd","observation_id":"91cc7ff3-acfe-4cdb-8e66-66cbfef8a740","resolution":{"observed_at":"2026-08-06T19:14:34.171422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:33.959291Z","title":"VIOLA: Object-centric imitation learning for vision-based robot manipulation","venue":null,"work_id":"2e5f0ae7-b8e4-4410-b291-332325ddc8bb","year":2022},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:33.131244Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:56ec1311f80413f031bb577b1078f486585278b2e1517e63cce06824c702c43a","observation_id":"6152338a-9c22-4d73-b900-98f6d4ea29fa","resolution":{"observed_at":"2026-08-06T19:14:34.055602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:33.699192Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":"d1da6221-370d-4bbb-bac1-6878d1e003fb","year":2023},"citing_paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:33.241364Z"},"links":{"citing_paper":"/paper/2507.06224"},"observation_digest":"sha256:467803605bc413d5ae6656a9cc55fb6a717bf8a7950c1dbe6bc0f61767d9b4bc","observation_id":"05d7fac3-e2f8-4242-bd22-d3c2b05831d6","resolution":{"observed_at":"2026-08-06T19:14:33.833322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06224","last_updated":"2025-07-08T17:57:03Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T19:05:55.289283Z","submitted_at":"2025-07-08T17:57:03Z","title":"EC-Flow: Enabling Versatile Robotic Manipulation from Action-Unlabeled Videos via Embodiment-Centric Flow"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2507.06224."}