{"as_of":"2026-08-05T13:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:becd7ad8a1b419c0e1539002d4aa180a97c9b854d3bea0b69ed16d46249c673d","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T11:50:20.766891Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T21:46:33.140202Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T15:49:56.509675Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"cited_work":{"arxiv_id":"2509.23468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.23468","snapshot_observed_at":"2026-07-04T15:49:56.509675Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","venue":"cs.RO","work_id":"f1e827f8-0afe-4954-9504-537f1988b940","year":2025},"citing_paper":{"arxiv_id":"2512.21898","last_updated":"2026-02-01T23:43:52Z","snapshot_observed_at":"2026-07-06T22:40:07.339525Z","submitted_at":"2025-12-26T07:11:47Z","title":"Flexible Multitask Learning with Factorized Diffusion Policy","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T19:21:52.191786Z"},"links":{"cited_paper":"/paper/2509.23468","citing_paper":"/paper/2512.21898"},"observation_digest":"sha256:35390a5c82d2216e519cd707821c733968b09c343cbf2f775d9bd1d2f4637d87","observation_id":"2e42f364-1b51-4705-8354-ffecd4b0fa42","resolution":{"observed_at":"2026-05-16T19:23:19.662614Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"cited_work":{"arxiv_id":"2509.23468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.23468","snapshot_observed_at":"2026-07-04T15:49:56.509675Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","venue":"cs.RO","work_id":"f1e827f8-0afe-4954-9504-537f1988b940","year":2025},"citing_paper":{"arxiv_id":"2601.20239","last_updated":"2026-05-13T12:53:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T04:22:47Z","title":"TouchGuide: Inference-Time Steering of Visuomotor Policies via Touch Guidance","version":6},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T11:06:23.555610Z"},"links":{"cited_paper":"/paper/2509.23468","citing_paper":"/paper/2601.20239"},"observation_digest":"sha256:56caf3ada18ec009427e11aafd6a473a8f0d6191d742e1cc7dcbe80c3bf09f10","observation_id":"813d9b54-93c7-4e3c-b80a-2600e01b362e","resolution":{"observed_at":"2026-05-16T11:07:48.146147Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"cited_work":{"arxiv_id":"2509.23468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.23468","snapshot_observed_at":"2026-07-04T15:49:56.509675Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","venue":"cs.RO","work_id":"f1e827f8-0afe-4954-9504-537f1988b940","year":2025},"citing_paper":{"arxiv_id":"2604.13015","last_updated":"2026-04-27T15:02:49Z","snapshot_observed_at":"2026-07-06T23:01:05.634599Z","submitted_at":"2026-04-14T17:54:17Z","title":"Learning Versatile Humanoid Manipulation with Touch Dreaming","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T14:48:33.942119Z"},"links":{"cited_paper":"/paper/2509.23468","citing_paper":"/paper/2604.13015"},"observation_digest":"sha256:7ec328f459ed26e80f737630a703faf2795006bad1c944c39eba79ab75d7f06f","observation_id":"24ee4827-a504-49b4-bccd-3b76481ea044","resolution":{"observed_at":"2026-05-11T11:31:03.061233Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"cited_work":{"arxiv_id":"2509.23468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.23468","snapshot_observed_at":"2026-07-04T15:49:56.509675Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","venue":"cs.RO","work_id":"f1e827f8-0afe-4954-9504-537f1988b940","year":2025},"citing_paper":{"arxiv_id":"2604.28156","last_updated":"2026-04-30T17:43:07Z","snapshot_observed_at":"2026-07-06T23:13:29.310140Z","submitted_at":"2026-04-30T17:43:07Z","title":"FlexiTac: A Low-Cost, Open-Source, Scalable Tactile Sensing Solution for Robotic Systems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T06:57:58.409411Z"},"links":{"cited_paper":"/paper/2509.23468","citing_paper":"/paper/2604.28156"},"observation_digest":"sha256:de2165036d84eba7c66d136db75b982ca83935f53942935dc7ad66d43046cdeb","observation_id":"1e1bad23-e9fc-4c2d-aa92-3dc143376e07","resolution":{"observed_at":"2026-05-12T10:16:27.594773Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"cited_work":{"arxiv_id":"2509.23468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.23468","snapshot_observed_at":"2026-07-04T15:49:56.509675Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","venue":"cs.RO","work_id":"f1e827f8-0afe-4954-9504-537f1988b940","year":2025},"citing_paper":{"arxiv_id":"2606.10818","last_updated":"2026-06-09T13:00:56Z","snapshot_observed_at":"2026-07-06T23:49:56.404171Z","submitted_at":"2026-06-09T13:00:56Z","title":"IMPACT: Learning Internal-Model Predictive Control for Forceful Robotic Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T13:04:17.761552Z"},"links":{"cited_paper":"/paper/2509.23468","citing_paper":"/paper/2606.10818"},"observation_digest":"sha256:59b89edcd02cdc460ed8e8a9beff3982b5e497d6a823f3c9492fb2889ee4ad93","observation_id":"26be07d9-adc1-4699-834c-bb6ef7dd4164","resolution":{"observed_at":"2026-07-03T05:47:41.666083Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"cited_work":{"arxiv_id":"2509.23468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.23468","snapshot_observed_at":"2026-07-04T15:49:56.509675Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","venue":"cs.RO","work_id":"f1e827f8-0afe-4954-9504-537f1988b940","year":2025},"citing_paper":{"arxiv_id":"2606.26423","last_updated":"2026-06-26T20:07:20Z","snapshot_observed_at":"2026-07-07T00:00:46.505337Z","submitted_at":"2026-06-24T22:25:19Z","title":"CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T01:25:21.796778Z"},"links":{"cited_paper":"/paper/2509.23468","citing_paper":"/paper/2606.26423"},"observation_digest":"sha256:438f80bf35d094e318a7688d7ff0605a7cb025d005fadf16a0b4180a09b52fd6","observation_id":"5e09e06c-9fc2-4cdc-960c-5af233a04cd8","resolution":{"observed_at":"2026-07-04T15:49:56.510872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"cited_work":{"arxiv_id":"2509.23468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.23468","snapshot_observed_at":"2026-07-04T15:49:56.509675Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","venue":"cs.RO","work_id":"f1e827f8-0afe-4954-9504-537f1988b940","year":2025},"citing_paper":{"arxiv_id":"2606.26423","last_updated":"2026-06-26T20:07:20Z","snapshot_observed_at":"2026-07-07T00:00:46.505337Z","submitted_at":"2026-06-24T22:25:19Z","title":"CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T00:54:50.393828Z"},"links":{"cited_paper":"/paper/2509.23468","citing_paper":"/paper/2606.26423"},"observation_digest":"sha256:1f8b97c9cd19afeb788abfa8066d7e3cc5fab87dd101cfee1890a0daac4bd6e7","observation_id":"edf248eb-b592-422d-9f77-6797beb16d12","resolution":{"observed_at":"2026-07-01T16:05:49.656311Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"cited_work":{"arxiv_id":"2509.23468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.23468","snapshot_observed_at":"2026-07-04T15:49:56.509675Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","venue":"cs.RO","work_id":"f1e827f8-0afe-4954-9504-537f1988b940","year":2025},"citing_paper":{"arxiv_id":"2606.29941","last_updated":"2026-06-29T08:20:18Z","snapshot_observed_at":"2026-07-07T00:03:51.213896Z","submitted_at":"2026-06-29T08:20:18Z","title":"Seeing Touch from Motion: A Unified Modality-Aware Visuo-Tactile Policy with Tactile Motion Correlation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T05:55:54.345160Z"},"links":{"cited_paper":"/paper/2509.23468","citing_paper":"/paper/2606.29941"},"observation_digest":"sha256:5675f7d6a66a523174bb12bc79dcd2e04fb2935082c3730591ea676d463fa23b","observation_id":"2608cd76-eec0-4188-b364-37b5527f2cb1","resolution":{"observed_at":"2026-06-30T08:44:28.206916Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.23468","snapshot_observed_at":"2026-07-12T02:52:21.616045Z","title":"Multi-modal manipulation via multi- modal policy consensus,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03387","last_updated":"2026-07-07T03:40:42Z","snapshot_observed_at":"2026-07-12T02:52:21.186673Z","submitted_at":"2026-07-03T14:42:30Z","title":"Feeling the Unexpected: ResTacVLA for Contact-Rich Manipulation via Residual Tactile Representation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T02:52:21.616045Z"},"links":{"cited_paper":"/paper/2509.23468","citing_paper":"/paper/2607.03387"},"observation_digest":"sha256:699dd5ccd9c2986a4918eee6f8b1ec5a54600007a354086b691ea65f2db111f2","observation_id":"d027a606-64e1-4300-82bc-c463595bb62e","resolution":{"observed_at":"2026-07-12T02:52:21.616045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.23468","snapshot_observed_at":"2026-08-01T21:46:33.140202Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15982","last_updated":"2026-07-17T14:18:20Z","snapshot_observed_at":"2026-08-02T13:01:47.695385Z","submitted_at":"2026-07-17T14:18:20Z","title":"Data and Learning Where it Matters for Contact-Rich Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T21:46:33.140202Z"},"links":{"cited_paper":"/paper/2509.23468","citing_paper":"/paper/2607.15982"},"observation_digest":"sha256:f50162da4f4e466258e52a6450f164014e61edef77b8f4f894c3500507462ccd","observation_id":"fa05b3c3-316b-4adc-9632-7b37b04a91d5","resolution":{"observed_at":"2026-08-01T21:46:33.140202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.23468","snapshot_observed_at":"2026-08-01T18:37:10.563802Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17257","last_updated":"2026-07-19T13:48:52Z","snapshot_observed_at":"2026-08-04T19:59:17.722362Z","submitted_at":"2026-07-19T13:48:52Z","title":"Asynchronous Multimodal Diffusion Policy Composition via Latency-Aware Guidance Fusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T18:37:10.563802Z"},"links":{"cited_paper":"/paper/2509.23468","citing_paper":"/paper/2607.17257"},"observation_digest":"sha256:b1f606b00af13e5ccb91197eb0ddcc4c35fdbc4237a39080eef49c6e17fde32c","observation_id":"44c16f47-34ed-4694-88f8-dfa6f04db926","resolution":{"observed_at":"2026-08-01T18:37:10.563802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.23468/citation-record","integrity":"/paper/2509.23468/integrity","json":"/paper/2509.23468/citation-record.json","paper":"/paper/2509.23468"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robot sound interpretation: Combining sight and sound in learning-based control","venue":null,"work_id":"137bc790-94ef-4d49-90f9-f88842b71096","year":2020},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:1b7c2047c804e93839272f61180bf88032cf1b6fa8beef04b61b32ab51ea9497","observation_id":"db24cf58-b01c-4105-8866-7566036e8b8a","resolution":{"observed_at":"2026-05-18T11:51:20.618751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Making sense of vision and touch: Self- supervised learning of multimodal representations for contact-rich tasks","venue":null,"work_id":"522a631c-4d98-48ee-89ba-5fe41f054917","year":2019},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:dfc50695431eb857d655e70c456b70b37b64cfa28a5451f22ff25937cf0fd5ad","observation_id":"564e76a7-ed89-4863-96f9-a7f35d089b08","resolution":{"observed_at":"2026-05-18T11:51:20.659689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"See, hear, and feel: Smart sensory fusion for robotic manipulation","venue":null,"work_id":"ba24eaaf-93ec-4b6b-87b7-bcdd6fe6bf02","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:cd3ad1b4cc3bdd487f216da99fe7d9b9118d4fd605db8841caee83161fd0d234","observation_id":"935e9984-c72a-4ac5-89cd-b51d2042849e","resolution":{"observed_at":"2026-05-18T11:51:20.555820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"More than a feeling: Learning to grasp and regrasp using vision and touch","venue":null,"work_id":"ed20f992-fe19-47b8-a869-dc312f5249b5","year":2018},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:fd62ec57703021965e2cb526dbcebe919a171ace300dc99b7e305217a3bf14d5","observation_id":"1fc5d21b-98be-45c0-8530-4c55ca8a1529","resolution":{"observed_at":"2026-05-18T11:51:20.542224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"General in-hand object rotation with vision and touch","venue":null,"work_id":"aea55d43-06a2-4a66-a12a-83c39699e8b6","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:ec55d5a3dd750d6d4469a41f35727425314a752445beb4fdaf660e6b5f2ab71b","observation_id":"f0d03b3b-2ef2-49b1-934b-576996f708be","resolution":{"observed_at":"2026-05-18T11:51:20.642048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visuotactile-rl: Learning multimodal manipulation policies with deep reinforcement learning","venue":null,"work_id":"3d156799-4406-46b2-a765-da4608b7d9da","year":2022},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:980563252a6a85d19a0dc713cf5cc6d42b754085c8ff873f38f9b54ff496ee13","observation_id":"4996df24-4cd4-4fce-8e5b-76f1a7cee8a8","resolution":{"observed_at":"2026-05-18T11:51:20.645401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compositional visual generation with energy based models","venue":null,"work_id":"f1108079-b85e-4d5e-97a7-09c9d80398ed","year":2020},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:ed66904c708ee248b60bc8801dcd2388be6b530f0c78c73aba806b2ce9fb816b","observation_id":"44439bd2-b5eb-4877-935c-2872ae134660","resolution":{"observed_at":"2026-05-18T11:51:20.549114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01714","last_updated":"2023-01-17T17:08:51Z","snapshot_observed_at":"2026-08-02T04:13:10.260957Z","submitted_at":"2022-06-03T17:47:04Z","title":"Compositional Visual Generation with Composable Diffusion Models","version":6},"cited_work":{"arxiv_id":"2206.01714","doi":"10.48550/arxiv.2206.01714","metadata_source":"arxiv_reference","pith_arxiv_id":"2206.01714","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Compo- sitional visual generation with composable diffusion models","venue":"arXiv (Cornell University)","work_id":"70a57732-0eed-47ad-92e4-de7d4e5e2263","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2206.01714","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:b3faf2078a7c1edb265f20d60e732ffa2b1ede7f571a3ddeffbb163f7757b3eb","observation_id":"e0340d81-1283-41fc-8355-30a6d8d7f256","resolution":{"observed_at":"2026-05-18T11:51:20.231334Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reduce, reuse, recycle: Compositional generation with energy-based diffusion models and mcmc","venue":null,"work_id":"f522118d-86eb-4719-a7ef-45b4ab1c0c24","year":2024},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:d08d1e7b97d6567f2aae6b6f4ac9f66546797fe12c82247ab7bcd7ff9869057f","observation_id":"6751fe4e-fef7-48a1-af9b-661edf1fa228","resolution":{"observed_at":"2026-05-18T11:51:20.538604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01103","last_updated":"2024-06-03T23:30:33Z","snapshot_observed_at":"2026-07-06T17:24:03.237617Z","submitted_at":"2024-02-02T02:40:51Z","title":"Compositional Generative Modeling: A Single Model is Not All You Need","version":3},"cited_work":{"arxiv_id":"2402.01103","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.01103","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compositional generative modeling: A single model is not all you need","venue":null,"work_id":"f973f8cf-b04b-419c-afdd-6255ab3101b9","year":2015},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2402.01103","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:25d63b96c27381252dc90ac6f765332b33826cf5381d32dff454ccf10364965d","observation_id":"50240155-6c3b-498a-8435-9a6415a6e818","resolution":{"observed_at":"2026-05-18T11:51:20.300926Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compositional diffusion-based continuous constraint solvers","venue":null,"work_id":"1d7777cd-4798-47c5-811f-a3c4dda4c78c","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:afdd15528cdcab20cb7b93a97e37231fa652722640f65d95b054bff9a24b38de","observation_id":"928f4f43-8c0e-44ac-ab7c-5189197f19ed","resolution":{"observed_at":"2026-05-18T11:51:20.599406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rlbench: The robot learning benchmark & learning environment","venue":null,"work_id":"658479fe-998a-40bb-9a03-36fa3da9717d","year":2019},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:387fb66beb6824b7595bcddddf5e296b99705c7562aa6c95a63c0fb9c1102970","observation_id":"e0b9e079-7a9b-4a55-a43d-95b10764f4df","resolution":{"observed_at":"2026-05-18T11:51:20.531898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roles of glabrous skin receptors and sensorimotor memory in automatic control of precision grip when lifting rougher or more slippery objects","venue":null,"work_id":"caf5313c-482b-4dd3-8b07-4b7ba432d497","year":2004},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:cee820e8a66474761450edde56e77ae7a004475ce355a688e204650a61ce97e9","observation_id":"85c2ce5d-fe02-4678-9bfe-130d60a57dfe","resolution":{"observed_at":"2026-05-18T11:51:20.622566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robotic grasping and contact: a review","venue":null,"work_id":"23f3118d-3890-4b66-a604-66bb3c61cf96","year":2000},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:9a1b82cdff8a11f4e82886d8fd8067133f9ca47d7e91fccef5a403ef4834dd51","observation_id":"e7e9861d-5e61-42c1-9718-98991b0569d5","resolution":{"observed_at":"2026-05-18T11:51:20.579248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03222","last_updated":"2023-08-06T22:39:25Z","snapshot_observed_at":"2026-08-04T03:54:53.545074Z","submitted_at":"2023-08-06T22:39:25Z","title":"Towards Safe Multi-Level Human-Robot Interaction in Industrial Tasks","version":1},"cited_work":{"arxiv_id":"2308.03222","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.03222","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards safe multi-level human-robot interaction in industrial tasks","venue":null,"work_id":"91e128c0-c497-4c61-b258-7fb21ab6c3bc","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2308.03222","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:31c7707ebb837a9a9343baccd65163293aaf67e7e59dbbe875684b6f0c65d3e9","observation_id":"3d073655-a6da-4582-8779-9bb4d2419d6a","resolution":{"observed_at":"2026-05-18T11:51:20.288273Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neural feels with neural fields: Visuo-tactile perception for in-hand manipulation","venue":null,"work_id":"7717cead-cd5b-49db-97b6-9e111f5506e8","year":2024},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:56711979e22330148ed0f20a21427342eca72a96745687bc56b279857480f3fb","observation_id":"b5b2f998-762d-404e-a684-3fc953f59e15","resolution":{"observed_at":"2026-05-18T11:51:20.608009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12024","last_updated":"2024-01-22T15:11:57Z","snapshot_observed_at":"2026-08-04T12:25:17.068585Z","submitted_at":"2024-01-22T15:11:57Z","title":"Multimodal Visual-Tactile Representation Learning through Self-Supervised Contrastive Pre-Training","version":1},"cited_work":{"arxiv_id":"2401.12024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.12024","snapshot_observed_at":"2026-07-02T13:46:59.743167Z","title":"Multimodal visual-tactile rep- resentation learning through self-supervised contrastive pre-training","venue":null,"work_id":"90650b92-b55a-48fd-af23-f0a66701bf50","year":2024},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2401.12024","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:2d75fc3606fe9c123a08803cda8eb8579082065405d7583f947868a66fd4a53c","observation_id":"54d76568-b424-4318-ae7c-a5cd31af6717","resolution":{"observed_at":"2026-05-18T11:51:20.261602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sim2real manipulation on unknown objects with tactile- based reinforcement learning","venue":null,"work_id":"f74487e1-6376-447e-ba94-454b5235b993","year":2024},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:eb6661a04ef80918c13221e05cdb7a584d07f4a17f954744a23ec0eb122b291f","observation_id":"43306b01-16ea-4728-9286-9e843f624d7d","resolution":{"observed_at":"2026-05-18T11:51:20.634431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visuo-tactile transformers for manipulation","venue":null,"work_id":"8a7064d5-1a0f-4817-bdca-1d9651a0ffb0","year":2022},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:42f31fddb384193a04acd000df521401d1f959eca6c116ae2e088db29536dfb5","observation_id":"6d874343-171f-49a1-bf92-8f646e2c6b30","resolution":{"observed_at":"2026-05-18T11:51:20.656021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01853","last_updated":"2024-07-31T06:46:16Z","snapshot_observed_at":"2026-08-04T07:28:02.409832Z","submitted_at":"2023-12-04T12:35:43Z","title":"Robot Synesthesia: In-Hand Manipulation with Visuotactile Sensing","version":3},"cited_work":{"arxiv_id":"2312.01853","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.01853","snapshot_observed_at":"2026-07-03T10:48:02.612683Z","title":"Robot synesthesia: In-hand manipulation with visuotactile sensing","venue":null,"work_id":"dbb8f1d7-3283-45df-9240-cd77e87e170e","year":2024},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2312.01853","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:b47d9219794f3e86a1c16a423a6af9973035f2730d2ff2864d9cde94bf76e8c7","observation_id":"56786c8d-9028-47ba-ac91-8aceab93f057","resolution":{"observed_at":"2026-05-18T11:51:20.236192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d vitac:learning fine-grained manipulation with visuo-tactile sensing","venue":null,"work_id":"dbdb422b-f471-4908-aeba-4404a132b549","year":2024},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:b829423632273cd66ce3a879b85327367f36e749d4ee057b5aa59fb1b2348999","observation_id":"30e8f970-7fff-4cd0-9b66-3d2d1dda86a0","resolution":{"observed_at":"2026-05-18T11:51:20.586305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to compose visual relations","venue":null,"work_id":"8ab0fe9f-d578-4308-994a-da38248475f7","year":2021},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:f5e9d3ae2bf6f130789055209b48d5193705cce9b25f9d4d9e03fd3c75fc0f2f","observation_id":"54f591d0-e812-40aa-9aeb-0c65204aed8b","resolution":{"observed_at":"2026-05-18T11:51:20.590137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Composable energy policies for reactive motion generation and reinforcement learning","venue":null,"work_id":"ae5a3501-4c30-48be-907f-5000ae57e72f","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:e7eeafff89520a6457c0cda3fdbbe525e7bac9709f9e464d923102e96c913ca4","observation_id":"9440ab59-ce00-4002-8a58-f3fbc94d02af","resolution":{"observed_at":"2026-05-18T11:51:20.611398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Energy-based Models are Zero-Shot Planners for Composi- tional Scene Rearrangement","venue":null,"work_id":"6087fe08-109a-4e59-822c-70ef2173506d","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:b017b56888c86391cf3cc7cc7f66eb46f94d5f37e4e77b746ff8e88805149015","observation_id":"a29b724d-fb85-4f78-a6ea-6d22c68ce427","resolution":{"observed_at":"2026-05-18T11:51:20.559522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":"3e816b3a-afbf-4635-9668-56ee131fa722","year":2021},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:9b86a7005f3923264cf93916c86d43ad915924064dd0ee7c41be7f1e3113be71","observation_id":"eb4c7754-5a76-4e1d-887f-fdd0dc24cc55","resolution":{"observed_at":"2026-05-18T11:51:20.568512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Planning with diffusion for flexible behavior synthesis","venue":null,"work_id":"93d539bc-4f4c-4718-a566-c438b46d2f3e","year":2022},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:49fa015f301ae373df610e173347b8a2acf08a4dfc8a44062b3fe2b7923e0f3c","observation_id":"2455ea69-fa22-404e-ba18-cc4ebfd59ee9","resolution":{"observed_at":"2026-05-18T11:51:20.595066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.15657","last_updated":"2023-07-10T07:25:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-28T18:59:02Z","title":"Is Conditional Generative Modeling all you need for Decision-Making?","version":4},"cited_work":{"arxiv_id":"2211.15657","doi":"10.48550/arxiv.2211.15657","metadata_source":"pith","pith_arxiv_id":"2211.15657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is Conditional Generative Modeling all you need for Decision-Making?","venue":"cs.LG","work_id":"dac365c0-e557-4886-9a1b-179151a66160","year":2022},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2211.15657","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:60cf3a825a3716e9a4a2ed274c7b6f779fa3af55730f73a9bd0d9fd1c15a8bce","observation_id":"3fe0ef16-3aca-4058-b3bd-61bf5175e426","resolution":{"observed_at":"2026-05-18T11:51:20.293005Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T22:49:28.005241+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T22:49:28.005241+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative trajectory stitching through diffusion composition","venue":null,"work_id":"b2775397-4de6-4e3b-b52f-d7c792b79b4a","year":2025},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:86d702b472cf02bdcdd4291229297ed4cac5b23245d5e1ea3fd06c6949d50ef8","observation_id":"fe7823af-afb8-4a44-b767-8c7f1ef8d5dc","resolution":{"observed_at":"2026-05-18T11:51:20.552363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14325","last_updated":"2023-05-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:55:11Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","version":1},"cited_work":{"arxiv_id":"2305.14325","doi":"10.48550/arxiv.2305.14325","metadata_source":"pith","pith_arxiv_id":"2305.14325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","venue":"cs.CL","work_id":"a543e65c-1cf8-4182-b03b-33c0cd2c65d5","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2305.14325","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:52aa3db53f37d7afac2e74f00fd75b3c61706a9546d34b3a1d78a4466e879e7d","observation_id":"65a4b2b6-bab0-4d45-ab27-e465bf24a3c0","resolution":{"observed_at":"2026-05-18T11:51:20.240922Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative skill chaining: Long-horizon skill planning with diffusion models","venue":null,"work_id":"6b669355-b36a-45fb-a107-91b6672020f8","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:75d5ecb1deb70f567efba4f4114671aafab684a73eff4d4e9708f39eb253b5a5","observation_id":"4502296c-719a-4f7f-ab83-205c2c5915bb","resolution":{"observed_at":"2026-05-18T11:51:20.534999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08587","last_updated":"2023-09-21T14:49:20Z","snapshot_observed_at":"2026-07-06T16:19:05.495349Z","submitted_at":"2023-09-15T17:44:05Z","title":"Compositional Foundation Models for Hierarchical Planning","version":2},"cited_work":{"arxiv_id":"2309.08587","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.08587","snapshot_observed_at":"2026-07-02T11:56:56.047138Z","title":"Compositional foundation models for hierarchical planning","venue":null,"work_id":"31122d0b-b1dc-41ad-8818-e05c05898071","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2309.08587","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:e8073886b3595e5eb4cc2f204a8e7f443f8b1858ef908b576e672d517c22b301","observation_id":"ba22846d-cfd4-4d45-a62d-ad2af0696661","resolution":{"observed_at":"2026-05-18T11:51:20.251767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17920","last_updated":"2025-05-26T22:43:40Z","snapshot_observed_at":"2026-08-04T13:30:35.106279Z","submitted_at":"2024-12-23T19:20:29Z","title":"Causal Composition Diffusion Model for Closed-loop Traffic Generation","version":3},"cited_work":{"arxiv_id":"2412.17920","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.17920","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Causal composition diffusion model for closed-loop traffic generation","venue":null,"work_id":"c055baea-ec01-414f-a640-bedd989cdd21","year":2024},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2412.17920","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:67fba2d936cb94b18e6af0fe335a2c8d1a5cf97418952ecdc9a229b6367ae786","observation_id":"ce30b3f8-77a0-4d6e-8177-b7abede9c71b","resolution":{"observed_at":"2026-05-18T11:51:20.266335Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01418","last_updated":"2023-08-30T04:41:10Z","snapshot_observed_at":"2026-08-04T22:38:03.106382Z","submitted_at":"2023-03-02T17:09:27Z","title":"Human Motion Diffusion as a Generative Prior","version":3},"cited_work":{"arxiv_id":"2303.01418","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.01418","snapshot_observed_at":"2026-07-10T16:17:21.705577Z","title":"Human motion diffusion as a generative prior","venue":"cs.CV","work_id":"ea88c49f-ba30-451c-8ec7-5be980885989","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2303.01418","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:ce864ebb89be95b696e4b5862073faab06c2cc11e86b340c425df9e5c0e29456","observation_id":"1f232c4a-1aa9-4335-87b0-1f7b20f9f317","resolution":{"observed_at":"2026-05-18T11:51:20.277727Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07320","last_updated":"2025-01-07T23:10:25Z","snapshot_observed_at":"2026-07-06T20:04:30.197401Z","submitted_at":"2024-12-10T09:08:41Z","title":"CoMA: Compositional Human Motion Generation with Multi-modal Agents","version":2},"cited_work":{"arxiv_id":"2412.07320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.07320","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Coma: Compositional human motion generation with multi-modal agents","venue":null,"work_id":"9e82e189-f086-411b-919b-d00a412cf677","year":2024},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2412.07320","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:f5085317e406819e75592a03d8bba2ea11c88c43e5e6c845e719f744504a7b58","observation_id":"2d162210-87f4-4338-b20a-c50fb13eafb4","resolution":{"observed_at":"2026-05-18T11:51:20.246560Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02511","last_updated":"2024-12-01T15:55:50Z","snapshot_observed_at":"2026-07-06T17:25:05.974815Z","submitted_at":"2024-02-04T14:51:49Z","title":"PoCo: Policy Composition from and for Heterogeneous Robot Learning","version":3},"cited_work":{"arxiv_id":"2402.02511","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02511","snapshot_observed_at":"2026-07-04T06:49:37.815396Z","title":"Poco: Policy composition from and for heterogeneous robot learning","venue":null,"work_id":"eead1e0d-f300-4fbb-996d-75093f2638e3","year":2024},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2402.02511","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:41f44dfbd02a65a330c51352f5ad218fecee1191d3e4b4207961ccbf3507b5b1","observation_id":"6f4f4223-d8d1-4946-8e35-d4b7cd964a1f","resolution":{"observed_at":"2026-05-18T11:51:20.273083Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:46:29.679668Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":"3519a89b-d5d2-44a6-ab51-4b2c6fdc96e6","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:c14159dae5cc0a51a25a6cacb35668b2ebd9ccd9f3bcb8c29d10db1e7a1ffe6b","observation_id":"67e32bd7-61e7-4af7-8255-bba77266754f","resolution":{"observed_at":"2026-05-18T11:51:20.630515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imitating human behaviour with diffusion models","venue":null,"work_id":"4fd5b6ec-ee1d-49d0-886d-7c2e80f21379","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:ab8ed5ac30d9781af98be68bc098a507a8ed574f5db73aeaa764ca19d592da6d","observation_id":"e2bf1b93-ef1e-4dd5-a326-3f8837a97230","resolution":{"observed_at":"2026-05-18T11:51:20.638479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Goal-conditioned imitation learning using score-based diffusion policies","venue":null,"work_id":"6bda64fd-6fe1-4be0-bae5-02202487faad","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:579623219b866c519a9e45f7642938ac46f9b2a0c0173c4700958cb48239fc95","observation_id":"221ee7fc-bd70-4585-9137-ffed0a8dc4fa","resolution":{"observed_at":"2026-05-18T11:51:20.652442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.15062","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T09:47:59.733834Z","title":"Touch in the wild: Learning fine-grained manipulation with a portable visuo-tactile gripper","venue":null,"work_id":"ed4b641d-a1c3-4e2c-a15e-7ff5f3264e86","year":2025},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:4b53cbae4646a9ba80c83c4272c86310e15e38551a19ae608723a482cf93cbb7","observation_id":"93009225-8c13-4e6f-bdaf-2b963a1547f0","resolution":{"observed_at":"2026-05-18T11:51:20.283536Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning coordinated bimanual manipulation policies using state diffusion and inverse dynamics models","venue":null,"work_id":"750d0993-123c-4b26-a443-8fc9d371c10b","year":2025},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:8409d1c0a84758cdb3976c359ef3648148687b8fca40b17920ab7d06b1ec3e2d","observation_id":"39f80e38-44f7-42a3-b529-e5cdf2a8c247","resolution":{"observed_at":"2026-05-18T11:51:20.648769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tool-as- interface: Learning robot policies from observing human tool use","venue":null,"work_id":"4c8b18ab-1e53-4e98-994f-cf9d23104d4c","year":2025},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:5bfc328679fe1d434366403cb8b541385a22dd1bee7b6efc5928af4b8cec58da","observation_id":"8f69e858-09d5-43b8-b127-2769e9023ad0","resolution":{"observed_at":"2026-05-18T11:51:20.575855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Edmp: Ensemble-of-costs-guided diffusion for motion planning","venue":null,"work_id":"bc6ef7be-ddbe-419e-a56a-3703987f8421","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:13661d7a1890b6d725eb5fa0baf195bec3ac2dae6200c9f8959af01d0b9225f8","observation_id":"6c382185-f5fa-41e2-83ea-5e1195afda06","resolution":{"observed_at":"2026-05-18T11:51:20.604268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vt-refine: Learning bimanual assembly with visuo-tactile feedback via simulation fine-tuning","venue":null,"work_id":"a33e937d-f446-42d8-91ca-32cb4a47b6d0","year":2025},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:607419078dbd1e1120fc09d43513e49190f6bd58d7a2e26f61cc39837673635a","observation_id":"e34b0999-8d5a-412c-ba8e-58d7b983df84","resolution":{"observed_at":"2026-05-18T11:51:20.626534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hierarchical diffusion for offline decision making","venue":null,"work_id":"8be95973-72ee-43bb-997d-52cc8b7dd2ac","year":2023},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:3a1dfec926326ae67f15c38f59b4198a214d56aae243c69c5b79f0510c6cbfe3","observation_id":"11cc854a-fdf4-4c95-8679-e863ba142b5f","resolution":{"observed_at":"2026-05-18T11:51:20.615104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15139","last_updated":"2025-04-10T08:48:37Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T18:59:47Z","title":"DiffusionDrive: Truncated Diffusion Model for End-to-End Autonomous Driving","version":3},"cited_work":{"arxiv_id":"2411.15139","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.15139","snapshot_observed_at":"2026-07-04T19:30:07.203930Z","title":"Diffusiondrive: Trun- 9 cated diffusion model for end-to-end autonomous driving","venue":null,"work_id":"66bfe3b2-f9cb-4d0c-8f12-1de1fdedfa9e","year":2024},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"cited_paper":"/paper/2411.15139","citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:df15521133b90a48241c1823ce03779aa3f6607ca54cfffe5c203b18ce8d7dc8","observation_id":"99fdbfc5-0bde-4051-9788-01ba29a644e5","resolution":{"observed_at":"2026-05-18T11:51:20.256825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Modality- composable diffusion policy via inference-time distribution-level com- position","venue":null,"work_id":"f4bca85c-ba06-41a0-85c8-97e3330c7ddb","year":2025},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:9385fcce93a4bf2a5a3fd81f338b35d2c6006ab8264e004637359842d0b50d89","observation_id":"907fdb69-3e1b-42e6-baa6-df80ce0fa8ae","resolution":{"observed_at":"2026-05-18T11:51:20.545944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"b9ed735a-db52-45c0-b733-56b89230eb74","year":2020},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:b61f522eddb4e7935bc41baa09d93b93c444a1d2b802825fc50e3155af594ac8","observation_id":"1c216eb8-16a8-4a78-971f-06a7e4b41272","resolution":{"observed_at":"2026-05-18T11:51:20.572222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emerging properties in self-supervised vision trans- formers","venue":null,"work_id":"c884f2c1-2859-472e-92f6-da2cdd638802","year":2021},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:2bd5d2bbb6e22dcae6ce0e0ef0585e9e414e94ecea131d0a77f2da92743e90e6","observation_id":"22e38317-1019-48d8-ab08-fab0561442ae","resolution":{"observed_at":"2026-05-18T11:51:20.563228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DINOv2: Learning robust visual features without supervision","venue":null,"work_id":"1769f0fb-877b-4ab7-8163-904e0cec62e0","year":2024},"citing_paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-18T11:50:20.766891Z"},"links":{"citing_paper":"/paper/2509.23468"},"observation_digest":"sha256:ffb89fd5688e86396cc3bd35e80595529e1b63d0cfdd32071c66ba5f5a8b1fa9","observation_id":"2ad35df5-ed64-4b04-9332-06239f41beb3","resolution":{"observed_at":"2026-05-18T11:51:20.582722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.23468","last_updated":"2026-04-15T21:51:13Z","latest_version":3,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-03T03:34:12.773710Z","submitted_at":"2025-09-27T19:43:04Z","title":"Multi-Modal Manipulation via Multi-Modal Policy Consensus"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":14,"verified_fuzzy":35},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 11 inbound Pith citation observations for arXiv:2509.23468."}