{"as_of":"2026-08-09T14:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d71ea9325c4e39f333cf61b8bf2fd59a617b223e0a3058c25d27793f0c019143","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:32:29.257711Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.27782/citation-record","integrity":"/paper/2607.27782/integrity","json":"/paper/2607.27782/citation-record.json","paper":"/paper/2607.27782"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-01T01:32:23.601264Z","title":"π0: A vision-language-action flow model for general robot control.arXiv preprint arXiv:2410.24164, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:23.601264Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:2b093808d2c5a424ee1bd3af9624d01d62358349c266c32afb96c4abda2a3703","observation_id":"e72429ad-42f0-4072-9f0a-da71a7148146","resolution":{"observed_at":"2026-08-01T01:32:23.601264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-01T01:32:23.677487Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:23.677487Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:49df6f9ea979cb61153e3ace831be911a8e8cf03899514778ebab3008b720fab","observation_id":"149e7607-976a-4929-b062-b505d443b47c","resolution":{"observed_at":"2026-08-01T01:32:23.677487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:23.766592Z","title":"Sanketi, Grecia Salazar, Michael S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:23.766592Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:1ab5b442cccb45ef0ba9db2b62bf526777f866e30dc8f426d6ff481649b9a1cf","observation_id":"88cfc586-1c62-47d9-bd75-66a42b2e4fa9","resolution":{"observed_at":"2026-08-01T01:32:23.766592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00909","last_updated":"2018-05-20T20:03:59Z","snapshot_observed_at":"2026-08-08T20:31:18.897748Z","submitted_at":"2018-05-02T17:11:20Z","title":"Reinforcement Learning and Control as Probabilistic Inference: Tutorial and Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00909","snapshot_observed_at":"2026-08-01T01:32:24.016278Z","title":"Reinforcement learning and control as probabilistic inference: Tutorial and review, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:24.016278Z"},"links":{"cited_paper":"/paper/1805.00909","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:52f7a8b81a70d8dcc1f6495d06307983ae4dddc047cad0f99a5a2a645aec8c27","observation_id":"20efdf95-28dc-4cd8-ae9c-609f45287d71","resolution":{"observed_at":"2026-08-01T01:32:24.016278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09674","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-11T17:59:17Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09674","snapshot_observed_at":"2026-08-01T01:32:24.247944Z","title":"Simplevla-rl: Scaling vla training via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:24.247944Z"},"links":{"cited_paper":"/paper/2509.09674","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:498d2f8bab2de49b02882a1afd6ea09ff91ce595a13b714fbdda416d888c2ebf","observation_id":"61fec517-7092-4679-88c5-267c8056e2b1","resolution":{"observed_at":"2026-08-01T01:32:24.247944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18719","last_updated":"2025-05-24T14:42:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-24T14:42:51Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18719","snapshot_observed_at":"2026-08-01T01:32:24.481776Z","title":"Vla-rl: Towards masterful and general robotic manipulation with scalable reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:24.481776Z"},"links":{"cited_paper":"/paper/2505.18719","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:dd29eefb393f7e575f8ea3cff05112d66103f2c8e33b9d968ec6bb44d26be5e7","observation_id":"01bf5c1e-2ec4-4feb-ab87-83801cc30ddb","resolution":{"observed_at":"2026-08-01T01:32:24.481776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:24.640811Z","title":"Reinflow: Fine-tuning flow matching policy with online reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:24.640811Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:8a179936e89c281eea6f42171a8f852b1b6477b0ea92725cd34c24cf0bbb9904","observation_id":"bef5b326-f5d2-497a-be70-338404c16ffc","resolution":{"observed_at":"2026-08-01T01:32:24.640811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-01T01:32:24.807759Z","title":"Advantage-weighted regression: Simple and scalable off-policy reinforcement learning, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:24.807759Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:4a448664ebcd91aa962df19592347d5180a22224c89a222a0c6fcb7a58f481dd","observation_id":"7cbb76f7-2b2f-4998-ba1e-706ad2cfd9e9","resolution":{"observed_at":"2026-08-01T01:32:24.807759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:24.985831Z","title":"Reinforcement learning by reward-weighted regression for operational space control","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:24.985831Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:b0b92d711ebaffeac009e1531193a69b7ed3102c667900666056fb4b01fb6b5d","observation_id":"ce3a0085-771e-4f88-8e61-3e6e77c6cc9a","resolution":{"observed_at":"2026-08-01T01:32:24.985831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:25.109246Z","title":"Lundell, and Dongdong Chen","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:25.109246Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:0d27377706ffeece5d1951ad4be6efe1edc8096629be0d7c2b604bcb957bf32e","observation_id":"c1d9edde-1026-4ae6-934f-10b1f556a7ee","resolution":{"observed_at":"2026-08-01T01:32:25.109246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19309","last_updated":"2025-02-04T08:49:11Z","snapshot_observed_at":"2026-07-31T23:24:14.896271Z","submitted_at":"2024-11-28T18:30:10Z","title":"GRAPE: Generalizing Robot Policy via Preference Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19309","snapshot_observed_at":"2026-08-01T01:32:25.304633Z","title":"Grape: Generalizing robot policy via preference alignment.arXiv preprint arXiv:2411.19309, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:25.304633Z"},"links":{"cited_paper":"/paper/2411.19309","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:0963fd6460216db4ae10739e908b1b6b1d2466681d0aea7dd89641fe488d8639","observation_id":"a95f753a-b662-479e-bbb8-80748f72cebb","resolution":{"observed_at":"2026-08-01T01:32:25.304633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-08-01T01:32:25.499227Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:25.499227Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:cc6054c212c80a92d0b902f5f2871d72c0d103530e201989cccfa146ec6b9133","observation_id":"558f1cde-f69a-4d52-9e9b-afa14f0aad0e","resolution":{"observed_at":"2026-08-01T01:32:25.499227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:25.692967Z","title":"Hg- dagger: Interactive imitation learning with human experts","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:25.692967Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:b7278c5fd8db496e85fea9b69af18860b8bb988965e16aac7c8bd3526f7a8497","observation_id":"a88983dc-5cf6-430d-b913-d3493a4a3ca8","resolution":{"observed_at":"2026-08-01T01:32:25.692967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:25.855282Z","title":"Precise and dexterous robotic manip- ulation via human-in-the-loop reinforcement learning.Science Robotics, 10(105):eads5033, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:25.855282Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:b5207944e3f7809d7f9c2be61b153f28065d7189484a18af033b441787070f85","observation_id":"6f363d81-147e-4705-bc25-db47dfb0eb44","resolution":{"observed_at":"2026-08-01T01:32:25.855282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:26.017594Z","title":"Human-assisted robotic policy refinement via action preference optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:26.017594Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:dce0f2068f8f79aba1e83f184c647b5ab5049fa4f5926d072eed00b300059296","observation_id":"18048a30-1ca7-4f61-b3c9-73d16cf214be","resolution":{"observed_at":"2026-08-01T01:32:26.017594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:26.146487Z","title":"Openvla: An open-source vision-language-action model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:26.146487Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:8246fd9acca2e995f3d1d137201cd54ebc05eea9c2de926b391cdebfea6691e0","observation_id":"5a65a549-f032-4208-89e2-a3a0240fe082","resolution":{"observed_at":"2026-08-01T01:32:26.146487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:26.258691Z","title":"Open x- embodiment: Robotic learning datasets and rt-x models: Open x-embodiment collaboration 0","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:26.258691Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:d4ab48130af7e1496191f3fed84a4649ad0fb6aa4e3c5d33a8a9da6fb0579cc9","observation_id":"e3c343a5-1d07-4c15-8de6-d7b3edff416f","resolution":{"observed_at":"2026-08-01T01:32:26.258691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12213","last_updated":"2024-05-26T19:55:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:57:01Z","title":"Octo: An Open-Source Generalist Robot Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12213","snapshot_observed_at":"2026-08-01T01:32:26.432497Z","title":"Octo: An open-source generalist robot policy, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:26.432497Z"},"links":{"cited_paper":"/paper/2405.12213","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:65d55bbe97a4a2d8e2f8b869a3026daf678e4e69941f6eb5f0251bac4bb0e1b0","observation_id":"ac7c9196-943b-41dc-8e24-a60ea0e5df51","resolution":{"observed_at":"2026-08-01T01:32:26.432497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:26.576523Z","title":"Halo: A unified vision-language-action model for embodied multimodal chain-of-thought reasoning, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:26.576523Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:f2607323dcfe7bddcc6c726016bca1ff258e0c42551e40621bf48b012cc9afed","observation_id":"25560d67-5566-4907-a189-f95aee1c0017","resolution":{"observed_at":"2026-08-01T01:32:26.576523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:26.746368Z","title":"Wmpo: World model-based policy optimization for vision-language-action models.arXiv preprint arXiv:2511.09515, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:26.746368Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:35417c590e636805f01e34a33056a8019477e9ad44c544fc60a662755885887e","observation_id":"8bbdc617-4fa0-48b5-97b5-170a633430d5","resolution":{"observed_at":"2026-08-01T01:32:26.746368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:26.943507Z","title":"Rlinf: Flexible and efficient large-scale reinforcement learning via macro-to-micro flow transformation.arXiv preprint arXiv:2509.15965, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:26.943507Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:d2bc49bbb4178d2885e72da32bf1b63ffa84e34f278a0cebaee22de49ec214b9","observation_id":"6a8139bc-0c1b-4c01-8e96-857964a96757","resolution":{"observed_at":"2026-08-01T01:32:26.943507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02219","last_updated":"2025-08-04T09:11:48Z","snapshot_observed_at":"2026-08-06T05:08:48.697177Z","submitted_at":"2025-08-04T09:11:48Z","title":"CO-RFT: Efficient Fine-Tuning of Vision-Language-Action Models through Chunked Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02219","snapshot_observed_at":"2026-08-01T01:32:27.131743Z","title":"Co-rft: Efficient fine-tuning of vision-language-action models through chunked offline reinforcement learning.arXiv preprint arXiv:2508.02219, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:27.131743Z"},"links":{"cited_paper":"/paper/2508.02219","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:212bd5445a379e4ae34e656cb5f507e3ab4cf67cf4457dca2a1bc7f2ac67a3ad","observation_id":"734a8d37-c8f0-4800-aedc-394c6387aa0d","resolution":{"observed_at":"2026-08-01T01:32:27.131743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:27.252963Z","title":"Rl-100: Performant robotic manipulation with real-world reinforcement learning.arXiv preprint arXiv:2510.14830, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:27.252963Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:4c2c3b04028c057d48bf0c7681d4bb484ab64e96680cec1748781a3ca98f6ded","observation_id":"4bf198d9-adaf-45cc-87fa-d87f755dfa2e","resolution":{"observed_at":"2026-08-01T01:32:27.252963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23458","last_updated":"2025-05-29T14:06:50Z","snapshot_observed_at":"2026-08-08T10:39:46.769874Z","submitted_at":"2025-05-29T14:06:50Z","title":"Diffusion Guidance Is a Controllable Policy Improvement Operator","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23458","snapshot_observed_at":"2026-08-01T01:32:27.374609Z","title":"Diffusion guidance is a controllable policy improvement operator.arXiv preprint arXiv:2505.23458, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:27.374609Z"},"links":{"cited_paper":"/paper/2505.23458","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:629a96a5c1e9732f628ff03e3f6af7db3c43e9200b52721222c570c82ee3e6b9","observation_id":"f08ee7e7-79ca-4e0b-ac81-af9759d37e18","resolution":{"observed_at":"2026-08-01T01:32:27.374609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:27.463145Z","title":"Roboreward: General-purpose vision-language reward models for robotics, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:27.463145Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:b43efdc4500af7d6cd18330e48d817717e555b41db4010ac0d3d017f680b0b10","observation_id":"7e1f1fa3-d458-4fc4-827b-3f161ef6b7f0","resolution":{"observed_at":"2026-08-01T01:32:27.463145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02115","last_updated":"2026-05-13T21:07:49Z","snapshot_observed_at":"2026-08-01T20:59:07.888539Z","submitted_at":"2026-03-02T17:38:58Z","title":"Robometer: Scaling General-Purpose Robotic Reward Models via Trajectory Comparisons","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.02115","snapshot_observed_at":"2026-08-01T01:32:27.671364Z","title":"Huang, Luke Zettlemoyer, Dieter Fox, Yu Xiang, Anqi Li, Andreea Bobu, Abhishek Gupta, Stephen Tu, Erdem Biyik, and Jesse Zhang","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:27.671364Z"},"links":{"cited_paper":"/paper/2603.02115","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:ffb69057154c2d418087a8a4e780fd535fec362f56c6a1357c5f4e51f6f8637c","observation_id":"c2352e95-8445-450d-b44e-25497fe26e6d","resolution":{"observed_at":"2026-08-01T01:32:27.671364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:27.796337Z","title":"Robo-dopamine: General process reward modeling for high- precision robotic manipulation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:27.796337Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:85a0569563f7d998f7ec9289e1aa95225d5b04b8dcced6852cce2541609ddc4d","observation_id":"12f6b819-2464-4816-92de-260ae5e4a463","resolution":{"observed_at":"2026-08-01T01:32:27.796337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01306","last_updated":"2024-11-19T18:12:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-02T10:53:36Z","title":"KTO: Model Alignment as Prospect Theoretic Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01306","snapshot_observed_at":"2026-08-01T01:32:27.996711Z","title":"Kto: Model alignment as prospect theoretic optimization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:27.996711Z"},"links":{"cited_paper":"/paper/2402.01306","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:96d717f0f4cc09e8ebd14acaea8be25fe93e98727cb36ad4ce82c6dd50c530b0","observation_id":"42e9925c-90ea-490f-b5ff-4ce284d18d14","resolution":{"observed_at":"2026-08-01T01:32:27.996711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:28.156356Z","title":"Flow match- ing for generative modeling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:28.156356Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:f18192ebcd1d83abfbf29a600143db7d752de799d2faa544c7ec4a563e4965ff","observation_id":"132e29d9-285f-47eb-9223-d7171980306a","resolution":{"observed_at":"2026-08-01T01:32:28.156356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:28.372431Z","title":"Accelerated hierarchical density based clustering","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:28.372431Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:969c3de4921722c0180b4692123ddc54af0e9f42a5bb448cf8ab7ec4b65507a1","observation_id":"81821e9c-cb5a-44c5-8e24-3d3912ee4e22","resolution":{"observed_at":"2026-08-01T01:32:28.372431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:28.535770Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:28.535770Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:ccdc97ef58e0acd10d3025f8460701709967a5e28a25fe57342003b8d3e4b447","observation_id":"9879ed17-1783-474f-80b3-696e11f41b1b","resolution":{"observed_at":"2026-08-01T01:32:28.535770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:28.662504Z","title":"URL https://arxiv.org/ abs/2510.25889","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:28.662504Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:1ac49e84a510d821926659894d9cfd2d1608cbcb8dffde07b85d54216c75dcee","observation_id":"a523d63f-1fac-4ffd-a16f-b8e9507a3ecc","resolution":{"observed_at":"2026-08-01T01:32:28.662504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T01:32:28.840631Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:28.840631Z"},"links":{"citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:1abded67ead9e6118e8d7385d02cfcf7df948ac3864cb6f5b039fdfac5bddbdd","observation_id":"bd52779b-0d90-4467-9c05-ed618d54296d","resolution":{"observed_at":"2026-08-01T01:32:28.840631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T01:32:28.948209Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:28.948209Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:74394cd49170ff925c3a5a154c5bcb09a9f9dfe3f88312643a7bfd38b7052fdf","observation_id":"47e095a4-d001-4326-afc8-46603a1986fa","resolution":{"observed_at":"2026-08-01T01:32:28.948209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-01T01:32:29.097678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:29.097678Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:30beb8bb7a275c0ec7e87034cfa1e111448eb385e1b852515c9acdcd72bfa530","observation_id":"69e58c6a-8ca7-4a6f-b72a-7cd138ffd8bf","resolution":{"observed_at":"2026-08-01T01:32:29.097678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-01T15:43:51.739518Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-01T01:32:29.257711Z","title":"Training diffusion models with reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T01:32:29.257711Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2607.27782"},"observation_digest":"sha256:9d2a8cf4f36749587bd8a46f9b1de11330c2be1e14e745b7f28538a504a2c1df","observation_id":"42f5953c-f3e1-4996-ac5b-32e9c9c9dfbc","resolution":{"observed_at":"2026-08-01T01:32:29.257711Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.27782","last_updated":"2026-07-30T07:14:39Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T16:30:55.760479Z","submitted_at":"2026-07-30T07:14:39Z","title":"RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2607.27782."}