{"as_of":"2026-08-08T11:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e1e884fac385f8faad959349018856723fb2952efe912eba60325922390f1899","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:13:13.797334Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T23:42:36.301802Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19717","snapshot_observed_at":"2026-08-02T23:42:36.301802Z","title":"Extremum flow matching for offline goal conditioned reinforcement learning.arXiv preprint arXiv:2505.19717,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.13061","last_updated":"2026-07-15T20:58:51Z","snapshot_observed_at":"2026-08-05T01:00:16.425522Z","submitted_at":"2026-02-13T16:15:58Z","title":"Native Extrapolation Awareness in Flow-Based Conditional Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T23:42:36.301802Z"},"links":{"cited_paper":"/paper/2505.19717","citing_paper":"/paper/2602.13061"},"observation_digest":"sha256:5d1b56361ccf3e10bef0e84fb935818ace5112c9aead535c69a0a8f6b21c34a9","observation_id":"b662e099-3a64-48af-be54-918eed490f37","resolution":{"observed_at":"2026-08-02T23:42:36.301802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19717/citation-record","integrity":"/paper/2505.19717/integrity","json":"/paper/2505.19717/citation-record.json","paper":"/paper/2505.19717"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:22.536794Z","title":"Implicit behavioral cloning,","venue":null,"work_id":"ca78f3f6-34ef-4849-9c22-0f6f80924e56","year":2022},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:10.344620Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:6a37ad101b1757c9132ad461c6ab1564cc93b63790513374272283de9f86117d","observation_id":"e5d39efb-a081-4752-b35c-9481816f62e2","resolution":{"observed_at":"2026-08-07T14:13:22.614774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:22.294181Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion,","venue":null,"work_id":"6dfcd518-5c6d-441e-bb0e-bc677f438272","year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:10.383771Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:73899249acd21d90a64ec9fdeef4d63cb55290a4f95703d843b815cc2c78e029","observation_id":"1a6cdce9-e039-4a68-a949-71757b0f889a","resolution":{"observed_at":"2026-08-07T14:13:22.402120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-07T14:13:10.424065Z","title":"π0: A vision-language-action flow model for general robot control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:10.424065Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:a4ec85ab4373ff2411690f3e0fe04453315f326e84bc777e426deb5884bf482b","observation_id":"545533ad-a22b-4268-b677-3107de5ee5dd","resolution":{"observed_at":"2026-08-07T14:13:10.424065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.932463Z","title":"Goal-conditioned imitation learning,","venue":null,"work_id":"c5fec8af-acb3-48f6-b6fc-8eb5529a193d","year":2019},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:10.458646Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:d03e30964c753e13e943659b739fa27aae4280f367ea98384815f2d58f7a791c","observation_id":"2c4a7aec-3d89-47ae-9f2b-90f4d5b8d11b","resolution":{"observed_at":"2026-08-07T14:13:22.027716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.739713Z","title":"Goal-conditioned imitation learning using score-based diffusion policies,","venue":null,"work_id":"204b0633-6e0c-412c-8735-a2e6bdb0a308","year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:10.517972Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:857da07fcb82b24dedbf69587c02ccf6d6abf8c4504d3c753a0be30f4b10854d","observation_id":"731f510a-c990-4e97-8bbe-2825ae134f8d","resolution":{"observed_at":"2026-08-07T14:13:21.830239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.564503Z","title":"From play to policy: Conditional behavior generation from uncurated robot data,","venue":null,"work_id":"6b0298a5-1c9c-4b2e-8b03-4963f8e10d91","year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:10.559130Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:066825fee37cdb42bf3b4998a57b089aba1a1e2c7f0f7e24699f33e4cfad48fd","observation_id":"9b456f13-4791-4eee-bcf3-7444acd4476c","resolution":{"observed_at":"2026-08-07T14:13:21.654084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.375700Z","title":"Nomad: Goal masked diffusion policies for navigation and exploration,","venue":null,"work_id":"2077af46-f1a0-4f4d-9bee-59f94b4f8f31","year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:10.615836Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:9fb24c4910776a6170e5c476729a3f07ecdea2d21b0c9db97ad25a571b33196d","observation_id":"a4069876-c30a-425f-8b2a-f384bb88072f","resolution":{"observed_at":"2026-08-07T14:13:21.488868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:21.164058Z","title":"Multimodal diffusion transformer: Learning versatile behavior from multimodal goals,","venue":null,"work_id":"bdf1675c-8246-4c7d-b0c9-53bda790cc89","year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:10.685703Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:cf2598b0b9ffef02817c12ba0ef30f6eef9a911ea2d78c6148b36172be7d627e","observation_id":"df922980-78c7-4ef6-ac36-7b18b4a68d66","resolution":{"observed_at":"2026-08-07T14:13:21.261925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2405.15775","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:14.148129Z","title":"Ai robots and humanoid ai: Review, perspectives and directions,","venue":null,"work_id":"3358469f-9e51-454b-ae82-71efe1694447","year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:10.758839Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:ae8782fd8111375f077418d21831c6852faebcfdd617cbdef4915a3211f64c99","observation_id":"95232859-c92e-44fc-a6b5-9d286f34d531","resolution":{"observed_at":"2026-08-07T14:13:14.277435Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:20.987191Z","title":"Advancements in humanoid robots: A comprehensive review and future prospects,","venue":null,"work_id":"ca4654ce-0764-456a-9363-b864851528f0","year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:10.812119Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:c02a1172fb7ad9ad11bb89dff7d02ddb1d5082a8731c496e2e6faca5eab73b50","observation_id":"bed0a074-b8f6-4ae5-8dca-5fbbc952a21b","resolution":{"observed_at":"2026-08-07T14:13:21.075008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:20.829120Z","title":"Learning latent plans from play,","venue":null,"work_id":"2a204d4e-0570-4c5c-a826-14fe3a78a260","year":2020},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:10.903727Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:8e06083e5ac644738561062a98e72de0331dacd146bd4e40b9a2651c9485166c","observation_id":"4903d5d4-4924-4edc-9666-beb5d5bda6ec","resolution":{"observed_at":"2026-08-07T14:13:20.890454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:20.592367Z","title":"Calvin: A benchmark for language-conditioned policy learning for long-horizon robot manipulation tasks,","venue":null,"work_id":"7d6b8a02-389c-470b-b830-ca9a58720b7d","year":2022},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:11.007525Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:c4b068188f0ad0e5d8e2b9b3b9de43e482e24bc5da5a954c98ff0fe2b77b02c0","observation_id":"fb6ed1a5-795b-4f13-93c0-28d0132aa7e6","resolution":{"observed_at":"2026-08-07T14:13:20.704051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:20.410286Z","title":"Mimicplay: Long-horizon imitation learning by watching human play,","venue":null,"work_id":"c869315c-7ecf-4312-bc16-012db43ea144","year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:11.245005Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:e1dcb5f00b79b4135011d9cc636cda5990fb7cfbb41ae542aa677961a3dfa4bd","observation_id":"bdbb5133-b17e-40f3-bf55-c3befb7d3cd4","resolution":{"observed_at":"2026-08-07T14:13:20.491154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:20.189608Z","title":"Is conditional generative modeling all you need for decision-making?","venue":null,"work_id":"82d8b78f-db57-4951-8a4a-784494e6d609","year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:11.604137Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:1b2e7528a8ed9eb9ae7c91c0c0424fd45295b00b010c20d215a4312f643954f1","observation_id":"021dbde6-fc11-423c-a7f9-7defa8cfbc22","resolution":{"observed_at":"2026-08-07T14:13:20.295710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:19.987668Z","title":"Offline reinforcement learning with implicit q-learning,","venue":null,"work_id":"4176057b-95c2-418e-8445-6b9231917c6b","year":2021},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:11.851151Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:39566428db9ff54ff2b3d77c0a41fa0503bc8eace30d34dacdb3d775f9b560f0","observation_id":"f15a7ee0-fe1c-4b0f-a0e8-b8a78106587a","resolution":{"observed_at":"2026-08-07T14:13:20.106721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11327","last_updated":"2024-11-18T06:44:14Z","snapshot_observed_at":"2026-08-07T01:25:57.107948Z","submitted_at":"2024-11-18T06:44:14Z","title":"Enhancing Decision Transformer with Diffusion-Based Trajectory Branch Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11327","snapshot_observed_at":"2026-08-07T14:13:11.951580Z","title":"Enhancing decision transformer with diffusion-based trajectory branch generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:11.951580Z"},"links":{"cited_paper":"/paper/2411.11327","citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:948474a5f94d3d9fe8be3034cac2ab2f0e2b3be6903e0560b7febaefb4c045a1","observation_id":"708a9874-fd61-4b2a-9b31-57e6197c721c","resolution":{"observed_at":"2026-08-07T14:13:11.951580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:19.815523Z","title":"Hiql: Offline goal-conditioned rl with latent states as actions,","venue":null,"work_id":"38fcfee4-0439-48ed-a8a2-577d219ea1d0","year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.051762Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:e6d87b5189c30498e888ddb965fa6a68bb61a386e7b998fde4292e6440410cf0","observation_id":"7443e3d9-cd8e-4f5c-9272-bc9676f77238","resolution":{"observed_at":"2026-08-07T14:13:19.887373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:19.609594Z","title":"Stitching sub-trajectories with conditional diffusion model for goal-conditioned offline rl,","venue":null,"work_id":"6c44d89d-2df9-47f4-b445-d01ee28b61a6","year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.156465Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:43d55592331c5e3520fbbb62d2d95063184c4ebd908abb2fb8c46227f3027e55","observation_id":"4bae52af-8a73-4158-bdc7-f6b3dfb4de4a","resolution":{"observed_at":"2026-08-07T14:13:19.724139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:19.472295Z","title":"What makes a good diffusion planner for decision making?","venue":null,"work_id":"f3b34147-0307-4693-ae43-c324221510ca","year":2025},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.266764Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:ae21449594f8fbc00d84c4d68fae0b7e26eed1559ba15084bcce848dbfad30d8","observation_id":"8a6a99a4-a041-4f00-a893-3b1fb963cc1f","resolution":{"observed_at":"2026-08-07T14:13:19.547599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:19.234103Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":"dff479bf-ca51-4a00-92f1-3c780c74e3c9","year":2020},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.347879Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:1726e307fca08b0e1b71e23a2b00171e7170a90792296fb585c3356a7180e360","observation_id":"3198f40b-b5fb-47f6-9ac6-8735306c7c98","resolution":{"observed_at":"2026-08-07T14:13:19.350494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:12.411901Z","title":"Denoising diffusion implicit models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.411901Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:35cdbbf145b734e4ffed7a6031aa091af17f95eb6fb12bd50babfa5601c674e2","observation_id":"de914c0c-c73c-4958-a4e7-002d8378602f","resolution":{"observed_at":"2026-08-07T14:13:12.411901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:18.973066Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow,","venue":null,"work_id":"f1806558-ffe0-48d4-8c04-4d556d071456","year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.522737Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:ff73c0cab584c198a3ee5d2539e28dbf752d47b854c438a247d1e1883060e173","observation_id":"1306ac9a-0419-4f3a-a203-b9f51252a0f8","resolution":{"observed_at":"2026-08-07T14:13:19.113131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:18.792347Z","title":"Planning with diffusion for flexible behavior synthesis,","venue":null,"work_id":"5b2ebaaf-ca41-433f-bb1b-29f4c2faf0a1","year":2022},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.597041Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:7dbe1d711fc30f999e946d34af8fcc2596726f316cf8a04c1799d2de1bfbd112","observation_id":"fe276f90-0e4b-4eca-9a79-184924bb178e","resolution":{"observed_at":"2026-08-07T14:13:18.860586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:18.531753Z","title":"Generative skill chaining: Long-horizon skill planning with diffusion models,","venue":null,"work_id":"0dd3ae80-dcf2-423a-8fdc-e53036a115b0","year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.675680Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:e4867560b0bbdb88879fd4edf6dc2e768836c3304660620f2d1136516fbbada7","observation_id":"1927f3b7-3165-40da-8259-27fc69aa2cd5","resolution":{"observed_at":"2026-08-07T14:13:18.670948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:18.338146Z","title":"Simple hierarchical planning with diffusion,","venue":null,"work_id":"35505f84-c5d8-459e-b178-3541ec7c2e67","year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.741001Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:b81fd91dbaa89e483d8d5c5fdc717383b19305d5b4d0e3d57ccae12597a8451a","observation_id":"32d62a88-606e-466e-a467-a2a6964ed055","resolution":{"observed_at":"2026-08-07T14:13:18.441594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05153","last_updated":"2025-05-05T16:26:30Z","snapshot_observed_at":"2026-08-07T17:22:58.699191Z","submitted_at":"2025-03-07T05:22:52Z","title":"Generative Trajectory Stitching through Diffusion Composition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05153","snapshot_observed_at":"2026-08-07T14:13:12.795022Z","title":"Generative trajectory stitching through diffusion composition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.795022Z"},"links":{"cited_paper":"/paper/2503.05153","citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:4630f8e07a09d3e4fb56a933c092e5d085f19da7173033ced2533ccb4d8e53cd","observation_id":"834b33c4-2866-4984-9b55-7fba85d288e0","resolution":{"observed_at":"2026-08-07T14:13:12.795022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08797","last_updated":"2025-10-09T00:43:44Z","snapshot_observed_at":"2026-07-06T15:03:52.079498Z","submitted_at":"2023-03-15T17:43:42Z","title":"Stochastic Interpolants: A Unifying Framework for Flows and Diffusions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08797","snapshot_observed_at":"2026-08-07T14:13:12.862097Z","title":"Stochastic interpolants: A unifying framework for flows and diffusions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.862097Z"},"links":{"cited_paper":"/paper/2303.08797","citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:14a3c59e2a5add2dcd5bd01a18896de6cfdc7417a416aff27502e663e81f769c","observation_id":"7a21a3ae-a52f-4449-9a5f-04e6ed277102","resolution":{"observed_at":"2026-08-07T14:13:12.862097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:18.074730Z","title":"Building normalizing flows with stochastic interpolants,","venue":null,"work_id":"1e2590ca-3922-4641-80e3-093a16232529","year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.907981Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:de3effdae3c3d1487bee01b399c0308a5cb8e45d008f83d522882366c26a74b0","observation_id":"70781da1-cd8b-409c-8c14-15bebfdf3d53","resolution":{"observed_at":"2026-08-07T14:13:18.235006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:17.805753Z","title":"Flow matching imitation learning for multi-support manipulation,","venue":null,"work_id":"10633906-227c-42ab-8706-cf09d6bb9574","year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.941740Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:e02b8f83ad154fae893303fbdaa359cac080fa4796f0d270f0188e7471974ea3","observation_id":"89c0b14b-1dcb-463d-82d1-5d5875188898","resolution":{"observed_at":"2026-08-07T14:13:17.950601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:17.465706Z","title":"Adaflow: Imitation learning with variance-adaptive flow-based policies,","venue":null,"work_id":"2f120a07-9b45-4950-a7d9-7170eb5ae68c","year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:12.981582Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:24538eca21d7bcbd38c8edcb428773bb6c76d89b18061e582ed3acf8a23c2994","observation_id":"c853b701-481d-4bce-8cd9-f0996d581477","resolution":{"observed_at":"2026-08-07T14:13:17.636475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:17.195670Z","title":"Riemannian flow matching policy for robot motion learning,","venue":null,"work_id":"b598712c-42da-49d3-8120-1bce81cc2794","year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.016061Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:f3aa0b4b8ff8390f3fac9f479dcfc258fe3ae97c8f728b817f37cf8174f24cdd","observation_id":"96ea8430-2587-4a30-bb67-39060cfb86a5","resolution":{"observed_at":"2026-08-07T14:13:17.342071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:16.913719Z","title":"Flowpolicy: Enabling fast and robust 3d flow-based policy via consistency flow matching for robot manipulation,","venue":null,"work_id":"3bc983e8-c731-4239-8c45-0d2192231104","year":2025},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.064149Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:6806109a9b660481c1c549728f53d99e80a368e954c8adc25fffdbcc4db18a47","observation_id":"ef7e17d1-7ff4-4255-a85d-8a98bc72d3c3","resolution":{"observed_at":"2026-08-07T14:13:17.058813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04975","last_updated":"2025-03-06T21:10:12Z","snapshot_observed_at":"2026-08-07T17:23:30.914733Z","submitted_at":"2025-03-06T21:10:12Z","title":"Energy-Weighted Flow Matching for Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04975","snapshot_observed_at":"2026-08-07T14:13:13.112158Z","title":"Energy-weighted flow matching for offline reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.112158Z"},"links":{"cited_paper":"/paper/2503.04975","citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:3ff6644b0a2e6ed3eef438fa701d1700960a10dcc30509b807120acd3b29cb85","observation_id":"8205e69e-8374-4dde-aea1-9753110244a2","resolution":{"observed_at":"2026-08-07T14:13:13.112158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02538","last_updated":"2025-05-25T22:15:41Z","snapshot_observed_at":"2026-08-07T08:16:36.494826Z","submitted_at":"2025-02-04T18:04:05Z","title":"Flow Q-Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02538","snapshot_observed_at":"2026-08-07T14:13:13.146702Z","title":"Flow q-learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.146702Z"},"links":{"cited_paper":"/paper/2502.02538","citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:bfcdfc3ff7060b57e480825ac4f3a5156fc2166e7f456149885bfa57fb4eb7ec","observation_id":"fa4a88f4-afdb-4f5d-98f1-c7b338a2f3e2","resolution":{"observed_at":"2026-08-07T14:13:13.146702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:16.709587Z","title":"Hindsight experience replay,","venue":null,"work_id":"af8e1277-29ae-4f2f-927e-71b1c436352b","year":2017},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.205702Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:542cafd23e267952214494cd66a623f589f1414020f903b20943e33e8a6f00fd","observation_id":"01f4e5b4-624c-4376-9fe7-d79390b9d59e","resolution":{"observed_at":"2026-08-07T14:13:16.801712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:16.366541Z","title":"Asymmetric least squares estimation and testing,","venue":null,"work_id":"5985ca6c-9539-4b7d-b98b-8e0a7ec1ec74","year":1987},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.280275Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:633e80a398cd4acdef775237fa02906b0d9aaaa2638783c081cd58a985338030","observation_id":"1f78d3f2-69d4-4616-a575-2b91b380fc2c","resolution":{"observed_at":"2026-08-07T14:13:16.509655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03570","last_updated":"2024-10-15T20:56:47Z","snapshot_observed_at":"2026-08-02T12:07:35.477265Z","submitted_at":"2024-02-05T22:43:57Z","title":"Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03570","snapshot_observed_at":"2026-08-07T14:13:13.314904Z","title":"Diffusion world model: Future modeling beyond step-by-step rollout for offline reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.314904Z"},"links":{"cited_paper":"/paper/2402.03570","citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:0aaf6eeb620f41b56443ecd2b79870a03c4469914ce5185878d88334544560c6","observation_id":"ec3fd0cf-ccde-487c-b2c0-01cff93c2db5","resolution":{"observed_at":"2026-08-07T14:13:13.314904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:13.343958Z","title":"Learning from reward-free offline data: A case for planning with latent dynamics models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.343958Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:e61ff074005319efa8989fbb2964c52538b6d632715e8fc1aaa17ac16bd5c759","observation_id":"19850cc5-4ade-4f1a-87b4-16ffda805e30","resolution":{"observed_at":"2026-08-07T14:13:13.343958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:16.150089Z","title":"Double q-learning,","venue":null,"work_id":"6033f9e4-8fcc-47c4-9733-8420bcd21180","year":2010},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.389500Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:ced1d01e52b8379300b84708017a07ff9409dbe3bcfbe6adc939c14a408a2ce3","observation_id":"8eb96060-8aa9-4b17-ab64-bf9d1822dbca","resolution":{"observed_at":"2026-08-07T14:13:16.263908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:15.885970Z","title":"Ogbench: Benchmarking offline goal-conditioned rl,","venue":null,"work_id":"dc18c787-964c-400a-8126-35f7d60d2628","year":2025},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.423507Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:5bce4f3e4ce82595a911cc8a0db0183a6716cc46dcd0754ff21c5f73b06f6f09","observation_id":"663eabc0-78d3-47f2-902d-36d325c33f32","resolution":{"observed_at":"2026-08-07T14:13:16.015627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:15.645335Z","title":"Learning to reach goals via iterated supervised learning,","venue":null,"work_id":"8e7510ea-36d9-413d-b941-9317db70f1e9","year":2021},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.501243Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:c2a6bffd43f54cfdfcef163db0e4648461f785a9f402eb561d955db6791fb1ad","observation_id":"4626e549-5c9e-4d85-b8ac-0e43bf6fcc8c","resolution":{"observed_at":"2026-08-07T14:13:15.786014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:15.449226Z","title":"Optimal goal-reaching reinforcement learning via quasimetric learning,","venue":null,"work_id":"41263381-eceb-417d-aaf5-36c5b5f71916","year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.559490Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:9696f265d71f32dab89d4999971dd492f6eb0c6b42b356a3ef290369da1c582a","observation_id":"a013d2db-8ba5-4a23-b30c-3a3a2d508bcd","resolution":{"observed_at":"2026-08-07T14:13:15.541101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:15.278784Z","title":"Contrastive learning as goal-conditioned reinforcement learning,","venue":null,"work_id":"fb6bd3b9-4386-4fd0-b8b0-3beec91591e9","year":2022},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.603159Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:34c61a4655f27df68a44e907a0be6fc15430079266589ca927804db7e529a174","observation_id":"4bb78712-a42b-4ab0-adb2-5b63d0bd26d3","resolution":{"observed_at":"2026-08-07T14:13:15.354411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:15.108007Z","title":"Multi-contact whole-body force control for position-controlled robots,","venue":null,"work_id":"63dafd32-cb9c-4513-9760-8a35b0674030","year":2024},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.645522Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:40c46a9b3286ac53405417b8ced2416d4a11a63f9f3ac7cc4266b1c9d523a516","observation_id":"da8add89-25ef-46c2-b455-fe45eb9974f8","resolution":{"observed_at":"2026-08-07T14:13:15.185382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:14.947701Z","title":"Multicontact motion retarget- ing using whole-body optimization of full kinematics and sequential force equilibrium,","venue":null,"work_id":"75e796c6-08a0-4f21-a3c0-44c0597d30c2","year":2022},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.675206Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:cea34624c66c71b8886bd9d2e5f1b191dc7f91fe8ea5ca3a444e023a32c1accd","observation_id":"762971fe-d9bf-44db-bbe8-893477d1d338","resolution":{"observed_at":"2026-08-07T14:13:15.007210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:14.825506Z","title":"Collaborative bimanual manipulation using optimal motion adaptation and interaction control,","venue":null,"work_id":"40ccdea1-1b22-4cc1-a4fe-986e6b36f10f","year":2023},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.734489Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:b6b57486b80668779da27b67c668e8604dcde918852d31db3071103646258d81","observation_id":"0f028772-3bba-49c6-b87b-8fecd00b2bc4","resolution":{"observed_at":"2026-08-07T14:13:14.893102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:14.650276Z","title":"Impala: Scalable distributed deep-rl with importance weighted actor-learner architectures,","venue":null,"work_id":"b10bd569-7b41-44c3-b3f1-716e3a12aa8e","year":2018},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.790169Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:617bb518afa725b09fcb7de806e16d93d784cc64f852d137027047816cecb158","observation_id":"ee689ab7-eded-40f9-a5a4-e323512eafca","resolution":{"observed_at":"2026-08-07T14:13:14.724425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:13:14.428148Z","title":"On the continuity of rotation representations in neural networks,","venue":null,"work_id":"c039e000-bdfa-4026-9f8f-bc23eccb0a23","year":2019},"citing_paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:13.797334Z"},"links":{"citing_paper":"/paper/2505.19717"},"observation_digest":"sha256:20082e0d65035779b71255afd8aa07aa8bdcb02359d99b0a2f4a8de1a80fb908","observation_id":"ee2d83bd-d09c-4c3d-8058-2bd59ce1f32b","resolution":{"observed_at":"2026-08-07T14:13:14.515702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19717","last_updated":"2025-08-20T08:55:32Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T04:30:02.798412Z","submitted_at":"2025-05-26T09:06:34Z","title":"Extremum Flow Matching for Offline Goal Conditioned Reinforcement Learning"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":38},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2505.19717."}