{"as_of":"2026-08-08T05:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83cf7c95667468214adb5b8e41a186763caf9e10600636425061d120df6e29b4","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:06:59.238874Z","state":"measured"},{"denominator":87,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":87,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20110/citation-record","integrity":"/paper/2505.20110/integrity","json":"/paper/2505.20110/citation-record.json","paper":"/paper/2505.20110"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.05309","last_updated":"2025-04-16T16:14:58Z","snapshot_observed_at":"2026-07-06T17:27:11.705550Z","submitted_at":"2024-02-07T23:02:53Z","title":"Investigating Generalization Behaviours of Generative Flow Networks","version":2},"cited_work":{"arxiv_id":"2402.05309","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.05309","snapshot_observed_at":"2026-08-07T14:07:01.418561Z","title":"Investigating Generalization Behaviours of Generative Flow Networks","venue":"cs.LG","work_id":"bac1ede5-2ff1-45d9-aa78-c39a377983a7","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:50.706259Z"},"links":{"cited_paper":"/paper/2402.05309","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:d961b7e54f667e20835f5791e34ac816e16ec69ee560351433c963ae1347e25d","observation_id":"2f3b8876-9123-4e47-9e01-799dad236ad7","resolution":{"observed_at":"2026-08-07T14:07:01.514044Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:50.787479Z","title":"Why is tanimoto index an appropriate choice for fingerprint-based similarity calculations? Journal of cheminformatics, 7: 0 1--13, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:50.787479Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:6d3e86abdf443e72b1916c2e1240fbfada17567a6e0de6e6907c5d89b1be6f67","observation_id":"2a312946-5bdd-4aa3-a5a4-d8a4407c07ad","resolution":{"observed_at":"2026-08-07T14:06:50.787479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:50.896695Z","title":"Flow network based generative models for non-iterative diverse candidate generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:50.896695Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:283f69253ba8ecec2a6ad4d1c54e978e6de9b81bed3b48709e9560f22f177c1d","observation_id":"4c22ac3a-43b8-4bf3-93aa-3f3a4f776a14","resolution":{"observed_at":"2026-08-07T14:06:50.896695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:50.980818Z","title":"Gflownet foundations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:50.980818Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:2b00831aa5dd8a9a65e275aafa5b5dca9778c99b2a1aeadc3d6d664b4c284d0f","observation_id":"72e3e87f-ef00-4b5b-bb02-127c97223e4f","resolution":{"observed_at":"2026-08-07T14:06:50.980818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:51.093074Z","title":"A theory of non-acyclic generative flow networks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:51.093074Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:5154936ef955df92a15081f9b78ca43677d45db6c73677162421d6cf6d15fb1b","observation_id":"f3c68c15-ec07-497b-ba86-045e72db6c97","resolution":{"observed_at":"2026-08-07T14:06:51.093074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03561","last_updated":"2025-05-06T14:13:21Z","snapshot_observed_at":"2026-08-07T15:49:30.669823Z","submitted_at":"2025-05-06T14:13:21Z","title":"Ergodic Generative Flows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03561","snapshot_observed_at":"2026-08-07T14:06:51.187728Z","title":"Ergodic generative flows","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:51.187728Z"},"links":{"cited_paper":"/paper/2505.03561","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:b82ed600317673fd94460837f0ce4ff6a30dee9f79e96e3fd1d7323e3d6424bd","observation_id":"a2026297-dc9e-4d6e-98c7-36afcc7bad34","resolution":{"observed_at":"2026-08-07T14:06:51.187728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:51.288220Z","title":"Jaakkola","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:51.288220Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:d758e0c2ba495cfcb389bb62ec7e50593e1b2643b3d43b74314ba94cde6494bf","observation_id":"71af4de3-dd33-43b9-85c3-a0749a421503","resolution":{"observed_at":"2026-08-07T14:06:51.288220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:51.406702Z","title":"Offline goal-conditioned reinforcement learning for safety-critical tasks with recovery policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:51.406702Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:83d354032ae7d5d01a49ff0750195b500a448d3f04bac9a25796fcd8e743204f","observation_id":"2ff8f617-b2b2-4a66-a818-1243d67290b5","resolution":{"observed_at":"2026-08-07T14:06:51.406702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:51.520129Z","title":"Kostas, Emma Jordan, and Philip S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:51.520129Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:ce261c8a3990178989ba08ce9d0f4f0eaeb09f4c2f9ffdb176ce1a3cec8e1124","observation_id":"845aa5b4-2eab-49d9-9ff7-e1e6bf85b5f2","resolution":{"observed_at":"2026-08-07T14:06:51.520129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:10.345487Z","title":"On the opportunities and challenges of offline reinforcement learning for recommender systems","venue":null,"work_id":"11d24e35-d54a-4848-b345-3f796e1b00fd","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:51.617595Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:857998bfdae4d64f18f2a517c22dc5375352c8eca4df08a843948d815e66e0e8","observation_id":"8735b758-b3ed-4284-9044-91c4b5a4dc60","resolution":{"observed_at":"2026-08-07T14:07:10.411910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:10.123569Z","title":"Order-preserving GF lownets","venue":null,"work_id":"da58896d-7d0d-4224-948f-40cd15e464cf","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:51.731516Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:4034d3e6e7f7c4fec2e1517dc67423e1d1419245c1cae273f0665eedc3957491","observation_id":"656f4a01-b6a2-4926-a78f-b470ce78734f","resolution":{"observed_at":"2026-08-07T14:07:10.232515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T14:06:51.846624Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:51.846624Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:e75cbcffdac684e6e0570c2219737619e9002d64d1e4f133bf7411703d3b4d37","observation_id":"e4985d0d-3f64-4051-aa40-1cae1993a19d","resolution":{"observed_at":"2026-08-07T14:06:51.846624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06624","last_updated":"2024-07-08T13:35:00Z","snapshot_observed_at":"2026-07-06T18:12:43.301678Z","submitted_at":"2024-05-10T17:38:32Z","title":"Towards Guaranteed Safe AI: A Framework for Ensuring Robust and Reliable AI Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06624","snapshot_observed_at":"2026-08-07T14:06:51.959013Z","title":"Towards guaranteed safe ai: A framework for ensuring robust and reliable ai systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:51.959013Z"},"links":{"cited_paper":"/paper/2405.06624","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:c1dcec95d30e288aab34d09d7cf603d40b4f9abe2b3b7ddd5ac554ff376cad00","observation_id":"dba15a1d-60cb-455f-aeb0-37588edbf45f","resolution":{"observed_at":"2026-08-07T14:06:51.959013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:09.947811Z","title":"Bayesian structure learning with generative flow networks","venue":null,"work_id":"9c91fecd-14cf-450d-b25e-dc5b10d9c6bf","year":2022},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:52.085225Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:184ae582dd07ea597d7b264aee11b73b33232ac4785eeb0ccf1c09331c83ef67","observation_id":"1d42dba5-d29e-467e-ad49-e054b4cdf125","resolution":{"observed_at":"2026-08-07T14:07:10.033616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:52.205806Z","title":"Decomposition of uncertainty in bayesian deep learning for efficient and risk-sensitive learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:52.205806Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:296c070946fb01b5be90f887bd4da31f77f96a46dc58152e9ecac6400845f48f","observation_id":"7cb682ea-d0af-434a-a35d-eebf744d8d1c","resolution":{"observed_at":"2026-08-07T14:06:52.205806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:09.750502Z","title":"Learning robust rewards with adverserial inverse reinforcement learning","venue":null,"work_id":"a728d3c0-a7d0-440a-b520-31208b8765a7","year":2018},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:52.379431Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:c688d44005d026b84e13886065996c4729d4bae516e22f64f4a58c6fc740ac4f","observation_id":"0e4bc098-4bad-4b57-a77b-ab324bd0f0dd","resolution":{"observed_at":"2026-08-07T14:07:09.844922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-07T14:06:52.551004Z","title":"Tucker, and Sergey Levine","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:52.551004Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:6b5cd2e1b734f479dbcc070b8cdb2869bdd743b4c18db468e299b37d59359723","observation_id":"25b95207-f9b7-4fb2-97d8-08e2eb4d143b","resolution":{"observed_at":"2026-08-07T14:06:52.551004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:52.659585Z","title":"Iq-learn: Inverse soft-q learning for imitation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:52.659585Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:78a0d5946f088420c38a29a4a773230e158be1dc27422df84271db70457f1ffb","observation_id":"e024c472-0f4f-4432-abde-5790ab6383fa","resolution":{"observed_at":"2026-08-07T14:06:52.659585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:09.520567Z","title":"Generative flow networks assisted biological sequence editing","venue":null,"work_id":"8d48c6bc-e041-4cc3-94fe-3a0bd53d7635","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:52.743514Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:9da1759aab399b11aab6d75372b3518607f30392575ad70ca2e5aec9f517e546","observation_id":"8c52a11d-87dd-4cb6-99a5-a10cc20e78a0","resolution":{"observed_at":"2026-08-07T14:07:09.652530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:09.248615Z","title":"Neural message passing for quantum chemistry","venue":null,"work_id":"ee032736-8092-4b4d-8744-3e3ee9e67ca5","year":2017},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:52.819642Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:a16ba2b267294cea4f380928c2cca27b5a57a7926fa78875b85a09ac523d2db8","observation_id":"69d1a6d4-773f-4fbc-a375-46f862563da7","resolution":{"observed_at":"2026-08-07T14:07:09.353849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15474","last_updated":"2025-03-03T14:08:48Z","snapshot_observed_at":"2026-07-06T19:36:41.445591Z","submitted_at":"2024-10-20T19:12:14Z","title":"Optimizing Backward Policies in GFlowNets via Trajectory Likelihood Maximization","version":2},"cited_work":{"arxiv_id":"2410.15474","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15474","snapshot_observed_at":"2026-08-07T14:07:01.181306Z","title":"Optimizing Backward Policies in GFlowNets via Trajectory Likelihood Maximization","venue":"cs.LG","work_id":"a861c5d9-0c04-4376-871b-705ef182caa9","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:52.870133Z"},"links":{"cited_paper":"/paper/2410.15474","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:e51098d5c05dbe73041b075e36a1b0b6600dd040602bc9a277d71a4fe8332363","observation_id":"c0d7c536-3be1-471a-8420-e5deb1fe120e","resolution":{"observed_at":"2026-08-07T14:07:01.278464Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13888","last_updated":"2021-02-12T18:34:07Z","snapshot_observed_at":"2026-07-06T09:32:23.160228Z","submitted_at":"2020-06-24T17:14:51Z","title":"RL Unplugged: A Suite of Benchmarks for Offline Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13888","snapshot_observed_at":"2026-08-07T14:06:52.959756Z","title":"Hoffman, Ofir Nachum, G","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:52.959756Z"},"links":{"cited_paper":"/paper/2006.13888","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:c29427d10df0dd165319d334e0c395665fceecc5b69dfaccd2b20635be884072","observation_id":"5c39f059-0952-4d0e-8c23-da3314372501","resolution":{"observed_at":"2026-08-07T14:06:52.959756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:53.065699Z","title":"Generative adversarial imitation learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.065699Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:9d067fdf32a9a9c0b0d94215e188ab3e90612e80e5008ff990e8904c4f2103b3","observation_id":"44fb0db7-1e77-4d1f-9a1a-5403c81b3757","resolution":{"observed_at":"2026-08-07T14:06:53.065699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13085","last_updated":"2023-06-22T17:58:02Z","snapshot_observed_at":"2026-08-07T11:08:08.355064Z","submitted_at":"2023-06-22T17:58:02Z","title":"Harnessing Mixed Offline Reinforcement Learning Datasets via Trajectory Weighting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13085","snapshot_observed_at":"2026-08-07T14:06:53.134962Z","title":"Harnessing mixed offline reinforcement learning datasets via trajectory weighting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.134962Z"},"links":{"cited_paper":"/paper/2306.13085","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:40349d376bc4b254a8941e61ea27e20da247e59d6a3ea116c96930fb283f8353","observation_id":"07a15643-82ea-4fc2-92e2-0ffcd406dbca","resolution":{"observed_at":"2026-08-07T14:06:53.134962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:08.966805Z","title":"Amortizing intractable inference in large language models","venue":null,"work_id":"326a4f60-2204-4dad-806e-c7448044cc6b","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.216532Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:71a91fd64ee8c5bb004b0db9f4bc720c84e704d3b121efd48c5659c53e71c03c","observation_id":"0cb1d4de-5476-4967-9b32-a2cb8210a1e4","resolution":{"observed_at":"2026-08-07T14:07:09.102084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02596","last_updated":"2026-07-25T14:06:54Z","snapshot_observed_at":"2026-08-07T23:30:12.943557Z","submitted_at":"2024-10-03T15:37:22Z","title":"Beyond Squared Error: Exploring Loss Design for Enhanced Training of Generative Flow Networks","version":2},"cited_work":{"arxiv_id":"2410.02596","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.02596","snapshot_observed_at":"2026-08-07T14:07:00.838368Z","title":"Beyond Squared Error: Exploring Loss Design for Enhanced Training of Generative Flow Networks","venue":"cs.LG","work_id":"a640a108-1750-48c9-9c49-19919e7fe894","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.272259Z"},"links":{"cited_paper":"/paper/2410.02596","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:35546e7c311025077b0305e637222971bf94d30dd19c7574edc09be9b0b0e67b","observation_id":"978246be-75c4-403b-bc59-fd98f273a464","resolution":{"observed_at":"2026-08-07T14:07:01.008083Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:53.346840Z","title":"Biological sequence design with gflownets","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.346840Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:7f12be394aac34e416bc28c54d2677a731cd0ce499e1769e1ec498cd56e5a6a2","observation_id":"7d1d0f10-35e8-4034-9caa-00dca3e7781e","resolution":{"observed_at":"2026-08-07T14:06:53.346840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:08.757627Z","title":"Gflownets for ai-driven scientific discovery","venue":null,"work_id":"d3599e85-0b22-4eeb-8715-3406930192c6","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.483302Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:8bc0a8c14ced7595c6e9d89d5c946d833d3d81a9a68e43ca56fb923afacdb5af","observation_id":"f1ea616d-8c6e-4ccb-b858-a26c524de2d3","resolution":{"observed_at":"2026-08-07T14:07:08.884392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:08.520232Z","title":"Multi-objective gflownets","venue":null,"work_id":"cb8ef4ab-8e78-46c1-bcbb-c9d69ded6a51","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.605395Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:431a06ddf31a31df54885af82ee67754bdf4dfdab69fe99b19cd99fb7a6115fc","observation_id":"56d06d83-494d-47f7-8905-599f8bf4eb5b","resolution":{"observed_at":"2026-08-07T14:07:08.595359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03301","last_updated":"2023-10-05T04:02:36Z","snapshot_observed_at":"2026-07-06T16:28:05.131241Z","submitted_at":"2023-10-05T04:02:36Z","title":"Learning Energy Decompositions for Partial Inference of GFlowNets","version":1},"cited_work":{"arxiv_id":"2310.03301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.03301","snapshot_observed_at":"2026-08-07T14:07:00.573738Z","title":"Learning Energy Decompositions for Partial Inference of GFlowNets","venue":"cs.LG","work_id":"74234f14-273d-4603-98da-030144e93949","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.738434Z"},"links":{"cited_paper":"/paper/2310.03301","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:70115b2becfebcc37836fe08faf3ec932f453da770de8e6e4766afaf6233c09f","observation_id":"291583ff-9eee-4707-8292-046ef1d88b89","resolution":{"observed_at":"2026-08-07T14:07:00.691832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16012","last_updated":"2024-10-29T03:11:17Z","snapshot_observed_at":"2026-08-07T04:40:41.475629Z","submitted_at":"2024-05-25T02:30:46Z","title":"Pessimistic Backward Policy for GFlowNets","version":3},"cited_work":{"arxiv_id":"2405.16012","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.16012","snapshot_observed_at":"2026-08-07T14:07:00.290814Z","title":"Pessimistic Backward Policy for GFlowNets","venue":"cs.LG","work_id":"eb2bd779-a505-4d8f-a9dd-818469dc14e4","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.800900Z"},"links":{"cited_paper":"/paper/2405.16012","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:e34c9b2e040ef2aa2acac7f2b62ba7ff37ea35f78329a7e9f560606bd2d4295d","observation_id":"5dd8814c-af88-4ecb-a2aa-328418e49962","resolution":{"observed_at":"2026-08-07T14:07:00.407582Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:08.331106Z","title":"Junction tree variational autoencoder for molecular graph generation","venue":null,"work_id":"f28659d5-2077-4cae-af98-add954e273fd","year":2018},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:53.914266Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:4cd47eb028cbe6fdc7190f4759ee6582683142d3ee74117051a9a9be5efd7b28","observation_id":"24bac716-b832-4355-8ffa-49655f3e1d15","resolution":{"observed_at":"2026-08-07T14:07:08.437404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-07T14:06:54.032620Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.032620Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:501beec380fd5e391d42889dba17cbbf729a2bc7ee1760450d292aa6daabe62e","observation_id":"4bb4d12f-7138-4b8a-98f2-7e04ed712f3b","resolution":{"observed_at":"2026-08-07T14:06:54.032620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07041","last_updated":"2025-02-28T05:33:02Z","snapshot_observed_at":"2026-07-06T17:42:49.471518Z","submitted_at":"2024-03-11T16:26:06Z","title":"Ant Colony Sampling with GFlowNets for Combinatorial Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07041","snapshot_observed_at":"2026-08-07T14:06:54.168561Z","title":"Ant colony sampling with gflownets for combinatorial optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.168561Z"},"links":{"cited_paper":"/paper/2403.07041","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:f09c231d52dff3ed8b93ee1631271f059e1b898d00f3200bd406e4a88e17df23","observation_id":"7f17649f-be56-42bc-95da-56a9ac5e91ef","resolution":{"observed_at":"2026-08-07T14:06:54.168561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01432","last_updated":"2025-04-14T05:09:11Z","snapshot_observed_at":"2026-07-06T19:25:56.114976Z","submitted_at":"2024-10-02T11:33:13Z","title":"Adaptive teachers for amortized samplers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01432","snapshot_observed_at":"2026-08-07T14:06:54.293159Z","title":"Adaptive teachers for amortized samplers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.293159Z"},"links":{"cited_paper":"/paper/2410.01432","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:b003b537b3b1f7c0013835382636d7d64c58809b60f05c03b2a3852ae6a8d2d5","observation_id":"eac58d74-cf28-420c-bbf8-89c8af3aefa4","resolution":{"observed_at":"2026-08-07T14:06:54.293159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:08.094080Z","title":"Local search gflownets","venue":null,"work_id":"dcbd6307-2bb3-4c2f-89cb-ace80a0252cc","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.414655Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:b51a93800e8499bcda170fbc37952a6bedb84cbf2a075787886de2fbdad78a5b","observation_id":"2fe1be81-6c7e-4668-ab4d-3bf375eb9fd1","resolution":{"observed_at":"2026-08-07T14:07:08.206444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02925","last_updated":"2018-10-15T17:27:25Z","snapshot_observed_at":"2026-07-06T06:59:59.617799Z","submitted_at":"2018-09-09T05:37:25Z","title":"Discriminator-Actor-Critic: Addressing Sample Inefficiency and Reward Bias in Adversarial Imitation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02925","snapshot_observed_at":"2026-08-07T14:06:54.469706Z","title":"Discriminator-actor-critic: Addressing sample inefficiency and reward bias in adversarial imitation learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.469706Z"},"links":{"cited_paper":"/paper/1809.02925","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:9e45e11c0fc1f11d23b05b408a9cda13a79a0a8da0a90df1032145859caeaf2b","observation_id":"ed049a15-31f0-4cdd-aff7-7f45c5325abb","resolution":{"observed_at":"2026-08-07T14:06:54.469706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:07.924236Z","title":"Imitation learning via off-policy distribution matching","venue":null,"work_id":"17014aae-fe6e-463d-a888-b13ee9f9bb51","year":2020},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.522126Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:f8745571620bcae27bcdcc99ca2553f18cdf6d9647cc18f5233d3e9845682936","observation_id":"61f7aed8-786f-454b-8563-277a630d5159","resolution":{"observed_at":"2026-08-07T14:07:08.004935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-06T15:42:21.967989Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-07T14:06:54.601744Z","title":"Offline reinforcement learning with implicit q-learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.601744Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:657bd758374547e9f38682707640d1b0f9d37ad8b40a4a3f5a7c577ca81a620b","observation_id":"24bc7957-8830-4053-9506-fabd3d949792","resolution":{"observed_at":"2026-08-07T14:06:54.601744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:54.679326Z","title":"Conservative q-learning for offline reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.679326Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:d67dbd856d835b4443f77cee0585554bd9fda63c14f095fb3b464270a631f31d","observation_id":"1867bf6a-e1a5-4ed6-9f06-edc34feea19d","resolution":{"observed_at":"2026-08-07T14:06:54.679326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:54.740178Z","title":"A theory of continuous generative flow networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.740178Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:60f1ffde0d52917c57fa146f8ea26708274e8635544accac13f491a685d1077b","observation_id":"f0c0cf97-643a-412c-be92-80d340f2e28b","resolution":{"observed_at":"2026-08-07T14:06:54.740178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:07.724941Z","title":"Qgfn: Controllable greediness with action values","venue":null,"work_id":"0cece0f4-e877-46a6-87c4-20b2d6620d11","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.799336Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:331f5f4e0c6edf710fce6790b4a0fd9fd2349ecb4ab16ad66dc8c84653834725","observation_id":"fbbecb08-0b29-496f-85cf-61a9742b29ae","resolution":{"observed_at":"2026-08-07T14:07:07.832725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09395","last_updated":"2021-04-15T04:30:35Z","snapshot_observed_at":"2026-08-03T16:16:13.326473Z","submitted_at":"2020-04-20T15:49:35Z","title":"Energy-Based Imitation Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.09395","snapshot_observed_at":"2026-08-07T14:06:54.856795Z","title":"Energy-based imitation learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.856795Z"},"links":{"cited_paper":"/paper/2004.09395","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:7a6389681262e9fae437a92d402e6529e9a61bc55be0fca7d3110ff2f036fb0f","observation_id":"e8184900-d0d6-4760-ab63-589e8270b881","resolution":{"observed_at":"2026-08-07T14:06:54.856795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:07.502879Z","title":"Generative flow network for listwise recommendation","venue":null,"work_id":"4d2043f4-3a05-4823-8726-31570fd96626","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.919194Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:4872c8ed4fce52f77412c5837362faf40f8cf3b08cdaee24398f3f7c2fbea242","observation_id":"7ce8d23e-9244-474b-b19b-a9e6d642fcbe","resolution":{"observed_at":"2026-08-07T14:07:07.610336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:07.237688Z","title":"Xiao, Weiyang Liu, Yoshua Bengio, and Dinghuai Zhang","venue":null,"work_id":"0cca8039-38db-464e-8a3f-9b7e28dcc79d","year":2025},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:54.980101Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:53a0c8720de0d0f6dd1149c75ef5d77d51717f1138ec461ef9be9cc266cbb753","observation_id":"b2665c5d-b4da-47c8-b7e6-d5477c32bd02","resolution":{"observed_at":"2026-08-07T14:07:07.331103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.00238","last_updated":"2024-06-26T08:24:26Z","snapshot_observed_at":"2026-08-04T01:57:41.935535Z","submitted_at":"2022-06-01T05:16:39Z","title":"Transferable Reward Learning by Dynamics-Agnostic Discriminator Ensemble","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.00238","snapshot_observed_at":"2026-08-07T14:06:55.053707Z","title":"Transferable reward learning by dynamics-agnostic discriminator ensemble","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.053707Z"},"links":{"cited_paper":"/paper/2206.00238","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:2f978ee5de56fa86b0a1fcbf2e341a1e8bdf07c5e8f75bc5b8979f5cbaed66ab","observation_id":"fc7ba83e-16f6-40a0-bae1-3e0266a1ee0a","resolution":{"observed_at":"2026-08-07T14:06:55.053707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:07.052149Z","title":"Reward-consistent dynamics models are strongly generalizable for offline reinforcement learning","venue":null,"work_id":"9bd185d8-c5c8-4b8a-943e-70663c2d1be8","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.200081Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:78cfa93cd8a0dbe948b17065464107f59963828852af367a591881191e795844","observation_id":"92477e93-39a7-4c61-b3b0-bff8f021f9e9","resolution":{"observed_at":"2026-08-07T14:07:07.145219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:55.364121Z","title":"Learning gflownets from partial episodes for improved convergence and stability","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.364121Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:6bce5d792c13479bdbbff9d5df7a443d13095bf40bb0c5242b13d9ba65243cb9","observation_id":"63303881-e7d8-45a7-8779-44759120d5a0","resolution":{"observed_at":"2026-08-07T14:06:55.364121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:06.828103Z","title":"Towards improving exploration through sibling augmented gflownets","venue":null,"work_id":"cd94c2bb-8e83-4272-a8a5-43d037e6a287","year":2025},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.537100Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:3c86cd931239bc4280b2c147059e903956140b459d81e6bdabdeb4a302e3a970","observation_id":"47ad0e20-de04-4ec5-bd1b-2cbf57f394f8","resolution":{"observed_at":"2026-08-07T14:07:06.947512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:55.695989Z","title":"Trajectory balance: Improved credit assignment in gflownets","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.695989Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:acc0e334cb530a9156fad8fd16edb5097f4162f8276b93d84ebca64cab244a87","observation_id":"cf110448-e826-49e6-be85-ddb54fa8079b","resolution":{"observed_at":"2026-08-07T14:06:55.695989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00580","last_updated":"2023-03-02T17:43:38Z","snapshot_observed_at":"2026-08-07T09:42:49.011984Z","submitted_at":"2022-10-02T17:41:01Z","title":"GFlowNets and variational inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00580","snapshot_observed_at":"2026-08-07T14:06:55.814281Z","title":"Gflownets and variational inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.814281Z"},"links":{"cited_paper":"/paper/2210.00580","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:5aff8ee08d0c764616c7bdf2855a3f8d8019bdee1f2bfcca41fb9d717649d7ad","observation_id":"dd7848e9-710b-46ca-8002-3a2f6c825eae","resolution":{"observed_at":"2026-08-07T14:06:55.814281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:06.595211Z","title":"Maximum entropy gflownets with soft q-learning","venue":null,"work_id":"7ed9a72c-eb79-4124-b71f-b87e7aee7281","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:55.949508Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:f65b32273ae38a8d61da082a2b14345304550b5fad0456f4c775a8a13654e303","observation_id":"074268e2-894d-418d-89bb-67170717106a","resolution":{"observed_at":"2026-08-07T14:07:06.708082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07735","last_updated":"2025-09-11T14:32:19Z","snapshot_observed_at":"2026-07-06T20:34:53.567141Z","submitted_at":"2025-02-11T17:55:03Z","title":"Revisiting Non-Acyclic GFlowNets in Discrete Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07735","snapshot_observed_at":"2026-08-07T14:06:56.077101Z","title":"Revisiting non-acyclic gflownets in discrete environments","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.077101Z"},"links":{"cited_paper":"/paper/2502.07735","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:0c7e51560a265b23abdba2cb4fa352981645b41efed9c2f7f906476f6d240a69","observation_id":"67a59749-62c2-458c-b324-85aff705161b","resolution":{"observed_at":"2026-08-07T14:06:56.077101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:06.384944Z","title":"Algorithms for inverse reinforcement learning","venue":null,"work_id":"9e7f483e-a25d-4ccc-9d07-6d886b952ee3","year":2000},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.222652Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:2e3160596631be6a9e45b8073a1db2cfa491ff3702552e7fc66a8856a5741a09","observation_id":"83a26344-9ca5-42d9-a67d-ee3989f4f136","resolution":{"observed_at":"2026-08-07T14:07:06.453244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:56.342285Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.342285Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:dee028e6c67ecf78f4493517eb8e3386cf1bd692d5778999935e48712f1f2215","observation_id":"4502d76f-a93c-43c6-ad13-c27faff9ab57","resolution":{"observed_at":"2026-08-07T14:06:56.342285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03308","last_updated":"2022-10-07T03:33:56Z","snapshot_observed_at":"2026-07-06T14:01:34.040852Z","submitted_at":"2022-10-07T03:33:56Z","title":"Generative Augmented Flow Networks","version":1},"cited_work":{"arxiv_id":"2210.03308","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.03308","snapshot_observed_at":"2026-08-07T14:06:59.932702Z","title":"Generative Augmented Flow Networks","venue":"cs.LG","work_id":"16b0764b-2b81-4df8-83df-727ddb7ec879","year":2022},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.511350Z"},"links":{"cited_paper":"/paper/2210.03308","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:86ddd89b064d76d6c74d59a278c552cde78a4aa44d4dcfb794ce7ac6081b8414","observation_id":"82c6ce44-e7d8-4827-8a8c-b6d7bd8d94a1","resolution":{"observed_at":"2026-08-07T14:07:00.067704Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:06.160841Z","title":"Better training of gflownets with local credit and incomplete trajectories","venue":null,"work_id":"a40fd601-ae5d-4ce4-9630-5a4275417a8b","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.682426Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:401de324af957bea4e7fabc3a88813d185cd4e9034736decc51316a07293b4b3","observation_id":"3b75aa14-ffe4-4183-853c-ac4c6e2c6b39","resolution":{"observed_at":"2026-08-07T14:07:06.282783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:05.972505Z","title":"Stochastic generative flow networks","venue":null,"work_id":"5e4e464d-12be-46c3-8c3f-3f722f00f4e6","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.831062Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:92cc091a38a404353b0d0b1bb79a18813941c35c14c6ca0c54962d1fc132190c","observation_id":"0e304cd7-920d-4ab1-8472-305ece07d5f2","resolution":{"observed_at":"2026-08-07T14:07:06.036562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:05.833470Z","title":"Dbaasp v3: database of antimicrobial/cytotoxic activity and structure of peptides as a resource for development of new therapeutics","venue":null,"work_id":"58fcb4be-8eb5-4728-9530-8e56188ec5da","year":2021},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:56.972753Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:05a7463e9eb07d5494d1e65e4878a92af058b6b601e82f8a81d948c57bb3b302","observation_id":"a77d252e-8a5f-425c-9252-1a751c754fd5","resolution":{"observed_at":"2026-08-07T14:07:05.904688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04620","last_updated":"2023-06-29T21:25:27Z","snapshot_observed_at":"2026-07-06T15:39:53.141172Z","submitted_at":"2023-06-07T17:48:29Z","title":"Goal-conditioned GFlowNets for Controllable Multi-Objective Molecular Design","version":2},"cited_work":{"arxiv_id":"2306.04620","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.04620","snapshot_observed_at":"2026-08-07T14:06:59.728071Z","title":"Goal-conditioned GFlowNets for Controllable Multi-Objective Molecular Design","venue":"cs.LG","work_id":"28790360-8be1-42cf-b004-466b91d7fd61","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.093913Z"},"links":{"cited_paper":"/paper/2306.04620","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:06071fe4ecb0b38d65e97612b26dcaedcb545e079b5689c43d509afd74c565ec","observation_id":"f2eda5c3-4c22-4ea1-be95-09c5d91394d7","resolution":{"observed_at":"2026-08-07T14:06:59.803036Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:05.620523Z","title":"Improved off-policy training of diffusion samplers","venue":null,"work_id":"fce05997-b8ee-4c01-9f35-d7f7d29f561a","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.226773Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:3aab92891627e41cfaefef19bd806f6bdc901e4a954c838cfd0111585a2b5d7c","observation_id":"3d6c531f-af69-40cf-865f-d4d4f8757d0b","resolution":{"observed_at":"2026-08-07T14:07:05.727147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:05.446535Z","title":"Towards understanding and improving gflownet training","venue":null,"work_id":"6b921b0a-3fa1-456b-8f3f-37a128b8b755","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.398950Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:ceb7ad1cf3e56b8643909e9aa526ac5929dc6e0a99d29918546975961f410f4a","observation_id":"d3a2cfef-bd2a-4046-9c32-41679f9ba5f5","resolution":{"observed_at":"2026-08-07T14:07:05.555180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:05.233103Z","title":"On divergence measures for training GF lownets","venue":null,"work_id":"5eb9e6ab-00fc-430d-a0bb-0e055bb4fd88","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.499484Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:b8c38b07cf70fbf36d4a53189ab9895a375bce81de32506b200c98292560cbc4","observation_id":"1d920b32-bf7d-4c44-aeb6-df718aec3f86","resolution":{"observed_at":"2026-08-07T14:07:05.375013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:04.975839Z","title":"When do GF lownets learn the right distribution? In The Thirteenth International Conference on Learning Representations, 2025","venue":null,"work_id":"c0aab62b-6c6f-40b0-b58f-c90892c1fc30","year":2025},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.558680Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:398ae42004e7118b602293621bd06380bef4d8f038a2b40a9d706d36f46d9b0b","observation_id":"1f2b4409-57a2-4bd6-a64c-4745ebc4d083","resolution":{"observed_at":"2026-08-07T14:07:05.111318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:04.635924Z","title":"Generative flow networks as entropy-regularized rl","venue":null,"work_id":"5557d5a2-42a9-4899-90fc-b9b6002cb522","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.631022Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:4c31bd5e2df69cc7473af5cfe6cfd1dbc06cc98e14a068c916ac2ca579438900","observation_id":"0c4e0ac2-0300-406f-9817-00961953f227","resolution":{"observed_at":"2026-08-07T14:07:04.780274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:04.315159Z","title":"Dynameomics: a comprehensive database of protein dynamics","venue":null,"work_id":"205b5c10-98e7-4e10-a9da-589702c384f3","year":2010},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.690519Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:be9f5f49f0000d2b145e08085d0d300405097912867e46948651c57c33f7f799","observation_id":"55d6f587-9835-4d48-9e64-77d67b74bd92","resolution":{"observed_at":"2026-08-07T14:07:04.488609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:04.038215Z","title":"Amortizing intractable inference in diffusion models for vision, language, and control","venue":null,"work_id":"85e32a4f-02e4-4a38-a767-a2bcffdd20d9","year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.748976Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:8ee6460ce42b5187ab4e2e69d7d9f75779031dd1f5c991f0e26b4b8e860c39dd","observation_id":"de7e5339-9fc8-483d-b992-f76b92088b67","resolution":{"observed_at":"2026-08-07T14:07:04.152511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:03.717877Z","title":"Regularized offline GF lownets, 2023","venue":null,"work_id":"3922daa0-7c3d-4129-b715-fc5e3459632b","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.788766Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:4abddd99d5cd174c4ab7311c7b7e856f12f8ec5977f57cb1150a77bc533fa4e3","observation_id":"12de91d8-82e7-4c4c-9c71-58b89b2a78a6","resolution":{"observed_at":"2026-08-07T14:07:03.890655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:57.849693Z","title":"Advdiffuser: Generating adversarial safety-critical driving scenarios via guided diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.849693Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:c879f079d82a92fbfcf11796b209f7e34eea73a44fd2669d46cd159544e697f9","observation_id":"d2b6cb0f-cb29-40d9-abc5-c42372b0da59","resolution":{"observed_at":"2026-08-07T14:06:57.849693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:03.407905Z","title":"Error bounds of imitating policies and environments for reinforcement learning","venue":null,"work_id":"13e78e65-cf7d-48f6-b9c2-4430be5ecc0a","year":2020},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.909872Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:7e9dfa7949daf5d241e5b262a517af301b6e56607b3c2a7e4324d2f8f29a137c","observation_id":"133d0371-d11b-4850-a9cb-cdca41577b9a","resolution":{"observed_at":"2026-08-07T14:07:03.561601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05673","last_updated":"2025-05-27T03:51:13Z","snapshot_observed_at":"2026-07-06T18:27:41.409205Z","submitted_at":"2024-06-09T07:06:58Z","title":"Flow of Reasoning: Training LLMs for Divergent Reasoning with Minimal Examples","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05673","snapshot_observed_at":"2026-08-07T14:06:57.990138Z","title":"Flow of reasoning: Training llms for divergent problem solving with minimal examples","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:57.990138Z"},"links":{"cited_paper":"/paper/2406.05673","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:fb81192b75ec261f3d5ae0f8cb6bfc283a5fe2a3adbaca727eed99857cff79e6","observation_id":"14fb4903-b29e-4fd2-8f07-b72e63265d87","resolution":{"observed_at":"2026-08-07T14:06:57.990138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:03.078930Z","title":"Learn what not to learn: Action elimination with deep reinforcement learning","venue":null,"work_id":"83a48130-b95c-4a91-820b-e9244729ce2d","year":2018},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.039664Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:de40f695853687264064246c08a2eb0b0c4ae445360842275513a1337b592921","observation_id":"521463d7-f910-4678-9c99-428f91e9d875","resolution":{"observed_at":"2026-08-07T14:07:03.254915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:02.863462Z","title":"Generative flow networks for discrete probabilistic modeling","venue":null,"work_id":"28c60f11-3d2e-4652-853c-d7ae6f165fe6","year":2022},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.042743Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:652c0f2f70ba21cee0c9f1774613aa4a94cd3b65193573ea9e12bd6703a2d60b","observation_id":"065170fc-2018-4c21-8459-fa9022fbde45","resolution":{"observed_at":"2026-08-07T14:07:02.950298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:02.659296Z","title":"Let the flows tell: Solving graph combinatorial problems with GF lownets","venue":null,"work_id":"94f4928e-0f32-4f5b-a81c-2a714ef109b4","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.045844Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:02b19ae97b0eaf7c10abc86f9ce61bc9562d0dd706446b800581704b795ff164","observation_id":"70994c33-b9fa-49fc-9cad-efa63ec35cc6","resolution":{"observed_at":"2026-08-07T14:07:02.757538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05793","last_updated":"2024-02-17T16:11:17Z","snapshot_observed_at":"2026-08-01T15:51:03.796832Z","submitted_at":"2023-02-11T22:06:17Z","title":"Distributional GFlowNets with Quantile Flows","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05793","snapshot_observed_at":"2026-08-07T14:06:58.052040Z","title":"Distributional gflownets with quantile flows","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.052040Z"},"links":{"cited_paper":"/paper/2302.05793","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:1a4257f54417b73b5ee919cbeecf42c5d458c3b4a6990aef94541c588d36ed97","observation_id":"58e6046e-ccfb-4d87-9324-2ef628215e4a","resolution":{"observed_at":"2026-08-07T14:06:58.052040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:02.493048Z","title":"Adversarial generative flow network for solving vehicle routing problems","venue":null,"work_id":"f7bf0521-9f4c-4f66-9e9f-50177b455df4","year":2025},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.078210Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:0a3a7d12f8ffff486dec348b9558620e8248fe3a29571d5eb7fc76faba6277ad","observation_id":"761b63e1-7b62-49c8-b61e-57fab653f057","resolution":{"observed_at":"2026-08-07T14:07:02.584854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:02.269815Z","title":"COF lownet: Conservative constraints on flows enable high-quality candidate generation","venue":null,"work_id":"c2f2570c-3e19-43ea-b269-92ccc4aea432","year":2025},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.099602Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:85875b4e5d03aaa496ac0e19a1121107367a499f000911cb96b9a251d09f19c0","observation_id":"f96d377e-3a98-48ab-ad0d-432002456453","resolution":{"observed_at":"2026-08-07T14:07:02.372906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:02.127815Z","title":"Automatic curriculum learning through value disagreement","venue":null,"work_id":"942a1c23-c6e9-40f8-b182-67575bf5e558","year":2020},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.130614Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:5ba18832cb8e58eb1f5c921c513f3345b46eb90f86f4d6f170d85d2a005a6ed1","observation_id":"f621da51-dc6c-49fa-a838-41a303814fda","resolution":{"observed_at":"2026-08-07T14:07:02.195529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:01.911798Z","title":"Sample-efficient multi-objective molecular optimization with gflownets","venue":null,"work_id":"595248e4-ca7d-4ed3-af1a-6e95202797a1","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.159679Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:1b5ee8e281982de8ce5f632cb0bae5a05737d226a9538289c9a4d0a4dd1c0217","observation_id":"a3a57f06-3781-4b9c-a1f1-4681076f0dc8","resolution":{"observed_at":"2026-08-07T14:07:02.036871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:58.245162Z","title":"Maximum entropy inverse reinforcement learning","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.245162Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:8aeb28ea58cf42d0b83140834f4656d79ef1f3c7d360c2e7adc96a0b9125b88f","observation_id":"6384325e-8274-40c2-8f5a-253450ae0260","resolution":{"observed_at":"2026-08-07T14:06:58.245162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:01.763899Z","title":"Ziebart, J","venue":null,"work_id":"7c52c168-cb35-41c6-8ee5-12dfe55fa76e","year":2010},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.415238Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:f730415b907db22a193f3f0c02d595813b5e76390630cecb6711da65c13a9208","observation_id":"103d4c21-96f9-4102-b9ba-612080de986b","resolution":{"observed_at":"2026-08-07T14:07:01.833567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-07T14:06:58.573483Z","title":"Fine-tuning language models from human preferences","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.573483Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:fb906dedfac0f873f25f658d8ac296c606984a1dff5a868107db0c96ef868c7a","observation_id":"f665048d-1725-47b5-995c-3e4c3da082e4","resolution":{"observed_at":"2026-08-07T14:06:58.573483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:01.600256Z","title":"A variational perspective on generative flow networks","venue":null,"work_id":"786956bb-de94-4272-a019-5f1fe050ce2a","year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.693621Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:e503aacd44568a2b5c41cff9145ba122f3e3233a23d6cf445bb1f4b20f48f6ef","observation_id":"d5898f2e-9d36-4f56-bf51-4c39a8e39a7a","resolution":{"observed_at":"2026-08-07T14:07:01.666621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:58.818203Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.818203Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:19aaa27f02b3dfc9b01352d0b91394c89810b4757307a544292c5613251a74db","observation_id":"65e59bf7-bbd4-4320-b844-8788df31577d","resolution":{"observed_at":"2026-08-07T14:06:58.818203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:58.924588Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:58.924588Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:d0c72ce256c4d5ea9a9ed9c31fb47a58c1aa10c23c465f307a26032f2c404768","observation_id":"1275dd23-e228-4ccd-b185-f27161277cfa","resolution":{"observed_at":"2026-08-07T14:06:58.924588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:59.074626Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:59.074626Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:89bc5b27405230d7a9dc93a4273265a760fa5222ebe23d6441d1605136deb330","observation_id":"bab3555e-3cfa-4231-9cf3-cd4ab4c333dd","resolution":{"observed_at":"2026-08-07T14:06:59.074626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:06:59.238874Z","title":"?+dp ǝA/8n6aN-Fo 7F<B :qRwl3d 9K 1","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training","version":3},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-07T14:06:59.238874Z"},"links":{"citing_paper":"/paper/2505.20110"},"observation_digest":"sha256:94f08c671932c6b918c68e1528fc84fd10bd13a3124665781fd6065f513acd29","observation_id":"b5d9e50b-d8cc-440c-b668-6d4f11f0e042","resolution":{"observed_at":"2026-08-07T14:06:59.238874Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20110","last_updated":"2026-05-25T16:15:16Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T13:56:44.227717Z","submitted_at":"2025-05-26T15:12:22Z","title":"Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":7,"verified_fuzzy":40},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 0 inbound Pith citation observations for arXiv:2505.20110."}