{"as_of":"2026-08-08T04:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7411f65ef09904a5827975b6e09beb7d3a32aaffcd8576932245cabf8f88332c","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:42:21.787743Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.16590/citation-record","integrity":"/paper/2506.16590/integrity","json":"/paper/2506.16590/citation-record.json","paper":"/paper/2506.16590"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.079181Z","title":"Hindsight experience replay.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.079181Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:6145ab75bad6b053f108e9648c1e77cecd405563317046583d865fafd230981e","observation_id":"5113ad28-9e89-44f7-9197-0fd91d4ee080","resolution":{"observed_at":"2026-08-06T23:42:20.079181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.172706Z","title":"Deep reinforcement learning: A brief survey.IEEE Signal Processing Magazine, 34(6):26–38, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.172706Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:fc5f0f58affc28e5e82d6e2861080d9352ab109e9c7087786f6a8a0af7f9ffca","observation_id":"ca7c705d-8b26-4a63-8dfc-2054ddb56fa4","resolution":{"observed_at":"2026-08-06T23:42:20.172706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.320206Z","title":"Torchrl: A data-driven decision-making library for pytorch, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.320206Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:31c7551fcb1db72e8e5585bff18efd55532dcdf33eadf3053a4fa1908e74dbad","observation_id":"cac52097-ca97-4204-a126-8911a88173a2","resolution":{"observed_at":"2026-08-06T23:42:20.320206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.084334Z","title":"Policy transfer using reward shaping","venue":null,"work_id":"7707c569-75d6-4393-90d2-a9fdaa3234f1","year":2015},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.398123Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:15df6528f852a595a99135c3b0b3c6b84844254a6614a359a8f141b7bb7a070a","observation_id":"008bc80b-c5c8-4682-819a-83d7c953d267","resolution":{"observed_at":"2026-08-06T23:42:22.088060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.073755Z","title":"Introspective action advising for interpretable transfer learning","venue":null,"work_id":"a05261e5-4dfc-46ad-9dde-a8cdbcf89875","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.456642Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:742a69cbea73fcc573813d090970ea03bce7047633abe954a3124bb4d62f9e51","observation_id":"6e48e6d6-017d-4a58-a348-191c43078aef","resolution":{"observed_at":"2026-08-06T23:42:22.076920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.514972Z","title":"On the utility of learning about humans for human-ai coordination.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.514972Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:055467b85dc8ac23aea8aee9b86df74d34bccfdeb3394b7eda32107c7fca1ac5","observation_id":"05fced0e-2742-4d85-8fb1-b2ae41dd85b4","resolution":{"observed_at":"2026-08-06T23:42:20.514972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.603489Z","title":"Minigrid & miniworld: Modular & customizable reinforcement learning environments for goal-oriented tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.603489Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:9f468b68da16cef0a8f9a78a827dd3a11a7f5f54717097ecb583bea9ed708379","observation_id":"b2ce6f32-3ac9-44e1-aa5d-c70fe05a013d","resolution":{"observed_at":"2026-08-06T23:42:20.603489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.051389Z","title":"Explainable action advising for multi-agent reinforcement learning","venue":null,"work_id":"b82b7cb0-752e-437e-9d9a-acfaa8fa562a","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.685516Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:abd1723f51528a0f1129e3f8e7e92d9065ec05d3f3dff72b9b3adfa2579e95ea","observation_id":"59b7320d-e1d1-4a40-960b-c78d45b4a243","resolution":{"observed_at":"2026-08-06T23:42:22.056322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.042258Z","title":null,"venue":null,"work_id":"33c92e84-f4d4-4c81-8856-5542e491b9ba","year":null},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.762980Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:e4f8abf0092428ad8f03d4e1bdc7abddf5b816f02a7e0400e0d8daac92c1c19b","observation_id":"a05a8e98-8702-47a5-9a09-f5cb650007e5","resolution":{"observed_at":"2026-08-06T23:42:22.044950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:20.882797Z","title":"Reinforcement learning with deep energy-based policies","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.882797Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:6b98696968c0e679190f86154b248993609f45ae3d1c9ef7f41d46802ebacb8e","observation_id":"cd113b0a-7a06-4315-b4ad-762c75c3fc03","resolution":{"observed_at":"2026-08-06T23:42:20.882797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.017191Z","title":"Expressing arbitrary reward functions as potential-based advice","venue":null,"work_id":"16a6b6fc-c61f-467c-92cd-5156faa21bc8","year":2015},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.043790Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:f9375ed6bdf620a0c87e7069b28c8f78b98bf03566e41a357d82adba1b702b94","observation_id":"09ad223d-c11d-4173-af9c-1841939870ce","resolution":{"observed_at":"2026-08-06T23:42:22.020642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02136","last_updated":"2018-10-03T07:32:57Z","snapshot_observed_at":"2026-08-02T06:41:33.803920Z","submitted_at":"2016-10-07T04:06:01Z","title":"A Baseline for Detecting Misclassified and Out-of-Distribution Examples in Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02136","snapshot_observed_at":"2026-08-06T23:42:21.117919Z","title":"A baseline for detecting misclassified and out-of-distribution examples in neural networks.arXiv preprint arXiv:1610.02136, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.117919Z"},"links":{"cited_paper":"/paper/1610.02136","citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:a247ccbf0668b30c1ec4e820b3894665cd10610cc7902045879be2b188a9e5c5","observation_id":"57fdacab-3d40-409c-8153-09a9eed7e5f1","resolution":{"observed_at":"2026-08-06T23:42:21.117919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.007240Z","title":"Transferring policy of deep reinforcement learning from simulation to reality for robotics.Nature Machine Intelligence, 4(12):1077–1087, 2022","venue":null,"work_id":"a37d27b8-9533-4c0e-a7d2-1fbfa649b3e4","year":2022},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.220530Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:cc3369d2fc75a5d679bf0d56ebea501a9819f57620f34d51eef58886ea6faf82","observation_id":"07477bb6-396d-4878-8f70-86181eb15b77","resolution":{"observed_at":"2026-08-06T23:42:22.010697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.299372Z","title":"A tutorial on energy-based learning.Predicting structured data, 1(0), 2006","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.299372Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:e04e371668b762ebd85c3ceeef9af935addfc9cb0e43f5729443f21d8838292e","observation_id":"de92af93-cdd2-4882-b7df-b9b0974a7333","resolution":{"observed_at":"2026-08-06T23:42:21.299372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07274","last_updated":"2018-11-26T04:56:31Z","snapshot_observed_at":"2026-07-06T05:27:30.168672Z","submitted_at":"2017-01-25T11:52:11Z","title":"Deep Reinforcement Learning: An Overview","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07274","snapshot_observed_at":"2026-08-06T23:42:21.371387Z","title":"Deep reinforcement learning: An overview.arXiv preprint arXiv:1701.07274, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.371387Z"},"links":{"cited_paper":"/paper/1701.07274","citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:a7354ebaca23032d0ba6b2bd9828a73a6ef770a401038c2a49cb8149ff96dc66","observation_id":"74ac0f85-b374-45fa-b604-3cfa1a4d53ae","resolution":{"observed_at":"2026-08-06T23:42:21.371387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.984877Z","title":"Energy-based out-of-distribution detection.Advances in neural information processing systems, 33:21464–21475, 2020","venue":null,"work_id":"7ba1e267-479f-455c-85ad-3434a6f87f30","year":2020},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.504756Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:4aa4d096bd70b8d4187a5a7ec72daea64535e65580706171baedf4f462a07d28","observation_id":"622f3abe-85ee-4e1d-adfb-8c647beb3744","resolution":{"observed_at":"2026-08-06T23:42:21.995051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.973185Z","title":"Characterizing out-of-distribution error via optimal transport.Advances in Neural Information Processing Systems, 36:17602–17622, 2023","venue":null,"work_id":"498bcc68-6c5a-4d30-8132-24936ee28ef4","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.564552Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:d2eaade4d7284b1c5718d13c10ec84ca9ac531c0caef359c6546398b4ef0572a","observation_id":"d71c0968-6e0d-4cf1-880a-2f5df971e0b9","resolution":{"observed_at":"2026-08-06T23:42:21.976955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.963007Z","title":"University of Wisconsin-Madison","venue":null,"work_id":"534da7db-7272-49cf-9829-c58971c45ca7","year":1994},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.584751Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:f77ef01f1b40e87dabfc589cd0ed4630f161b99c36483ac6068d9468ba531a3d","observation_id":"c4ed34d0-b365-4b70-b077-2a68124e78a8","resolution":{"observed_at":"2026-08-06T23:42:21.966387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.722555Z","title":"Policy invariance under reward transforma- tions: Theory and application to reward shaping","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.722555Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:d3d7afeec9cc3aa047ba258bd9bc18ad0941bde604adce6dd5af4352291c20e3","observation_id":"62208f8b-b58f-4ec4-851c-e704ec580428","resolution":{"observed_at":"2026-08-06T23:42:21.722555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.945590Z","title":"Deep neural networks are easily fooled: High confidence predictions for unrecognizable images","venue":null,"work_id":"b82ec3fd-5680-4103-88dc-50a4ac41a52a","year":2015},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.746635Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:f8c4ab54b6ac709f748389c9f2781a54bb3b90abf1f217405de01fecd208c4fc","observation_id":"aaa8590f-e92e-4dd0-8584-8a37a2104733","resolution":{"observed_at":"2026-08-06T23:42:21.949324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.935094Z","title":"Transfer learning and fine- tuned transfer learning methods’ effectiveness analyse in the cnn-based deep learning models","venue":null,"work_id":"eb59bcfb-3755-4f07-9f94-a3c701870b39","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.749668Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:90ab9206aef834cf0ecea00c106c2ee5d99beb45019de7a4d3c96d436233d16f","observation_id":"5f1562ae-b514-4585-9b3b-fe5ce35ba953","resolution":{"observed_at":"2026-08-06T23:42:21.939727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04664","last_updated":"2020-05-28T20:51:40Z","snapshot_observed_at":"2026-07-06T09:03:37.435861Z","submitted_at":"2020-03-10T12:38:31Z","title":"Automatic Curriculum Learning For Deep RL: A Short Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04664","snapshot_observed_at":"2026-08-06T23:42:21.752276Z","title":"Au- tomatic curriculum learning for deep rl: A short survey.arXiv preprint arXiv:2003.04664, 2020","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.752276Z"},"links":{"cited_paper":"/paper/2003.04664","citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:d9a0bf58f33bca9b0e64e27f7fd6f63f6bd14218c0be48fd7ff172262dacc2ea","observation_id":"7fae3eea-146a-459e-b94a-773036c72f49","resolution":{"observed_at":"2026-08-06T23:42:21.752276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.925519Z","title":"Likelihood ratios for out-of-distribution detection.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":"70c72fbc-3bc9-4d32-811f-c056c977daa1","year":2019},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.755646Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:dcb7afcc44567a807a949a12f1652b9af14c6bf5b7d7ac09ebee82bdfbf673b0","observation_id":"66f54886-a0f0-4295-a22f-3c375323c52c","resolution":{"observed_at":"2026-08-06T23:42:21.929000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06295","last_updated":"2016-01-07T18:43:03Z","snapshot_observed_at":"2026-07-06T04:37:06.738855Z","submitted_at":"2015-11-19T18:38:47Z","title":"Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06295","snapshot_observed_at":"2026-08-06T23:42:21.758615Z","title":"Policy distillation.arXiv preprint arXiv:1511.06295, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.758615Z"},"links":{"cited_paper":"/paper/1511.06295","citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:79e7a0d76e2e5154884cbf232d4d02cdde89e5a36bf6d58f8beebceca63eba48","observation_id":"47b47bf6-2a53-40c5-af74-0a635efaa990","resolution":{"observed_at":"2026-08-06T23:42:21.758615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03835","last_updated":"2018-03-10T16:45:00Z","snapshot_observed_at":"2026-07-06T06:27:37.630587Z","submitted_at":"2018-03-10T16:45:00Z","title":"Kickstarting Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03835","snapshot_observed_at":"2026-08-06T23:42:21.762144Z","title":"Kickstarting deep reinforcement learning.arXiv preprint arXiv:1803.03835, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.762144Z"},"links":{"cited_paper":"/paper/1803.03835","citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:51b9e8e79cfe5ebf6ccfe05532065dc99703a898d2795cb22d713b0b90e07c10","observation_id":"0c28a6a4-bf45-4af6-8a3d-eac8f7dd2c37","resolution":{"observed_at":"2026-08-06T23:42:21.762144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.765683Z","title":"MIT press Cambridge, 1998","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.765683Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:8fd0b93b0dada8ac735675fb396edb5e1f5e5c1b1ce68fc7df921da75be8f39c","observation_id":"1ba6e15f-a06e-40dc-b3e4-ab6d56db54a8","resolution":{"observed_at":"2026-08-06T23:42:21.765683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.770399Z","title":"Transfer learning for reinforcement learning domains: A survey.Journal of Machine Learning Research, 10(7), 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.770399Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:70811547728aa95fd23cba83c94c273dd96441ba3a1a3402472ab1531c1b6583","observation_id":"8b0e84c2-564b-48f7-8544-a0432105b2c3","resolution":{"observed_at":"2026-08-06T23:42:21.770399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.903433Z","title":"Teaching on a budget: Agents advising agents in reinforcement learning","venue":null,"work_id":"9f0e9fc2-061a-4362-9bd9-93f8485f3728","year":2013},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.773775Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:e674ceca606f0cc6c3b2b593967b415810d8e77328c830c4964f6dfa584e7d45","observation_id":"c0890ec2-33a9-4e8c-aea3-63bdb4774db8","resolution":{"observed_at":"2026-08-06T23:42:21.908147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.893484Z","title":"Jump-start reinforcement learning","venue":null,"work_id":"65d9c028-635c-4d40-821d-f855a6a314fb","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.777168Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:3e3c8d66042413a57f916ee8794d086bef789d1d4629993ad3e9ad61f6158e71","observation_id":"210e6868-b91a-46e5-b6d3-1de8433cd77f","resolution":{"observed_at":"2026-08-06T23:42:21.897273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.884100Z","title":"A survey of transfer learning.Journal of Big data, 3:1–40, 2016","venue":null,"work_id":"0a8f3198-1b90-469e-8d4f-202528b232bf","year":2016},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.779630Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:2b3eb8f9cff9b7a0fd7d82c9485f18e004418645bd2d74d94a2e05c7235b66f4","observation_id":"f5e207f1-3904-461b-b4b6-7efc8d64dcf1","resolution":{"observed_at":"2026-08-06T23:42:21.887793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.782318Z","title":"Generalized out-of-distribution detection: A survey.International Journal of Computer Vision, 132(12):5635–5662, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.782318Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:7b5b493d5b9ca273e970528f7a8c20222aa38d1013fb69e94116a905cd8abd8c","observation_id":"321fba6f-a874-4e8c-a89b-5b1d588a02cf","resolution":{"observed_at":"2026-08-06T23:42:21.782318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.785030Z","title":"How transferable are features in deep neural networks?Advances in neural information processing systems, 27, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.785030Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:dd3dacae751933bbfbc5e6c9d4d909b070b8e43d6ae4ef9b1332d47162238485","observation_id":"ce346e79-d1dc-44aa-b7d7-c56bfd72f93e","resolution":{"observed_at":"2026-08-06T23:42:21.785030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:21.859913Z","title":"Transfer learning in deep reinforce- ment learning: A survey.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45 (11):13344–13362, 2023","venue":null,"work_id":"38082480-62bb-495d-87e1-4ed532eabeef","year":2023},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:21.787743Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:e7631aa8b30d5d6ba88b70db2425b5c505fd71507379efdabda31968c361a9ef","observation_id":"94a97d4b-e979-4da2-8dc9-8ec0f67164c0","resolution":{"observed_at":"2026-08-06T23:42:21.866507Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:42:22.032745Z","title":"URL https://proceedings.mlr.press/v274/guo25a","venue":null,"work_id":"854f614f-a90d-433f-8f8f-a2f0407a71ab","year":2025},"citing_paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning","version":1},"reference_index":267,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:20.817071Z"},"links":{"citing_paper":"/paper/2506.16590"},"observation_digest":"sha256:df3fa2a0e76f5038c1bc0665107c583e6ffa015bf04029e2c90b741092a8c99d","observation_id":"b492e458-1530-4d01-9fcf-e35719ccad39","resolution":{"observed_at":"2026-08-06T23:42:22.036378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.16590","last_updated":"2025-06-19T20:25:52Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T07:36:25.852801Z","submitted_at":"2025-06-19T20:25:52Z","title":"Energy-Based Transfer for Reinforcement Learning"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2506.16590."}