{"as_of":"2026-08-11T17:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1919986d1db891da5257d313463d71810e2a7ec58b8cde780128aba78b327d07","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T20:29:22.040301Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T06:51:33.077793Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T03:46:32.394299Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"cited_work":{"arxiv_id":"2602.23280","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.23280","snapshot_observed_at":"2026-07-02T03:46:32.394299Z","title":"Mollified Value Learning","venue":"cs.LG","work_id":"b16cca1f-f9e8-41fe-a04d-976cc65e4887","year":2026},"citing_paper":{"arxiv_id":"2605.30503","last_updated":"2026-05-28T19:36:46Z","snapshot_observed_at":"2026-08-06T09:42:26.512945Z","submitted_at":"2026-05-28T19:36:46Z","title":"Physics-informed Goal-Conditioned Reinforcement Learning under Hybrid Contact Dynamics","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T06:51:33.077793Z"},"links":{"cited_paper":"/paper/2602.23280","citing_paper":"/paper/2605.30503"},"observation_digest":"sha256:6455270c0a0451ee34922b2e9a4933421e697f279e54d1abe8829a6264e55a30","observation_id":"92b930ac-1940-46b2-ab5e-a336c74d6dc2","resolution":{"observed_at":"2026-06-29T06:53:12.421301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"cited_work":{"arxiv_id":"2602.23280","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.23280","snapshot_observed_at":"2026-07-02T03:46:32.394299Z","title":"Mollified Value Learning","venue":"cs.LG","work_id":"b16cca1f-f9e8-41fe-a04d-976cc65e4887","year":2026},"citing_paper":{"arxiv_id":"2606.03756","last_updated":"2026-06-02T15:06:25Z","snapshot_observed_at":"2026-08-06T21:48:58.774893Z","submitted_at":"2026-06-02T15:06:25Z","title":"Neural Navigation Functions for Zero-Shot Generalizable Motion Planning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T09:44:54.897829Z"},"links":{"cited_paper":"/paper/2602.23280","citing_paper":"/paper/2606.03756"},"observation_digest":"sha256:9e30c5745de042553535998f65ba34f72abadfd0320deb5e8886fd6bb71113cb","observation_id":"9b5cd6db-3359-4878-a51b-67f36bad4880","resolution":{"observed_at":"2026-07-02T03:46:32.395636Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2602.23280/citation-record","integrity":"/paper/2602.23280/integrity","json":"/paper/2602.23280/citation-record.json","paper":"/paper/2602.23280"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:16.951131Z","title":"Giammarino, R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:16.951131Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:cfb37c458c397f862a5b4affaeabb5a30d362fb502baa2b546ee47ec28ee303a","observation_id":"73da9b16-1816-4c16-9b77-3351906501da","resolution":{"observed_at":"2026-08-02T20:29:16.951131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.04478","last_updated":"2022-02-14T04:26:50Z","snapshot_observed_at":"2026-08-08T23:10:28.615456Z","submitted_at":"2022-02-09T14:17:05Z","title":"Rethinking Goal-conditioned Supervised Learning and Its Connection to Offline RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.04478","snapshot_observed_at":"2026-08-02T20:29:17.032064Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.032064Z"},"links":{"cited_paper":"/paper/2202.04478","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:412e9357343fe18244caaea6df2e9cfaee6e9c3c9a28fd590bc86e0d76c9bd95","observation_id":"f393526e-a576-4671-b498-f7748703d520","resolution":{"observed_at":"2026-08-02T20:29:17.032064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:17.113257Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.113257Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:ae5d9212215209b7cf0bb8390e034a236b164f164cf6514aec6e087a2164c591","observation_id":"e3678338-48c0-493a-a75c-8b178e71808d","resolution":{"observed_at":"2026-08-02T20:29:17.113257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-11T15:42:16.204049Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-02T20:29:17.156100Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.156100Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:151a8c3daa4b69d5c7156d9d6d13ae4ce111f644c863b16516a7acb0dc32757a","observation_id":"6bdb7b08-a227-4452-b7f6-ef9426d9e3fc","resolution":{"observed_at":"2026-08-02T20:29:17.156100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:17.240062Z","title":"Schaul, D","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.240062Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:26e9b39d96ec3e12ebaae827da35a8fe4a6a9bdbc6365c48162831750160ac4d","observation_id":"6a0cfa2e-bd2c-49e7-b717-17229dbfedc6","resolution":{"observed_at":"2026-08-02T20:29:17.240062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:17.341151Z","title":"Weissenbacher, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.341151Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:ea75b23afc178cb07aaf0a49eec40a2442f959da832796299461b475842b3418","observation_id":"57ccbf32-e3b3-4b2b-909d-eab8e46d0da0","resolution":{"observed_at":"2026-08-02T20:29:17.341151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:17.419697Z","title":"Cheng, X","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.419697Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:78d61bccb8e9b85ef9f444dda1785a7089f44cb5757b3491fc3e297d1ba4ab7f","observation_id":"92f3d2a1-c14a-4940-a86a-8bff4079f63b","resolution":{"observed_at":"2026-08-02T20:29:17.419697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:17.501061Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.501061Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:a0d5b14ff0410206932291a48be73700619c8438d014d8dfbc219b6314227681","observation_id":"2f6d56ae-3f61-4310-a52d-5deb1d70709d","resolution":{"observed_at":"2026-08-02T20:29:17.501061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05691","last_updated":"2025-05-09T00:02:22Z","snapshot_observed_at":"2026-08-07T15:48:36.294754Z","submitted_at":"2025-05-09T00:02:22Z","title":"Physics-informed Temporal Difference Metric Learning for Robot Motion Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05691","snapshot_observed_at":"2026-08-02T20:29:17.567014Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.567014Z"},"links":{"cited_paper":"/paper/2505.05691","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:b580099fb71b3bc62f95d5b54099f551533862f3ff1124fd5dceb516b9ed97b3","observation_id":"ed6a8077-e219-4a85-b32f-d35610cbd963","resolution":{"observed_at":"2026-08-02T20:29:17.567014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:17.653261Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.653261Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:436aa3397a9e97c444167966d6831c959567e084d2ac1e87276edca6372173e7","observation_id":"5877e250-1e3c-4cfe-b222-25508149ce47","resolution":{"observed_at":"2026-08-02T20:29:17.653261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12742","last_updated":"2025-06-15T06:30:09Z","snapshot_observed_at":"2026-08-09T19:38:37.677820Z","submitted_at":"2025-06-15T06:30:09Z","title":"Physics-informed Neural Motion Planning via Domain Decomposition in Large Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12742","snapshot_observed_at":"2026-08-02T20:29:17.717612Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.717612Z"},"links":{"cited_paper":"/paper/2506.12742","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:f48a6c3511b3b97f39214d2e1fe7d8b1ce2e15230d25b9d401b9bc6002053ae8","observation_id":"1f7a6bee-c769-451a-892d-5daece239d71","resolution":{"observed_at":"2026-08-02T20:29:17.717612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00120","last_updated":"2023-03-01T15:23:49Z","snapshot_observed_at":"2026-08-10T22:51:52.698898Z","submitted_at":"2022-09-30T22:34:54Z","title":"NTFields: Neural Time Fields for Physics-Informed Robot Motion Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00120","snapshot_observed_at":"2026-08-02T20:29:17.829512Z","title":"Ni and A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.829512Z"},"links":{"cited_paper":"/paper/2210.00120","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:004e021dcdde1cdd8be3bc48f8a3c12ce83badd4fde282bb3f26c04b43e65375","observation_id":"bb3809c3-7835-4ebd-bc77-47acca08621e","resolution":{"observed_at":"2026-08-02T20:29:17.829512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:17.874823Z","title":"Ni and A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.874823Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:994aad6be4bebb5c1d0aa1ae9ffbeeba30ef2a460f9ec87a35b783b6fc4da088","observation_id":"6e0bb287-991d-4b2b-99bd-039914739729","resolution":{"observed_at":"2026-08-02T20:29:17.874823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00616","last_updated":"2023-06-01T12:41:05Z","snapshot_observed_at":"2026-08-09T19:38:18.129618Z","submitted_at":"2023-06-01T12:41:05Z","title":"Progressive Learning for Physics-informed Neural Motion Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00616","snapshot_observed_at":"2026-08-02T20:29:17.984191Z","title":"Ni and A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:17.984191Z"},"links":{"cited_paper":"/paper/2306.00616","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:4a11562bc106b2268017a5a67afa8ee19240216d1d05ed2d81e6d1ca3dcd5b97","observation_id":"750c7618-b533-49d5-a4ff-806199af7d83","resolution":{"observed_at":"2026-08-02T20:29:17.984191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:18.105833Z","title":"Lien, P.-C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:18.105833Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:5074e899ec46daef0ea284d07632c94b9105b2af66df9d83ec32778ddcfe295e","observation_id":"ad189127-eb05-464c-8153-04a1f476dd55","resolution":{"observed_at":"2026-08-02T20:29:18.105833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:18.198716Z","title":"Munos and P","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:18.198716Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:69c5ff9f085a909398ff911bf805fced77ecb508d93ddf5798777f70ff2c78d9","observation_id":"99717d51-8893-4813-ae26-3e69d5329449","resolution":{"observed_at":"2026-08-02T20:29:18.198716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:18.336979Z","title":"Quer and E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:18.336979Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:e59eb094f2085c381f626adb0679b5aed5ef5cf3988a7215ad15843b052561a7","observation_id":"3ad73c6a-64c3-46b3-b697-355d8b80f09f","resolution":{"observed_at":"2026-08-02T20:29:18.336979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:18.488803Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:18.488803Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:dcd8c8528e2100a0d83d078e70dc0743dced5da2bdb1d89b68a479afda427dac","observation_id":"78726102-d3a7-4d2a-84db-6121da0cb790","resolution":{"observed_at":"2026-08-02T20:29:18.488803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:18.639101Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:18.639101Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:8c1bb17089f58df4a758c53a2fe2ed1c27b4e7a7ae5f5c64831f7acd1b7f7f72","observation_id":"b35b7a65-448b-4beb-8a84-9d2be91380f0","resolution":{"observed_at":"2026-08-02T20:29:18.639101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:18.813525Z","title":null,"venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:18.813525Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:edcba66484813c004d253424898f18866cfffef37400692ac2b43e485901e191","observation_id":"a5e1c7d7-ce00-4d41-868f-131bab4d4439","resolution":{"observed_at":"2026-08-02T20:29:18.813525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-02T20:29:19.038948Z","title":"Levine, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:19.038948Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:f09446b32c7bcaf80f34ad6450142644b726db0a343bff231a36d2f327e39642","observation_id":"63fd0a51-1e7f-485e-8265-ec4ca40cff1c","resolution":{"observed_at":"2026-08-02T20:29:19.038948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:19.143609Z","title":"Andrychowicz, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:19.143609Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:9b69e734f628893b937c3e67c67e97deb73fef2b6e3c460efde14a30ffcae139","observation_id":"e7c2b705-938d-489b-a1f4-49d10f942418","resolution":{"observed_at":"2026-08-02T20:29:19.143609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07749","last_updated":"2021-06-10T23:54:34Z","snapshot_observed_at":"2026-08-06T05:54:55.251384Z","submitted_at":"2021-04-15T20:10:11Z","title":"Actionable Models: Unsupervised Offline Reinforcement Learning of Robotic Skills","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.07749","snapshot_observed_at":"2026-08-02T20:29:19.303477Z","title":"Chebotar, K","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:19.303477Z"},"links":{"cited_paper":"/paper/2104.07749","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:3e6f3edcb810830fc0140139ffea3359397e9bab12d1364c46a75d853f652cb4","observation_id":"8331ad51-66f8-4152-aeb1-89aa3e6113a6","resolution":{"observed_at":"2026-08-02T20:29:19.303477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:19.457127Z","title":"Peters, K","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:19.457127Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:79b801282f1e05dbbc04662ec9e3212807f276b37a010b70bf9118639a4b7d86","observation_id":"903c311a-5daa-408e-bf03-987ad43cf52b","resolution":{"observed_at":"2026-08-02T20:29:19.457127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:19.630400Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:19.630400Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:83fca1e41ff67423ccc93a1be0c02bf2c0e1083bc50c1f1f12121858673e0626","observation_id":"c67dc8c9-a550-436a-8413-33d60e626e37","resolution":{"observed_at":"2026-08-02T20:29:19.630400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:19.762650Z","title":"Kostrikov, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:19.762650Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:c93b06e75fe9b7b628a47f31c8240f1b32fc7aa61beb05081a72978a12312c05","observation_id":"396404d1-d74c-40a1-a8aa-30998f3eed52","resolution":{"observed_at":"2026-08-02T20:29:19.762650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:19.961455Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:19.961455Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:3fae1b8bd01ce232f1cd4cbb0c3b6dc4eecea49bce7315d3b1e75cd30cbeaf51","observation_id":"87c02f60-5601-4a26-be2b-f4dc2c79170d","resolution":{"observed_at":"2026-08-02T20:29:19.961455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:20.117194Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:20.117194Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:9490e3a6f28db413a510d0eb823916f5c144ed5e772c12af966f1ed4ae055885","observation_id":"f1b4fdbc-c62d-42f5-9aeb-52a6391e7443","resolution":{"observed_at":"2026-08-02T20:29:20.117194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:20.194812Z","title":"Eysenbach, T","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:20.194812Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:d521cdb7ccbad1c44d6163b4577bd035a335b23e39bd097f70210a945bff0d74","observation_id":"0ec11b75-2fc8-442a-a647-042b1abb00f4","resolution":{"observed_at":"2026-08-02T20:29:20.194812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:20.308752Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:20.308752Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:5c3de99e90a0c340cc60ddc38d423121564f74cb2e5135ef6fe1ad8ecc8f0a7b","observation_id":"daba14aa-03a4-4fc8-a69b-c2f5d56b30fa","resolution":{"observed_at":"2026-08-02T20:29:20.308752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:20.456896Z","title":"Shilova, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:20.456896Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:d1d71fe9d426ee24a62bdd67c11c789f8c0bce0891ecbde5c48cfeeadfc3707a","observation_id":"fe8407ac-2333-41d2-b212-c196403061eb","resolution":{"observed_at":"2026-08-02T20:29:20.456896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17547","last_updated":"2025-05-26T21:03:51Z","snapshot_observed_at":"2026-07-06T19:38:13.816410Z","submitted_at":"2024-10-23T04:06:35Z","title":"Generalizable Motion Planning via Operator Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17547","snapshot_observed_at":"2026-08-02T20:29:20.545394Z","title":"Matada, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:20.545394Z"},"links":{"cited_paper":"/paper/2410.17547","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:870994c06efd3e83c7c82a225fb935cf24d7a171df2fbc6567b635f4dadc9550","observation_id":"3866e188-56a2-48d5-8525-aa59547ecb71","resolution":{"observed_at":"2026-08-02T20:29:20.545394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:20.649039Z","title":"Viswanath, H","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:20.649039Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:6611dd0e01c494b8b13665602ac074f901ad3979da376cf9899047e1563d675c","observation_id":"9fee51cc-35e6-4ea2-b210-b21141f4278f","resolution":{"observed_at":"2026-08-02T20:29:20.649039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:20.771868Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:20.771868Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:87843a2a986b180762d4f24d677ae7eb39a7f98cbde4c32446bba138a0a1ef75","observation_id":"842ff4c3-fff6-4114-b928-ab5378cb2f4d","resolution":{"observed_at":"2026-08-02T20:29:20.771868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.03986","last_updated":"2021-03-04T23:49:19Z","snapshot_observed_at":"2026-08-02T00:58:18.666300Z","submitted_at":"2019-02-11T16:46:39Z","title":"Learning Deep Stochastic Optimal Control Policies using Forward-Backward SDEs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.03986","snapshot_observed_at":"2026-08-02T20:29:20.877421Z","title":"Pereira, Z","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:20.877421Z"},"links":{"cited_paper":"/paper/1902.03986","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:84566935ecd5f022e4f974f12575fd3221382c395329a6185558c1789014d894","observation_id":"0248615c-94cd-4587-81cc-6b85517dc80b","resolution":{"observed_at":"2026-08-02T20:29:20.877421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:20.974283Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:20.974283Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:8a7c27e82ebfade91e017bf1182f63e428fdd36e452ede51e2a66c7483481834","observation_id":"eae8d5ba-b0ca-413f-9940-fbfab4654421","resolution":{"observed_at":"2026-08-02T20:29:20.974283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:21.055680Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.055680Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:342a5f9624d52bed6e1ba2532bde1f18a90a407e4dab6cc58fbe8054b4918957","observation_id":"204a51d0-32ed-4997-a0b5-edd7d3128b63","resolution":{"observed_at":"2026-08-02T20:29:21.055680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:21.085411Z","title":"Jia and X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.085411Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:39d5a5547d0d968f29154c5c4c87b26aea4980d878d79d083ecca0af0d3e109a","observation_id":"3e1c02b2-5ee2-4cea-a875-6bfdb772497e","resolution":{"observed_at":"2026-08-02T20:29:21.085411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:21.189982Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.189982Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:eb9b562e2cbdfae3446221079a5495889648b783a1c728fd19fcdb573b664758","observation_id":"f87036d8-77e7-44b3-b212-922b09ac55a4","resolution":{"observed_at":"2026-08-02T20:29:21.189982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:21.320202Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.320202Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:8c2153f35fe96cc3ca22d516d875d26df1861f4882afb3a900dafeeb1162d1b5","observation_id":"0c05733a-b001-457d-9ead-10ee544bd5f1","resolution":{"observed_at":"2026-08-02T20:29:21.320202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:21.440162Z","title":"Goldys and F","venue":null,"work_id":null,"year":1932},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.440162Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:099d8730ac85cf808dda1838a8ca4669ba03b3d36beae5941f1c4e1c8088c3a8","observation_id":"5b247180-7bfa-4b12-beb4-35974ea927f5","resolution":{"observed_at":"2026-08-02T20:29:21.440162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:21.557094Z","title":"Nevistic and J","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.557094Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:af41c620dd8e75ae09d9af3440d835b7bc01c382688b2882765639c667ed16d9","observation_id":"8b16e794-2330-40ae-bf3d-a06514ff1c88","resolution":{"observed_at":"2026-08-02T20:29:21.557094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:21.596392Z","title":"Yong and X","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.596392Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:3c2a4e55809d5057b301798e6a449157b8b7e94fc8c01f1e7349137e5f50b708","observation_id":"8b8e5ca0-b157-4588-8a19-39c66b619142","resolution":{"observed_at":"2026-08-02T20:29:21.596392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:21.678237Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.678237Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:350d12376723d610f61cbcaa348be728b0d2c2fa056d07e20e0c335a46cef859","observation_id":"80405882-f02d-4d53-b6a7-9f6a9eeefd5b","resolution":{"observed_at":"2026-08-02T20:29:21.678237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20092","last_updated":"2025-02-13T18:38:13Z","snapshot_observed_at":"2026-08-09T00:27:34.912875Z","submitted_at":"2024-10-26T06:06:08Z","title":"OGBench: Benchmarking Offline Goal-Conditioned RL","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20092","snapshot_observed_at":"2026-08-02T20:29:21.761975Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.761975Z"},"links":{"cited_paper":"/paper/2410.20092","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:a5b5a6a77cab60210c1fb614f2a2595936a282dd090d3cd03fc820faafe4f434","observation_id":"a8343163-33b9-4f8f-862e-8bfb86baf7ce","resolution":{"observed_at":"2026-08-02T20:29:21.761975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.05859","last_updated":"2023-10-11T09:07:01Z","snapshot_observed_at":"2026-08-04T05:49:33.744788Z","submitted_at":"2021-04-12T23:14:41Z","title":"Rapid Exploration for Open-World Navigation with Latent Goal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.05859","snapshot_observed_at":"2026-08-02T20:29:21.869071Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.869071Z"},"links":{"cited_paper":"/paper/2104.05859","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:50dc4d7738271f323c765634d81aca27a89ffd3fb51a601f49a5ab39f9a41d75","observation_id":"780c4d8d-cf3c-42c1-8440-2592759c5179","resolution":{"observed_at":"2026-08-02T20:29:21.869071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05454","last_updated":"2025-02-13T08:54:06Z","snapshot_observed_at":"2026-08-09T14:57:54.067377Z","submitted_at":"2025-02-08T05:26:29Z","title":"Temporal Representation Alignment: Successor Features Enable Emergent Compositionality in Robot Instruction Following","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05454","snapshot_observed_at":"2026-08-02T20:29:21.928946Z","title":"Myers, B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.928946Z"},"links":{"cited_paper":"/paper/2502.05454","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:81ac87af1251252a9f125fe5f8e7000559fbb2d503cc6cd2290537398b5f778f","observation_id":"7622205b-d211-4094-aa08-d02376dc3c91","resolution":{"observed_at":"2026-08-02T20:29:21.928946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10137","last_updated":"2026-04-19T14:49:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T19:32:41Z","title":"Self-Predictive Representations for Combinatorial Generalization in Behavioral Cloning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10137","snapshot_observed_at":"2026-08-02T20:29:21.990487Z","title":"Lawson, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:21.990487Z"},"links":{"cited_paper":"/paper/2506.10137","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:dd7af9e4803892502bfefa93e866e531f52c936bb7c46eb5553866f8d6729104","observation_id":"25354b25-2edd-437b-aaf2-0dd89e4d417d","resolution":{"observed_at":"2026-08-02T20:29:21.990487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T20:29:22.040301Z","title":"We use the Adam optimizer and GELU activation functions throughout","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:22.040301Z"},"links":{"citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:7da104e66fb6ac470c2cd80fa056d351d4a08f5e34e00c9ebf8cb93722882fb3","observation_id":"1d50a496-1865-47d7-9b49-0ba1a11b0ddc","resolution":{"observed_at":"2026-08-02T20:29:22.040301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06169","last_updated":"2021-10-12T17:05:05Z","snapshot_observed_at":"2026-08-06T15:42:21.967989Z","submitted_at":"2021-10-12T17:05:05Z","title":"Offline Reinforcement Learning with Implicit Q-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06169","snapshot_observed_at":"2026-08-02T20:29:19.843886Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T20:29:19.843886Z"},"links":{"cited_paper":"/paper/2110.06169","citing_paper":"/paper/2602.23280"},"observation_digest":"sha256:ae62e18ef3c767ca9dc764b35fac0cbff1ec41cf69757d88381095c1bcf92180","observation_id":"93f93dee-28af-4828-b85f-ff11c947ab61","resolution":{"observed_at":"2026-08-02T20:29:19.843886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.23280","last_updated":"2026-05-29T16:05:00Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T10:56:14.300559Z","submitted_at":"2026-02-26T17:53:46Z","title":"Mollified Value Learning"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 2 inbound Pith citation observations for arXiv:2602.23280."}