{"as_of":"2026-08-21T06:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ebd74596b6c4344d1e8fcff760c703ba5bf4da58cc6df00be20addf78c2c0e60","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T00:48:32.753805Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.18086/citation-record","integrity":"/paper/2501.18086/integrity","json":"/paper/2501.18086/citation-record.json","paper":"/paper/2501.18086"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:35.023361Z","title":"Cic: Contrastive intrinsic control for unsupervised skill discovery,","venue":null,"work_id":"95700726-677f-4bb6-b391-14ad83627d00","year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.450693Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:9911fcd10d157e34488776f9f2e324189485aa458f26d2d5fc4be620243dd318","observation_id":"4daa092c-1248-4526-ba6a-f606389e8e78","resolution":{"observed_at":"2026-08-10T00:48:35.028770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:35.007431Z","title":"Urlb: Unsupervised reinforcement learning benchmark,","venue":null,"work_id":"bee30259-9571-466e-bb4a-0ee39898cb7f","year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.530551Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:f9ca7fe43dd6900bdd2a721195226b092fcf7d8a38c4b744db1ebf541af916c0","observation_id":"0342578d-af3c-4c21-9f96-9c7646e99500","resolution":{"observed_at":"2026-08-10T00:48:35.012998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.991041Z","title":"Unsupervised reinforcement learning in multiple environments,","venue":null,"work_id":"852a3f3e-d1d0-47a1-914d-d91df5ed11b3","year":2022},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.583130Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:d764c60ad49ce322a8541fa7f2d911c5fd5046e2c72f337513d1a869e135a7c8","observation_id":"1df158d5-de82-4297-b5d9-14dfdad06d82","resolution":{"observed_at":"2026-08-10T00:48:34.996288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:31.635698Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.635698Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:d2ae18a96c86a144011ec71a1263d87903e4edcedcedd09aec55eebe65feda6d","observation_id":"38bc8abc-7070-40ed-826c-43b1fb186ae6","resolution":{"observed_at":"2026-08-10T00:48:31.635698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:31.675493Z","title":"Efficient training of artificial neural networks for autonomous navigation,","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.675493Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:d7657e192d64758a46bd09edbce3fa69481f044b18badd7e48939adc3714ff11","observation_id":"7097344a-004f-47af-894a-e83ea9ccc664","resolution":{"observed_at":"2026-08-10T00:48:31.675493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.954777Z","title":"Learning from demonstration,","venue":null,"work_id":"07cfde95-96da-4921-9bed-2962fd1e5d81","year":1996},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.683014Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:01dea4c65c1d5e540032684bea546516199fcb8f6b6ca63dde62fcda57dea514","observation_id":"337df680-0a43-4008-bac2-0b5b3d6ee255","resolution":{"observed_at":"2026-08-10T00:48:34.960046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:31.701992Z","title":"A survey of robot learning from demonstration,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.701992Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:5ff1ebd7efbec42c5d08f430d430f29dd3109499399a8a045fa639ba52fd20fe","observation_id":"1041deaa-0f38-48c6-9987-a05dfc64655e","resolution":{"observed_at":"2026-08-10T00:48:31.701992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:31.724809Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.724809Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:34655f0451f1472ee8fab54b51ff3f926bc98e9dc146aa28e3da4777850e95ca","observation_id":"4c9b351d-e9e0-410e-88f9-1516913b0c8b","resolution":{"observed_at":"2026-08-10T00:48:31.724809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.919085Z","title":"Never give up: Learning directed exploration strategies,","venue":null,"work_id":"d3b83098-6801-4119-9538-cf310082b1de","year":2019},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.729354Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:b7adf7944f064cdd42c9b736c2470175249fad6953062c2720a5aa8e1ff643d5","observation_id":"a47ba89b-d833-4bd2-8b86-36926039bfeb","resolution":{"observed_at":"2026-08-10T00:48:34.924402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.849303Z","title":"Novelty search in repre- sentational space for sample efficient exploration,","venue":null,"work_id":"c5506c8c-fce6-405a-a435-070e8237dc3e","year":2020},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.734358Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:bab1b557eefa3daedc61900c91085f23287b2c248c82b0e5ee3ab007cdf4e98a","observation_id":"776e3556-3fef-466d-9a36-ad0cfb2870e6","resolution":{"observed_at":"2026-08-10T00:48:34.890509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:31.739472Z","title":"State entropy maximization with random encoders for efficient exploration,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.739472Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:df542990f9bdcf905d3f3a16d6cb9b167959d3bfafa34123ff3230774597a043","observation_id":"e59bb6a3-7c2a-4cd5-b2ba-847ddb84b818","resolution":{"observed_at":"2026-08-10T00:48:31.739472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:31.744381Z","title":"A comprehensive survey on safe reinforce- ment learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.744381Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:9f351a39b43e1807f83439023a67431f2934e5b5b51abebfb1392b498f798b78","observation_id":"b502e8d5-6717-4515-856f-c542a6985f9f","resolution":{"observed_at":"2026-08-10T00:48:31.744381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.631744Z","title":"Learning to run a power network challenge for training topology controllers,","venue":null,"work_id":"96799dcd-cf86-4651-bae8-edee9a4cc6e3","year":2020},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.749156Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:0ef8dcc950122832faafbe1cf770d979779cb61def8280fd7e714e05ca8c1d0d","observation_id":"e73112fe-69e6-475e-83e4-dba79ea23a0e","resolution":{"observed_at":"2026-08-10T00:48:34.725677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.536972Z","title":"Challenges of real-world reinforcement learning: definitions, benchmarks and analysis,","venue":null,"work_id":"a8dd8766-ebce-47c8-9173-7c9c959a6dbe","year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.754294Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:71840986226d84fea4182ed46524f30cceec12b55720d8aae1de5877391a955f","observation_id":"096df9b7-499f-45ef-8b43-912f17e834c4","resolution":{"observed_at":"2026-08-10T00:48:34.580303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:31.759043Z","title":"Constrained policy optimization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.759043Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:cb9aab10165bcbbe36ba47b5d8dc40f5de5699ce1a3b81e3ea04cda8be30ae43","observation_id":"2c372663-fc1a-447c-ac08-4a5f29d452ef","resolution":{"observed_at":"2026-08-10T00:48:31.759043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.510956Z","title":"Safe reinforcement learning in constrained markov decision processes,","venue":null,"work_id":"9a948250-d5ca-4adc-9ca0-2d388aa81a15","year":2020},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.763786Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:3980fe9666b1a1133e4cf862dbaf962b1e4ab9338de7009b4146b4d769d9ed49","observation_id":"2a4e7517-7172-4e4a-9d66-76d9eb1e4c36","resolution":{"observed_at":"2026-08-10T00:48:34.515932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.496725Z","title":"Density constrained reinforcement learning,","venue":null,"work_id":"d31848a9-9055-4824-936d-5947722a15a8","year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.769142Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:084274d1c3067967e93fe2a3329b0ad4778681afb874ad313960ab672f6a9793","observation_id":"16eaab49-7206-4ea8-a3f6-aa7101110125","resolution":{"observed_at":"2026-08-10T00:48:34.501166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.480784Z","title":"Cem: Constrained entropy maximization for task-agnostic safe exploration,","venue":null,"work_id":"2c98407b-6dd3-4a1a-a3bc-a436e0d7c186","year":2023},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.774386Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:7ffb64ec4bcc1d6aa9ae189f1214cf929b6a8ad6140bb1303d172ccdd468382e","observation_id":"5f59d091-fdf1-4802-85d4-e46607fa6fa0","resolution":{"observed_at":"2026-08-10T00:48:34.486541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.465240Z","title":"Learning constraints from demon- strations,","venue":null,"work_id":"6a605342-8e33-42cc-b5c3-af069de35166","year":2020},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.779376Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:012c9c001cafcc0262656748993d019fe91e8fa92b9c08cd72fa6e531c335721","observation_id":"a1030c76-5be3-429f-8d8d-a443745378ac","resolution":{"observed_at":"2026-08-10T00:48:34.470519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.449643Z","title":"Inverse constrained re- inforcement learning,","venue":null,"work_id":"92f9507d-24fe-430e-8d9a-4fcd71095447","year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.852221Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:6ad65e355ccbbabf895c0a8cc93a5d6a1957f1db1139fab9cacb153d8e594609","observation_id":"1f3df500-4e79-4011-9b80-cd7faaedc697","resolution":{"observed_at":"2026-08-10T00:48:34.454623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.433244Z","title":"Learning shared safety constraints from multi-task demonstrations,","venue":null,"work_id":"681d04c2-3024-4a20-a3ef-ddc39c99e626","year":2024},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.909696Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:4c90a1fba5347a7a1648089f4296c68c0000e65718b297ddf40c69add5b1ac45","observation_id":"1a9f6cfc-0b33-4415-ad61-d3857dffed08","resolution":{"observed_at":"2026-08-10T00:48:34.438443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.417910Z","title":"Conditional value-at-risk for elliptical distributions,","venue":null,"work_id":"580ae3ee-3bfa-4ec1-be1e-5a4357758b52","year":2016},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:31.993829Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:496f7b8ba33df88a805e0c2659af53f4b4d4cecc8044afd76f4d4a1678013bdf","observation_id":"19a93881-4d3d-465f-a7f1-0cc4bebc9677","resolution":{"observed_at":"2026-08-10T00:48:34.422642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.256160Z","title":"Worst cases policy gradients,","venue":null,"work_id":"be8f954a-ea67-4810-95e4-48b53f81902b","year":2020},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.117853Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:ff3e7adaee39b70e7ada8e331220000f0457e14ba7da23912f9864dcc72c14c7","observation_id":"f8c842f9-f593-4935-8117-231d643b78ab","resolution":{"observed_at":"2026-08-10T00:48:34.367155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.111928Z","title":"Wcsac: Worst-case soft actor critic for safety-constrained reinforcement learn- ing,","venue":null,"work_id":"04506b56-fb8c-40c9-8d9b-dc3a1bd1a283","year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.122955Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:770a993a7a35b5086a73c6cc5eea86c4b204e91a54a5b75fd69a4948e1c4d537","observation_id":"ee9d3446-804a-47ff-ac1a-70764afbcd6c","resolution":{"observed_at":"2026-08-10T00:48:34.176402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.084253Z","title":"Task-agnostic exploration in reinforce- ment learning,","venue":null,"work_id":"6e3a4946-cb1b-474b-8078-a91c9808d7db","year":2020},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.127213Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:fc5ec146b7ef8a891b1ec98140d7c0299643758cefe021fa93939b9cbf234d02","observation_id":"49f5489f-2fa0-4948-bbc2-5e4e295899ce","resolution":{"observed_at":"2026-08-10T00:48:34.088809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.068233Z","title":"Learning safety constraints from demonstrations with unknown re- wards,","venue":null,"work_id":"816267cb-4ff3-4a87-bece-34f41ebb60f1","year":2024},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.131439Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:44ed30c161f4b4cee1bbd5104cb8e52de3bd7f7251c3934d7944b1b2b1658a05","observation_id":"2396b1d5-c093-4948-aa9b-1f8e51078b4e","resolution":{"observed_at":"2026-08-10T00:48:34.073630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.051086Z","title":"Train hard, fight easy: Robust meta reinforcement learning,","venue":null,"work_id":"cc76f456-5bcf-4886-93eb-066a90e2226c","year":2024},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.135777Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:e8a7a03a87c8cdcd38feb2b68c010409de50a4c7073ad252535085a07ef0ff82","observation_id":"f9918328-d66d-430b-b5ea-dd509971e848","resolution":{"observed_at":"2026-08-10T00:48:34.057044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1507.00814","last_updated":"2015-11-19T22:40:30Z","snapshot_observed_at":"2026-08-18T02:29:03.842532Z","submitted_at":"2015-07-03T04:11:15Z","title":"Incentivizing Exploration In Reinforcement Learning With Deep Predictive Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.00814","snapshot_observed_at":"2026-08-10T00:48:32.140574Z","title":"Incentivizing exploration in reinforcement learning with deep predictive models,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.140574Z"},"links":{"cited_paper":"/paper/1507.00814","citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:e815b9ef4a9785cedcae0df0fe7ac94b4870e900390a8736d49a3d82855a6153","observation_id":"0cabb9a8-e59f-45a7-8ccd-03f3d6dcfbc7","resolution":{"observed_at":"2026-08-10T00:48:32.140574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.034654Z","title":"Reward-free exploration for reinforcement learning,","venue":null,"work_id":"596355f7-4b25-4943-afbb-658e7aaed970","year":2020},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.146002Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:9fe59d78c00806c52e58aacd0e0c0c78147eec03a0f6ed21eb144e3a18dc2b8f","observation_id":"f0b238c4-f198-4e9f-ae0e-85ed1b072020","resolution":{"observed_at":"2026-08-10T00:48:34.039793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.017206Z","title":"Provably efficient maximum entropy exploration,","venue":null,"work_id":"63a107ad-c8e6-4420-96e3-44ab897cce15","year":2019},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.150961Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:12807f22308790dc587dcc23c8ebe8f293bc9e87e60acd4da45111734fe70a81","observation_id":"a4fd1942-f300-4043-a1ec-0499e23eb5dc","resolution":{"observed_at":"2026-08-10T00:48:34.022731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05274","last_updated":"2020-02-28T16:02:59Z","snapshot_observed_at":"2026-08-21T03:01:35.903843Z","submitted_at":"2019-06-12T17:57:02Z","title":"Efficient Exploration via State Marginal Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05274","snapshot_observed_at":"2026-08-10T00:48:32.155017Z","title":"Efficient exploration via state marginal matching,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.155017Z"},"links":{"cited_paper":"/paper/1906.05274","citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:b4b24fc6db69ffcc9309f4583b15251d851ea2f132eded7e3a9002ba19d62e05","observation_id":"46912794-0df4-4cfd-b9fc-38c387092c1b","resolution":{"observed_at":"2026-08-10T00:48:32.155017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:34.001238Z","title":"Constrained cross-entropy method for safe reinforcement learning,","venue":null,"work_id":"61d95481-446d-4594-b087-2ac5e24576a0","year":2018},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.160225Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:5e6f7e1d9bb1476aa3a66871e64c12cd0596e5f4cacc0f07aca9d6e0228a947e","observation_id":"501e5005-bd15-45ff-98e7-714bcc3fe0c9","resolution":{"observed_at":"2026-08-10T00:48:34.005886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.984954Z","title":"Learning to fly,","venue":null,"work_id":"421ac633-1ee2-4607-99f6-549ac81aa1e1","year":1992},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.165376Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:1b4646fca8a8b5eba447fa563c98469a64019a40d299aec6d855f43835360cf3","observation_id":"8b45eaf0-623c-4d42-b538-8b8df7a11f90","resolution":{"observed_at":"2026-08-10T00:48:33.990268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.969740Z","title":null,"venue":null,"work_id":"8b4ab48f-3838-44e3-9142-cabd7ad6fe47","year":1994},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.169801Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:05d54af10725c50cfc5c10412d474a1d4ad29fe4408be2b040fd8c57f2fb0fc0","observation_id":"936e9e12-8eab-4a6e-ba98-ed91ee1054d6","resolution":{"observed_at":"2026-08-10T00:48:33.973898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:32.173834Z","title":"Apprenticeship learning via inverse rein- forcement learning,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.173834Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:c9e72eb7d5741a4393bb3c763952db1562b064b3f2f43892b2c61f6168578b90","observation_id":"3afd8016-a712-4b1d-8e5d-b78f1278f0f6","resolution":{"observed_at":"2026-08-10T00:48:32.173834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:32.178103Z","title":"Generative adversarial imitation learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.178103Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:61b17e10eeb725c75e6098269d18355b73a733450f3dfc571a408019eadc82b9","observation_id":"b225c898-29e6-4348-a94b-32eaa65f2a24","resolution":{"observed_at":"2026-08-10T00:48:32.178103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.933860Z","title":"Learning robust rewards with adverserial inverse reinforcement learning,","venue":null,"work_id":"e57c755d-2d69-4508-b1d6-e601487cbcf3","year":2018},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.182217Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:fbee25741da750ea841265953e3210f7391657b8a0c7bb6164052fbe697d9a8c","observation_id":"75b8c992-6b1e-4709-a1be-9e0eeed87ed5","resolution":{"observed_at":"2026-08-10T00:48:33.939014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.893393Z","title":"Iq-learn: Inverse soft-q learning for imitation,","venue":null,"work_id":"48de1b66-8359-406e-965c-6b347d57065f","year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.186768Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:0ff4240348272f8a6ff3364e1b68a2ceb3c4ed219e4473442e92b482f371d648","observation_id":"fa645a3a-0e85-4e29-8d65-0e5fea072805","resolution":{"observed_at":"2026-08-10T00:48:33.923032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:32.191737Z","title":"Maximum entropy inverse reinforcement learning","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.191737Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:409c3e7d5319995299dc643d0a3c1b007c4841ed4d77d516a1e8d5706652e88b","observation_id":"1816aead-b213-472b-a638-1e29af456356","resolution":{"observed_at":"2026-08-10T00:48:32.191737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.754495Z","title":"Bridging the gap between imitation learning and inverse reinforcement learning,","venue":null,"work_id":"7f4b1018-3937-42e4-8055-b5b537021be0","year":2016},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.196399Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:a490518bda23844ea09bb5c2a30b718964863c58f9e9fcdfdbc01ad8edd6dcc4","observation_id":"96faf043-56f6-454f-a84d-9e76eaea414d","resolution":{"observed_at":"2026-08-10T00:48:33.813002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.03852","last_updated":"2016-11-25T08:09:55Z","snapshot_observed_at":"2026-08-14T21:30:48.662143Z","submitted_at":"2016-11-11T20:53:45Z","title":"A Connection between Generative Adversarial Networks, Inverse Reinforcement Learning, and Energy-Based Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.03852","snapshot_observed_at":"2026-08-10T00:48:32.201198Z","title":"A connection between generative adversarial networks, inverse reinforcement learning, and energy-based models,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.201198Z"},"links":{"cited_paper":"/paper/1611.03852","citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:8bff3e96eb1503d40c5967a2a4a48e5acff4b18570d1800e7a7a19435282b38e","observation_id":"f68e6c6e-c5ea-496a-8125-565e9aa65e62","resolution":{"observed_at":"2026-08-10T00:48:32.201198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05477","last_updated":"2020-04-30T00:13:16Z","snapshot_observed_at":"2026-07-06T08:21:07.968983Z","submitted_at":"2019-09-12T06:38:46Z","title":"Maximum Likelihood Constraint Inference for Inverse Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05477","snapshot_observed_at":"2026-08-10T00:48:32.206554Z","title":"Maximum likelihood constraint inference for inverse reinforcement learning,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.206554Z"},"links":{"cited_paper":"/paper/1909.05477","citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:6901d1e33d5dbe452553560ae950608b235966a532792cac0d540308c4e06f95","observation_id":"80cb5e59-5b8b-49eb-86b1-83b401e1e587","resolution":{"observed_at":"2026-08-10T00:48:32.206554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.635586Z","title":"Learning constraints from demon- strations with grid and parametric representations,","venue":null,"work_id":"bb4eeda2-fb86-47d1-959a-ca112273bd16","year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.211728Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:efd4ca5b5177b35d3520fb5667cf7935ff1fe4ed0f1bdb40a55b490ce1960b40","observation_id":"fd1ded94-c38f-457b-bc72-e9148432ad45","resolution":{"observed_at":"2026-08-10T00:48:33.715976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.591120Z","title":"Gaussian process constraint learning for scalable chance-constrained motion planning from demon- strations,","venue":null,"work_id":"76a72a37-200c-4417-a504-0dcd0e541e16","year":2022},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.216974Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:f02029436c08c7c554b9b9cb28c967f59e45ef13ed889ab4dbf160435188d250","observation_id":"573c1ce4-7b3d-4253-b4f9-f626d4ed3881","resolution":{"observed_at":"2026-08-10T00:48:33.596229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.575568Z","title":"Learning soft constraints from constrained expert demonstrations,","venue":null,"work_id":"e0049605-afb0-49d3-a355-c171f4951f80","year":2023},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.222108Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:ddcff86a328606c6a2ee2ce3367aff8b639eb3deeec49ca84e74cd1a206d556c","observation_id":"1b5e8fdf-dd69-4838-92cb-de460f28a0b2","resolution":{"observed_at":"2026-08-10T00:48:33.580418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.559437Z","title":"Uncertainty-aware constraint inference in inverse constrained reinforcement learning,","venue":null,"work_id":"b3d34a87-23af-4929-a8d2-42448b2b3e76","year":2023},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.269252Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:a68968b4bb039d4df3a90b6e690c5fbb4f7bb361da7e268d2b75630e204977b0","observation_id":"1423062b-be2c-489e-8bdd-aea74a493fd5","resolution":{"observed_at":"2026-08-10T00:48:33.564589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16782","last_updated":"2024-06-24T16:44:45Z","snapshot_observed_at":"2026-08-16T13:40:03.658231Z","submitted_at":"2024-06-24T16:44:45Z","title":"Confidence Aware Inverse Constrained Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16782","snapshot_observed_at":"2026-08-10T00:48:32.306249Z","title":"Confidence aware inverse constrained reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.306249Z"},"links":{"cited_paper":"/paper/2406.16782","citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:882ba3366b992be74775f5b9250ea9e7869e9d8e000308b1bcff533d24e297f8","observation_id":"b2a25c70-9fb6-4c3b-8337-364794e6982c","resolution":{"observed_at":"2026-08-10T00:48:32.306249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.543622Z","title":"Inverse constraint learning and gen- eralization by transferable reward decomposition,","venue":null,"work_id":"0b891aa4-873b-476a-8770-dacd74e6303d","year":2023},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.342237Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:7f6ad5b5a9d21d60fbb991980213b3d6fbef44eb34b81d70ef32679cfdd9c049","observation_id":"cc73d1fd-dd46-48ca-829f-9081f2c4c89f","resolution":{"observed_at":"2026-08-10T00:48:33.548668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:32.455776Z","title":"Altman, Constrained Markov decision processes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.455776Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:9c091d5a57c8768bac0c7eaf0775f4efa7f8f35f9e3d2c2f8edaf93923352913","observation_id":"27802c63-be74-4062-87c6-6c7945e75c81","resolution":{"observed_at":"2026-08-10T00:48:32.455776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01708","last_updated":"2019-10-03T20:15:55Z","snapshot_observed_at":"2026-08-14T05:35:42.838302Z","submitted_at":"2019-10-03T20:15:55Z","title":"Benchmarking Batch Deep Reinforcement Learning Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01708","snapshot_observed_at":"2026-08-10T00:48:32.560569Z","title":"Benchmarking safe exploration in deep reinforcement learning,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.560569Z"},"links":{"cited_paper":"/paper/1910.01708","citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:c14a1a622a1b739a8c61127f6fd955d58ceaf2ad37a84305ba4a452d7aba807f","observation_id":"db4b5a4d-393b-48bc-b55e-c00e0b9c856a","resolution":{"observed_at":"2026-08-10T00:48:32.560569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00220","last_updated":"2019-03-01T09:23:48Z","snapshot_observed_at":"2026-08-21T03:57:54.552103Z","submitted_at":"2019-03-01T09:23:48Z","title":"Approximate Robust Control of Uncertain Dynamical Systems","version":1},"cited_work":{"arxiv_id":"1903.00220","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.00220","snapshot_observed_at":"2026-08-10T00:48:32.846436Z","title":"Approximate Robust Control of Uncertain Dynamical Systems","venue":"cs.SY","work_id":"f7b911b8-5c69-4ad4-92c8-c473d953478e","year":2019},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.651094Z"},"links":{"cited_paper":"/paper/1903.00220","citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:47981bb74e4dd53b888754251b1c3652726aa426620bf1a03f04da703d645f44","observation_id":"21b481c7-6aa3-4a04-ab70-bd745ffb3136","resolution":{"observed_at":"2026-08-10T00:48:32.854221Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.516773Z","title":"Bayesian methods for constraint inference in reinforcement learning,","venue":null,"work_id":"bdb179bb-f59f-4189-9e78-0c7cc414638d","year":2024},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.669783Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:eda052eaa3aaa62c3fa755c6042159d34045f937aa132a26084bad95f3758ce2","observation_id":"c3efdc1a-2d29-4ed2-9928-c5a8d085c1e7","resolution":{"observed_at":"2026-08-10T00:48:33.522112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.500858Z","title":"Risk-sensitive inverse reinforcement learning via coherent risk models","venue":null,"work_id":"e9fe60fe-59a3-4b36-97ea-9bc32cc743aa","year":2017},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.684075Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:e14c6ce5368c440d392194b40cda1b4c3358ff46f1c80f10de6939accd44c228","observation_id":"2a5dbb09-8942-4ec3-8318-6551f0845769","resolution":{"observed_at":"2026-08-10T00:48:33.505778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.480760Z","title":"Benchmarking constraint inference in inverse reinforcement learning,","venue":null,"work_id":"e45d4e78-fb36-40c2-9224-695b10e1e93f","year":2023},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.690639Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:847f175c2f3d261def7cbc19c5a43ddd677595bef41f2dde19ba536ab18dc680","observation_id":"a0cbd5af-f9a4-4862-814c-e8e6f8d22f31","resolution":{"observed_at":"2026-08-10T00:48:33.489286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.463039Z","title":"Near- est neighbor estimates of entropy,","venue":null,"work_id":"79ef1dc9-a5db-49f5-96f9-00a28c442ebc","year":2003},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.701007Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:a38d5359693fe1ef7edea7ee237d52312c0397095daba38a1a5f263d9596c0bb","observation_id":"7150cc6a-b9b4-4b74-9a5e-8176cd2838e0","resolution":{"observed_at":"2026-08-10T00:48:33.469520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.408059Z","title":"Particle based probability density fusion with differential shannon entropy criterion,","venue":null,"work_id":"b988953d-cbab-41e7-ba4b-5441da8806a0","year":2011},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.709316Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:d8a5c78f04671bf68cf2db72026402322e3dad5564a5958b4c70bf667c012092","observation_id":"c899864f-9de5-4213-a0f4-ef36e355e6e6","resolution":{"observed_at":"2026-08-10T00:48:33.429642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.303271Z","title":"Task-agnostic exploration via policy gradient of a non-parametric state entropy estimate,","venue":null,"work_id":"9df96731-357b-4fed-b7ae-8c6a493b42a0","year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.721815Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:73f507ec231abf61c2b0d69c32aa351624a5830877da4704fa2f79784fcb03e7","observation_id":"1da520f0-4726-42aa-bf2a-1a6e291dd466","resolution":{"observed_at":"2026-08-10T00:48:33.374367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.11074","last_updated":"2018-12-26T11:09:40Z","snapshot_observed_at":"2026-08-14T19:10:15.765536Z","submitted_at":"2018-05-28T17:31:11Z","title":"Reward Constrained Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.11074","snapshot_observed_at":"2026-08-10T00:48:32.728968Z","title":"Reward constrained policy optimization,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.728968Z"},"links":{"cited_paper":"/paper/1805.11074","citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:4b4794b0667248f602f29b2386ee34076f147bd387b2921d91ac9ec79ccba0ca","observation_id":"1eaa7da7-30cd-4d05-902e-ae9a0c322804","resolution":{"observed_at":"2026-08-10T00:48:32.728968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.108125Z","title":"An environment for autonomous driving decision- making,","venue":null,"work_id":"0a234261-975d-4838-a918-25356a2777f4","year":2018},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.734110Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:6143ec0df5037df39a8ff0ba16713dc4b86778b3ebebbca7fed7f7ef8e93b359","observation_id":"bcf0f65e-4bce-42be-beee-e20cd5829ec7","resolution":{"observed_at":"2026-08-10T00:48:33.235606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-10T00:48:32.739075Z","title":"Openai gym,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.739075Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:ed35a5817759fdb530f17825ba72fe0c0065edd82ed5b5f7da7b47911b1ce3af","observation_id":"1cc0b4a2-166f-4fe4-a896-a1de0e1827b2","resolution":{"observed_at":"2026-08-10T00:48:32.739075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-10T00:48:32.744343Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.744343Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:ee51212aee23e37489638e90d29d4c94a411d802ebd91df928e8acbc638f71d5","observation_id":"a3c275c2-1d46-4086-94d7-f557ac3a4e64","resolution":{"observed_at":"2026-08-10T00:48:32.744343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:32.749342Z","title":"Constrained differential optimization,","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.749342Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:b61a0a55969dcfa3903623f0758f0b1018509dd2772b0f6f073746ac5c8179ff","observation_id":"c6810a24-0bac-4704-8bd5-de1bad7855a6","resolution":{"observed_at":"2026-08-10T00:48:32.749342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T00:48:33.065057Z","title":"Controlled text gen- eration as continuous optimization with multiple constraints,","venue":null,"work_id":"c454bde3-2949-4a60-8e0f-bd6af03a9e54","year":2021},"citing_paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T00:48:32.753805Z"},"links":{"citing_paper":"/paper/2501.18086"},"observation_digest":"sha256:8e295d968bd9544deca7461b0362bfe35609099cf6f76ae5e9106157ee22106c","observation_id":"a6d67648-b7bf-4c36-935d-b8118952f541","resolution":{"observed_at":"2026-08-10T00:48:33.069704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.18086","last_updated":"2025-01-30T01:56:07Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T21:38:44.458850Z","submitted_at":"2025-01-30T01:56:07Z","title":"DIAL: Distribution-Informed Adaptive Learning of Multi-Task Constraints for Safety-Critical Systems"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":40},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2501.18086."}