{"as_of":"2026-08-08T03:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1e1d02f9d4d4719d168d5dead65a1cf892144a7c33e4f0b64851a5dfa413ee03","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:50:37.183184Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.21026/citation-record","integrity":"/paper/2505.21026/integrity","json":"/paper/2505.21026/citation-record.json","paper":"/paper/2505.21026"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:41.105686Z","title":"A review on reinforcement learning: Introduction and applications in industrial process control,","venue":null,"work_id":"8c3875b9-de42-4a72-a202-7d1150514da1","year":2020},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:35.620357Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:6961e3dae185087ac3ab8577b83917c7a915bb39e1948a2093ce3314dabdddfc","observation_id":"fb1864d0-0080-4fd7-9f71-90b69333e83b","resolution":{"observed_at":"2026-08-07T13:50:41.176542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:40.888902Z","title":"Reinforcement learning – overview of recent progress and implications for process control,","venue":null,"work_id":"a1172cfa-a7b1-4838-83de-1fbf769ec4c8","year":2019},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:35.686265Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:8e6b0acc3c93fd2f1aad83ec407f73e2ba72af6c745274fb3f896e49387e93ba","observation_id":"91c86fd5-92bd-4c30-96a7-b9e761ccc91e","resolution":{"observed_at":"2026-08-07T13:50:41.030021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:40.735252Z","title":"Accelerating reinforcement learning with case-based model-assisted experience augmentation for process control,","venue":null,"work_id":"e64a48a7-cfa3-4ef7-9a6a-f024f9cc97c3","year":2023},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:35.778385Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:05df9138988bebd68bbdd04c93ef8a9f180fe3040dec8dd72657608e371a420e","observation_id":"3eceee6e-c1f0-4c42-80dc-bd777ce3d2fe","resolution":{"observed_at":"2026-08-07T13:50:40.791614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:40.539904Z","title":"Surrogate empowered Sim2Real transfer of deep reinforcement learning for ORC superheat control,","venue":null,"work_id":"73318b1e-b2f3-4d5d-9ae7-15c6911d490a","year":2024},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:35.869001Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:2fcdb7a44de0c3d0e100950bd4b192a464245f18256a02ae54ba5e8bdf864155","observation_id":"691c49a2-dd08-44b4-9c2f-0a1b8f7f1fe2","resolution":{"observed_at":"2026-08-07T13:50:40.623075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:40.385941Z","title":"Event-triggered con- strained optimal control for organic rankine cycle systems via safe reinforcement learning,","venue":null,"work_id":"c2309f28-d40d-412a-b719-9ddd1e615810","year":2024},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:35.970852Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:b59aa28f8958f2ac41d22cfb60a5c32087454b1f851f337320f39312d841b2b5","observation_id":"3d5ecf44-59e9-4a17-be88-be780b3b39ef","resolution":{"observed_at":"2026-08-07T13:50:40.464024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:40.200109Z","title":"Dual-mode fast DMC algorithm for the control of ORC based waste heat recovery system,","venue":null,"work_id":"5d23c814-5622-421f-91ec-4ab939b5021b","year":2022},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.063738Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:7cbea3b75d1aedb9c79f5557e1ea44eb614edf563521cfe4703cba30005a37dc","observation_id":"2b63dea2-5657-4d05-b75e-886746c53721","resolution":{"observed_at":"2026-08-07T13:50:40.297043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:40.003600Z","title":"Accelerating reinforcement learning with local data enhancement for process control,","venue":null,"work_id":"20c9b9ff-d951-4b99-9899-859a8fd101e5","year":null},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.154906Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:b802059c01841b7610c226d3e8cc4b388a5d83763a63e8dbf034b97bad1d4df6","observation_id":"dd98dd2d-fc26-4754-b090-ac8f371fef09","resolution":{"observed_at":"2026-08-07T13:50:40.086440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:39.777168Z","title":"Controlling pressure of gas pipeline network based on mixed proximal policy optimization,","venue":null,"work_id":"47a6b5f2-e236-44dc-a656-1b63ee95fbab","year":2022},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.221129Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:af2f2fd4b62cea16302ecdb9b8c9540795b03ebc6295ddacf306017a5f6395d2","observation_id":"48544a8a-893e-405b-82bf-0ff464e0f2c8","resolution":{"observed_at":"2026-08-07T13:50:39.910881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:39.595575Z","title":null,"venue":null,"work_id":"a2188e0f-3e9c-4855-b4c2-a8138ebdf39f","year":2024},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.299145Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:a67dbf6fc000f22ca1104f545fc5ac49db334fbe6911d5125a12279ed0b61aba","observation_id":"6ccd7100-e037-4c54-8b84-a7531c1ebb2f","resolution":{"observed_at":"2026-08-07T13:50:39.690416Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:39.350124Z","title":"Using process data to generate an optimal control policy via apprenticeship and reinforcement learning,","venue":null,"work_id":"4dfd91d6-e840-4ddc-903a-888502d09a27","year":2021},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.382322Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:50046b52afe5bde25998d57d0987441986a3d2aad8e38324fec3484850591291","observation_id":"02315801-bdc5-4921-bcdc-fbc2e8fb1c5a","resolution":{"observed_at":"2026-08-07T13:50:39.444637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:39.078445Z","title":"A survey of inverse reinforcement learning,","venue":null,"work_id":"22ac7e03-3efc-4a68-8fbe-38c03c94910b","year":2022},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.461975Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:e992795e99fa4705b4eaecf5d4d59c4df42ad81399016fc92f81ba933aacbec9","observation_id":"ab33e6ff-6907-4f00-a7cc-95d50d018bc5","resolution":{"observed_at":"2026-08-07T13:50:39.257736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:38.753206Z","title":"Generative adversarial imitation learning,","venue":null,"work_id":"8438edfd-2111-4e6d-856d-52fb2b944a72","year":2016},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.551741Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:b0bb08aba5fc4e755c48b8aaeab927cfffc0d661818514ef59c1ad59476ff6aa","observation_id":"85b15980-f3ee-465f-9c4f-1830bd295885","resolution":{"observed_at":"2026-08-07T13:50:38.913849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.11248","last_updated":"2018-08-13T18:33:24Z","snapshot_observed_at":"2026-07-06T06:06:54.331476Z","submitted_at":"2017-10-30T21:22:28Z","title":"Learning Robust Rewards with Adversarial Inverse Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.11248","snapshot_observed_at":"2026-08-07T13:50:36.618567Z","title":"Learning Robust Rewards with Adversarial Inverse Reinforcement Learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.618567Z"},"links":{"cited_paper":"/paper/1710.11248","citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:27542356414269d84d1381ecbb9f39c934f9524da92d2d8ee260781e368268b7","observation_id":"a630022b-9e3d-41cd-8452-5c9a8777ac7c","resolution":{"observed_at":"2026-08-07T13:50:36.618567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00909","last_updated":"2018-05-20T20:03:59Z","snapshot_observed_at":"2026-07-06T06:37:02.085757Z","submitted_at":"2018-05-02T17:11:20Z","title":"Reinforcement Learning and Control as Probabilistic Inference: Tutorial and Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00909","snapshot_observed_at":"2026-08-07T13:50:36.694463Z","title":"Reinforcement Learning and Control as Probabilistic Infer- ence: Tutorial and Review,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.694463Z"},"links":{"cited_paper":"/paper/1805.00909","citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:ac19d5c26f48758994b7d35c43304578641f1801d4f4f0686ffb13b38ffe127f","observation_id":"d0a25fd5-3524-445d-8843-03ca3612621e","resolution":{"observed_at":"2026-08-07T13:50:36.694463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:38.382494Z","title":"Semi-supervised deep dynamic probabilistic latent variable model for multimode process soft sensor application,","venue":null,"work_id":"a7fa5538-ffca-490c-9af3-da11331e07a2","year":2023},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.744259Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:0903b2cac5a52f90adf4a0fa7e791cd8e01e1647bd56ba576c8da17d06aec445","observation_id":"25993c48-b2f3-4b02-86d3-bf29d00dea91","resolution":{"observed_at":"2026-08-07T13:50:38.559042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:38.206195Z","title":"InfoGAN: Interpretable representation learning by infor- mation maximizing generative adversarial nets,","venue":null,"work_id":"518c540a-58e9-4eea-a1ae-c4b59e1caadf","year":2016},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.787855Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:b91d08073658872d30d8acdb552cbbd724cacdd4e6c2936281fbf0ed1fb8f8f4","observation_id":"6123c6a0-5bcc-4e89-bbeb-ad21e853fd85","resolution":{"observed_at":"2026-08-07T13:50:38.298715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:36.846622Z","title":"A survey on multi-task learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.846622Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:4f6a9b968132065800d94317eb7492664ffd5e8ed5234b14962ac28d13fdac4d","observation_id":"dc7ac342-a19f-4921-93c6-8cace43f3e1f","resolution":{"observed_at":"2026-08-07T13:50:36.846622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:37.866441Z","title":"Maximum entropy inverse reinforcement learning,","venue":null,"work_id":"5d25fb91-8df2-48d8-a65f-9f76decb0050","year":null},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:36.925247Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:a65aca0bcb2763876a66a2d638aac888c05d332a6e451e4c19328c85b2972145","observation_id":"69d1c7b6-f953-46ed-acec-ef230013f1fe","resolution":{"observed_at":"2026-08-07T13:50:38.051529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:37.652298Z","title":"Meta-inverse reinforcement learning with probabilistic context variables,","venue":null,"work_id":"73cb1237-4616-4115-a9c4-7b7c812252b7","year":2019},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:37.028977Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:707d6943f06bde05962c6e10ebd5a3343aa5847cfdcbd66183e8e5d022a342cd","observation_id":"8241523d-ae10-46dd-b050-14e0d177d8d2","resolution":{"observed_at":"2026-08-07T13:50:37.764251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:50:37.454672Z","title":"Reinforcement learning for batch bioprocess optimiza- tion,","venue":null,"work_id":"51de4793-f10a-481d-8b38-1c5351ec7c3b","year":2020},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:37.116288Z"},"links":{"citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:442bc4dd26507e0678600e1e637842138e7ef45de01c8d064a7b8b2c229c7572","observation_id":"eea7620c-c0fc-471d-98a9-9d0b1d5090a5","resolution":{"observed_at":"2026-08-07T13:50:37.542930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00247","last_updated":"2025-04-22T13:05:04Z","snapshot_observed_at":"2026-07-06T17:53:23.188198Z","submitted_at":"2024-03-30T04:58:59Z","title":"Facilitating Reinforcement Learning for Process Control Using Transfer Learning: Overview and Perspectives","version":3},"cited_work":{"arxiv_id":"2404.00247","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.00247","snapshot_observed_at":"2026-08-07T13:50:37.284687Z","title":"Facilitating Reinforcement Learning for Process Control Using Transfer Learning: Overview and Perspectives","venue":"eess.SY","work_id":"2e1b9973-d349-494c-971d-8060e00fa9cd","year":2024},"citing_paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:50:37.183184Z"},"links":{"cited_paper":"/paper/2404.00247","citing_paper":"/paper/2505.21026"},"observation_digest":"sha256:6f2259326b509a6d8fb4f8ddc5abccf21ff84161a899e4ca0cd1545269d94706","observation_id":"bae350cd-7a0d-40dc-a29f-65ce76d02e5c","resolution":{"observed_at":"2026-08-07T13:50:37.341180Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21026","last_updated":"2025-05-27T11:01:00Z","latest_version":1,"primary_category":"eess.SY","snapshot_observed_at":"2026-08-07T20:50:01.859016Z","submitted_at":"2025-05-27T11:01:00Z","title":"Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2505.21026."}