{"as_of":"2026-08-19T22:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:08e4fe064bf4d1191becbf2ed768de7dacb6ed32cc21c4e01babdf28297bb603","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:35:36.141307Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14820/citation-record","integrity":"/paper/2505.14820/integrity","json":"/paper/2505.14820/citation-record.json","paper":"/paper/2505.14820"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:39.565784Z","title":null,"venue":null,"work_id":"8823ee49-35ee-47d8-80a3-281ee691c970","year":2004},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:33.586848Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:8fe21fafbcb3685e37cd9c90bc19a24a76f6538b9efe3aa92275f2404c1ae298","observation_id":"89718f58-42b5-4b34-94c5-a3ae893b2ca9","resolution":{"observed_at":"2026-08-07T15:35:39.568926Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:36.893479Z","title":"(11) where α(j) k = 1 fk(ξ)−fk( ˜ξ(j)) is the hinge slope that makes demonstration ˜ξ(j) exactly where the subdominance becomes zero","venue":null,"work_id":"4bce0c4c-f779-45aa-a59d-a8fdda0a2922","year":2023},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.994262Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:924142a55cab3f821f654fabff6414e6a3dbc0a4ff57d6d641deefdd5d7afdaf","observation_id":"b8529d1b-38a4-473c-b962-bf873ebb59cd","resolution":{"observed_at":"2026-08-07T15:35:37.000313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:39.526400Z","title":"Extrapolating beyond sub- optimal demonstrations via inverse reinforcement learning from observations","venue":null,"work_id":"d188ee6a-19d1-4960-b981-7832ed852249","year":2019},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.069702Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:4b943cfebaf363b5e2a58d75cab7034f4097965697ec1452afcdba57784c0a7a","observation_id":"567eb4dc-46ef-4eda-a3ae-c704e96e1521","resolution":{"observed_at":"2026-08-07T15:35:39.529854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:36.776876Z","title":null,"venue":null,"work_id":"4a28748f-14c4-4dd0-871d-ee65e1fd7666","year":2000},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:36.042227Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:e2ae855c244b59acf84a74dd9533c244d259df8fb861d0c00a8fcfcd44353821","observation_id":"80d3df44-a186-442c-b4ca-f83d0de777e4","resolution":{"observed_at":"2026-08-07T15:35:36.837938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11723","last_updated":"2020-11-23T16:07:38Z","snapshot_observed_at":"2026-08-16T19:12:49.794892Z","submitted_at":"2020-10-17T04:18:04Z","title":"Learning from Suboptimal Demonstration via Self-Supervised Reward Regression","version":3},"cited_work":{"arxiv_id":"2010.11723","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.11723","snapshot_observed_at":"2026-08-07T15:35:36.417779Z","title":"Learning from Suboptimal Demonstration via Self-Supervised Reward Regression","venue":"cs.RO","work_id":"f3b29f29-599c-430f-b104-99d3cd3fc2b6","year":2020},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.323405Z"},"links":{"cited_paper":"/paper/2010.11723","citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:a29090aaabe853abebabe1f03078cba98dcb475db325f813056dc57e88bd346b","observation_id":"c42fc5e4-aa07-442b-b18b-e99483566b8a","resolution":{"observed_at":"2026-08-07T15:35:36.506393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:39.404425Z","title":"Deep reinforcement learning from human preferences.Ad- vances in Neural Information Processing Systems , 30,","venue":null,"work_id":"4035bbb8-1697-49da-aaa9-9506a5157b89","year":2017},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.392724Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:32cd6a366f187688846b5614ad1392000e6db7a8bf3faea74c75b48aa99c45d7","observation_id":"0aefb1ac-c840-4de0-b9f1-c74e2a912cbd","resolution":{"observed_at":"2026-08-07T15:35:39.463498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:39.215317Z","title":null,"venue":null,"work_id":"5b11de85-6113-4b75-a2a0-b94706014d30","year":1964},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.575158Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:93ea980e12489d8848f369caacb6007948af45fe635093a2493f51389f522f0e","observation_id":"b1e1749e-267b-46a1-9646-f8560bd66cff","resolution":{"observed_at":"2026-08-07T15:35:39.273548Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:38.947436Z","title":"Superhuman fairness","venue":null,"work_id":"4c9d22e4-0b5c-41fe-b641-d80fb786117d","year":2023},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.887251Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:4108ef5d9ed1d9af576bf71aa2d66ca5a5ddc48a0ea1867a4caa5309c180e643","observation_id":"0949aa94-09fb-4491-9b86-1b12fb6d3502","resolution":{"observed_at":"2026-08-07T15:35:39.006266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:38.792531Z","title":"The magical number seven, plus or minus two: Some limits on our capacity for pro- cessing information","venue":null,"work_id":"997513df-0b05-42aa-96cd-a5471d72a464","year":1956},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.922402Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:52bf102a97061ee0f139faa950612d712b123e1473c7ff82d44c4660b3b7656e","observation_id":"4916cc7e-3ec7-457e-83f1-55342638685c","resolution":{"observed_at":"2026-08-07T15:35:38.852336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T15:35:35.319508Z","title":"Prox- imal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.319508Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:0aaf86aba70845277f748b220257839c07478fba5aa6e2d472f4a0c73012d9e9","observation_id":"18318c54-1983-4868-8572-15e048cf9704","resolution":{"observed_at":"2026-08-07T15:35:35.319508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:38.104898Z","title":"Rational choice and the structure of the environment","venue":null,"work_id":"7e8c4d3c-d234-40ae-b8c5-2c98f313b723","year":1956},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.385964Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:0b59e0b1641931c2b1f133bbb9ab4dfd9d9cc412edd779a1521b7939ce8844e6","observation_id":"9e24915e-2ea6-4a85-8970-1c1f9b214ae1","resolution":{"observed_at":"2026-08-07T15:35:38.154925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.971179Z","title":"Policy gradient methods for reinforcement learning with function approx- imation","venue":null,"work_id":"8a3cfbb4-c477-477a-a04a-24d50eb32d89","year":1999},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.430377Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:47d6aaec8072ea88b6cab39933643c2d4c7bf507e2bdc5d678947fba486db6ca","observation_id":"f1efaa88-2a2c-449d-9fc9-c4dbe255a07a","resolution":{"observed_at":"2026-08-07T15:35:38.061670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.603347Z","title":"Bounds on error expectation for support vector machines","venue":null,"work_id":"9984649b-26cb-42a0-bb26-09bc37d63875","year":2000},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.627625Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:c0f62b26e3570752e7de4113a2406a87ce0307758317f46913a37bcc29559327","observation_id":"1672cabb-1ffb-469d-acea-42e35c33b066","resolution":{"observed_at":"2026-08-07T15:35:37.669355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.464150Z","title":"Effective analysis of reac- tion time data","venue":null,"work_id":"9f8a922f-7bc5-46ab-9cda-48f9be0e38da","year":2008},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.689680Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:0a77e4ac59f755dfe73a4f6df9883e49cf6a3428dfd7998b9b5a48210d1bb13e","observation_id":"10c490d2-fb9e-4d1d-9d7e-5145c5c12264","resolution":{"observed_at":"2026-08-07T15:35:37.512584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.212769Z","title":"Imitation learning from imperfect demonstra- tion","venue":null,"work_id":"07f7433b-6c8f-4c66-8456-938f45a022ce","year":2019},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.792257Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:6c62f0943c3688876254f1230a7cc7d4402c0585afa05581d8d4bc5c2e3db3e8","observation_id":"16d40326-967d-4cf0-b49c-4b2b2396107c","resolution":{"observed_at":"2026-08-07T15:35:37.275972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14754","last_updated":"2022-01-26T16:56:07Z","snapshot_observed_at":"2026-08-18T08:49:28.354149Z","submitted_at":"2021-10-27T20:29:38Z","title":"Confidence-Aware Imitation Learning from Demonstrations with Varying Optimality","version":2},"cited_work":{"arxiv_id":"2110.14754","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.14754","snapshot_observed_at":"2026-08-07T15:35:36.206435Z","title":"Confidence-Aware Imitation Learning from Demonstrations with Varying Optimality","venue":"cs.LG","work_id":"990755f4-6bab-41f0-a414-6ae40f9e0efd","year":2021},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.864821Z"},"links":{"cited_paper":"/paper/2110.14754","citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:43e973574d056697b26c91c5a8ecae82d4f34408d42cec594cb83878b3e3b67f","observation_id":"ce191812-b140-4123-873b-26bfd2ca04b7","resolution":{"observed_at":"2026-08-07T15:35:36.315940Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.076490Z","title":"Ziebart, Sanjiban Choudhury, Xinyan Yan, and Paul Vernaza","venue":null,"work_id":"8957a00f-dfc8-473b-8928-a4a608c8b4f0","year":2022},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.955448Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:461f1ee3c565640d3ef7d0392cb22f44140cd81c0029e059cc1d6debee8256d3","observation_id":"6f06fde6-2ef1-489f-ac1e-37ac0d3c89a2","resolution":{"observed_at":"2026-08-07T15:35:37.111038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:36.603454Z","title":"This toy examples gives us a peek into the source of this degeneracy","venue":null,"work_id":"b18fd142-346e-4c92-811a-0a80f1fe9e24","year":2021},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:36.141307Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:7f94978f01fd8fd070fe04475447f846d6df1c35742eb72aa323b10a29779e4e","observation_id":"30bbfac7-c60f-4310-9077-6ee7ed4c0217","resolution":{"observed_at":"2026-08-07T15:35:36.623491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:39.536183Z","title":"Openai gym,","venue":null,"work_id":"c1203b35-d8bb-4ed6-8ca8-6db7740c47b2","year":2016},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":1952,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:33.995624Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:f081c1d8730915c8e4e8e07ff462826a4776e0b7438e0e012cb4d41990f719d6","observation_id":"642a20e8-45f4-4375-83c5-dfceb3bae3c2","resolution":{"observed_at":"2026-08-07T15:35:39.539257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:38.631429Z","title":"Algorithms for inverse reinforcement learning","venue":null,"work_id":"2a315b4c-fa14-4488-a302-f44df9995c18","year":2000},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":1956,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.961395Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:2f3f7d721d1dc967990123a444154cc9f28f02a1023e5fc42d48285ebe0e6245","observation_id":"0d4d7fbd-d284-4517-9baf-3c8f4726b1a2","resolution":{"observed_at":"2026-08-07T15:35:38.701008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:39.098886Z","title":"Advantages of robotic assistance over a manual approach in simulated subretinal injections and its relevance for gene therapy","venue":null,"work_id":"c3e68ba7-d364-4240-98d4-30dc9871ea66","year":2023},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":1964,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.681688Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:c41308a00947b2b526fab5e8ab0965f1ae7b31faec5a5495872b189cd59613a8","observation_id":"671cb537-3c3d-4e11-a207-10562b30f609","resolution":{"observed_at":"2026-08-07T15:35:39.172429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:38.395102Z","title":"Direct preference optimization: Your lan- guage model is secretly a reward model.Advances in Neu- ral Information Processing Systems, 36,","venue":null,"work_id":"7b0c1972-f987-4b6d-a040-f2f9486e7400","year":2024},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.178015Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:0ee050831836e563c87b033d86eeae6a343d41a59c8e064b02ee709ed2538e3a","observation_id":"0ab965ba-710a-47e6-b237-3b72cf175061","resolution":{"observed_at":"2026-08-07T15:35:38.455155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.867139Z","title":"A game-theoretic approach to apprenticeship learning","venue":null,"work_id":"16f2b053-274a-4338-a9b2-60e9347bc803","year":2007},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.463615Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:da108935be89e9df79acbe9e33bc91d7b2fbc14e1965fa323e5ccc35880abdfa","observation_id":"6282de34-0edc-4f95-9407-fa405ce5b3e9","resolution":{"observed_at":"2026-08-07T15:35:37.901702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.06711","last_updated":"2018-11-16T09:06:54Z","snapshot_observed_at":"2026-08-14T17:57:56.417407Z","submitted_at":"2018-11-16T09:06:54Z","title":"An Algorithmic Perspective on Imitation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.06711","snapshot_observed_at":"2026-08-07T15:35:35.024041Z","title":"An algorithmic perspective on imitation learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.024041Z"},"links":{"cited_paper":"/paper/1811.06711","citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:58464e78134a3dccf86dda3fb5275c67cfe29ad75e8d4c31d6a901a7c5258280","observation_id":"d305f85c-9281-4f78-bc05-001d56c2d282","resolution":{"observed_at":"2026-08-07T15:35:35.024041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-07T15:35:33.685232Z","title":"Concrete problems in ai safety","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:33.685232Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:e1d8622357096f3aa486997b0a83db78d42a3d0ede16d6c783fbfacf1ee1fd85","observation_id":"762903c9-13cc-46c7-b187-8de77b6eea95","resolution":{"observed_at":"2026-08-07T15:35:33.685232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.710292Z","title":"Robust imitation learning from noisy demonstrations","venue":null,"work_id":"a6e34e7e-659a-408c-8508-bb009afccfc8","year":2021},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.567714Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:c7edd3be1ec6043e4c927646a5789758cfe2268c11beefdefe8b3a740a88d0f7","observation_id":"c34949cc-d14b-4b3d-a549-cebc43e89063","resolution":{"observed_at":"2026-08-07T15:35:37.752139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:37.316333Z","title":"A survey of preference-based reinforcement learning methods","venue":null,"work_id":"4ed7db1c-e327-4a69-b82d-fba16c8b91a2","year":2017},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.743587Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:ec6674f28d6e6020e6af9f5c64d434880662ea17f1ec8b73a5d904f6681c9f68","observation_id":"8b910c09-371c-47ce-8d93-3f98899132e8","resolution":{"observed_at":"2026-08-07T15:35:37.394464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:39.555830Z","title":"Pitfalls of learning a reward function online","venue":null,"work_id":"88ae98db-c71c-4332-a509-2d7d0a63e002","year":2021},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:33.823094Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:8f6adcff7471a234c6a477556fbe12dc56aa3a98badc9b28e60e2e5e0f777ff9","observation_id":"c437e437-e3eb-4c32-9b1b-fd886c24c99d","resolution":{"observed_at":"2026-08-07T15:35:39.559053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:39.342217Z","title":"Learning robust rewards with adverserial inverse rein- forcement learning","venue":null,"work_id":"d5e83ef9-407b-4944-98ef-1c7ebd5aaa85","year":2018},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.478420Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:e96a4e6ab5b7bcc791ff56939b1afb394d36153b145b5aa23fcc97307452cb95","observation_id":"f4e82e5f-f619-4c75-978f-4a1cc2924837","resolution":{"observed_at":"2026-08-07T15:35:39.372211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:38.512254Z","title":"Pomerleau","venue":null,"work_id":"e536a80d-5a2c-40c8-b12c-47d59dfd2cdc","year":1991},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.079168Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:a59a8a34313efba94efef8609395525644caedaef74202bebd0bcfe3daaaf453","observation_id":"ce59d8ef-055c-4a50-b2c8-db239f1e7664","resolution":{"observed_at":"2026-08-07T15:35:38.560191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:39.513944Z","title":"Brown, Wonjoon Goo, and Scott Niekum","venue":null,"work_id":"5d4e2ded-8d1d-4fd7-acb3-a17bf537dec9","year":2020},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.153521Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:a07006a603116d86d0719075469bbe13e8fb4df725dfc652ee6e73455fb63827","observation_id":"d3cc2954-95e1-476c-b6ae-55442ce90f2f","resolution":{"observed_at":"2026-08-07T15:35:39.516949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:39.504753Z","title":"Distance minimization for reward learn- ing from scored trajectories.Proceedings of the AAAI Con- ference on Artificial Intelligence, 30(1),","venue":null,"work_id":"d8e02432-9cc0-4886-8610-dea9082b3033","year":2016},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.247089Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:8355f015b3e10885f347184ae8084962a8ab5e310b6de8522b6f8f47f690f541","observation_id":"52eb1291-eb47-49ac-9cc2-b91efbc3935f","resolution":{"observed_at":"2026-08-07T15:35:39.508110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:39.545894Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":"c0de2f01-8c87-48bc-abb2-02a3a6122363","year":1952},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:33.935001Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:121e6681d55a4f6b7fff21bb4cc56d91efcca43722179677da0e8237e96806d5","observation_id":"fedb857e-e6b1-4e19-9f48-407a89167f90","resolution":{"observed_at":"2026-08-07T15:35:39.549659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-07T15:35:34.756014Z","title":"Offline reinforcement learning: Tu- torial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:34.756014Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:db66c1ea6a054b53f5e3f32dff716e65b4f9b8384a213c38b12ee596005bc4a4","observation_id":"fffdea06-e94a-4121-a594-bed435bdfef7","resolution":{"observed_at":"2026-08-07T15:35:34.756014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:35:38.240694Z","title":"Stable-baselines3: Reliable reinforcement learning implementations","venue":null,"work_id":"5d19c2b2-13da-4a30-ab8c-7c4692541f2c","year":2021},"citing_paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:35:35.243155Z"},"links":{"citing_paper":"/paper/2505.14820"},"observation_digest":"sha256:649826b666380ce47228e5aa3ba0bb1f8d69fe79ad06c25873db7521b78222a1","observation_id":"74fe25e3-1786-45ec-8ad7-01aeff79e74c","resolution":{"observed_at":"2026-08-07T15:35:38.291195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14820","last_updated":"2025-05-25T16:55:31Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T06:02:00.265218Z","submitted_at":"2025-05-20T18:36:52Z","title":"Imitation Learning via Focused Satisficing"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":2,"verified_fuzzy":26},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2505.14820."}