{"as_of":"2026-08-14T00:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:778cff61ae0e05a49787d0ce7be2a2b53247283bc29e08d75a2932b5fb334fa1","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:56:44.297886Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.00381/citation-record","integrity":"/paper/2501.00381/integrity","json":"/paper/2501.00381/citation-record.json","paper":"/paper/2501.00381"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:45.046781Z","title":"Human Compatible: Artificial Intelligence and the Problem of Control","venue":null,"work_id":"0d710faf-bc64-4ad4-9ee5-2cb35579ed2a","year":2019},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.174953Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:efc028c2d7118e14c3167884a1008200fdf37ca2be6a84a31ea6811c55756e48","observation_id":"a73649d9-245e-440e-9ee3-08a4a786a07a","resolution":{"observed_at":"2026-08-10T22:56:45.052130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:45.031366Z","title":"Active learning for reward estimation in inverse reinforcement learning","venue":null,"work_id":"7b0fe50c-7150-4a3d-a52c-4dc520f763c1","year":2009},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.181767Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:8d3af50f082e7c439101dcf55ee84d481e0f39a9487b4ced2b8344a02eb87811","observation_id":"d55e18c0-50d2-4b12-8c4b-afd1d4db1c30","resolution":{"observed_at":"2026-08-10T22:56:45.036331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:45.015768Z","title":"Brown, Yuchen Cui, and Scott Niekum","venue":null,"work_id":"caa0a47f-2d01-4368-b11f-873036dfc922","year":2018},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.187998Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:cb0c9dfb8991ee6ce3703a6cd06e8fc90e7418927c22c89d9eb75b7b7e7173ce","observation_id":"c86268c7-2074-4caa-aa07-505887ce5bf8","resolution":{"observed_at":"2026-08-10T22:56:45.020690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.998795Z","title":"Provably Efficient Learning of Transferable Rewards","venue":null,"work_id":"0cce270c-18f0-4dd5-a645-92a12cf206ac","year":2021},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.194479Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:d61f37ca456f5d8ecf9e3a521385d97fefd3a2b4092d84d3f00682a052ae1468","observation_id":"1a10a6a2-d163-435e-b883-5c7f459af65a","resolution":{"observed_at":"2026-08-10T22:56:45.004047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.983304Z","title":"Trajectory-based active inverse reinforce- ment learning for learning from demonstration","venue":null,"work_id":"b63c7c2f-820d-4a04-86c9-96379be5d7ed","year":2023},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.199580Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:23a1745da8926e571e2a6dd0330217dcc96afd8bb7c2475978d643f8b27f3f8c","observation_id":"7c3af399-514d-47a6-b3dd-e0e33d5d36f6","resolution":{"observed_at":"2026-08-10T22:56:44.988531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14545","last_updated":"2023-11-29T10:20:19Z","snapshot_observed_at":"2026-08-13T12:35:20.763500Z","submitted_at":"2023-02-28T13:10:04Z","title":"Modern Bayesian Experimental Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.14545","snapshot_observed_at":"2026-08-10T22:56:44.205492Z","title":"Ivanova, and Freddie Bickford Smith","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.205492Z"},"links":{"cited_paper":"/paper/2302.14545","citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:702383e8eff65002c9bcd72be527e4bfb13bbdb54f7ba255a4d3fa0a7c4a4f75","observation_id":"01122049-58e0-4676-b163-a2f447626763","resolution":{"observed_at":"2026-08-10T22:56:44.205492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.02811","last_updated":"2018-07-08T13:06:26Z","snapshot_observed_at":"2026-08-13T17:25:53.968899Z","submitted_at":"2018-07-08T13:06:26Z","title":"A Tutorial on Bayesian Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.02811","snapshot_observed_at":"2026-08-10T22:56:44.211639Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.211639Z"},"links":{"cited_paper":"/paper/1807.02811","citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:54e55618dcb109a9e793afb0baada493fcc83b30b475aa7e1164c65492544341","observation_id":"090e4c14-29e7-48fe-b7f5-9d15980bff4e","resolution":{"observed_at":"2026-08-10T22:56:44.211639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.217089Z","title":"Bayesian optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.217089Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:90c588bfd426ca5bf412ae7e38bddedc2b5c8fd9ddca46b3455a18e2d2de9a1b","observation_id":"669aee4f-deed-4be2-a39d-d5aeb5abe8a7","resolution":{"observed_at":"2026-08-10T22:56:44.217089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.957473Z","title":"A versatile stochastic model of a function of unknown and time varying form","venue":null,"work_id":"55476738-09f1-4ae3-9fb4-5b6df07cb357","year":1962},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.221378Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:6fb77f70f09619bfe1b08a223642753d154e80a7df42b65e3fe8a5383b05ebab","observation_id":"8afa3070-cc2d-474f-a31c-1eef6f8137b1","resolution":{"observed_at":"2026-08-10T22:56:44.962347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.227198Z","title":"Learning agents for uncertain environments (extended abstract)","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.227198Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:d46524bc4142f6a2a25b5df388593d15f2f4f2252e04839071fbb315c23418e4","observation_id":"5e8d4b3e-14c0-4b66-8237-d3baab7b618c","resolution":{"observed_at":"2026-08-10T22:56:44.227198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.231991Z","title":null,"venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.231991Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:398e20d1a1b5476894ae16517739f206c3a5d2da7c0cdda39649aa91752b3754","observation_id":"c8fe45fc-2de4-468f-9d08-314a644a1fb5","resolution":{"observed_at":"2026-08-10T22:56:44.231991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.237339Z","title":"A survey of inverse reinforcement learning: Challenges, methods and progress","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.237339Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:ea680d4f1e226f194b020c2bdb67a0987564e5a72c8511b3d55c3fb76af1632d","observation_id":"f9ea9e3e-dab3-424e-be90-a422eccf3a03","resolution":{"observed_at":"2026-08-10T22:56:44.237339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.942138Z","title":null,"venue":null,"work_id":"5231a632-9cfd-484e-997c-a3ed9f77e3f1","year":2022},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.242088Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:6884885ac327ae9f148424479a0bfbde1c1f788a114c359ba308f0a65df75a49","observation_id":"c9042d4f-cd21-406e-a8fc-26ea3e908867","resolution":{"observed_at":"2026-08-10T22:56:44.946828Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.924092Z","title":"Bayesian Inverse Reinforcement Learning","venue":null,"work_id":"3b6bbc4f-68f3-4fb0-8ae6-8b2cccb598a4","year":2007},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.252121Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:35fb114d76b965325c1de0135c3d3c480a831a343b49087efd30b15b94ab6173","observation_id":"beecdc7d-8bcf-456c-8163-24c8be05bebf","resolution":{"observed_at":"2026-08-10T22:56:44.931392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.908151Z","title":"Environment Design for Inverse Reinforcement Learning","venue":null,"work_id":"6221a8b2-a02f-4eb7-bf5b-345eec754161","year":2024},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.256621Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:f851f4812fef7869f3855df63ace1e468d922032daceefc84c66ea2f2025bcae","observation_id":"e2f8d37e-c5f8-4bd2-8607-8d5cd19b7f00","resolution":{"observed_at":"2026-08-10T22:56:44.913446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.891049Z","title":"Interactive Inverse Reinforcement Learning for Cooperative Games","venue":null,"work_id":"fd680150-fbf5-4319-afdd-655daab37b39","year":2022},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.261156Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:cc25767fcb6bae8a504079400c1f9306acb8579db309e29041ba1a4074037e34","observation_id":"465724d2-ddbd-41b1-9593-958e47323240","resolution":{"observed_at":"2026-08-10T22:56:44.896509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.265705Z","title":"Active Preference-Based Learning of Reward Functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.265705Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:9817522f653a178c8312054926712d2b3fcbcc62579325f39255cb51d1b46d6e","observation_id":"f82e5197-958b-468c-8ee4-2e32d8bb4ad4","resolution":{"observed_at":"2026-08-10T22:56:44.265705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.872242Z","title":"Losey and Marcia K","venue":null,"work_id":"18418032-8372-474d-9a90-8fa533d0996d","year":2018},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.270419Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:37c90d9743824dc3fb17c292090397aeb9b1b44f49c375e73557fc2682861dda","observation_id":"6be15342-e14f-42aa-8e2b-ff395a73e335","resolution":{"observed_at":"2026-08-10T22:56:44.877389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.853957Z","title":"Active Exploration for Inverse Reinforcement Learning","venue":null,"work_id":"211bd0f7-de8a-4002-80aa-9289b80f78b9","year":2022},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.275977Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:35c1b2e028401e18a8e2f125e4200c4339cd248d305eeffd7327fc6c7e85cb57","observation_id":"2b0ca698-522a-475f-94c5-03628a697269","resolution":{"observed_at":"2026-08-10T22:56:44.860614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.838027Z","title":null,"venue":null,"work_id":"e98a355d-14b1-4c72-b30e-456a43a74cee","year":2024},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.281234Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:61cd5e653e0a1b495bc24cfebed9b04b44a4b01905cea74d89e538cc1205bff7","observation_id":"8710d1a6-0b99-4929-84bd-7e3c8512175b","resolution":{"observed_at":"2026-08-10T22:56:44.842815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.821321Z","title":"Scalable Bayesian Inverse Reinforcement Learning","venue":null,"work_id":"0b0a0b44-d445-4afb-883f-b4ec9bfae56f","year":2021},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.286658Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:717d492bc833c208038edf6c32bd8541ed799a0155e84da279f3052c4c4992e0","observation_id":"32ec3210-06e7-4363-b1ff-aac7dd90a4db","resolution":{"observed_at":"2026-08-10T22:56:44.827252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.292149Z","title":null,"venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.292149Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:c4e8963815385a50cc59de20b53af06e08306122f4a6155ab6afbf1ffa69327a","observation_id":"0190ef5a-e3b9-4a71-8a22-2ee84ab6bb3e","resolution":{"observed_at":"2026-08-10T22:56:44.292149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.804648Z","title":"upper bound","venue":null,"work_id":"cac3088d-abe2-4207-a578-5443f0e40b4f","year":2014},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.297886Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:eb56f3cf55bea17deeabb8e0e4d3986594f085e766c2125eef05ab2b1ca901ae","observation_id":"417d667c-ca71-4777-a691-e628207536b3","resolution":{"observed_at":"2026-08-10T22:56:44.810401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:56:44.247119Z","title":"URL https://link.springer.com/10.1007/ s10462-021-10108-x","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning","version":1},"reference_index":7462,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:44.247119Z"},"links":{"citing_paper":"/paper/2501.00381"},"observation_digest":"sha256:44242ef50f876aacc2f0bae6888f8a562e8908ab6dfe457fba3437c1cd167f9e","observation_id":"cc468039-ed6b-44b2-b261-1417190f41c2","resolution":{"observed_at":"2026-08-10T22:56:44.247119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.00381","last_updated":"2024-12-31T10:32:24Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T18:06:43.459326Z","submitted_at":"2024-12-31T10:32:24Z","title":"Toward Information Theoretic Active Inverse Reinforcement Learning"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2501.00381."}